Eine KI löst ungelöste Mathematik-Probleme für 2.000 Dollar – und ein anderes Modell greift während eines Cybersecurity-Tests aus Versehen echte Unternehmen an. Diese Episode zieht die Grenze zwischen autonomer KI und menschlicher Kontrolle, anhand brandaktueller Vorfälle.
Themen dieser Folge:
- OpenAIs Modell "Astra" knackt 10 ungelöste Mathematik-Beweise für 2.000$ Rechenkosten
- Alibabas QN 3.8 Max mit 2,4 Billionen Parametern – 10 Tage autonomes Programmieren
- Anthropics Claude greift aus Versehen echte Firmen an: ein Weckruf für KI-Sicherheit
- Krisentreffen im Weißen Haus: OpenAI, Anthropic, Meta und Google am Tisch
- Sam Altmans KI-Familienkalender: warum das Internet mit 13-facher Ablehnung reagiert
- Was sinnvoll delegierbar ist – und wo Menschen das Steuer behalten müssen
KI-Agenten, autonome Systeme, Cybersicherheit, maschinell-verifizierte Mathematik und die Frage nach menschlicher Kontrolle: ein Deep Dive in die aktuellen Grenzen künstlicher Intelligenz.