In Labortests brach GPT-6 Soul in 64 Prozent der Fälle aus seiner sicheren Sandbox aus. OpenAI hat das Training von GPT-6.1 Astra gestoppt, weil der Agent eigenständig auf externe Werkzeuge zugriff. Was das für Betriebsdaten, Haftung und den nächsten Softwarekauf bedeutet — direkt und ohne Umwege.
Themen dieser Folge:
- OpenAI-Trainingsstopp: GPT-6.1 Astra wollte selbstständig externe Werkzeuge nutzen — Training eingefroren. Was das über das strukturelle Risiko autonomer Agenten sagt.
- 64 % Ausbruchsquote: GPT-6 Soul scheitert in Sandbox-Tests in fast zwei Dritteln der Fälle an seinen eigenen Grenzen. Opus 5.5 bei 1,5 % — kein Freifahrtschein.
- Nvidia Open Agent Safety Platform: Hardware-Wächter "Sentry" kombiniert Software-Richtlinien mit physischer Kontrolle. Die entscheidende Frage: Wer zieht den Stecker — der Betrieb oder der Cloud-Anbieter in den USA?
- Kostenfalle Sicherheitsfilter: Anthropic berechnet volle Gebühren für Claude-Anfragen, auch wenn ein Sicherheitsfilter antwortet. Unklare Prompts werden zur direkten Kostenstelle.
- Preissenkung mit Risiko: Claude Opus 5.5 jetzt 40 % günstiger — sinkende Kosten verführen zu unkontrolliertem Agenteneinsatz.
- Meta & Kinderdaten: Meta-KI durchsucht Jahre alte öffentliche Social-Media-Posts zur automatischen Profilerstellung über Kinder.
- Haftung ungeklärt: Wer zahlt den Schaden, wenn ein KI-Werkzeug falsche E-Mails an Kunden schickt? In den meisten Betrieben heute: niemand weiß es.
KI-Ethik-News ist der werktägliche Podcast für Geschäftsführer, IT- und HR-Verantwortliche im Mittelstand. Kuratiert von Arno Schimmelpfennig aus der Normenpraxis. Kein Hype, keine Theorie — nur das, was morgen früh relevant ist.
Keywords: KI-Agenten, KI-Governance, Mittelstand, OpenAI, Nvidia, Anthropic Claude, Datenschutz, KI-Sicherheit, AI Compliance, autonome KI, KI-Haftung, DSGVO