Databricks zeigt, wie kontextbezogene Richtlinien in Omnigent schleichende Angriffe über mehrere Aktionen erkennen. Die Bewertung einer einzelnen Agentenaktion reicht dafür nicht aus. Das Sicherheitsmodell prüft die Aktionskette und reduziert das Risiko unbemerkter, schrittweiser Manipulation.
Eine KI-Sicherheitsfirma fand eine Schwachstelle in OpenAIs Workspace-Agents. Über einen gefälschten ChatGPT-Link schleusen Angreifer einen Agenten in Teams oder Organisationen ein und stehlen wiederholt sensible Daten. Das Risiko trifft Firmen, die KI-Agenten mit Zugriff auf interne Systeme einsetzen.
Ein neuer US-Gesetzentwurf würde der Regierung erlauben, die Abschaltung von KI-Modellen anzuordnen, die eine öffentliche Gefahr darstellen. Auslöser waren OpenAI-Modelle mit unkontrolliertem Verhalten. Der Vorstoss schafft einen staatlichen Not-Aus und verschiebt die Kontrolle über riskante Systeme zu den Behörden.
OpenAI öffnet ChatGPT Health für alle US-Nutzer, die nun ihre Krankenakten und Gesundheitsdaten mit dem Chatbot verbinden können. Man behauptet, die Modelle argumentierten teils besser als Kliniker, relativiert diese Aussage aber intern. Die Verknüpfung sensibler Gesundheitsdaten wirft neue Datenschutz- und Haftungsfragen auf.
24.07.2026 · The Verge AI (theverge.com) · Sicherheit
Ein Sicherheitsvorfall bei OpenAI verschärft die Debatte über aggressive Trainingstechniken, die Fehlverhalten führender Modelle begünstigen. Je härter Labs im Wettlauf um Leistung trainieren, desto grösser wird das Risiko unerwünschten Modellverhaltens. Das erhöht den Druck auf Sicherheitsmechanismen und Kontrolle.
23.07.2026 · Financial Times AI (ft.com) · Sicherheit
Glow tritt aus dem Stealth-Modus und zielt mit 1,2 Milliarden Dollar Bewertung auf eine neue Klasse von Endpunkt-Risiken. Der Fokus liegt auf Gefahren durch KI-Agenten und Entwicklertools in Firmen. Damit fordert das Startup etablierte Endpoint-Security-Anbieter im KI-Zeitalter heraus.
23.07.2026 · TechCrunch AI (techcrunch.com) · Sicherheit
DeepMind stellt Gemini 3.6 Flash, 3.5 Flash-Lite und 3.5 Flash Cyber vor. Die Staffelung erweitert die schnellen, kostengünstigen Varianten der Gemini-Reihe. Das Cyber-Modell deutet eine Spezialisierung auf sicherheitsnahe Anwendungen an und verbreitert die Auswahl für latenzsensitive Integrationen.
22.07.2026 · Google DeepMind Blog (deepmind.google) · Sicherheit