Frontier-Modelle wachsen über die etablierten Methoden zur Messung ihrer Hackfähigkeiten hinaus. US-Behörden müssen bis 1. August ein klassifiziertes Benchmark-Verfahren etablieren; Anthropic entwickelt mit Amazon, Google und Microsoft einen Standard, der die Folgen eines Jailbreaks statt dessen blosse Möglichkeit bewertet. Ohne neue Tests bleibt sichere Freigabe unklar.
China erklärt, bestimmte Versionen von Claude Code enthielten Backdoor-Schwachstellen, die sensible Daten an einen entfernten Server senden könnten. Die Warnung erhöht den Druck auf Anthropic in einem strategischen Markt und wirft Fragen zur Lieferkettensicherheit von KI-Coding-Tools auf.
Meta veröffentlicht mit Muse Spark Image sein erstes Bildmodell seit Zuckerbergs KI-Umbau. Das Modell wird in den KI-Chatbot und die Instagram-Fotoapp integriert, wodurch die Bildgenerierung direkt in Metas Massenprodukte einzieht und den Wettbewerb mit spezialisierten Anbietern verschärft.
Der Agent Claude Cowork erledigt Aufgaben jetzt weiter, auch nachdem der Laptop geschlossen wurde. Die Steuerung wandert damit aufs Smartphone und macht Agenten unabhängig vom offenen Rechner. Das erweitert die Kontrolle über laufende Aufgaben und verschiebt die Nutzung hin zu mobilen, dauerhaft aktiven Assistenten.
Das von Turing-Preisträger Yann LeCun unterstützte französische Startup ZML veröffentlicht die Software ZML/LLMD kostenlos. Sie beschleunigt Inferenz über viele verschiedene KI-Chips hinweg und könnte so die Betriebskosten für den Modellbetrieb senken sowie die Abhängigkeit von einzelnen Hardware-Anbietern verringern.
Nvidias Vera CPU beschleunigt die Arbeit zwischen den Modellschritten agentischer Systeme, die Inferenz, Toolnutzung, Codeausführung und Orchestrierung kombinieren. Da diese Systeme in der AI Factory skalieren, hängt die Leistung nicht nur von GPUs ab, sondern zunehmend auch von der CPU-Verarbeitung.
NVIDIA Generative AI (developer.nvidia.com) · Agenten
Die japanische Grossbank MUFG nutzt ChatGPT Enterprise, um Abläufe zu verbessern und neue KI-gestützte Finanzdienstleistungen im grossen Massstab anzubieten. Der Einsatz zeigt, wie stark regulierte Finanzinstitute OpenAIs Unternehmensangebot in den Kernbetrieb integrieren.
Eine neue Deep-Link-Integration zwischen Hugging Face und Amazon SageMaker AI erlaubt den Wechsel von der Modellsuche zum Experiment mit einer einzigen Auswahl. Das verkürzt den Weg von der Entdeckung eines Modells bis zum praktischen Test in SageMaker Studio deutlich.