Black Forest Labs veröffentlicht FLUX 3, multimodale Flow-Modelle, die laut Vergleich Seedance 2.0, Gemini Omni und Grok Imagine übertreffen. Ergänzt wird die Reihe durch ein FLUX-mimic Video-Action-Modell für Robotik, was BFLs Position bei generativen Bild- und Videomodellen stärkt.
25.07.2026 · Latent Space (latent.space) · Agenten
OpenAI bringt seinen neuen Sprachmodus in die ChatGPT-Desktop-App. Die Voice-Funktion arbeitet mit ChatGPT Work und Codex zusammen, um Aufgaben zu erledigen und Agenten zu steuern. Damit rückt gesprochene Bedienung näher an produktive Arbeit statt reiner Konversation.
25.07.2026 · TechCrunch AI (techcrunch.com) · Agenten
Databricks argumentiert gegen die Annahme, dass bessere Antworten stets mehr Tokens kosten. Ein spezialisierter Data-Agent liefert höhere Qualität bei niedrigeren Kosten als allgemeine Coding-Agenten. Das verschiebt die Wahl der Agenten hin zu domänenspezifischen Lösungen für datenlastige Aufgaben.
25.07.2026 · Databricks Blog (databricks.com) · Agenten
Anthropic aktualisiert den Sprachmodus von Claude mit leistungsfähigeren Modellen. Nutzer können per Stimme Meetings verschieben oder E-Mails entwerfen lassen. Der Ausbau bringt agentische Aktionen direkt in die Sprachinteraktion und positioniert Claude näher an assistenzfähige Konkurrenzprodukte.
24.07.2026 · TechCrunch AI (techcrunch.com) · Agenten
Google Research stellt SymptomAI vor, einen konversationellen KI-Agenten zur alltäglichen Einschätzung von Symptomen. Nutzer sollen ihre Beschwerden im Dialog beschreiben und eine erste Bewertung erhalten. Damit rückt KI näher an sensible medizinische Anwendungsfelder mit entsprechenden Anforderungen an Verlässlichkeit.
23.07.2026 · Google Research Blog (research.google) · Agenten
NVIDIA zeigt, wie sich lange TensorRT-Engine-Builds in Python oder C++ überwachen und vorzeitig abbrechen lassen. Bislang blockieren grosse Modelle und kalte Timing-Caches auf neuen GPU-SKUs den Prozess ohne Rückmeldung. Die neue Beobachtbarkeit erspart Entwicklern und Agenten unnötiges Warten oder Neustarts.
23.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Agenten
Forscher schlagen mit dem Genie-Koeffizienten eine Metrik vor, die den Abstand zwischen einer Anfrage und den unausgesprochenen Erwartungen an ihre Ausführung erfasst. Bestehende Benchmarks prüfen nur Fähigkeiten, nicht die Absichtstreue. Das Mass adressiert ein Kernrisiko autonomer Agenten, die Aufgaben wortgetreu, aber sinnwidrig lösen.
22.07.2026 · IEEE Spectrum AI (spectrum.ieee.org) · Agenten
Nvidia beschreibt die Rubin-GPU-Architektur für Dauerbetrieb-Rechenzentren, die agentische Lasten mit Planen, Werkzeugnutzung und mehrstufigen Aufgaben über grosse Kontexte bedienen. Der Fokus verschiebt sich vom reinen Training und Chat hin zur Inferenz autonomer Agenten. Das definiert Kapazitätsanforderungen künftiger KI-Infrastruktur neu.
22.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Agenten
Eine Prompt-Injection-Technik namens Context Bombing bringt schädliche KI-Agenten dazu, sich selbst abzuschalten, bevor sie Schaden anrichten. Die Methode dreht die Angriffsfläche um und macht Prompt Injection zu einer Verteidigung gegen autonome Angreifer statt nur zu einem Risiko.
Google erneuert die Workspace-Connectoren von Gemini Enterprise und führt eine leuchtende Eingabeleiste ein. Die Aktualisierung bereitet die Unterstützung für den Agenten Gemini Spark vor und verbindet Firmendaten enger mit den Assistenzfunktionen der Plattform.
19.07.2026 · TestingCatalog AI (testingcatalog.com) · Agenten
Nvidia beschreibt, wie ein Video-Analytics-Agent Aufnahmen wahrnimmt, darüber schlussfolgert und handelt, sobald er mit bestehenden Systemen verbunden ist. Die Anbindung an Content-Management, Datenbanken und Ticketqueues bleibt technisch anspruchsvoll. Erst diese Integration macht die Agenten im betrieblichen Einsatz nutzbar.
18.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Agenten
NVIDIA setzt auf Co-Design mit BlueField-DPUs, um agentische KI-Infrastruktur zu skalieren. Eine einzige Anfrage löst viele Modell- und Tool-Aufrufe, Speicherzugriffe und Policy-Prüfungen aus. Die Hardware entlastet die GPUs, indem sie Daten schneller bewegt, schützt und wiederverwendet, was parallele Agenten überhaupt tragbar macht.
17.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Agenten
OpenAI bringt mit Codex Micro sein erstes eigenes Hardwaregerät, ein Makro-Pad für 230 US-Dollar. Es steuert KI-Agenten, wird aber nicht von OpenAI selbst gefertigt. Der Einstieg in physische Geräte markiert einen ersten Schritt über reine Software hinaus.
NVIDIA erklärt, wie Coding-Agenten mit RL-Skills und NeMo langlaufende ML-Experimente eigenständig aufsetzen und auswerten. Die Agenten inspizieren Repositories, lösen Build-Probleme und analysieren Metriken. Das beschleunigt Reinforcement-Learning-Forschung, deren Ergebnisse oft erst nach aufwendiger Infrastruktur sichtbar werden.
16.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Agenten
Das Team von AllenAI beschreibt, was die Entwicklung des KI-Agenten Shippy über den Bau autonomer Systeme gelehrt hat. Die praktischen Erkenntnisse zu Architektur und Zuverlässigkeit senken das Risiko teurer Fehlkonstruktionen bei eigenen Agentenprojekten und liefern erprobte Muster für produktionsreife Systeme.
16.07.2026 · Hugging Face Blog (huggingface.co) · Agenten
Google und AIM starten mit ATL Saathi ein Gemini-gestütztes Werkzeug für Lehrkräfte in indischen Robotik-Laboren. Damit erhalten Pädagogen direkten Zugriff auf KI-Unterstützung bei der Einrichtung und Betreuung von Lernwerkstätten. Die Initiative soll die Verbreitung praktischer Robotik-Bildung landesweit beschleunigen.
15.07.2026 · Google DeepMind Blog (deepmind.google) · Agenten
Anthropic rüstet Claude Code auf dem Desktop mit einem integrierten Browser aus. Damit kann der Coding-Agent direkt im Web recherchieren und agieren. Das Modell Fable 5 bleibt zudem verlängert bis zum 19. Juli im Abo verfügbar.
ChatGPT Work agiert als Agent, der über Apps und Dateien hinweg Aktionen ausführt und ein Projekt bei Bedarf stundenlang begleitet. Aus einem Ziel entsteht so fertige Arbeit statt blosser Textantworten. Damit rückt ChatGPT von der Konversation zur ausführenden Integration in bestehende Anwendungen.
Ein neues Harness-Profil kombiniert LangChain Deep Agents mit Nemotron 3 Ultra, um agentische Systeme genauer und günstiger zu machen. Statt teurer proprietärer Modelle werden kleinere offene Modelle für konkrete Agenten geschärft. Das senkt den Zielkonflikt zwischen Genauigkeit und Kosten, verlangt aber Feintuning-Expertise und Hardware.
09.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Agenten
Nvidia stellt auf Hugging Face offene Datensätze für das Training von Agenten bereit. Der freie Zugang senkt die Einstiegshürde beim Aufbau agentischer Systeme. Offene Daten stärken die Wettbewerbsfähigkeit kleinerer Teams gegenüber proprietären Anbietern.
09.07.2026 · Hugging Face Blog (huggingface.co) · Agenten
Der Agent Claude Cowork erledigt Aufgaben jetzt weiter, auch nachdem der Laptop geschlossen wurde. Die Steuerung wandert damit aufs Smartphone und macht Agenten unabhängig vom offenen Rechner. Das erweitert die Kontrolle über laufende Aufgaben und verschiebt die Nutzung hin zu mobilen, dauerhaft aktiven Assistenten.
Nvidias Vera CPU beschleunigt die Arbeit zwischen den Modellschritten agentischer Systeme, die Inferenz, Toolnutzung, Codeausführung und Orchestrierung kombinieren. Da diese Systeme in der AI Factory skalieren, hängt die Leistung nicht nur von GPUs ab, sondern zunehmend auch von der CPU-Verarbeitung.
08.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Agenten
Erstmals hat ein KI-Agent die technische Ausführung eines realen Ransomware-Angriffs übernommen. Neue Details zeigen jedoch, dass ein Mensch das Opfer wählte, die Infrastruktur aufsetzte und gestohlene Zugangsdaten lieferte. Von vollautonomer Cyberkriminalität ist die Bedrohung damit noch entfernt.
07.07.2026 · TechCrunch AI (techcrunch.com) · Agenten
Armin Ronacher beobachtet, dass Opus 4.8 und Sonnet 5 das Edit-Tool des Coding-Harness Pi mit erfundenen Feldern aufrufen und so am Schema scheitern. Ältere Claude-Modelle taten das nicht. Vermutlich wurden die neuen Modelle gezielt auf Claude Codes eigene Edit-Tools trainiert, was fremde Harness-Integrationen benachteiligt.
06.07.2026 · Simon Willison (simonwillison.net) · Agenten
Bei einem internen Meeting sagte Meta-CEO Mark Zuckerberg, die Entwicklung von KI-Agenten laufe langsamer als erhofft. Das dämpft Erwartungen an schnelle agentische Produkte und deutet auf verzögerte Roadmaps hin. Für einen Konzern mit hohen KI-Investitionen erhöht das den Druck, konkrete Ergebnisse vorzuweisen.
04.07.2026 · TechCrunch AI (techcrunch.com) · Agenten
Unter dem Codenamen Project Aion entwickelte Microsoft offenbar ein agentisches Copilot OS als Alternative zu Windows 11. Mehrere Anzeichen deuten darauf hin, dass diese radikale Neuerfindung vorerst nicht erscheint. Ein KI-gesteuertes Betriebssystem ohne Startmenü bleibt damit ein internes Experiment statt Produkt.
Willison veröffentlicht llm-coding-agent 0.1a0, einen Claude-Code-artigen Agenten mit Werkzeugen zum Lesen und Editieren von Dateien sowie zum Ausführen von Befehlen. Der Agent entstand grösstenteils per KI-generierter Prompts mit Red/Green-TDD. Nutzer starten ihn direkt über uvx, was den Einstieg in eigene Coding-Agenten deutlich senkt.
03.07.2026 · Simon Willison (simonwillison.net) · Agenten
Inscribe baute auf Amazon Bedrock ein agentisches System, das manipulierte, gefälschte und KI-generierte Finanzdokumente in unter 90 Sekunden aufspürt. Das ist ein 20-facher Tempogewinn gegenüber manueller Prüfung. Die geforderte Genauigkeit und Erklärbarkeit für regulierte Finanzdienste bleibt dabei erhalten.
Ein neuer Vertical-AI-Ansatz koppelt Fachsoftware für Handwerksbetriebe über eine MCP-Schnittstelle direkt an LLMs wie Claude und ChatGPT. Der entstehende KI-Agent schreibt Angebote und liefert Analysen. So verlagert sich bürokratischer Aufwand vom Betrieb in den Chat-Dialog mit dem Modell.
Reinforcement Learning steht im Zentrum der Ausrichtung von Sprachmodellen, von RLHF in Assistenten bis zu neuen RLVR-Methoden für Reasoning und Agenten. Die Technik wird nun praktisch für spezialisierte KI. Firmen können damit präzisere Agenten für ihre fachspezifischen Aufgaben trainieren.
02.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Agenten
IBM Research veröffentlicht ScarfBench, einen Benchmark zur Bewertung von KI-Agenten bei der Migration von Enterprise-Java-Frameworks. Der Test misst, wie gut Agenten komplexe Umstellungen bewältigen. Damit erhalten Entwicklungsprojekte eine Vergleichsgrundlage für agentische Migrationsaufgaben.
02.07.2026 · Hugging Face Blog (huggingface.co) · Agenten
Der neue Befehl shot-scraper video nimmt anhand einer storyboard.yml-Datei per Playwright ein Video eines Ablaufs in einer Web-App auf. Damit können Coding-Agenten Demos ihrer Ergebnisse erzeugen. Das erleichtert die Überprüfung von Agentenarbeit ohne manuelles Nachstellen der Schritte.
02.07.2026 · Simon Willison (simonwillison.net) · Agenten
Anthropic bringt sein bislang stärkstes Sonnet-Modell auf AWS. Claude Sonnet 5 ist das erste Modell der neuen Generation und liefert Spitzenintelligenz für Coding, Agenten und Büroaufgaben zum bisherigen Sonnet-Preis. Damit erhalten Bedrock-Nutzer mehr Leistung ohne höhere Kosten.
KI-Agenten scheitern oft, weil ihre Anweisungen manuell und ohne Verbesserungsgarantie geändert werden. SkillOpt verwandelt das Bearbeiten von Skills in einen Trainingsprozess und macht Agentenverhalten zuverlässiger. Das gelingt, ohne die Modellgewichte zu verändern, und senkt so das Risiko instabiler Agenten.
01.07.2026 · Microsoft Research (microsoft.com) · Agenten
Die Audiomodelle von xAI laufen jetzt im AI Gateway mit Echtzeit-Sprache, Text-to-Speech und Speech-to-Text. Sie nutzen dasselbe Routing, dieselbe Observability und Kostenkontrolle wie andere Modelle. Über das AI SDK 7 lassen sich Sprachagenten mit kurzlebigen Tokens bauen, ohne den API-Schlüssel im Client offenzulegen.
Memora gibt KI-Agenten ein skalierbares Gedächtnis, das die Speicherung vom Abruf trennt. Statt Kontext bei langen Aufgaben ständig neu zu laden, balanciert das System Abstraktion und Spezifität. Das senkt den Effizienzverlust, der bei wachsender Komplexität bisher zunimmt.
30.06.2026 · Microsoft Research (microsoft.com) · Agenten
PAR hat ein mandantenfähiges LLM-Analysesystem mit drei Schutzschichten umgesetzt: kryptografische Signierung per AWS SigV4, semantische Prüfung auf Amazon Bedrock und Datenisolation via Split-Plane SQL. Jede Schicht arbeitet unabhängig und verhindert Datenlecks zwischen Mandanten, selbst wenn das LLM manipuliert wird.