Databricks argumentiert gegen die Annahme, dass bessere Antworten stets mehr Tokens kosten. Ein spezialisierter Data-Agent liefert höhere Qualität bei niedrigeren Kosten als allgemeine Coding-Agenten. Das verschiebt die Wahl der Agenten hin zu domänenspezifischen Lösungen für datenlastige Aufgaben.
Black Forest Labs veröffentlicht FLUX 3, multimodale Flow-Modelle, die laut Vergleich Seedance 2.0, Gemini Omni und Grok Imagine übertreffen. Ergänzt wird die Reihe durch ein FLUX-mimic Video-Action-Modell für Robotik, was BFLs Position bei generativen Bild- und Videomodellen stärkt.
25.07.2026 · Latent Space (latent.space) · Agenten
OpenAI bringt seinen neuen Sprachmodus in die ChatGPT-Desktop-App. Die Voice-Funktion arbeitet mit ChatGPT Work und Codex zusammen, um Aufgaben zu erledigen und Agenten zu steuern. Damit rückt gesprochene Bedienung näher an produktive Arbeit statt reiner Konversation.
25.07.2026 · TechCrunch AI (techcrunch.com) · Agenten
Anthropic aktualisiert den Sprachmodus von Claude mit leistungsfähigeren Modellen. Nutzer können per Stimme Meetings verschieben oder E-Mails entwerfen lassen. Der Ausbau bringt agentische Aktionen direkt in die Sprachinteraktion und positioniert Claude näher an assistenzfähige Konkurrenzprodukte.
24.07.2026 · TechCrunch AI (techcrunch.com) · Agenten
Google Research stellt SymptomAI vor, einen konversationellen KI-Agenten zur alltäglichen Einschätzung von Symptomen. Nutzer sollen ihre Beschwerden im Dialog beschreiben und eine erste Bewertung erhalten. Damit rückt KI näher an sensible medizinische Anwendungsfelder mit entsprechenden Anforderungen an Verlässlichkeit.
23.07.2026 · Google Research Blog (research.google) · Agenten
NVIDIA zeigt, wie sich lange TensorRT-Engine-Builds in Python oder C++ überwachen und vorzeitig abbrechen lassen. Bislang blockieren grosse Modelle und kalte Timing-Caches auf neuen GPU-SKUs den Prozess ohne Rückmeldung. Die neue Beobachtbarkeit erspart Entwicklern und Agenten unnötiges Warten oder Neustarts.
23.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Agenten
Forscher schlagen mit dem Genie-Koeffizienten eine Metrik vor, die den Abstand zwischen einer Anfrage und den unausgesprochenen Erwartungen an ihre Ausführung erfasst. Bestehende Benchmarks prüfen nur Fähigkeiten, nicht die Absichtstreue. Das Mass adressiert ein Kernrisiko autonomer Agenten, die Aufgaben wortgetreu, aber sinnwidrig lösen.
22.07.2026 · IEEE Spectrum AI (spectrum.ieee.org) · Agenten