Das von Turing-Preisträger Yann LeCun unterstützte französische Startup ZML veröffentlicht die Software ZML/LLMD kostenlos. Sie beschleunigt Inferenz über viele verschiedene KI-Chips hinweg und könnte so die Betriebskosten für den Modellbetrieb senken sowie die Abhängigkeit von einzelnen Hardware-Anbietern verringern.
Nvidia stellt ModelExpress vor, das riesige Modell-Checkpoints von Hunderten Gigabyte effizienter durch den Cluster bewegt. Da Cold Starts, Autoscaling und RL-Nachtraining ständig Gewichte kopieren, senkt die Technik Ladezeiten und Kosten für GPU-Deployments spürbar.
25.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Infrastruktur
Laut einem Vertreter des Weissen Hauses griff Moonshot AI in Thailand auf Nvidias GB300-Chips zu, trotz chinesischer Exportbeschränkungen. Das Unternehmen trainierte damit sein leistungsstarkes Modell Kimi K3. Der Fall verdeutlicht, wie schwer sich die US-Exportkontrollen gegen Umgehungswege durch Drittländer durchsetzen lassen.
Nvidia zeigt, wie sich das Modell Nemotron 3 Nano über das Prime Intellect Lab in Minuten auf eigene Anwendungsfälle, Domänen und Sprachen zuschneiden lässt. Die vorkonfigurierte Umgebung senkt Hürden bei Infrastruktur, GPU-Zugang und Fachwissen, die individuelle Anpassungen sonst aufwendig machen.
24.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Infrastruktur
OpenAI arbeitet mit dem US-Energieministerium und nationalen Laboren zusammen, um mit fortschrittlicher KI wissenschaftliche Entdeckungen zu beschleunigen. Die Partnerschaft verankert kommerzielle Modelle in staatlicher Grundlagenforschung und öffnet OpenAI den Zugang zu Rechenkapazität und Daten der Labore.
Google entwickelt Chips, in die Gemini-Modellstrukturen fest verdrahtet sein sollen. Die fixe Integration soll KI-Anwendungen schneller und effizienter machen. Der Ansatz bindet Hardware direkt an ein Modell und könnte Inferenzkosten senken, aber die Flexibilität bei Modellwechseln einschränken.
Nvidia-Aktien schneiden 2026 schwächer ab, während die Wall Street auf Firmen setzt, die den KI-Infrastrukturausbau tragen. Der Machtkampf um die höchste Marktkapitalisierung zeigt, wie stark die Kapitalströme von reinen Chip-Erwartungen zu den Betreibern von Rechenkapazität wandern.