Die deutschsprachige Chronik der KI-Nachrichtenlage

ZML gibt Gratis-Tool LLMD zur schnelleren KI-Inferenz frei

08.07.2026 · Infrastruktur

Das von Turing-Preisträger Yann LeCun unterstützte französische Startup ZML veröffentlicht die Software ZML/LLMD kostenlos. Sie beschleunigt Inferenz über viele verschiedene KI-Chips hinweg und könnte so die Betriebskosten für den Modellbetrieb senken sowie die Abhängigkeit von einzelnen Hardware-Anbietern verringern.

Originalquelle

TechCrunch AI — techcrunch.com

Mehr zum Thema

Nvidia ModelExpress verteilt Modellgewichte im Cluster schneller

Nvidia stellt ModelExpress vor, das riesige Modell-Checkpoints von Hunderten Gigabyte effizienter durch den Cluster bewegt. Da Cold Starts, Autoscaling und RL-Nachtraining ständig Gewichte kopieren, senkt die Technik Ladezeiten und Kosten für GPU-Deployments spürbar.

25.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Infrastruktur

Moonshot AI umging Chip-Exportverbot mit Nvidia GB300

Laut einem Vertreter des Weissen Hauses griff Moonshot AI in Thailand auf Nvidias GB300-Chips zu, trotz chinesischer Exportbeschränkungen. Das Unternehmen trainierte damit sein leistungsstarkes Modell Kimi K3. Der Fall verdeutlicht, wie schwer sich die US-Exportkontrollen gegen Umgehungswege durch Drittländer durchsetzen lassen.

24.07.2026 · CNBC Technology (cnbc.com) · Infrastruktur

Nvidia Nemotron 3 Nano lässt sich mit Prime Intellect anpassen

Nvidia zeigt, wie sich das Modell Nemotron 3 Nano über das Prime Intellect Lab in Minuten auf eigene Anwendungsfälle, Domänen und Sprachen zuschneiden lässt. Die vorkonfigurierte Umgebung senkt Hürden bei Infrastruktur, GPU-Zugang und Fachwissen, die individuelle Anpassungen sonst aufwendig machen.

24.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Infrastruktur

OpenAI kooperiert mit US-Energieministerium für Forschung

OpenAI arbeitet mit dem US-Energieministerium und nationalen Laboren zusammen, um mit fortschrittlicher KI wissenschaftliche Entdeckungen zu beschleunigen. Die Partnerschaft verankert kommerzielle Modelle in staatlicher Grundlagenforschung und öffnet OpenAI den Zugang zu Rechenkapazität und Daten der Labore.

24.07.2026 · OpenAI News (openai.com) · Infrastruktur

Google plant Chip "Frozen v2" mit fixen Gemini-Strukturen

Google entwickelt Chips, in die Gemini-Modellstrukturen fest verdrahtet sein sollen. Die fixe Integration soll KI-Anwendungen schneller und effizienter machen. Der Ansatz bindet Hardware direkt an ein Modell und könnte Inferenzkosten senken, aber die Flexibilität bei Modellwechseln einschränken.

22.07.2026 · heise KI (heise.de) · Infrastruktur

Apple und Nvidia kämpfen um Titel des wertvollsten Konzerns

Nvidia-Aktien schneiden 2026 schwächer ab, während die Wall Street auf Firmen setzt, die den KI-Infrastrukturausbau tragen. Der Machtkampf um die höchste Marktkapitalisierung zeigt, wie stark die Kapitalströme von reinen Chip-Erwartungen zu den Betreibern von Rechenkapazität wandern.

19.07.2026 · CNBC Technology (cnbc.com) · Infrastruktur

Ganze Ausgabe vom 08.07.2026