Nvidia stellt ModelExpress vor, das riesige Modell-Checkpoints von Hunderten Gigabyte effizienter durch den Cluster bewegt. Da Cold Starts, Autoscaling und RL-Nachtraining ständig Gewichte kopieren, senkt die Technik Ladezeiten und Kosten für GPU-Deployments spürbar.
25.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Infrastruktur
Laut einem Vertreter des Weissen Hauses griff Moonshot AI in Thailand auf Nvidias GB300-Chips zu, trotz chinesischer Exportbeschränkungen. Das Unternehmen trainierte damit sein leistungsstarkes Modell Kimi K3. Der Fall verdeutlicht, wie schwer sich die US-Exportkontrollen gegen Umgehungswege durch Drittländer durchsetzen lassen.
Nvidia zeigt, wie sich das Modell Nemotron 3 Nano über das Prime Intellect Lab in Minuten auf eigene Anwendungsfälle, Domänen und Sprachen zuschneiden lässt. Die vorkonfigurierte Umgebung senkt Hürden bei Infrastruktur, GPU-Zugang und Fachwissen, die individuelle Anpassungen sonst aufwendig machen.
24.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Infrastruktur
OpenAI arbeitet mit dem US-Energieministerium und nationalen Laboren zusammen, um mit fortschrittlicher KI wissenschaftliche Entdeckungen zu beschleunigen. Die Partnerschaft verankert kommerzielle Modelle in staatlicher Grundlagenforschung und öffnet OpenAI den Zugang zu Rechenkapazität und Daten der Labore.
Google entwickelt Chips, in die Gemini-Modellstrukturen fest verdrahtet sein sollen. Die fixe Integration soll KI-Anwendungen schneller und effizienter machen. Der Ansatz bindet Hardware direkt an ein Modell und könnte Inferenzkosten senken, aber die Flexibilität bei Modellwechseln einschränken.
Nvidia-Aktien schneiden 2026 schwächer ab, während die Wall Street auf Firmen setzt, die den KI-Infrastrukturausbau tragen. Der Machtkampf um die höchste Marktkapitalisierung zeigt, wie stark die Kapitalströme von reinen Chip-Erwartungen zu den Betreibern von Rechenkapazität wandern.
Meta spricht mit Anthropic über einen Rechenzentrumsdeal von bis zu 10 Milliarden Dollar und erwägt zugleich den Einstieg ins Cloud-Geschäft. Der Konzern investiert 145 Milliarden Dollar in Infrastruktur. Ein solcher Vertrag würde Meta als Kapazitätsanbieter neben den etablierten Cloud-Riesen positionieren.
18.07.2026 · Financial Times AI (ft.com) · Infrastruktur
Über 5000 Teilnehmende in rund 4000 Teams traten bei der Nvidia Nemotron Model Reasoning Challenge auf Kaggle an. Sie optimierten die Genauigkeit eines offenen Modells unter identischen Benchmark- und Infrastruktur-Bedingungen. Das liefert vergleichbare Erkenntnisse zu wirksamen Reasoning-Techniken für alle Teilnehmenden.
15.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Infrastruktur
New York stoppt als erster US-Bundesstaat für ein Jahr den Bau neuer Hyperscale-Rechenzentren für künstliche Intelligenz. Gouverneurin Kathy Hochul unterzeichnete die entsprechende Verfügung per Dekret, was Investitionspläne grosser Cloud- und KI-Anbieter im Bundesstaat vorerst bremst.
Aurora 1.5 ergänzt das offene Foundation-Modell um 22 zusätzliche Variablen, stündliche Auflösung und probabilistische Ensemble-Vorhersagen. Damit wird das Modell für Wetter-, Klima- und Energieanwendungen praxistauglicher. Die höhere Auflösung öffnet den Einsatz in realen Prognose- und Risikoszenarien.
10.07.2026 · Microsoft Research (microsoft.com) · Infrastruktur
Das von Turing-Preisträger Yann LeCun unterstützte französische Startup ZML veröffentlicht die Software ZML/LLMD kostenlos. Sie beschleunigt Inferenz über viele verschiedene KI-Chips hinweg und könnte so die Betriebskosten für den Modellbetrieb senken sowie die Abhängigkeit von einzelnen Hardware-Anbietern verringern.
08.07.2026 · TechCrunch AI (techcrunch.com) · Infrastruktur
Dichte und synchronisierte KI-Rechenlasten schwanken rasch nach Zeit und Ort und verändern die Betriebseigenschaften der Stromnetze. Rechenzentren könnten laut IEA bis Ende des Jahrzehnts 3 bis 4 Prozent des globalen Verbrauchs ausmachen. Netzbetreiber stehen dadurch vor neuen Planungs- und Stabilitätsproblemen jenseits der reinen Verbrauchsmenge.
04.07.2026 · IEEE Spectrum AI (spectrum.ieee.org) · Infrastruktur
Anthropic spricht mit Samsung über die Entwicklung eines massgeschneiderten KI-Chips. Die Gespräche folgen kurz auf OpenAIs Custom-Chip-Partnerschaft mit Broadcom. Eigene Hardware würde Anthropics Abhängigkeit von Nvidia-GPUs senken und die Rechenkosten für das Training langfristig kontrollierbarer machen.
03.07.2026 · TechCrunch AI (techcrunch.com) · Infrastruktur