Die deutschsprachige Chronik der KI-Nachrichtenlage

Nvidia sichert sich SK-Hynix-Speicher in 500-Milliarden-Deal

27.07.2026 · Infrastruktur

NVIDIA

Nvidia sichert sich aggressiv den Nachschub an High-Bandwidth-Memory, einer Schlüsselkomponente für seine GPUs und Systeme. Der Vertrag mit SK Hynix bindet knappe Speicherkapazität langfristig und verschärft die Versorgungslage für konkurrierende Chiphersteller im KI-Beschleunigermarkt.

Originalquelle

CNBC Technology — cnbc.com

Mehr zum Thema

Microsoft und Nvidia fordern offenes KI-Ökosystem

25 US-Tech-Konzerne sprechen sich in einem offenen Brief für ein KI-Ökosystem mit Open-Weights-Modellen aus. Der Vorstoss gilt als Antwort auf das chinesische Kimi K3. Offene Gewichte würden Entwicklern breiteren Zugriff verschaffen und die Abhängigkeit von geschlossenen Anbietern verringern.

26.07.2026 · heise KI (heise.de) · Infrastruktur

Nvidia ModelExpress verteilt Modellgewichte im Cluster schneller

Nvidia stellt ModelExpress vor, das riesige Modell-Checkpoints von Hunderten Gigabyte effizienter durch den Cluster bewegt. Da Cold Starts, Autoscaling und RL-Nachtraining ständig Gewichte kopieren, senkt die Technik Ladezeiten und Kosten für GPU-Deployments spürbar.

25.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Infrastruktur

Moonshot AI umging Chip-Exportverbot mit Nvidia GB300

Laut einem Vertreter des Weissen Hauses griff Moonshot AI in Thailand auf Nvidias GB300-Chips zu, trotz chinesischer Exportbeschränkungen. Das Unternehmen trainierte damit sein leistungsstarkes Modell Kimi K3. Der Fall verdeutlicht, wie schwer sich die US-Exportkontrollen gegen Umgehungswege durch Drittländer durchsetzen lassen.

24.07.2026 · CNBC Technology (cnbc.com) · Infrastruktur

Nvidia Nemotron 3 Nano lässt sich mit Prime Intellect anpassen

Nvidia zeigt, wie sich das Modell Nemotron 3 Nano über das Prime Intellect Lab in Minuten auf eigene Anwendungsfälle, Domänen und Sprachen zuschneiden lässt. Die vorkonfigurierte Umgebung senkt Hürden bei Infrastruktur, GPU-Zugang und Fachwissen, die individuelle Anpassungen sonst aufwendig machen.

24.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Infrastruktur

NVIDIA macht TensorRT-Builds abbrechbar und beobachtbar

NVIDIA zeigt, wie sich lange TensorRT-Engine-Builds in Python oder C++ überwachen und vorzeitig abbrechen lassen. Bislang blockieren grosse Modelle und kalte Timing-Caches auf neuen GPU-SKUs den Prozess ohne Rückmeldung. Die neue Beobachtbarkeit erspart Entwicklern und Agenten unnötiges Warten oder Neustarts.

23.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Agenten

Nvidia Rubin-Architektur zielt auf agentische KI-Fabriken

Nvidia beschreibt die Rubin-GPU-Architektur für Dauerbetrieb-Rechenzentren, die agentische Lasten mit Planen, Werkzeugnutzung und mehrstufigen Aufgaben über grosse Kontexte bedienen. Der Fokus verschiebt sich vom reinen Training und Chat hin zur Inferenz autonomer Agenten. Das definiert Kapazitätsanforderungen künftiger KI-Infrastruktur neu.

22.07.2026 · NVIDIA Generative AI (developer.nvidia.com) · Agenten

Ganze Ausgabe vom 27.07.2026