Google stellt der Genesis Mission 40 Millionen Dollar in KI-Tokens und Credits zur Verfügung, um wissenschaftliche Forschung zu beschleunigen. Forschende erhalten dadurch Rechenzugang für datenintensive Entdeckungen ohne eigene Infrastrukturkosten. So senkt das Programm die Einstiegshürde für KI-gestützte Wissenschaft.
23.07.2026 · Google DeepMind Blog (deepmind.google) · Forschung
Dylan Castillo prüfte systematisch, ob KI-Labs ihre Modelle gezielt auf Willisons Pelikan-Benchmark trainieren. Mit 48 Prompts über sieben Modelle wie GPT-5.6 Terra, Claude Sonnet 5 und Gemini 3.5 Flash fand er keine Belege. Die Zeichnungen sind weder besser noch memorisiert, was den Benchmark als Test stützt.
23.07.2026 · Simon Willison (simonwillison.net) · Forschung
Hugging-Face-Chef Clem Delangue sagt, Unternehmen setzten wegen Kosten, Zugänglichkeit und Kontrolle zunehmend auf offene statt auf geschlossene Spitzenmodelle. Das verschiebt laut ihm Marktmacht weg von geschlossenen Anbietern hin zu offenen Alternativen für den produktiven Einsatz in Firmen.
15.07.2026 · TechCrunch AI (techcrunch.com) · Forschung
Frontier-Modelle wachsen über die etablierten Methoden zur Messung ihrer Hackfähigkeiten hinaus. US-Behörden müssen bis 1. August ein klassifiziertes Benchmark-Verfahren etablieren; Anthropic entwickelt mit Amazon, Google und Microsoft einen Standard, der die Folgen eines Jailbreaks statt dessen blosse Möglichkeit bewertet. Ohne neue Tests bleibt sichere Freigabe unklar.
Eine neue Deep-Link-Integration zwischen Hugging Face und Amazon SageMaker AI erlaubt den Wechsel von der Modellsuche zum Experiment mit einer einzigen Auswahl. Das verkürzt den Weg von der Entdeckung eines Modells bis zum praktischen Test in SageMaker Studio deutlich.
Google DeepMind und das Filmstudio A24 kündigen eine erste Forschungspartnerschaft dieser Art an. Die Kooperation verbindet KI-Forschung mit kreativer Filmproduktion und markiert einen Brückenschlag zwischen Labor und Unterhaltungsbranche. Damit erschliesst DeepMind ein neues Anwendungsfeld für generative Modelle im Medienbereich.
04.07.2026 · Google DeepMind Blog (deepmind.google) · Forschung
Sergey Edunov verlässt Meta und wechselt mit Evan Feinberg zu Genesis Molecular AI. Das Modell PEARL gewinnt den OpenBind-Benchmark im Zero-Shot-Setting. Sobald Co-Folding die Genauigkeitsschwelle überschreitet, öffnet sich Diffusion für die Wirkstoffsuche statt nur für Sprachmodelle.
03.07.2026 · Latent Space (latent.space) · Forschung
Anthropics neue App Claude Science ist eine KI-gestützte Forschungswerkbank für die Life Sciences mit über 60 Werkzeugen. Sie läuft auf macOS, Linux, lokalen Maschinen, Remote-Clustern und via SSH. Damit erhalten Forschende eine integrierte Umgebung für rechenintensive wissenschaftliche Arbeit.
02.07.2026 · TestingCatalog AI (testingcatalog.com) · Forschung
Google Research präsentiert TabFM, ein Foundation-Modell für tabellarische Daten. Es liefert Vorhersagen im Zero-Shot-Verfahren, also ohne aufgabenspezifisches Training. Das senkt den Aufwand für klassische Machine-Learning-Pipelines und macht Analysen auf strukturierten Datensätzen schneller zugänglich.
01.07.2026 · Google Research Blog (research.google) · Forschung
Hugging Face integriert die Resultate von Every Eval Ever direkt in die Modellseiten. Nutzer sehen damit Benchmark-Ergebnisse zusammen mit dem jeweiligen Modell an einem Ort. Das erleichtert den Vergleich und die Auswahl passender Modelle ohne separate Recherche.
01.07.2026 · Hugging Face Blog (huggingface.co) · Forschung