
Nemotron 4 Leak: NVIDIAs Open-Weights-Antwort mit 1 Billion Parametern auf die Frontier
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 143 tok/s
- OpenAINEUOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAINEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAINEUGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 933 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 50 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
Nemotron 4 ist noch immer nicht veröffentlicht, aber diese Woche war es kein bloßes Gerücht mehr, sondern hatte bereits eine Parameteranzahl. Das Wall Street Journal berichtete am 22. August 2026 unter Berufung auf Personen, die mit der Angelegenheit vertraut sind, dass NVIDIA etwa 6 Milliarden Dollar ausgibt, um Nemotron 4 zu einem der leistungsfähigsten Open-Weight-KI-Modelle der Welt zu machen – und dass der Plan eine nicht-exklusive Lizenz für die Modelltrainingstechnologie des KI-Startups Poolside sowie die Versetzung von mehr als 100 Poolside-Ingenieuren in das Nemotron-4-Projekt umfasst. Das kommt zu dem früheren Leak von The Information vom 11. August hinzu, wonach das Flaggschiff der Familie „mindestens 1 Billion Parameter" aufweisen wird. Zusammen beschreiben die beiden Berichte den bislang ernsthaftesten Versuch von NVIDIA, die Spitze der Open-Weight-Grenze zu erreichen.
Nichts davon ist ausgeliefert, und nichts davon ist bestätigt. NVIDIA hat bestätigt, dass es eine Nemotron-4-Familie baut, aber es hat weder das Parameterziel, noch den Zeitplan, noch den Lizenz- und Einstellungsplan, den das WSJ Personen mit Kenntnis der Angelegenheit zuschreibt, noch die Allianzdetails, die The Information anonymen Mitarbeitern zuschreibt, bestätigt. Behandeln Sie jede Zahl in diesem Artikel als „berichtet“, nicht als „spezifiziert“. Der Sinn eines Leak-Berichts ist es, den kleinen bestätigten Kern vom größeren berichteten Umfeld zu trennen – und Ihnen zu sagen, welche Teile wichtig sind, wenn das echte Datenblatt erscheint.
Der Einzeiler-Leak, aufgeschlüsselt
Zuerst der Name, denn er wird Sie in den Suchergebnissen verwirren: NVIDIA hat bereits im Juni 2024 ein Modell namens Nemotron-4-340B veröffentlicht. Das neue Nemotron 4 ist eine andere, größere Familie – der Nachfolger der Nemotron-3-Reihe (Nano, Super, Ultra), die dieses Jahr erschienen ist – und verwendet den Namen „Nemotron 4“ erneut für die darauffolgende Generation. Dieser Artikel handelt von dem neuen.
Was The Information tatsächlich berichtete: NVIDIA entwickelt Nemotron 4 als eine Familie von Open-Source-Modellen, die an die Spitze der Open-Weight-Bestenliste zielen soll, und das Flaggschiff soll voraussichtlich "mindestens 1 Billion Parameter" haben. NVIDIA hat kein Veröffentlichungsdatum festgelegt, hat noch nicht mit dem endgültigen Trainingslauf begonnen – ein Prozess, von dem Mitarbeiter erwarten, dass er Monate dauern wird – und hat bisher nur die Vortrainingsdaten und die Architektur festgelegt; die Spezifikation ist noch in Bewegung. Zwei Mitarbeiter sagten, die Familie könnte bereits im späten Herbst fertig sein; andere rechnen mit einem späteren Zeitpunkt.
Derselbe Bericht führt ein separates Budget an: rund 28 Milliarden US-Dollar an mehrjährigen Cloud-Service-Vereinbarungen, die bis Anfang 2031 laufen, etwa dreimal so viel, wie NVIDIA ein Jahr zuvor offengelegt hatte, wobei rund 7 Milliarden US-Dollar auf das laufende Geschäftsjahr entfallen. Diese Zahl umfasst Compute-Verpflichtungen, nicht den neuen Deal, über den diese Woche berichtet wurde. Der Bericht merkt außerdem an, dass das Forschungspapier des vorherigen Flaggschiffs 570 Autoren auflistete und Nemotron 4 noch mehr umfasst – ein ehemaliger Mitarbeiter sagte The Information, dass „jeder dabei sein will“. All das wurde von NVIDIA nicht offengelegt.

Diese Woche: ein 6-Milliarden-Dollar-Deal, um Nemotron 4 Realität werden zu lassen.
The Wall Street Journal berichtete diese Woche, dass NVIDIAs Plan für Nemotron 4 nicht nur ein Forschungsprojekt ist – es ist ein finanziertes Vorhaben. Laut WSJ, das sich auf Personen beruft, die mit der Angelegenheit vertraut sind, wird NVIDIA rund 6 Milliarden Dollar für eine nicht-exklusive Lizenz an der „Model Factory“ von Poolside zahlen, dem Trainings- und Evaluierungssystem hinter den Open-Weight-Laguna-Codemodellen von Poolside, und mehr als 100 Mitarbeitern von Poolside – Berichten zufolge 109, die meisten davon Ingenieure – Stellenangebote unterbreiten, um am Nemotron-Projekt zu arbeiten. Bloomberg berichtete separat, dass NVIDIA weitere 1 Milliarde Dollar in Poolside investieren wird, bei einer gemeldeten Pre-Money-Bewertung von 12 Milliarden Dollar, womit sich NVIDIAs gesamtes gemeldetes Engagement auf rund 7 Milliarden Dollar beläuft.
Es handelt sich nicht um eine Übernahme. Die Lizenz ist nicht exklusiv, die Gründer von Poolside bleiben, und Poolside ist weiterhin als unabhängiges Unternehmen tätig; der Berichterstattung zufolge plant Poolside, die Lizenzzahlung in Höhe von 6 Milliarden Dollar an seine Investoren auszuschütten. Die Geschichte kam am 20. August erstmals über Newcomer ans Licht und wurde am 21. August von Bloomberg sowie am 22. August vom WSJ bestätigt — alles weiterhin nur „berichtet“, nichts davon von NVIDIA oder Poolside bestätigt.
Warum der Deal wichtiger ist als die Schlagzeilenzahl: Er verschafft dem Nemotron-4-Projekt ein Team, das tatsächlich bereits Open-Weight-Modelle veröffentlicht hat. Die Laguna-Familie von Poolside ist eine bewährte Open-Weight-Coding-Reihe, und das berichtete Ziel – eine Nemotron-Veröffentlichung innerhalb von etwa einem Jahr, die mit den stärksten Frontier-Modellen konkurrieren kann – ist der erste konkrete Zeitrahmen, den jemand mit dem Projekt verbunden hat. Die Berichte stellen den Schritt als Antwort von NVIDIA auf die Open-Weight-Marktführer in China dar, insbesondere DeepSeek und Moonshot AIs Kimi K3, und in der Debatte zwischen offenen und geschlossenen Modellen als Absicherung gegen die geschlossenen US-Labore.
Die Struktur ist ebenfalls wichtig. Eine nicht-exklusive Lizenz bedeutet, dass Poolside sein geistiges Eigentum behält und dieselbe Technologie an andere lizenzieren kann — NVIDIA kauft Fähigkeiten und Talente, nicht Eigentum. Analysten werten es als NVIDIAs Bestreben, die Modellebene austauschbar zu halten: Wenn Open-Weight-Modelle stark und günstig bleiben, fließt die Nachfrage weiterhin in die Ebene, die NVIDIA kontrolliert — die GPUs. Wie LMArena-CEO Anastasios Angelopoulos in der früheren Berichterstattung formulierte: „Egal welches Unternehmen ein großartiges Open-Source-Modell entwickelt, NVIDIA gewinnt.“
Warum die Größenangabe der am wenigsten interessante Teil ist
Die naheliegende Geschichte lautet: „NVIDIA geht auf Billionen-Parameter." Die weniger naheliegende ist, dass die Open-Weight-Front zuerst dort war. Kimi K3 öffnete seine Gewichte am 27. Juli mit insgesamt 2,8 Billionen Parametern – etwa 104 Milliarden aktive pro Token in einer Mixture-of-Experts-Konfiguration – und Alibabas Qwen3.8 Max, vorgestellt am 19. Juli, ist ein Modell mit insgesamt 2,4 Billionen und etwa 95 Milliarden aktiven Parametern. Demgegenüber würde ein Nemotron-4-Flaggschiff mit „mindestens 1 Billion" den Nemotron 3 Ultra verdoppeln, aber dennoch hinter den Größenführern zurückbleiben, und beide dieser Führer sind chinesisch.

Das macht die Gesamtparameterzahl völlig zur falschen Betrachtungsweise. Bei einem Mixture-of-Experts-Modell bestimmen die aktiven Parameter pro Token Kosten und Geschwindigkeit, nicht die Schlagzeilen-Gesamtzahl. Ein Nemotron 4 mit insgesamt 1 Billion Parametern könnte auf etwa 100 Milliarden aktive Parameter kommen – genau in der Liga von Kimi K3 und Qwen3.8 Max – oder auf die Hälfte davon. Die Zahl, die als Nächstes durchsickert, ist die, die zählt, und sie ist noch nicht durchgesickert.

Auch die andere Richtung ist erwähnenswert: DeepSeek V4-Flash, das am 31. Juli unter einer MIT-Lizenz erschien, ging den entgegengesetzten Weg — insgesamt 284 Milliarden Parameter, ausgerichtet auf den Preis statt auf Skalierung, mit geschätzten Kosten von etwa 0,14 $ pro Million Input-Tokens. Der Markt belohnt beide Extreme. Skalierung ist nicht die Strategie; sie ist eine Strategie.
NVIDIAs Position erklärt den Schritt. The Information berichtet, dass Nemotron 3 Ultra unter den US-Modellen mit offenen Gewichten auf Platz zwei liegt – hinter Thinking Machines' Inkling – und außerhalb der Spitzengruppe des globalen Open-Leaderboards. Nemotron 4 ist der Versuch, wieder ins Frontier-Gespräch zu kommen, und NVIDIAs eigene Führungskräfte rahmen es als Souveränitäts-Play: VP für generative KI Kari Briski sagte, NVIDIA investiere in Nemotron, weil „jedes Unternehmen und jedes Land zugängliche Frontier-Open-Source-Modelle braucht, um Sicherheit und Schutz zu stärken, Innovation zu beschleunigen und eine Grundlage zu schaffen, auf die sie sich von Generation zu Generation verlassen können.“ Jensen Huang argumentiert auf X ähnlich: Offene Modelle „stärken Sicherheit und Cybersicherheit, beschleunigen Innovation und Verbreitung und ermöglichen Souveränität.“ Die strukturelle Spannung ist real – NVIDIA besitzt Berichten zufolge rund 30 Milliarden Dollar an OpenAI – aber die Wette ist, dass offene Modelle den GPU-Kuchen vergrößern, nicht schrumpfen.
Die Nemotron-Koalition ist der Teil, den man beobachten sollte.
Nemotron 4 ist kein Soloprojekt, und der Poolside-Deal ist nicht die einzige Struktur darum herum. Auf der GTC am 16. März 2026 kündigte NVIDIA die Nemotron Coalition an — acht Gründungsmitglieder: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam und Thinking Machines Lab — die sich zusammengeschlossen haben, um Forschung, Daten und Rechenleistung hinter „Frontier Open Models" zu bündeln. Ihr erstes Projekt ist ein Basismodell, das gemeinsam von Mistral AI und NVIDIA entwickelt und auf NVIDIA DGX Cloud trainiert wird, das die Koalition laut eigenen Angaben als Open Source veröffentlichen will und das die Grundlage der Nemotron-4-Familie bilden soll.
{{1}}The Information ergänzt die Arbeitsdetails:{{/1}} Reflection, Cursor, Thinking Machines und Mistral sind {{2}}bestätigte Mitwirkende{{/2}}; Prime Intellect hat 300.000 Simulationsumgebungen für das Training beigesteuert; Cognition hat darüber gesprochen, Code-Trainingsdaten bereitzustellen. Der CEO von Prime Intellect, Vincent Weisser, bezeichnete das Bündnis als kollektive Maßnahme gegen ein, wie er es nannte, „gottähnliches“ Modellmonopol. {{3}}Was das operativ bedeutet:{{/3}} Nemotron 4 könnte als Konsortiumsgrundlage ausgeliefert werden, die jedes Mitglied für sein eigenes Produkt nachtrainiert, anstatt als Checkpoint eines einzelnen Anbieters. Das würde „Open-Weights-NVIDIA-Modell“ {{4}}zur falschen Kategorie{{/4}} machen — die Basis ist das interessante Artefakt.
Der Poolside-Deal fügt sich in all das ein. Die Koalition bündelt Forschung und Rechenleistung; die Lizenz-und-Einstellungs-Vereinbarung bringt eine funktionierende Modellfabrik und ein Team ein, das bereits offene Gewichte veröffentlicht hat. Falls sich die Berichte bestätigen, setzt NVIDIA Nemotron 4 gleichzeitig aus drei Quellen zusammen – dem eigenen Trainingsbetrieb, einer Konsortialbasis und Poolshares Produktionssystem – was eine andere Form hat als jede einzelne Checkpoint-Veröffentlichung.
Bestätigt, gemeldet, unbekannt
• Bestätigt — NVIDIA arbeitet an einer Nemotron-4-Familie (Unternehmensangabe). Die Nemotron Coalition existiert und baut ein offenes Basismodell mit Mistral AI auf (NVIDIA, März 2026).
• Gemeldet, unbestätigt – das „mindestens 1 Billion“-Flaggschiffziel und der Zeitplan für den Spätherbst, dazu die Cloud-Verpflichtung von rund 28 Milliarden Dollar mit etwa 7 Milliarden Dollar in diesem Geschäftsjahr (The Information); das von der WSJ gemeldete Bau-Budget von rund 6 Milliarden Dollar, die nicht-exklusive Poolside-„Model Factory“-Lizenz und mehr als 100 Poolside-Ingenieure, die zum Nemotron-Projekt stoßen; die von Bloomberg gemeldete 1-Milliarden-Dollar-Investition von NVIDIA in Poolside bei einer Pre-Money-Bewertung von rund 12 Milliarden Dollar; welche Koalitionsmitglieder was beitragen.
• Unbekannt — Anzahl der aktiven Parameter, Kontextlänge, Modalitätenmix, Lizenzbedingungen, Preis, welche Checkpoints zuerst ausgeliefert werden, ob die gemeinsam mit Mistral entwickelte Basis tatsächlich zum Fundament der Familie wird und ob der Poolside-Deal wie berichtet strukturiert ist (beide Unternehmen haben sich nicht geäußert).
Zeitleiste und worauf man achten sollte
Es gibt noch immer kein Veröffentlichungsdatum. Der letzte Trainingslauf hat noch nicht begonnen; Mitarbeiter beschreiben ihn als monatelang, und die Schätzungen reichen von „Spätherbst“ (zwei Quellen) bis später. Die Poolside-Berichterstattung nennt den ersten konkreten Zeitrahmen, den jemand mit dem Projekt verbunden hat: Laut dem Bericht ist das Ziel eine Veröffentlichung innerhalb von etwa einem Jahr, die mit den stärksten Frontier-Modellen konkurrieren kann. NVIDIA hat die Familie in der Zwischenzeit in Bewegung gehalten: Es hat Nemotron 3.5 Lightning ausgeliefert, einen 31.6B-Parameter-Agent-Worker, der am 11. August veröffentlicht wurde – am selben Tag, an dem der Nemotron-4-Bericht herauskam – zusammen mit NeMo Switchyard, NVIDIAs eigener Open-Source-Routing-Software.
Was man sich ansehen sollte, in etwa nach Wichtigkeit geordnet:
• Aktive Parameter — die Gesamtzahl ist das Aushängeschild; die Anzahl der aktiven Parameter entscheidet über Kosten und Geschwindigkeit. Ein MoE mit ~1T Gesamtparametern und ~100B aktiven Parametern verändert das Gesamtbild im Vergleich zu einem mit ~50B.
• Die Poolside-Integration — ob die Model-Factory-Lizenz und ihr neues Team den Trainingsplan tatsächlich umgestalten und den gemeldeten Zeitplan verkürzen, oder ob es eine Talentakquise ist, die den Plan unverändert lässt.
• Unabhängige Bewertungen — für ein Modell, das nicht trainiert wurde, gibt es keine Bewertung durch Dritte. Beobachten Sie den Artificial Analysis Intelligence Index, sobald ein gehosteter Checkpoint erscheint.
• Lizenzbedingungen — Nemotron 3 Ultra wird unter OpenMDW-1.1 ausgeliefert, permissiv, aber nicht MIT oder Apache 2.0. Ob Nemotron 4 dem folgt oder es verschärft, ist unentschieden, und für ein Unternehmen, das auf den Gewichten aufbaut, entscheidet das alles.
• Welche Größen werden zuerst ausgeliefert — Nemotron 3 kam als Familie (Nano, Super, Ultra). Erwarten Sie eine Reihe von Nemotron-4-Größen, und erwarten Sie die kleinen vor dem Flaggschiff.
• Die Mistral-Basis — ob das Basismodell der Koalition tatsächlich zur Grundlage der Familie wird, ist die strukturelle Frage hinter all dem Parameter-Gerede.
• Preis — nichts wird gehostet, also hat nichts einen Preis. Wenn ein Hosting-Partner Nemotron 4 listet, ist der Durchreichpreis das, was Sie tatsächlich zahlen.
Was es für Ihre Inferenzschicht bedeutet
Sie können Nemotron 4 heute nicht anrufen — {{1}}niemand kann das{{/1}} — und die Poolside-Berichte, {{2}}wie dramatisch auch immer{{/2}}, ändern daran nichts. Die praktische Frage bleibt, wie viel Ihres Stacks Sie ändern sollten, um ein Modell zu unterstützen, dessen Spezifikationsblatt sich noch bewegt. Die Antwort ist dieselbe wie bei jedem unveröffentlichten Frontier-Modell: Halten Sie die Inferenzschicht modellagnostisch. Wenn Sie über eine einzige API routen, die 200+ Modelle bedient, ist eine neue Nemotron-Familie eine Konfigurationsänderung, kein Rewrite. OrcaRouter reicht den Listenpreis des Anbieters mit 0% Aufschlag durch, sodass das, was ein Host letztlich für Nemotron 4 verlangt, genau das ist, was Sie zahlen — und eine Preissenkung des Anbieters greift am selben Tag, an dem sie vorgenommen wird. Automatisches Failover ist das richtige Werkzeug für eine unbewiesene Erstveröffentlichung: Lenken Sie frühen Traffic auf das neue Modell, fallen Sie auf eine stabile Alternative zurück, wenn es ins Stocken gerät oder Fehler auftreten, und stufen Sie es erst dann auf Produktion hoch, nachdem es sich Ihre Workloads verdient hat. Nichts davon erfordert, einen Produktionspfad auf ein Leak zu setzen — {{3}}was genau die richtige Haltung ist, wenn das Spezifikationsblatt so vorläufig ist{{/3}}.
FAQ
Wann wird Nemotron 4 veröffentlicht?
Es wurde kein Datum festgelegt. Mitarbeiter teilten The Information mit, dass der finale Trainingslauf noch nicht begonnen hat und Monate dauern wird; zwei sagten, der späte Herbst 2026 sei möglich, andere rechnen mit später. Die Berichterstattung dieser Woche ergänzt ein berichtetes Ziel, innerhalb von etwa einem Jahr eine an der Spitze konkurrenzfähige Veröffentlichung zu erreichen, aber weiterhin ohne festes Datum. Behandeln Sie beide Angaben als Schätzungen aus dem Projekt heraus, nicht als Fahrplan.
Wird Nemotron 4 Open-Source sein?
NVIDIAs erklärte Absicht ist offene Gewichte, und das erste Projekt der Nemotron-Koalition – das gemeinsam mit Mistral entwickelte Basismodell – soll als Open Source veröffentlicht werden. Aber „offene Gewichte“ ist nicht „Open Source“: Nemotron 3 Ultra erscheint unter der OpenMDW-1.1-Lizenz, die freizügiger ist als NVIDIAs ältere Bedingungen, aber immer noch nicht MIT oder Apache 2.0. Die konkrete Lizenz von Nemotron 4 wurde noch nicht bekannt gegeben.
Ist der gemeldete 6-Milliarden-Dollar-Deal mit Poolside bestätigt?
Nein. Das WSJ berichtete am 22. August unter Berufung auf Personen, die mit der Angelegenheit vertraut sind, über die Lizenz im Wert von rund 6 Milliarden US-Dollar und die mehr als 100 Poolside-Ingenieure, die zum Nemotron-Projekt stoßen; Bloomberg berichtete über die zusätzliche Investition von 1 Milliarde US-Dollar. Newcomer berichtete zuerst am 20. August darüber. Weder NVIDIA noch Poolside hat irgendetwas davon bestätigt. Die Lizenz wird als nicht-exklusiv gemeldet, und Poolside würde ein unabhängiges Unternehmen bleiben.
Ist „mindestens 1 Billion Parameter" eine echte Spezifikation?
Es handelt sich um einen von Mitarbeitern stammenden Zielwert, über den The Information berichtet hat – keine bestätigte Spezifikation, und derselbe Bericht sagt, dass sich die Zahl noch ändern könnte. Selbst bei insgesamt 1 Billion läge es in der reinen Größe hinter Kimi K3 (2,8 Billionen) und Qwen3.8 Max (2,4 Billionen); die Anzahl der aktiven Parameter – die nicht durchgesickert ist – ist die Zahl, die über Kosten und Geschwindigkeit entscheiden wird.
Sollte ich auf Nemotron 4 warten, bevor ich ein Modell auswähle?
Nein. Es ist bestenfalls noch Monate entfernt und nicht erprobt. Wählen Sie jetzt das beste verfügbare Modell für die Aufgabe und halten Sie die Routing-Schicht flexibel; wenn Nemotron 4 tatsächlich erscheint, bewerten Sie es genauso wie jedes neue Modell — aktive Parameter, unabhängige Benchmarks, Lizenz und Preis — und nicht anhand der Gesamtzahl in der Schlagzeile oder der Höhe des gemeldeten Budgets.
Fazit
Die Familie ist real; die Zahlen sind Schätzungen. Diese Woche hat die Geschichte ihre Form verändert: Nemotron 4 ist nicht mehr nur ein Parameter-Leak, sondern ein finanzierter Build. NVIDIA soll rund 6 Milliarden Dollar ausgeben, die Model Factory von Poolside lizenzieren, mehr als 100 Ingenieure von Poolside einstellen und weitere 1 Milliarde Dollar in das Unternehmen investieren – alles, um ein Open-Weight-Flaggschiff zu schaffen, das neben DeepSeek und Kimi K3 bestehen kann. Jede dieser Zahlen stammt aus Presseberichten, keine ist bestätigt, und nichts wurde ausgeliefert. Die Open-Weight-Frontier hat die Billionen-Parameter-Marke bereits überschritten, und NVIDIAs Antwort ist ein Konsortial-Basismodell, eine lizenzierte Model Factory und ein Versprechen. Für einen Leser, der heute Modelle auswählt, bedeutet das weiterhin eines: nicht auf Basis des Leaks planen. Die Inferenzschicht flexibel halten, jedes ausgelieferte Modell anhand seiner realen Zahlen bewerten und Routing das tun lassen, wofür Routing da ist – das Neue ausprobieren, ohne den Produktionspfad darauf zu setzen.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
