Eine generierte Hero-Karte mit dem Titel 'Dots vs Grok 4.6', mit dem Untertitel 'Der Agent, der seine eigenen Meetings bucht, gegen das Modell, das antwortet'. Eine vertikale Linie teilt die Karte: Das linke Feld, beschriftet mit 'Dots', lautet 'eigener Computer, Browser, 4.000+ Apps'; das rechte, beschriftet mit 'Grok 4.6', lautet '500K Kontext - 88.4 Terminal-Bench - $2,00 / $6,00'. Das OrcaRouter-Logo ist in der unteren rechten Ecke eingefügt.
Guides & Insights

Dots vs Grok 4.6: Der Agent, der seine eigenen Meetings bucht, gegen das Modell, das antwortet

Autor

Magnus Corvin

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Versuchen Sie, eine Telefonnummer für einen Dot zu schreiben, und Sie werden scheitern – und genau dieses Scheitern ist das Nützlichste an dieser Paarung. Dots ist der Always-on-Agent des Unternehmens, angekündigt am 29. September 2026 auf dem DevDay: Jeder Dot erhält seinen eigenen Cloud-Computer und Browser, verbindet sich mit mehr als 4.000 Apps und ist innerhalb von ChatGPT, Slack und Teams erreichbar, läuft auf GPT-6 Astra und ist bei Pro und Business Premium ohne separate Kosten enthalten. Grok 4.6 ist das Frontier-Modell von SpaceXAI, veröffentlicht am 12. August 2026, und es ist eine völlig andere Art von Objekt: ein Kontextfenster von 500.000 Token, Text-, Bild- und Dateieingabe mit Textausgabe, konfigurierbarer Reasoning-Aufwand, nativer Tool-Aufruf und strukturierte Ausgaben, zu einem Preis von 2,00 $ pro Million Input-Token und 6,00 $ pro Million Output bei einem Prompt unter 200.000 Token und dem Doppelten darüber. Eines davon ist ein Kollege mit einem Zeitplan. Das andere ist eine Funktion, die Sie aufrufen.

Beide sind wirklich stark bei agentischer Arbeit, und genau das macht die Verwechslung so verbreitet. Grok 4.6 erzielt 88,4 bei Terminal-Bench 2.1 und 50,7 im τ-banking-Tool-Use-Segment – Zahlen, bei denen ein Modell schnell als „ein Agent" beschrieben wird. Ist es aber nicht. Es ist die Reasoning-Engine, aus der man einen bauen würde.

Was jedes einzelne tatsächlich ist

• Identität — ein gehostetes Produkt ohne Modellkennung, die Sie adressieren können (Dots), gegenüber einem benannten, routingfähigen Modell mit einer stabilen Zeichenfolge, die Sie in eine Konfigurationsdatei schreiben können (Grok 4.6)

• Wo die Ausführung stattfindet — auf OpenAIs Cloud-Computer mit eigenem Browser, isoliert von deinem Rechner, es sei denn, du verknüpfst sie (Dots) mit dem Ort, an dem du den Aufruf ausführst: einem Container, den du kontrollierst, einem Queue-Worker, einem Cron-Job (Grok 4.6)

• Reichweite — 4.000+ Apps über OpenAI's connectors (Dots) gegenüber beliebigen Tools, die du selbst anbindest, weil Tool-Calling ein Protokoll und kein Verzeichnis ist (Grok 4.6)

• Erinnerung an eine Aufgabe – getragen vom Produkt über Tage hinweg, über Apps hinweg, über neue Threads (Dots) hinweg, gegen ein 500.000-Token-Fenster und alles, was du selbst persistierst (Grok 4.6)

• Kosten — in einem Abonnement enthalten, Kontingent nicht veröffentlicht (Dots) gegenüber 2,00 $ und 6,00 $ pro Million Token, Verdopplung ab 200.000 Eingabe-Token, mit zwischengespeicherten Lesevorgängen zu 0,50 $ (Grok 4.6)

• Belege — Herstellerdemonstration und Leistungsangaben, keine unabhängige Benchmark (Dots) gegenüber einem Artificial Analysis Coding Index von 76,8, Fünfter von 138 gemessenen Modellen, und 94,9 bei GPQA Diamond (Grok 4.6)

Die Zahl, die die meisten Fragen entscheidet: das Kontingent

OpenAI hat einen Preis für Dots veröffentlicht, und es ist kein Preis in einer Einheit, in der man Arbeit messen kann. Der erste Dot ist in Pro oder Business Premium enthalten; Gespräche damit verbrauchen keine ChatGPT-Nutzungslimits; im ersten Monat gelten erweiterte Limits. Das ist die gesamte veröffentlichte Kostenstruktur. Keine Kontingentangabe, kein Preis für den zweiten Dot, kein Preis pro Aufgabe, kein Enterprise-Preis für die spezialisierten Dots, die sich Berichten zufolge im internen Test befinden. CNBCs Bericht über die Keynote zeigt, wie Finanzchefin Sarah Friar den Pro 500-Tarif für 500 $ pro Monat als Nutzungskontingent plus den neuen Ultrafast-Modus statt als Preis pro Dot bepreist, was bedeutet, dass das teuerste Angebot auf OpenAIs Preisliste immer noch keine Kosten pro Einheit Agentenarbeit ergibt.

Grok 4.6 macht es andersherum und veröffentlicht alles, auch den Teil, der weh tut. Die Stufengrenze bei 200.000 Input-Tokens ist eine Klippe: Eine Anfrage mit 199.000 Tokens wird zum halben Satz einer Anfrage mit 201.000 Tokens abgerechnet. Das ist keine versteckte Falle, sondern eine Zahl in der Preisliste, und sie verändert, wie man einen Long-Context-Job entwirft. Entweder zerlegt man an der Grenze in Chunks, oder man akzeptiert die zweite Stufe bewusst.

A screenshot of the OrcaRouter model page for Grok 4.6, showing the identifier 'grok/grok-4.6' with Vision, Tools, JSON and Reasoning badges, a publication date of 2026-08-12, a description of it as SpaceXAI's smartest model to date and the current flagship of the Grok line with a 500K-token context window, a side panel reading 500K tokens of context over text, image and file input, and a price strip reading $2.00 and $6.00 with tiered rates above a 200,000-token prompt.

Ein Nachfolger wurde ausgeliefert, während dieses Paar verglichen wurde.

Grok 4.7 wurde am 21. September 2026 veröffentlicht und ist jetzt das Flaggschiff der Grok-Reihe – mit demselben 500.000-Token-Kontext, derselben Eingabeoberfläche, derselben Basispreisgestaltung und einer deutlich größeren maximalen Ausgabe von 450.000 Token. Grok 4.6 bleibt verfügbar und weiterhin als aktuelles Modell gelistet – ein Versionssprung ist keine Ausmusterung –, doch wer heute ein Grok-Modell wählt, sollte sich zwischen 4.6 und 4.7 entscheiden, statt anzunehmen, 4.6 sei die Speerspitze. Der Grund, das so deutlich zu sagen, ist, dass der Artikel, den Sie gerade lesen, einen Vergleich behandelt, der den Übergang überdauert: Wie auch immer das Spitzenmodell der Grok-Reihe im nächsten Quartal heißen mag, es ist weiterhin ein nach Verbrauch abgerechnetes Modell mit einer Preisliste, und Dot ist weiterhin ein Abonnement mit einem nicht veröffentlichten Kontingent.

Das ist auch das Argument dafür, deine Modellaufrufe über eine Abstraktion statt über einen fest codierten Anbieter zu leiten. Wenn der Nachfolger auf den Markt kommt, ist das Ändern des Modells eine einzeilige Anpassung statt einer Migration.

A generated scoreboard titled 'Dots vs Grok 4.6 - product against protocol', with two columns. The left column, 'Dots', lists: price included with Pro or Business Premium; allowance not published; computer its own cloud computer and browser; connectors 4,000+ apps; channels ChatGPT, Slack, Teams; independent benchmark none. The right column, 'Grok 4.6', lists: context 500,000 tokens; input text, image, file; price $2.00 in / $6.00 out per 1M; above 200K input $4.00 in / $12.00 out per 1M; cached reads $0.50 per 1M; AA Coding Index 76.8, 5th of 138. A footer reads 'Dots details vendor-stated from OpenAI's DevDay launch; Grok 4.6 figures from independent listings as carried in the OrcaRouter catalogue.'

Den Agenten bauen, anstatt ihn zu mieten

Die interessante Konsequenz dieser Paarung ist, dass Grok 4.6 dich das, was Dots verkauft, schlecht und dann besser bauen lässt. Eine Schleife, die eine Warteschlange liest, das Modell mit angehängten Tools aufruft, Ergebnisse schreibt und bei Fehlern erneut versucht, ist nicht schwer; schwer sind die Teile, die ein Dot dir kostenlos liefert – ein Browser, der sich wie ein Mensch verhält, Connectoren, die von den App-Anbietern geschrieben wurden, ein Genehmigungs-Workflow und ein Aktivitätsprotokoll. Die sind genau deshalb ein Abonnement wert, weil sie mühsam sind.

Wo die abgerechnete Seite gewinnt, ist der Moment, in dem die Arbeit aufhört, generisch zu sein. Der Moment, in dem Sie denselben Aufruf im nächsten Quartal gegen einen anderen Anbieter ausführen lassen, aus einem Protokoll wiedergeben, auf den Cent genau berechnen oder mitten im Flug auf ein günstigeres Geschwistermodell ausweichen lassen müssen, wenn ein vorgelagerter Anbieter wackelt. Auf OrcaRouter wird Grok 4.6 angeboten als grok/grok-4.6 zum Listenpreis von SpaceXAI mit 0 % Aufschlag obendrauf — der eigene Tarif des Anbieters, durchgereicht, sodass eine Preissenkung des Anbieters noch am selben Tag auf Ihrer Rechnung landet — im selben Katalog wie über 200 weitere Modelle hinter einem Schlüssel, mit automatischem Failover und einer Routing-DSL zum Kombinieren mehrerer Modelle in einem einzigen Aufruf. Für einen Punkt gibt es kein Äquivalent: keinen Endpunkt, keine Kennung, nichts, worauf man ausweichen könnte.

Der anzuwendende Test

Frag dich, ob die Arbeit noch existieren würde, wenn niemand sie sich ansehen würde. Wenn die Antwort ja lautet – sie muss nach einem Zeitplan ablaufen, über mehrere Tools hinweg, ohne dass eine Person ein Chat-Fenster öffnet – dann ist dot das dafür geformte Produkt, und das verbrauchsabhängige Modell ist eine Komponente in allem, was du baust. Wenn die Antwort nein lautet, wenn jemand auf die Ausgabe wartet und die Ausgabe ein Format und eine Frist hat, dann ist ein verbrauchsabhängiges Modell der richtige Kauf und ein Agent ein teurer Umweg.

Der Fehler, den es zu vermeiden gilt, ist, einen dot zu kaufen, um eine bessere Antwort zu bekommen. Ein dot ist kein klügeres Modell; es ist eine längere Leine an einem. Und der zweite Fehler ist, für ein Abonnement zu zahlen, um eine Fähigkeit zu bekommen, die dir eine Preisliste bereits pro Token verkauft, wobei die Berechnung im Voraus sichtbar ist.

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models · 16 providers · one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with model cards visible in a grid beneath.

In diesem Artikel verglichen2

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert