
Dots vs Grok 4.6: L'agente che prenota le proprie riunioni contro il modello che risponde
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 349 tok/s
- OpenAINUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- OpenAINUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAINUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 210 tok/s
- OrcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- xAISpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
Prova a scrivere un numero di telefono per un dot e fallirai, e quel fallimento è la cosa più utile di questo abbinamento. Dots è l'agente sempre attivo dell'azienda, annunciato al DevDay il 29 settembre 2026: ogni dot ottiene il proprio computer cloud e browser, si connette a più di 4.000 app ed è raggiungibile all'interno di ChatGPT, Slack e Teams, funziona su GPT-6 Astra ed è incluso con Pro e Business Premium senza costi separati. Grok 4.6 è il modello di frontiera di SpaceXAI, pubblicato il 12 agosto 2026, ed è un tipo di oggetto completamente diverso: una finestra di contesto di 500.000 token, input di testo, immagini e file con output testuale, sforzo di ragionamento configurabile, tool calling nativo e output strutturati, al prezzo di $2,00 per milione di token di input e $6,00 per milione di output al di sotto di un prompt di 200.000 token, e il doppio al di sopra. Uno di questi è un collega con un'agenda. L'altro è una funzione che chiami.
Entrambi sono davvero solidi nel lavoro agentico, ed è proprio questo che rende comune la confusione. Grok 4.6 segna 88,4 su Terminal-Bench 2.1 e 50,7 sulla porzione di τ-banking relativa all'uso degli strumenti — il genere di numeri che portano a definire un modello "un agente". Non lo è. È il motore di ragionamento con cui ne costruiresti uno.
Cosa sia in realtà ognuno
• Identità — un prodotto ospitato senza un identificatore di modello che puoi indirizzare (Dots) rispetto a un modello denominato e instradabile con una stringa stabile che puoi inserire in un file di configurazione (Grok 4.6)
• Dove avviene l'esecuzione — sul computer cloud di OpenAI, con il suo browser, isolato dalla tua macchina a meno che tu non li colleghi (Dots) a qualunque ambiente in cui esegui la chiamata: un container che controlli, un queue worker, un cron job (Grok 4.6)
• Copertura — oltre 4.000 app tramite i connettori di OpenAI (Dots) contro qualunque strumento ti configuri da solo, perché il tool calling è un protocollo e non una directory (Grok 4.6)
• Memoria di un'attività — mantenuta dal prodotto nell'arco di giorni, attraverso app e nuovi thread (Dots) a fronte di una finestra di 500.000 token e di qualunque cosa tu persista da solo (Grok 4.6)
• Costo — incluso con un abbonamento, quota non pubblicata (Dots) rispetto a $2,00 e $6,00 per milione di token, raddoppiando oltre 200.000 token di input, con letture in cache a $0,50 (Grok 4.6)
• Prove — dimostrazione del fornitore e dichiarazioni sulle capacità, nessun benchmark indipendente (Dots) rispetto a un Artificial Analysis Coding Index di 76,8, quinto su 138 modelli misurati, e 94,9 su GPQA Diamond (Grok 4.6)
Il numero che decide la maggior parte delle domande: l'indennità
OpenAI ha pubblicato un unico prezzo per i dot e non è un prezzo in alcuna unità in cui si possa misurare il lavoro. Il primo dot è incluso con Pro o Business Premium; le conversazioni con esso non intaccano i limiti di utilizzo di ChatGPT; nel primo mese si applicano limiti estesi. Questa è l'intera struttura di costo pubblicata. Nessuna cifra di quota inclusa, nessun prezzo per il secondo dot, nessuna tariffa per attività, nessun prezzo enterprise per i dot specializzati che si dice siano in fase di test interno. Il resoconto del keynote di CNBC vede la direttrice finanziaria Sarah Friar presentare il livello Pro 500 da $500 al mese come una quota di utilizzo più la nuova modalità Ultrafast, anziché come una tariffa per dot, il che significa che il piano più costoso nel listino di OpenAI non fornisce comunque un costo per unità di lavoro dell'agente.
Grok 4.6 va nella direzione opposta e pubblica tutto, compresa la parte che fa male. Il confine di fascia a 200.000 token di input è un precipizio: una richiesta da 199.000 token viene fatturata a metà tariffa rispetto a una da 201.000. Non è una trappola nascosta, è un numero nel listino, e cambia il modo in cui progetti un lavoro a contesto lungo. O suddividi in blocchi al confine, oppure accetti consapevolmente la seconda fascia.

Un successore è stato rilasciato mentre questa coppia veniva confrontata
Grok 4.7 è stato pubblicato il 21 settembre 2026 ed è ora il modello di punta della linea Grok, con lo stesso contesto da 500.000 token, la stessa superficie di input, lo stesso prezzo base e un output massimo di 450.000 token molto più ampio. Grok 4.6 resta disponibile ed è ancora elencato come modello attuale — un incremento di versione non è un pensionamento — ma chiunque scelga oggi un modello Grok dovrebbe scegliere tra 4.6 e 4.7 invece di dare per scontato che 4.6 sia la frontiera. Il motivo per dirlo chiaramente è che l'articolo che stai leggendo riguarda un confronto che sopravvive alla transizione: qualunque sia il nome del vertice della linea Grok il prossimo trimestre, resta comunque un modello a consumo con un listino tariffario, e un dot è ancora un abbonamento con una quota non pubblicata.
Questo è anche l'argomento a favore dell'instradamento delle chiamate al modello attraverso un'astrazione anziché un fornitore codificato in modo rigido. Quando arriva il successore, cambiare il modello è una modifica di una riga anziché una migrazione.

Costruire l'agente invece di affittarlo
La conseguenza interessante di questo abbinamento è che Grok 4.6 ti permette di costruire ciò che vende Dots, male e poi meglio. Un ciclo che legge una coda, chiama il modello con gli strumenti allegati, scrive i risultati e riprova in caso di errore non è difficile; la parte difficile sono i componenti che un dot ti dà gratis — un browser che si comporta come quello di una persona, connettori scritti dai fornitori delle app, un flusso di approvazione e un registro delle attività. Questi valgono un abbonamento proprio perché sono noiosi.
Dove vince il lato a consumo è nel momento in cui il lavoro smette di essere generico. Il momento in cui ti serve che la stessa chiamata venga eseguita su un fornitore diverso il trimestre successivo, che venga riprodotta da un log, che abbia un prezzo al centesimo, o che passi a un gemello più economico in corsa quando un provider a monte vacilla. Su OrcaRouter, Grok 4.6 è servito come grok/grok-4.6 al prezzo di listino di SpaceXAI con 0% di ricarico aggiuntivo — la tariffa del provider stesso, passata così com'è, quindi un taglio di prezzo del fornitore arriva sulla tua fattura lo stesso giorno — nello stesso catalogo di oltre 200 altri modelli dietro un'unica chiave, con failover automatico e un DSL di routing per comporre diversi modelli in un'unica chiamata. Non esiste un equivalente per un punto: nessun endpoint, nessun identificatore, nulla da cui fare failover.
Il test da applicare
Chiediti se il lavoro esisterebbe ancora se nessuno lo guardasse. Se la risposta è sì — deve avvenire secondo una pianificazione, attraverso diversi strumenti, senza che una persona apra una finestra di chat — un dot è il prodotto pensato per questo, e il modello a consumo è un componente all'interno di qualunque cosa tu costruisca. Se la risposta è no, se qualcuno è in attesa dell'output e l'output ha un formato e una scadenza, allora un modello a consumo è l'acquisto giusto e un agente è una deviazione costosa.
L'errore da evitare è comprare un dot per ottenere una risposta migliore. Un dot non è un modello più intelligente; è un guinzaglio più lungo su uno. E il secondo errore è pagare un abbonamento per ottenere una capacità che un tariffario ti vende già a token, con l'aritmetica visibile in anticipo.

Confrontati in questo articolo2
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
