
Octen Search conquista il terzo posto nell'Artificial Analysis Search Index: il più veloce per attività, il più economico tra i leader
- deepseekNUOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiNUOVOOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleNUOVOGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenNUOVOQwen: Qwen3.8 Max (0902)2026-09-0240Intelligenza72Codice
- anthropicNUOVOAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 per 1M di token
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligenza72Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligenza69Codice
Octen Search ha ottenuto 77 alla sua prima apparizione nell'Artificial Analysis Search Index, risultato buono per il terzo posto in classifica — ed è arrivato lì in 17,2 secondi per attività, più rapidamente di qualsiasi altra cosa testata da Artificial Analysis. Il prodotto in sé non è nuovo: Octen Search è disponibile in commercio dal 22 aprile 2026, quando la sua società madre APITECH AI ha annunciato un round seed da 10 milioni di dollari guidato da Square Peg. Quello che è cambiato è che, stando ai dati dell'8 settembre di Artificial Analysis, c'è finalmente un numero di terze parti associato ad esso, e il numero è migliore di quanto avrebbe previsto il primo test indipendente pratico di Octen Search.
Che cosa sta effettivamente misurando Artificial Analysis
Il Search Index è entrato in funzione il 18 agosto 2026, e il suo design è insolitamente pulito per una classifica. Ogni provider viene eseguito all'interno dello stesso harness per agenti — Stirrup, l'agente open-source di Artificial Analysis — guidato dallo stesso modello, GPT-5.6 Luna con ragionamento medio, e valutato dallo stesso grader. L'agente dispone di due strumenti, web_search e web_fetch, fino a 25 turni per attività e al massimo dieci risultati per ricerca, con le fonti di contaminazione note filtrate. Un'esecuzione che consuma tutti i 25 turni senza chiamare finish ottiene un punteggio pari a zero, quindi lasciare l'agente incapace di concludere un'attività è punito duramente quanto non recuperare nulla.
L'unica variabile è il provider di ricerca. È la proprietà che manca alla maggior parte dei confronti sulla ricerca, ed è ciò che rende il posizionamento di Octen Search leggibile come un'affermazione sul recupero anziché su quale fornitore abbia integrato il modello di risposta più potente.
I punteggi sono la media a pesi uguali di tre valutazioni su una scala da 0 a 100. L'F1 di DeepSearchQA viene calcolato su una partizione di 900 attività di domande di ricerca ampie e valuta la risposta come un elenco di elementi. L'accuratezza di BrowseComp usa un sottoinsieme difficile di 200 campioni di fatti multi-hop in cui la risposta è un singolo valore verificabile. L'accuratezza di AA-Omniscience usa 600 domande di conoscenza generale tenute da parte e serve principalmente a isolare quanto la ricerca aggiunga oltre ciò che il modello già sapeva. Poiché l'indice è una media semplice, una singola componente soft trascina verso il basso il numero di punta, e il profilo delle componenti è spesso più utile della classifica. Eseguire lo stesso agente senza alcuno strumento di ricerca totalizza 33, quindi quasi tutto ciò che un provider ottiene è un miglioramento rispetto ai parametri del modello stesso.
Artificial Analysis afferma di aver testato 20 prodotti di ricerca di 10 fornitori; i grafici predefiniti ne mostrano 12.
Dove è approdato Octen Search
La parte superiore della tabella dell'8 settembre, con i costi per attività calcolati sommando le colonne relative a ricerca e token del modello che Artificial Analysis pubblica per 1.000 attività — la classifica stessa non riporta un'unica cifra combinata:
• Perplexity Search (medium) — Indice 80, 28,8 s per attività, circa 0,091 $ per attività
• Perplexity Search (alta) — Indice 79, 29,7s, circa 0,091 $
• Octen Search (in evidenza) — Indice 77, 17,2s, circa 0,058 $
• Perplexity Search (bassa) — Indice 77, 37,4 s, circa 0,105 $
• Ricerca parallela (avanzata) — Indice 75, 42,9s, circa $0,084
• Brave Search (contesto LLM) — Indice 75, 24,4 s, circa 0,130 $
• You.com Search (punti salienti) — Indice 74, 20,7s, circa $0,117
• Exa Search (auto) — Indice 74, 33,3s, circa $0,127
I punteggi dei componenti sono il punto in cui il posizionamento diventa più interessante della classifica. Octen Search ottiene 80 su DeepSearchQA, 86 su BrowseComp e 66 su AA-Omniscience. Parallel Search (advanced), il provider che era in testa all'indice al lancio, ottiene 81, 77 e 67. Quindi Octen Search batte Parallel Search di nove punti sul benchmark multi-hop di ricerca di fatti e lo eguaglia sulla ricerca ampia, mentre resta indietro rispetto alle impostazioni di Perplexity Search sul miglioramento della conoscenza generale — 66 contro 72 per Perplexity Search (medium). In parole semplici, Octen Search è molto bravo a scovare cose che sono davvero difficili da trovare, e offre meno valore aggiunto sulle domande che il modello già conosce a metà.
Una piccola complicazione degna di nota per chiunque citi questo: l'annuncio stesso di Artificial Analysis del risultato indicava Octen Search a 16,9 secondi per attività, mentre la tabella live mostra 17,2 sui dati dell'8 settembre. Si tratta di deriva da riesecuzione, non di una contraddizione, ma è il motivo per cui conviene citare la tabella invece del post sui social.

La velocità fa notizia; la ripartizione dei costi è la vera storia
17,2 secondi per attività rendono Octen Search la voce più veloce dell'indice. Perplexity Search (medium) impiega 28,8 secondi, Parallel Search (advanced) 42,9 e Firecrawl Search 63,2. Artificial Analysis riporta inoltre Octen Search come il più veloce per singola query, con una media di 0,21 secondi per ricerca — il tempo di chiamata più rapido misurato, indipendentemente da quante chiamate richiede un'attività.
Il numero su cui vale la pena soffermarsi, però, è la ripartizione dei costi. Per 1.000 attività, Artificial Analysis stima che Octen Search comporti 9,07 $ di spesa per la ricerca e 49,15 $ di spesa per i token del modello. I token costano circa 5,4 volte le ricerche. Non è una stranezza di Octen Search — è il punto strutturale che questo indice continua a evidenziare. Un fornitore di ricerca non ti fattura solo il recupero; decide quanti turni compie l'agente, e ogni turno extra sono token del modello alla tariffa del modello.
Artificial Analysis ha sostenuto lo stesso argomento con Parallel al lancio: la modalità avanzata costava più per ricerca di quella base (0,048 $ contro 0,045 $) ma meno per attività (0,084 $ contro 0,11 $), perché risultati migliori riducevano l'uso di token da circa 339.000 a 169.000 per attività. Chiamate più economiche e attività più economiche sono cose diverse, e solo una delle due compare sulla tua fattura.
Rispetto al resto della classifica, il costo di Octen Search, pari a circa $0,058 per attività, è il più basso tra tutte le voci con un punteggio di 75 o superiore. TinyFish Search costa meno, circa $0,035, ma ottiene 71 e impiega 60,4 secondi per completare un’attività.
Cosa stabilisce il risultato, e cosa no
I numeri di Octen sono sempre stati aggressivi, e restano dichiarati dal fornitore. L'azienda sostiene 62 ms P50 e 68 ms P90 di latenza sul benchmark SealQA Hard, un throughput superiore a un milione di query al secondo per account, nuovi contenuti indicizzati entro cinque minuti e una terza posizione a livello globale su DeepResearch Bench con un punteggio complessivo di 55,58. Nessuno di questi è stato riprodotto in modo indipendente, e diversi non sono direttamente comparabili con nient'altro di pubblicato.
Ora esistono due test indipendenti, e indicano direzioni diverse. Artificial Analysis, mantenendo fissi il modello e il sistema di valutazione, colloca Octen Search al terzo posto per qualità e al primo per velocità. Un altro benchmark indipendente pubblicato nell'agosto 2026 ha misurato Octen Search a 359 ms P50 e 941 ms P95 — diverse volte la latenza dichiarata dal fornitore — e un nDCG@10 di 0,495, appena sotto la soglia di 0,5 e dietro Parallel, Brave, Kagi, Perplexity, Context, Tavily ed Exa su quella metrica. Il team di Octen ha detto a quel recensore che il proprio benchmark testa principalmente la latenza anziché la qualità dei risultati, il che è una precisazione giusta e anche un'ammissione che la qualità dei risultati non era ciò che veniva rivendicato.
Entrambi i risultati possono essere corretti, perché pongono domande diverse. Quel test precedente valutava se i primi dieci risultati sembravano pertinenti tramite euristiche sui metadati sul proprio insieme di query; Artificial Analysis valuta se un agente, guidato da un modello reale, completa correttamente un'attività. Ciò che la posizione in classifica stabilisce con certezza è più limitato di "migliore API di ricerca" e più utile di un'affermazione di un fornitore: sul completamento di attività agentiche, a modello costante, Octen Search è competitiva con i fornitori più forti e più veloce di tutti loro.
Quanto costa davvero eseguire Octen Search
Il listino prezzi pubblicato da Octen, che la società ha aggiornato l'ultima volta il 7 settembre 2026:
• Chiamate Search API — 1 $ per 1.000 chiamate, uno sconto dell'80% sul prezzo di listino di 5 $ applicato automaticamente dal 16 luglio 2026
• Limiti sui risultati — i primi 10 risultati all'interno di una ricerca sono gratuiti; quelli extra vengono fatturati a $0.50 per 1.000 risultati
• Altri endpoint — Image Search e Video Search a $5 per 1.000 chiamate; Extract a $1 per 1.000 URL elaborati con successo
• Embedding — octen-embedding-8b a $0,07 e octen-embedding-0.6b a $0,01 per milione di token
• Piani di throughput — livello gratuito fino a 10 QPS; Base fino a 20 QPS senza costi una volta che l'account dispone di credito; Builder fino a 50 QPS a $2.099/mese; Pro fino a 200 QPS a $13.999/mese; Max fino a 500 QPS a $33.999/mese
• Registrazione — $5 di saldo gratuito
I livelli di throughput sono la parte che manda silenziosamente in tilt il calcolo dei costi. Quegli 0,058 $ per attività sono un puro calcolo per chiamata. Se il tuo carico di lavoro richiede 200 query concorrenti al secondo, stai pagando 13.999 $ al mese prima ancora che venga eseguita la prima ricerca, e la cifra per attività smette di essere il numero interessante.
Ci sono anche le lacune segnalate al lancio di Octen: i termini di conservazione zero dei dati, le certificazioni di conformità e la disponibilità regionale non sono pubblicati con lo stesso livello di dettaglio dei provider consolidati. Se operi in un ambiente regolamentato, questo conta molto più di un divario di tre punti nell'indice.


Se è terzo, perché qualcuno dovrebbe ancora scegliere Perplexity Search?
Il divario di tre punti rispetto a Perplexity Search (medium) è più piccolo di quanto sembri, e lo stesso vale per l'ipotesi di passare direttamente all'alternativa. Perplexity Search vince su AA-Omniscience per 72 a 66, e restituisce una risposta sintetizzata e con citazioni in un'unica chiamata, cosa che alcune pipeline desiderano e che questo indice — costruito attorno a un agente che chiama strumenti — non premia. I vantaggi di Octen Search sono la velocità e il prezzo: circa 1,7 volte più veloce per attività e circa il 36% più economico per attività rispetto a Perplexity Search (medium) su questi dati.
Riepilogo pratico: se il tuo agente è vincolato dalla latenza, o la tua bolletta è dominata dal retrieval ad alto volume, Octen Search è ormai una scelta predefinita difendibile anziché un azzardo. Se la tua pipeline dipende da una risposta sintetizzata, o dalla posizione di conformità di un incumbent, l'indice non ti dà alcun motivo per passare.
Dove questo lascia il tuo stack di agenti
Il Search Index misura uno strato che la maggior parte dei team tratta come impiantistica di base, e solleva un punto che va oltre la ricerca. Nella riga di Octen Search stessa, i token del modello costano 5,4 volte il costo del retrieval. Qualunque cosa tu scelga per il retrieval, è sul lato del modello che vanno i soldi, ed è il lato che vuoi reintegrare meno ogni volta che valuti un nuovo fornitore di ricerca.
Questo è il motivo per cui conviene mantenere il percorso del modello dietro un unico endpoint. OrcaRouter serve oltre 200 modelli dietro un'unica API con markup dello 0% — il prezzo di listino del provider viene passato tal quale, così un taglio di prezzo del fornitore ti arriva lo stesso giorno — con failover automatico tra provider e un DSL di routing per comporre più modelli in un'unica chiamata. Mantieni fissa la rotta del modello, sostituisci il livello di retrieval che sta dietro e, se il nuovo provider si rivela più debole sul tuo traffico di quanto lo sia su DeepSearchQA, avrai cambiato una dipendenza invece di due. Puoi vedere il catalogo in catalogo dei modelli di OrcaRouter.
Per essere espliciti su ciò che serviamo e ciò che non serviamo: Octen Search non è nel catalogo di OrcaRouter e non ne facciamo proxy — quella chiamata va direttamente a Octen. Ciò che instradiamo è il modello all'altro capo.
Cosa guardare dopo
Tre cose potrebbero cambiare questa storia. Artificial Analysis riesegue l'indice man mano che i fornitori rilasciano modifiche, quindi un secondo punto dati pari o vicino a 77 trasformerebbe un debutto in una traiettoria, mentre un calo suggerirebbe che la prima posizione è stata favorita dal mix di query. Octen non ha pubblicato i propri numeri per singolo benchmark di DeepSearchQA, BrowseComp e AA-Omniscience, che è la credibilità più a buon mercato a sua disposizione. E la tariffa di 1 $ per 1.000 chiamate è in vigore dal 16 luglio; se quella promozione scade e si torna al prezzo di listino di 5 $, la voce relativa alla ricerca nel costo di Octen Search quintuplica all'incirca e l'argomentazione sul prezzo si indebolisce considerevolmente.
Per chiunque stia costruendo un agente in questo trimestre, la mossa è piccola. L'indice è un segnale di qualità per costo, non un test di compatibilità. Esegui la tua distribuzione di query su Octen Search prima di spostare un percorso di retrieval in produzione, e considera un 77 come un motivo per fare benchmark anziché un motivo per migrare.
