
Union Alpha vs Tencent Hy3 (Free): stessa forma, solo uno dei due ha un nome
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token
- deepseekNUOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiNUOVOOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenza76Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Metti Union Alpha e Tencent Hy3 (Free) uno accanto all'altro su una scheda tecnica e sembrano la stessa offerta: un modello gratuito, con una finestra di contesto di circa 256K, mixture-of-experts, proposto per lavoro agentico e di coding, con limiti di frequenza, a $0. La differenza non sta nelle specifiche. Sta nel fatto che uno dei due arriva con un laboratorio con un nome, una licenza pubblicata, un'architettura documentata, una tabella di benchmark e un prezzo dichiarato per quando la versione gratuita finisce — e l'altro è uno sconosciuto con un buon punteggio nei test e una finestra di una settimana.
Ciò che è genuinamente identico
Entrambi i modelli funzionano supiano gratuito di OrcaRoutera 0 $, entrambi restituiscono HTTP 429 non appena si supera il limite del proprio piano e nessuno dei due addebiti viene mai applicato al saldo. Entrambi sono commercializzati per la programmazione e i flussi di lavoro agentici. Entrambi espongono il tool calling. Entrambi hanno una finestra di contesto di 262.144 token.
È una sovrapposizione notevole per due modelli che per il resto hanno così poco in comune, ed è per questo che il confronto vale la pena di essere fatto come si deve, piuttosto che sul prezzo.
Fianco a fianco
• Finestra di contesto — 262.144 token su entrambi. Un vero pareggio, ed è il motivo per cui questi due vengono confrontati.
• Output massimo — Union Alpha 131.072 token contro Tencent Hy3 (Free) che ne dichiara fino a 262.144 token.
• Input — testo e immagine su Union Alpha vs solo testo su Tencent Hy3 (Free), che non accetta immagini.
• Controlli di ragionamento — nessuno su Union Alpha vs tre modalità su Tencent Hy3 (Free): no_think, low e high, selezionate tramite reasoning_effort.
• Architettura — non divulgata su Union Alpha rispetto a un ibrido dense-MoE documentato da 295 miliardi di parametri che attiva circa 21 miliardi per token, con 192 esperti instradati più un esperto condiviso, instradamento sigmoide top-8, e un livello di previsione multi-token da 3,8 miliardi per la decodifica speculativa.
• Pesi — nessuno pubblicato su Union Alpha rispetto alle release open source di Hy3.
• Prezzi dopo la fase gratuita — non annunciati su Union Alpha rispetto a una tariffa ufficiale a pagamento di circa ¥1 per milione di token di input e ¥4 per milione di token di output, con input in cache a ¥0,25.
• Tempo al primo token — Union Alpha 10,00 s p50 vs Tencent Hy3 (Free) 3,01 s p50, entrambi sulla stessa finestra di sette giorni sul nostro endpoint. La velocità di output è più vicina di quanto ti aspetteresti: 170 token al secondo contro 155.

Cosa ti offre Tencent Hy3 (Free) che Union Alpha non può darti
La lista è lunga, e riguarda soprattutto la capacità di pianificare.
Hy3 ha una tabella di benchmark pubblicata. SWE-bench Verified si attesta a 74,4, in aumento da 53,0 per Hy2 — un salto relativo di circa il 40%. SWE-bench Pro è 57,9, SWE-bench Multilingual 75,8, BrowseComp 84,2, MCP Atlas 79,1, GPQA Diamond 87,2 secondo quanto riportato dalla stessa Tencent (la nostra pagina del modello indica 89,7), MMLU 87,42 e Humanity's Last Exam 33,5 con 53,2 quando sono consentiti gli strumenti. Questi dati sono in stragrande maggioranza dichiarati dal fornitore e dovrebbero essere etichettati come tali, ma esistono, sono datati e sono collegati a un'azienda che ha una reputazione da perdere.
La nostra pagina aggiunge un livello misurato in modo indipendente: AA Coding 58,8, AA Intelligence 25,8, recall su contesto lungo 79,0, SciCode 48,6, ClawEval 68,5, NL2repo 45,6. C'è anche una valutazione in cieco in cui 270 esperti di dominio hanno assegnato a Hy3 un punteggio di 2,67 su 4 contro il 2,51 di GLM5.1, con le categorie più forti in front-end, dati e storage, e CI/CD.
Ha una licenza, con un'avvertenza che vale la pena conoscere. Le informazioni su quale si applichi sono incoerenti: alcune fonti descrivono la Tencent Hy Community License, che consente l'uso commerciale con clausole relative alla policy di utilizzo e all'attribuzione, mentre altre riportano Apache 2.0 per la versione completa di Hy3. La licenza community dell'anteprima escludeva originariamente UE, Regno Unito e Corea del Sud. Se intendi eseguire il self-hosting, leggi il file di licenza effettivo invece del post del blog — e tieni presente che il self-hosting richiede la corretta configurazione del parser delle chiamate agli strumenti (hy_v3, oppure hunyuan per SGLang), altrimenti le tue chiamate strutturate si comporteranno in modo anomalo in modi che sembrano errori del modello.
E parte velocemente. Il tempo p50 al primo token di Hy3 è di 3,01 secondi, genera in streaming 155 token di output al secondo e il suo tasso di errore nello stesso periodo di sette giorni è dello 0,08% — all'incirca un fallimento ogni milleduecento richieste. Union Alpha, misurato allo stesso modo, impiega dieci secondi o più per emettere un primo token su almeno la metà di tutte le richieste e fallisce il 7,7% di esse. La velocità di decodifica grezza è simile tra i due; la prontezza no, e la prontezza è ciò che decide se un modello può stare davanti a un essere umano.

Cosa ti dà Union Alpha che Hy3 non può darti
Esattamente un vantaggio strutturale, e non è cosa da poco: la visione.
Union Alpha accetta testo e immagini. Hy3 non accetta affatto immagini. Per il lavoro degli agenti guidato da screenshot, l'automazione dell'interfaccia utente, la lettura di grafici o le attività di layout di documenti, quello è un vincolo di capacità imprescindibile, non una preferenza — ed è la ragione più forte per tenere Union Alpha nella rotazione finché dura.
Il suo secondo vantaggio è il tetto di output: 131.072 token sono una risposta singola molto grande. Il terzo è il prezzo, nel senso stretto che gratis è gratis.
Tutto il resto è un vuoto. Union Alpha è apparso su cataloghi di terze parti il 16 settembre 2026 con un operatore indicato solo come "Stealth". Nessun laboratorio, nessun peso, nessuna licenza, nessun numero di parametri, nessuna nota sull'architettura, nessuna data limite delle conoscenze. Nessun controllo di ragionamento, e la scelta degli strumenti supporta di fatto solo "auto". La sua dichiarazione di prestazioni — di livello frontier sui compiti di uso generale — è riferita dall'operatore e non verificata.
L'unica misurazione indipendente è la run ufficiale A di SMF Clearinghouse: 157 test, ragionamento disattivato, 136 corretti (86,6%), zero errori, decimo su ventisei. Ragionamento 30/30, strumenti 2/2, programmazione 26/30, matematica 24/30, scrittura 2/5.

Le clausole in piccolo del gratuito
Gli endpoint gratuiti sono il luogo in cui si trovano le condizioni sui dati più deboli, e anche lì questi due non sono equivalenti.
Su Union Alpha, l'operatore afferma che i prompt e i completamenti possono essere conservati dal fornitore ma non vengono utilizzati per l'addestramento — mentre un canale di distribuzione ha separatamente promesso zero retention. Quelle sono due promesse diverse, e la discrepanza non è risolta. Tratta conservazione e addestramento come questioni separate e presupponi la risposta più conservativa.
Su Tencent Hy3 (Free), hai a che fare con un'azienda che pubblica un'informativa sulla privacy e a cui è legata una reputazione commerciale. Neanche questo è una garanzia, ma è una controparte identificata a cui puoi chiedere conto di qualcosa.
Entrambi condividono le avvertenze operative che accompagnano qualsiasi livello gratuito: capacità condivisa, deprioritizzazione sotto carico e limiti di frequenza che si adattano alla domanda anziché essere pubblicati. Nessuno dei due è un posto sensato per un percorso di produzione senza un fallback alle spalle.
L'unica cosa che lo rende facile
OrcaRouter passa il prezzo di listino del provider con un markup dello 0%, quindi la tariffa ufficiale a pagamento di Hy3 — circa ¥1 per milione di token in input e ¥4 per milione di token in output — è la tariffa sulla quale passi quando il livello gratuito non è sufficiente, senza alcun livello di riprezzamento nel mezzo. E poiché entrambi i modelli stanno dietro un'unica chiave, "quale di questi due dovrei usare" smette di essere una decisione di approvvigionamento. Non c'è un secondo contratto, nessun SDK separato e nessuna modifica al codice: sposti un nome di modello.
Questo conta soprattutto proprio per il caso di cui tratta questo articolo. La mossa razionale non è sceglierne uno. È usare Hy3 come predefinito perché è veloce, documentato e permanente, e instradare le richieste con immagini verso Union Alpha finché la sua anteprima è aperta — poi lasciare che la regola di instradamento assorba il giorno in cui l'anteprima si chiude.
Verdetto
Tencent Hy3 (Free) è il modello su cui è meglio fare affidamento, e non di poco. Architettura documentata, benchmark pubblicati, pesi aperti, tre modalità di ragionamento, un tempo al primo token di tre secondi contro dieci, una licenza che puoi leggere e un prezzo noto dopo la versione gratuita. La sua unica vera debolezza — nessun input di immagini — è una lacuna reale, ma è una lacuna nelle capacità, non nell'affidabilità.
Union Alpha è il modello migliore con cui sperimentare, e l'input visivo lo rende l'unica opzione tra i due per un'intera classe di attività su screenshot e documenti. Ma un operatore anonimo, un singolo test indipendente, un quinto della velocità e una data di fine non annunciata non sono una base. Sono un'opportunità con una scadenza.
Cogli l'opportunità. Mantieni le fondamenta.
La metà nominata della coppia è documentata: la pagina del modello Tencent Hy3 (Free)riporta l'architettura MoE 295B/21B, la finestra da 262K, le tre modalità di ragionamento e la tariffa a pagamento su cui passi dopo la versione gratuita.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
