Blog
Análises técnicas aprofundadas, novidades de produto e notas de infraestrutura de IA da equipe OrcaRouter.
Guides & InsightsDestaquePrévia do Step 5: O flagship de 600B não anunciado da StepFun já está no leaderboard
O Step 5 Preview apresenta um AA Intelligence Index de 44 e um preço de $1.00/$2.70, sem lançamento da StepFun. O que o vazamento confirma, e o que não.
Guides & InsightsKimi K3.1: As assinaturas estão de volta, e um sucessor estaria em pós-treinamento, segundo relatos
As assinaturas do Kimi foram reabertas em 18 de setembro de 2026, e um vazador afirma que o próximo modelo está em pós-treinamento para um lançamento em outubro. O que está verificado.
Guides & InsightsGrok Voice Transcribe 2.0 vs NVIDIA Parakeet TDT 0.6B: Duas tabelas de classificação, uma comparação enganosa
O Grok Voice Transcribe 2.0 obtém 2,7% de WER; o NVIDIA Parakeet TDT 0.6B é citado com 13,7%. Esse número está ultrapassado - aqui está a diferença real.
Guides & InsightsGrok Voice Transcribe 2.0 vs VibeVoice ASR Streaming 7B: O número que a Microsoft não publicou
O VibeVoice ASR Streaming 7B tem pesos MIT e nenhum WER publicado. O Grok Voice Transcribe 2.0 responde em 0,49s. Qual lacuna realmente decide a questão?
Engineering & ResearchResumo Diário de IA, 19 de setembro: Grok Voice Transcribe 2.0 entra no ar e Meta abre o Muse para desenvolvedores
O Grok Voice Transcribe 2.0 está no ar por US$ 0,10 por hora, a Meta abre os conectores do Muse para desenvolvedores, e o ganho de precisão recaiu sobre a transcrição parcial.
Guides & InsightsGrok Voice Transcribe 2.0 vs Muse Voice Transcribe: Um Reinado de 17 Dias e um Quarto de Segundo
Muse Voice Transcribe manteve a coroa do streaming por 17 dias. O Grok Voice Transcribe 2.0 tomou o posto, mas o modelo da Meta ainda é três vezes mais rápido.
Guides & InsightsGrok Voice Transcribe 2.0 vs Granite Speech 5.0 470M TurboCTC: 12.600× de Tempo Real Encontra Meio Segundo
O Granite Speech 5.0 TurboCTC processa 3,5 horas por segundo; o Grok Voice Transcribe 2.0 responde em 0,49 s. Por que esses dois números não são comparáveis.
Guides & InsightsQwen3.8-LiveTranslate vs Qwen 3.8: Uma colisão de nomenclatura, não uma luta justa
Qwen3.8-LiveTranslate e Qwen 3.8 compartilham apenas um prefixo e nada mais: um é um intérprete em tempo real, o outro é um modelo carro-chefe MoE de 2,4T. Qual escolher, e por quê?
Guides & InsightsQwen3.8-LiveTranslate vs. Gemini 3.5 Live Translate: Um entrega um número, o outro entrega um mapa
A Qwen publica um valor de latência de 2,3 s; o Google publica mais de 70 idiomas e nenhum número de latência. O que a assimetria significa para uma decisão real de implantação.
Engineering & ResearchConheça o Qwen3.8-LiveTranslate: O meio segundo que coloca a interpretação por IA no ritmo humano
Qwen3.8-LiveTranslate reduz o atraso médio de 2,8s para 2,3s, dentro da faixa de um intérprete humano. Arquitetura, preços, limites de taxa e o que ele não consegue fazer.
