ブログ
OrcaRouterチームによるエンジニアリング解説、製品アップデート、AIインフラのノート。
Guides & Insights注目の記事Grok Voice Transcribe 2.0 対 NVIDIA Parakeet TDT 0.6B:2つのリーダーボード、1つの誤解を招く比較
Grok Voice Transcribe 2.0 は WER 2.7% を記録している。NVIDIA Parakeet TDT 0.6B は 13.7% と引用されている。その数字はもう過去のものだ——本当の差はここにある。
Guides & InsightsGrok Voice Transcribe 2.0 vs VibeVoice ASR Streaming 7B:Microsoftが公表しなかった数字
VibeVoice ASR Streaming 7B は MIT ライセンスの重みを持ち、公表された WER はない。Grok Voice Transcribe 2.0 は 0.49 秒で応答する。実際に決め手となるのはどちらの差か。
Engineering & Research日刊AIブリーフ、9月19日:Grok Voice Transcribe 2.0が提供開始、MetaがMuseを開発者向けに公開
Grok Voice Transcribe 2.0が1時間0.10ドルで提供開始、MetaがMuseコネクタを開発者向けに公開、そして精度の向上は部分的な文字起こしに適用された。
Guides & InsightsGrok Voice Transcribe 2.0 対 Muse Voice Transcribe:17日間の君臨と4分の1秒
Muse Voice Transcribeは17日間、ストリーミングの王座を守った。Grok Voice Transcribe 2.0がその座を奪ったが、Metaのモデルは依然として3倍高速だ。
Guides & InsightsGrok Voice Transcribe 2.0 vs Granite Speech 5.0 470M TurboCTC:12,600倍のリアルタイムが0.5秒と出会う
Granite Speech 5.0 TurboCTCは1秒で3.5時間を処理し、Grok Voice Transcribe 2.0は0.49秒で応答する。なぜこの2つの数字は比較できないのか。
Guides & InsightsQwen3.8-LiveTranslate 対 Qwen 3.8:命名の衝突であり、公平な勝負ではない
Qwen3.8-LiveTranslate と Qwen 3.8 に共通するのは名前の接頭辞だけで、それ以外に共通点はありません。一方はリアルタイム通訳、もう一方は 2.4T の MoE フラッグシップです。どちらを選ぶべきか、そしてその理由を解説します。
Guides & InsightsQwen3.8-LiveTranslate 対 Gemini 3.5 Live Translate:一方は数値を出荷し、もう一方は地図を出荷する
Qwenは2.3秒という遅延値を公表している。一方、Googleは70以上の言語を公表しているが、レイテンシの数値は公表していない。この非対称性が、実際の導入判断にとって何を意味するのか。
Engineering & ResearchQwen3.8-LiveTranslate 登場:AI 通訳を人間のペースに乗せる 0.5 秒
Qwen3.8-LiveTranslateは平均遅延を2.8秒から2.3秒に短縮し、人間の同時通訳者が示す範囲内に収まる。アーキテクチャ、料金、レート制限、そしてできないこと。
Guides & InsightsOrcaCyber Zero 1.0と15万ドルの準備金:OrcaRouterがOmacom Foundationの名誉企業パトロンに参画
OrcaRouterはこのたび、Omacom Foundationの名誉ある企業パトロンになりました。OrcaCyber Zero 1.0を皮切りに、セキュリティ業務向けに15万ドル相当のトークンを提供します。
Guides & InsightsGLM-5.3-FlashX 対 DeepSeek V4.1 Flash:安価なモデルより遅いスピードティア
GLM-5.3-FlashXは出力$1.25で200 tok/sを謳っている。DeepSeek V4.1 Flashは$0.60で214.7 tok/sを計測。価格、キャッシュ入力、そしてエフォートに関する但し書き。
