博客
OrcaRouter 团队的工程深度文章、产品更新与 AI 基础设施笔记。
Guides & Insights精选Grok Voice Transcribe 2.0 vs NVIDIA Parakeet TDT 0.6B:两个排行榜,一次误导性的比较
Grok Voice Transcribe 2.0 的 WER 为 2.7%;NVIDIA Parakeet TDT 0.6B 据称是 13.7%。那个数字已经作废——以下是真正的差距。
Guides & InsightsGrok Voice Transcribe 2.0 对比 VibeVoice ASR Streaming 7B:微软未公布的那个数字
VibeVoice ASR Streaming 7B 采用 MIT 许可权重,且未公布 WER。Grok Voice Transcribe 2.0 在 0.49 秒内给出回答。真正起决定作用的究竟是哪一项差距?
Engineering & Research每日 AI 简报,9月19日:Grok Voice Transcribe 2.0 正式上线,Meta 向开发者开放 Muse
Grok Voice Transcribe 2.0 已上线,每小时收费 0.10 美元;Meta 向开发者开放 Muse 连接器;准确率提升体现在部分转写结果上。
Guides & InsightsGrok Voice Transcribe 2.0 对比 Muse Voice Transcribe:17 天的统治与四分之一秒
Muse Voice Transcribe 占据流式转录王座 17 天。Grok Voice Transcribe 2.0 夺走了它,但 Meta 的模型仍然快三倍。
Guides & InsightsGrok Voice Transcribe 2.0 对比 Granite Speech 5.0 470M TurboCTC:12,600 倍实时遇上半秒
Granite Speech 5.0 TurboCTC 每秒可处理 3.5 小时;Grok Voice Transcribe 2.0 在 0.49 秒内给出结果。为什么这两个数字并不具有可比性。
Guides & InsightsQwen3.8-LiveTranslate 与 Qwen 3.8:命名撞车,而非公平较量
Qwen3.8-LiveTranslate 和 Qwen 3.8 只共享一个前缀,除此之外毫无共同之处:一个是实时口译器,另一个是 2.4T MoE 旗舰模型。该选哪个,又为什么?
Guides & InsightsQwen3.8-LiveTranslate 对比 Gemini 3.5 Live Translate:一个交付的是数字,另一个交付的是地图
通义千问公布了2.3秒的延迟数据;谷歌公布了70多种语言支持,却没有给出任何延迟数字。这种不对称对实际部署决策意味着什么。
Engineering & Research认识 Qwen3.8-LiveTranslate:让 AI 口译跟上人类节奏的半秒
Qwen3.8-LiveTranslate 将平均延迟从 2.8 秒降至 2.3 秒,进入人类同传译员的区间。架构、定价、速率限制以及它做不到的事。
Guides & InsightsOrcaCyber Zero 1.0 与 150,000 美元储备金:OrcaRouter 以杰出企业赞助人身份加入 Omacom Foundation
OrcaRouter 现已成为 Omacom 基金会的杰出企业赞助人。提供价值 150,000 美元的代币用于安全工作,首先从 OrcaCyber Zero 1.0 开始。
Guides & InsightsGLM-5.3-FlashX 对比 DeepSeek V4.1 Flash:比廉价模型还慢的速度档位
GLM-5.3-FlashX 宣传可达 200 tok/s,输出价格为 $1.25;DeepSeek V4.1 Flash 实测为 214.7 tok/s,价格为 $0.60。价格、缓存输入以及有关 effort 的注意事项。
