Blog
Phân tích kỹ thuật chuyên sâu, cập nhật sản phẩm và ghi chú hạ tầng AI từ đội ngũ OrcaRouter.
Guides & InsightsNổi bậtGrok Voice Transcribe 2.0 vs NVIDIA Parakeet TDT 0.6B: Hai bảng xếp hạng, một so sánh gây nhầm lẫn
Grok Voice Transcribe 2.0 đạt 2,7% WER; NVIDIA Parakeet TDT 0.6B được ghi nhận ở mức {{1}}13,7%{{/1}}. Con số đó đã lỗi thời — đây mới là khoảng cách thực sự.
Guides & InsightsGrok Voice Transcribe 2.0 vs VibeVoice ASR Streaming 7B: Con số mà Microsoft không công bố
VibeVoice ASR Streaming 7B có trọng số MIT và không có WER được công bố. Grok Voice Transcribe 2.0 trả lời trong 0.49 giây. Khoảng cách nào thực sự quyết định điều đó.
Engineering & ResearchBản tin AI hằng ngày, ngày 19 tháng 9: Grok Voice Transcribe 2.0 chính thức ra mắt và Meta mở Muse cho các nhà phát triển
Grok Voice Transcribe 2.0 đã ra mắt với mức giá 0,10 USD một giờ, Meta mở connector Muse cho các nhà phát triển, và mức tăng độ chính xác tập trung vào bản chép lời từng phần.
Guides & InsightsGrok Voice Transcribe 2.0 so với Muse Voice Transcribe: Một triều đại 17 ngày và một phần tư giây
Muse Voice Transcribe giữ ngôi vương streaming trong 17 ngày. Grok Voice Transcribe 2.0 đã chiếm lấy nó, nhưng mô hình của Meta vẫn nhanh gấp ba lần.
Guides & InsightsGrok Voice Transcribe 2.0 so với Granite Speech 5.0 470M TurboCTC: 12.600× thời gian thực đạt mốc nửa giây
Granite Speech 5.0 TurboCTC xử lý 3,5 giờ mỗi giây; Grok Voice Transcribe 2.0 trả lời trong 0,49 giây. Vì sao hai con số đó không thể so sánh với nhau.
Guides & InsightsQwen3.8-LiveTranslate so với Qwen 3.8: Một cuộc va chạm tên gọi, không phải một cuộc so tài công bằng
Qwen3.8-LiveTranslate và Qwen 3.8 chỉ chung nhau mỗi tiền tố, ngoài ra chẳng có gì khác: một bên là phiên dịch viên thời gian thực, bên kia là mẫu flagship MoE 2,4T. Nên chọn cái nào, và vì sao?
Guides & InsightsQwen3.8-LiveTranslate so với Gemini 3.5 Live Translate: Một bên phát hành một con số, bên kia phát hành một bản đồ
Qwen công bố chỉ số độ trễ 2,3 giây; Google công bố hơn 70 ngôn ngữ và không có số liệu độ trễ. Sự bất đối xứng này có ý nghĩa gì đối với một quyết định triển khai thực tế.
Engineering & ResearchGặp gỡ Qwen3.8-LiveTranslate: Nửa giây đưa phiên dịch AI lên nhịp độ con người
Qwen3.8-LiveTranslate cắt giảm độ trễ trung bình từ 2,8 giây xuống 2,3 giây, nằm trong khoảng của phiên dịch viên con người. Kiến trúc, định giá, giới hạn tốc độ và những gì nó không thể làm.
Guides & InsightsOrcaCyber Zero 1.0 và khoản dự trữ 150.000 USD: OrcaRouter gia nhập Quỹ Omacom với tư cách Nhà Bảo trợ Doanh nghiệp Danh dự
OrcaRouter hiện là Nhà bảo trợ Doanh nghiệp Xuất sắc của Quỹ Omacom. 150.000 USD bằng token dành cho công tác bảo mật, bắt đầu với OrcaCyber Zero 1.0.
Guides & InsightsGLM-5.3-FlashX vs DeepSeek V4.1 Flash: Hạng tốc độ còn chậm hơn cả mô hình giá rẻ
GLM-5.3-FlashX quảng cáo 200 tok/s với giá đầu ra $1.25; DeepSeek V4.1 Flash đo được 214.7 tok/s với giá $0.60. Giá, đầu vào được cache và lưu ý về mức nỗ lực.
