google/gemini-3.1-flash-tts-preview

google/gemini-3.1-flash-tts-preview
صوت
بواسطة google

نموذج Google لتحويل النص إلى كلام السريع والفعال من حيث التكلفة لتوليد الصوت في الوقت الفعلي، والذي يتم الوصول إليه عبر OrcaRouter.

نقاط النهاية:/v1/audio/speech
الإدخالtext
p50 TTFT9.07 s
الإدخال$1.00/ مليون رمز
الإخراج$20.00/ مليون رمز
p50 TTFT9.07 s7 أيام
p95 TTFT10.00 s7 أيام
حركة المرور78.0Kرموز / 7 أيام

google/gemini-3.1-flash-tts-preview هو نموذج لتحويل النص إلى كلام من Google، وهو جزء من عائلة Gemini Flash. يقبل إدخالًا نصيًا ويولّد مخرجات صوتية منطوقة. تم تحسين النموذج من حيث السرعة والتكلفة، مما…

ما هو google/gemini-3.1-flash-tts-preview؟

لمن صُمم هذا النموذج؟

ما هي المواصفات الأساسية للمدخلات والمخرجات؟

كيف يوفر OrcaRouter الوصول إلى هذا النموذج؟

عينات الكود

استدعِ من أي SDK

متوافق مع OpenAI — أبقِ على SDK الحالي

  • OpenAI SDKhttps://api.orcarouter.ai/v1

المعلمات المدعومة

  • voice

الأسعار

الإدخال / 1M توكن$1.00
الإخراج / 1M توكن$20.00
العملةUSD

حاسبة التكلفة

الرموز / الشهر10MM
نسبة الإدخال70%%
تقديري / الشهر $67.00

تقدير بناءً على السعر المُعلن

مقدّر الرموز والتكلفة

رموز الإدخال: 13التكلفة لكل طلب: $0.0100

تقدير فقط — يعتمد العدد الفعلي للرموز على مُجزّئ الرموز الخاص بالمزوّد.

الأداء

p50 TTFT
9.07 s
سرعة الإخراج
1794 tok/s
p95 TTFT
10.00 s
معدل الخطأ
0%

المعايير العامة

المصدر: Design Arena

المقارنة

google/gemini-3.1-flash-tts-previewGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
الإدخال $/مليون$1.00$2.00$4.00$0.50
الإخراج $/مليون$20.00$12.00$18.00$3.00
السياق1.0M1.0M1.0M
الجودة2/1010/1010/109/10
مقارنة جنبًا إلى جنبمقارنة جنبًا إلى جنبمقارنة جنبًا إلى جنبمقارنة جنبًا إلى جنب

المزيد من google

الأسئلة الشائعة

كم تكلفة استخدام google/gemini-3.1-flash-tts-preview على OrcaRouter؟
التسعيرة هي $1.00 لكل مليون رمز إدخال و$20.00 لكل مليون رمز إخراج، تُحسب وفقًا لسعر مزود Google دون أي زيادة من OrcaRouter. لا توجد رسوم إضافية على المنصة. يتم تحصيل مقابل كل من رموز الإدخال والإخراج المستهلكة.
ما هي نافذة السياق (أقصى طول للإدخال) لهذا النموذج؟
الحد الأقصى لطول الإدخال (نافذة السياق) لنموذج google/gemini-3.1-flash-tts-preview غير محدد في البيانات المتاحة. وباعتبار هذا النموذج نموذجًا تجريبيًا، فقد تفرض Google حدودًا معينة. يُنصح باختبار النموذج بأطوال النصوص المتوقعة لديك، أو مراجعة وثائق Google الرسمية الخاصة بالنموذج التجريبي.
ما هي نقاط القوة الرئيسية لنموذج تحويل النص إلى كلام (TTS) هذا؟
تشمل نقاط القوة انخفاض تكلفة الرموز المدخلة جدًا (1 دولار/مليون رمز)، وسرعة التوليد بفضل بنية Flash، وتحويل بسيط من النص إلى الكلام. صُمم هذا النظام للتطبيقات في الوقت الفعلي والمعالجة المجمعة للمقاطع الصوتية القصيرة. توفر OrcaRouter تسعيرًا بدون هوامش ربح وواجهة API متوافقة مع OpenAI.
كيف يقارن هذا النموذج بنماذج TTS الأخرى مثل tts-1 من OpenAI؟
نماذج TTS الخاصة بـ OpenAI تتقاضى رسومًا لكل حرف (~$0.015/1k characters) ولها أصوات معروفة. يستخدم Flash TTS من Google تسعيرًا قائمًا على الرموز المميزة (tokens)؛ رموز الإدخال رخيصة ولكن رموز الإخراج باهظة الثمن. من المتوقع أن يكون زمن الاستجابة مشابهًا. تختلف خيارات الجودة والصوت؛ يجب عليك اختبار كليهما مع المحتوى الخاص بك لمقارنة الطبيعية.
ما هي سياسات معالجة البيانات التي تنطبق عند استخدام هذا النموذج عبر OrcaRouter؟
تتبع معالجة البيانات سياسات Google لنماذج Gemini وسياسة الخصوصية الخاصة بـ OrcaRouter. لا يقوم OrcaRouter بتسجيل أو تخزين مطالباتك أو مخرجاتك بما يتجاوز ما هو ضروري لتوجيه API. قد تقوم Google بمعالجة البيانات وفقًا لشروطها الخاصة. راجع شروط OrcaRouter والشروط الخاصة بنماذج Google من أجل الامتثال.
كيف يمكنني استدعاء هذا النموذج باستخدام OpenAI Python SDK؟
قم بتعيين قاعدة API الخاصة بك إلى https://api.orcarouter.ai/v1، واستخدم مفتاح OrcaRouter API الخاص بك، واضبط model="google/gemini-3.1-flash-tts-preview". مثال: client = OpenAI(base_url="https://api.orcarouter.ai/v1", api_key="sk-..."). ثم أرسل طلب إكمال محادثة. سيكون الإخراج الصوتي في الاستجابة؛ قد تحتاج إلى فك تشفير base64 أو استخدام البث.
هل يدعم هذا النموذج إخراج الصوت المتدفق؟
دعم التدفق غير مؤكد في الحقائق المقدمة. العديد من نماذج TTS تدعم التدفق عن طريق إرسال أجزاء الصوت أثناء إنشائها. يمكنك اختبار ذلك عن طريق تعيين stream=true في طلب API الخاص بك. إذا كان مدعومًا، فستتلقى بيانات استجابة تدريجية. وإلا، فسيتم إرجاع كتلة الصوت الكاملة في النهاية.
ما هي وسائط الإدخال التي يقبلها هذا النموذج؟
يقبل هذا النموذج إدخال النص فقط. يقوم بتحويل النص إلى مخرجات صوتية. لا يوجد دعم للأنماط الأخرى مثل إدخال الصور أو الفيديو. تأكد من أن مطالباتك هي نص عادي.
هل هناك أي تخزين مؤقت للسياق متاح لهذا النموذج على OrcaRouter؟
الحقائق المتاحة لا تذكر ميزات التخزين المؤقت لهذا النموذج. قد يوفر OrcaRouter التخزين المؤقت لبعض النماذج، لكنه غير محدد. لتقليل التكاليف للطلبات المتكررة، فكر في تخزين الصوت المولّد مؤقتًا في طبقة التطبيق الخاصة بك.
كيف يمكنني الانتقال من استخدام API الخاص بجوجل الأصلي إلى API الخاص بـ OrcaRouter لهذا النموذج؟
غيّر رابط القاعدة الخاص بك إلى https://api.orcarouter.ai/v1، واستخدم مفتاح واجهة برمجة تطبيقات OrcaRouter، واضبط النموذج على "google/gemini-3.1-flash-tts-preview". قم بتعديل هيكل المصادقة والنقطة النهائية. واجهة برمجة تطبيقات OrcaRouter متوافقة مع OpenAI لذا يمكنك استخدام حزم SDK القياسية. لا حاجة لتغييرات في الكود تتجاوز تحديثات هذه المعاملات.

تضمين هذه الشارة

google/gemini-3.1-flash-tts-preview$1.00/M in9074ms p50عبر OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.1-flash-tts-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.1-flash-tts-preview.svg" alt="google/gemini-3.1-flash-tts-preview على OrcaRouter" /> </a>
Markdown [![google/gemini-3.1-flash-tts-preview](https://www.orcarouter.ai/embed/google/gemini-3.1-flash-tts-preview.svg)](https://www.orcarouter.ai/models/google/gemini-3.1-flash-tts-preview)

بطاقة النموذج كبيانات

GET /api/public/models/google/gemini-3.1-flash-tts-previewفتح
قابل للقراءة آليًا:/llms.txt/llms-full.txt