Model text-to-speech definisi tinggi OpenAI, diakses melalui API OrcaRouter seharga $30 per 1M token (tanpa markup).
openai/tts-1-hd adalah model text-to-speech dari OpenAI yang mengubah teks menjadi ucapan alami definisi tinggi. Ini adalah versi yang ditingkatkan dari model TTS-1 standar, menawarkan kualitas audio…
OpenAI's TTS-1-HD mendukung beberapa suara bawaan, termasuk alloy, echo, fable, onyx, nova, dan shimmer. Setiap suara memiliki nada yang berbeda, mulai dari dalam dan bergema hingga cerah dan energik. Model ini juga menangani berbagai bahasa, seperti Inggris, Spanyol, Prancis, Jerman, Italia, Portugis, dan lainnya, dengan aksen dan ritme alami. Anda dapat menentukan suara dan bahasa dalam permintaan API. Model definisi tinggi meningkatkan akurasi aksen dan rentang emosi dibandingkan dengan versi standar. Untuk daftar lengkap bahasa yang didukung, lihat dokumentasi resmi OpenAI.
openai/tts-1-hd dioptimalkan untuk latensi yang lebih rendah daripada TTS-1 standar, sehingga cocok untuk aplikasi real-time seperti asisten suara dan tayangan teks langsung (live captioning). Namun, latensi yang tepat tergantung pada faktor-faktor seperti panjang teks, kecepatan jaringan, dan beban server. Model ini mendukung respons streaming melalui API, yang memungkinkan Anda memulai pemutaran sebelum seluruh audio dihasilkan. Ini mengurangi keterlambatan yang dirasakan. Untuk respons yang hampir seketika, pertimbangkan untuk menggunakan model TTS-1 standar, yang mengutamakan kecepatan daripada kualitas. Infrastruktur stabil OrcaRouter memastikan latensi tambahan yang minimal.
Jika aplikasi Anda tidak memerlukan kualitas audio premium, pertimbangkan untuk menggunakan model TTS-1 standar dari OpenAI atau penyedia TTS ramah anggaran lainnya. Misalnya, saat menghasilkan ucapan untuk pengujian internal, pemberitahuan suara dengan fidelitas rendah, atau skenario dengan batasan karakter, model yang lebih murah mengurangi biaya. Selain itu, jika Anda bereksperimen dengan banyak variasi atau memerlukan latensi yang sangat rendah, TTS-1 mungkin lebih cocok. openai/tts-1-hd berlebihan untuk notifikasi sederhana. Evaluasi ambang kualitas dan toleransi biaya Anda: model HD memiliki biaya per token yang sama dengan versi standar di OrcaRouter, tetapi outputnya dapat menghasilkan jumlah token yang lebih tinggi untuk audio yang lebih panjang.
OpenAI's TTS-1-HD memberikan suara dengan fidelitas lebih tinggi, kejelasan yang lebih baik, prosodi yang lebih alami, serta mengurangi bunyi klik atau artefak dengung. Model ini lebih baik dalam menangkap nada emosional dan menangani tanda baca serta jeda dengan lebih akurat. Meskipun tidak ada skor tolok ukur yang tepat, laporan pengguna dan pengembang menunjukkan kualitas subjektif yang terasa lebih baik. Model ini sangat efektif untuk konten bentuk panjang seperti buku audio, di mana konsistensi kualitas suara sangat penting. Untuk frasa pendek sederhana, perbedaannya mungkin tidak terlalu terlihat. Konsekuensinya adalah biaya komputasi yang sedikit lebih tinggi, namun harga per token tetap sama.
Meskipun memiliki kualitas yang baik, openai/tts-1-hd memiliki keterbatasan. Model ini masih dapat menghasilkan pengucapan yang keliru sesekali, terutama untuk nama yang tidak umum, kata asing, atau istilah teknis. Model ini tidak dapat menghasilkan nyanyian, efek suara, atau audio non-ucapan. Model ini juga memiliki batasan panjang teks input (jendela konteks) per permintaan, meskipun batas pastinya tidak dirinci secara publik; input yang sangat panjang mungkin perlu dipecah dan digabungkan. Model ini tidak mendukung kloning suara kustom melalui API standar. Selain itu, model ini tidak dirancang untuk mengontrol kecepatan bicara atau nada dengan granularitas halus. Untuk fitur-fitur lanjutan tersebut, pertimbangkan platform sintesis ucapan khusus.
Kecepatan tergantung pada panjang teks dan format audio yang diminta. openai/tts-1-hd dioptimalkan untuk latensi yang lebih rendah dibandingkan pendahulunya, tetapi bukanlah opsi tercepat yang tersedia. Untuk kalimat biasa, waktu respons di bawah satu detik dalam kondisi normal. Kemampuan streaming memungkinkan hasil parsial. API OrcaRouter sendiri menimbulkan overhead yang dapat diabaikan karena meneruskan permintaan langsung ke OpenAI. Untuk aplikasi real-time di mana setiap milidetik sangat penting, model TTS-1 standar (atau versi non-HD) mungkin memberikan byte audio pertama yang lebih cepat. Pertimbangkan untuk melakukan benchmarking dengan payload tipikal Anda untuk menentukan kinerja yang dapat diterima.
openai/tts-1-hd dibanderol dengan harga $30,00 per 1 juta token input dan $30,00 per 1 juta token output. Token input sesuai dengan teks yang Anda kirimkan, sedangkan token output mewakili audio yang dihasilkan. Ini adalah tarif penyedia; OrcaRouter tidak menambahkan markup apa pun. Anda ditagih hanya berdasarkan penggunaan aktual. Token dihitung pada input dan output, tetapi karena output audio secara inheren lebih panjang durasinya, biaya token output mungkin mendominasi. Sebagai contoh, teks sepanjang 1.000 karakter mungkin memakan biaya sekitar $0,0012 untuk token input, sedangkan output (misalnya audio 30 detik) bisa lebih mahal.
Di OrcaRouter, TTS-1 dan TTS-1-HD memiliki harga per token yang sama, sehingga perbedaan biaya bukan terletak pada harga satuan, melainkan pada penggunaan token. Karena TTS-1-HD dapat menghasilkan audio dengan kualitas lebih tinggi menggunakan pengaturan kompresi yang berbeda, jumlah token keluarannya bisa mirip dengan TTS-1 untuk teks yang sama. Namun, jika Anda memerlukan lebih sedikit percobaan ulang karena kualitas yang lebih baik, model HD mungkin lebih hemat biaya secara keseluruhan. Penyedia TTS lain mungkin menawarkan tarif per karakter yang lebih rendah tetapi dengan kualitas yang lebih rendah. Pertimbangkan pentingnya fidelitas audio terhadap anggaran. Untuk aplikasi bervolume tinggi, perbedaan persentase kecil pun menjadi signifikan.
OrcaRouter tidak menyediakan caching untuk respons TTS karena setiap permintaan dapat memiliki suara, bahasa, atau teks yang berbeda. Namun, ia meneruskan harga penyedia tanpa biaya tambahan. Tidak ada diskon bertingkat atau harga volume melalui OrcaRouter untuk model ini; biaya meningkat secara linear seiring penggunaan. Jika Anda memperkirakan penggunaan yang sangat tinggi, Anda dapat mempertimbangkan untuk menghubungi OpenAI secara langsung untuk harga perusahaan, tetapi melalui OrcaRouter Anda mendapatkan manfaat dari tagihan bayar sesuai pemakaian yang sederhana. Tidak ada komitmen minimum atau biaya tersembunyi yang berlaku.
Anda dapat menggunakan klien yang kompatibel dengan OpenAI (misalnya, pustaka openai Python) dengan mengatur base URL ke `https://api.orcarouter.ai/v1`. Sertakan ID model `"openai/tts-1-hd"` dalam permintaan Anda. Sebagai contoh, menggunakan Python: `client = OpenAI(base_url='https://api.orcarouter.ai/v1', api_key='your_orcarouter_key')`. Kemudian panggil `client.audio.speech.create(model='openai/tts-1-hd', voice='alloy', input='Hello world', response_format='mp3')`. OrcaRouter meneruskan permintaan ke OpenAI dan mengembalikan file audio. Pastikan kunci API Anda berasal dari OrcaRouter, bukan langsung dari OpenAI.
API ini mendukung beberapa parameter: model (wajib: openai/tts-1-hd), input (teks yang akan diucapkan), voice (salah satu dari: alloy, echo, fable, onyx, nova, shimmer), response_format (mp3, opus, aac, flac), speed (angka floating dari 0.25 hingga 4.0, default 1.0), dan opsional boolean streaming. Anda juga dapat mengatur bahasa untuk meningkatkan pengucapan untuk bahasa tertentu. OrcaRouter meneruskan ini tanpa perubahan. Parameter seperti temperature atau top_p tidak berlaku untuk model TTS. Lihat dokumentasi API audio OpenAI untuk detail lengkap.
Iya. Migrasi hanya memerlukan dua perubahan: ganti URL dasar dari 'https://api.openai.com/v1' menjadi 'https://api.orcarouter.ai/v1', dan gunakan kunci API OrcaRouter sebagai pengganti kunci OpenAI. Struktur permintaan dan respons identik. Tidak perlu memodifikasi logika kode atau nama parameter Anda. OrcaRouter juga mendukung konvensi streaming dan penanganan kesalahan yang sama. Ini membuat peralihan menjadi mudah bagi pengembang yang ingin mengelola beberapa model melalui satu pintu gerbang.
Perbedaan utamanya adalah kualitas audio. TTS-1-HD dirancang untuk fidelitas yang lebih tinggi dengan kejelasan yang lebih baik dan intonasi yang lebih alami, sedangkan TTS-1 dioptimalkan untuk latensi yang lebih rendah dan generasi yang lebih cepat. Keduanya memiliki harga yang sama per token di OrcaRouter. Model HD mengonsumsi sedikit lebih banyak sumber daya komputasi di backend OpenAI, tetapi jumlah token untuk teks input tertentu tetap identik. Untuk frasa pendek dan sederhana, perbedaan kualitas mungkin dapat diabaikan; untuk konten panjang atau emosional, versi HD terasa lebih baik. Pilih berdasarkan kebutuhan kualitas dan kecepatan Anda.
ElevenLabs menawarkan ucapan yang sangat ekspresif dengan kemampuan kloning suara tetapi dengan biaya per karakter yang lebih tinggi. Google Cloud TTS menyediakan berbagai macam suara dan dukungan SSML tetapi mungkin tidak sealami model HD OpenAI. openai/tts-1-hd menyeimbangkan kualitas dan biaya, dengan model harga berbasis token yang mudah. Ia tidak mendukung kloning suara kustom melalui API standar, yang merupakan keunggulan ElevenLabs. Model Google menawarkan lebih banyak cakupan bahasa dan kontrol yang lebih terperinci. Melalui OrcaRouter, Anda dapat membandingkan biaya secara langsung dengan menjalankan tes menggunakan panjang teks khas Anda.
Gunakan openai/tts-1-hd ketika keberhasilan aplikasi Anda bergantung pada kualitas audio—misalnya, jika Anda membuat konten profesional, asisten suara yang berhadapan langsung dengan pengguna di mana kesan pertama penting, atau alat aksesibilitas yang memerlukan ucapan yang jelas. Hindari jika pengguna Anda tidak dapat membedakan perbedaan kualitas, seperti pada sistem notifikasi internal atau ketika output akan dikompresi berat. Juga pertimbangkan bahwa di OrcaRouter harga per token sama untuk TTS-1 dan TTS-1-HD, sehingga model HD tidak membebani Anda dalam biaya per unit; Anda hanya membayar lebih jika audio yang lebih panjang dihasilkan karena pengaturan kualitas yang lebih tinggi.
Kompatibel OpenAI — pakai SDK Anda yang sekarang
https://api.orcarouter.ai/v1response_formatspeedvoice| Input / 1M token | $30.00 |
| Output / 1M token | $30.00 |
| Mata uang | USD |
Perkiraan berdasarkan harga daftar
Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.
GET /api/public/models/openai/tts-1-hdBuka @misc{orcarouter_tts_1_hd,
title = {openai/tts-1-hd API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/tts-1-hd}
}openai. (n.d.). openai/tts-1-hd API. OrcaRouter. https://www.orcarouter.ai/models/openai/tts-1-hd