GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
ツールJSON
提供 OpenAI · 2023-08-28

このモデルはgpt-3.5-turboの4倍のコンテキスト長を提供し、より高いコストで、1回のリクエストで約20ページのテキストをサポートすることができます。トレーニングデータ:最大...

エンドポイント:/v1/chat/completions
コンテキスト16.4K トークン
最大出力4.1K
入力text
出力text
p50 TTFT2.00 s
入力$3.00/ 100万 tokens
出力$4.00/ 100万 tokens
p50 TTFT2.00 s7日
p95 TTFT3.63 s7日
トラフィック16.8Ktokens / 7日

GPT-3.5 Turbo 16kは、OpenAIのGPT-3.5 Turboモデルの拡張コンテキストバージョンであり、分割せずに大量のテキストを処理する必要があるタスクをサポートするために当初リリースされました。そのコンテキストウィンドウ容量は16,385トークン(約12,000語)で、1回の推論呼び出しで記事全体、トランスクリプト、コードリポジトリを処理しながら、最大4,096トークンを出力で…

GPT-3.5 Turbo 16kとは何ですか?

このモデルは誰向けですか?

主要な仕様は何ですか?

OrcaRouterはどのようにアクセスを提供しますか?

コードサンプル

あらゆる SDK から呼び出し

OpenAI 互換——今お使いの SDK のまま

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

対応パラメータ

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

料金

入力 / 1M tokens$3.00
出力 / 1M tokens$4.00
通貨USD

料金計算ツール

月間トークン数10MM
入力の割合70%%
月額見積もり $33.00

表示価格に基づく概算

トークン・コスト見積もり

入力トークン: 8リクエストあたりのコスト: $0.002024

見積もりのみ — 実際のトークン数はプロバイダーのトークナイザーに依存します。

パフォーマンス

p50 TTFT
2.00 s
出力速度
238 tok/s
p95 TTFT
3.63 s
エラー率
0%

公開ベンチマーク

10.7
AA Coding
比較対象モデルの 2% を上回る
123 中 118 位
3.6
AA Intelligence
比較対象モデルの 0% を上回る
125 中 122 位
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
ソース: artificialanalysis.ai

比較

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
入力 $/100万$3.00$21.00$60.00$5.00
出力 $/100万$4.00$168.00$270.00$30.00
コンテキスト16K400K1.1M
品質2/1010/1010/1010/10
並べて比較並べて比較並べて比較並べて比較

よくある質問

GPT-3.5 Turbo 16kのOrcaRouterでのコストはいくらですか?
コストは、入力トークン1Mあたり$3.00、出力トークン1Mあたり$4.00で、OpenAIプロバイダーの正確なレートで請求され、マークアップはゼロです。追加のプラットフォーム料金はありません。
コンテキストウィンドウサイズとは何ですか?
このモデルは16,385トークンのコンテキストウィンドウと最大4,096トークンの出力をサポートしています。テキスト入力のみを処理します。
このモデルの、GPT-3.5 Turbo 4kと比較した強みは何ですか?
主な強みは16kのコンテキストで、より長いドキュメントや会話を分割せずに1回のリクエストで処理できることです。ベンチマークの性能も若干向上しており、4kバリアントの標準MMLUで約43に対して、MMLU‑Proでは46.2です。
GPT-4と比較してどうですか?
GPT-3.5 Turbo 16kは、推論、事実の正確性、およびニュアンスのあるタスクにおいて、はるかに能力が低い。GPT‑4はMMLUで80%以上をスコアし、複雑なロジックをよりうまく処理できるが、10〜20倍高価で低速である。拡張されたコンテキストが必要だが、高度な推論が不要な場合は、GPT-3.5 Turbo 16kを使用する。
OrcaRouterは私がこのモデルを使用するとき、どのように私のデータを扱いますか?
OrcaRouterはプロキシとして動作します。お客様のAPIリクエストをOpenAIに転送し、その応答を返します。プロンプトの内容は、一時的なリクエスト処理の範囲を超えて保存または記録されることはありません。詳細なデータ取り扱いについては、OrcaRouterのプライバシーポリシーおよびOpenAIのデータ利用規約を参照してください。
OpenAI互換のAPIを使用してこのモデルを呼び出すにはどうすればよいですか?
ベースURLを https://api.orcarouter.ai/v1 に設定し、モデルID「openai/gpt-3.5-turbo-16k」を使用してください。その他のチャット補完パラメータ(messages、temperature、max_tokensなど)は、OpenAI APIと同様に動作します。
16,384トークンの制限を超えた場合はどうなりますか?
OrcaRouter は、プロンプトと補完トークンの合計がモデルのコンテキストウィンドウを超えていることを示すエラーを返します。入力を短くする、max_tokens を減らす、またはリクエストを複数の呼び出しに分割する必要があります。
このモデルでストリーミングを使用できますか?
はい、リクエスト内でstreamパラメータをtrueに設定してください。OrcaRouterは、OpenAIストリーミングAPIと同じフォーマットに従って、トークンをデータイベントとしてストリーミングバックします。
最低支出額や契約義務はありますか?
いいえ。使用したトークンに対してのみ料金が発生します。サブスクリプション料金や最低月額契約、数量割引はありません。料金は完全に従量制です。

このバッジを埋め込む

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50OrcaRouter 経由
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OrcaRouter の OpenAI: GPT-3.5 Turbo 16k" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

モデルカードをデータで取得

GET /api/public/models/openai/gpt-3.5-turbo-16k開く