Experimentelle visionsfähige Variante von DeepSeek V4 Flash: Text + Bild als Eingabe, Text als Ausgabe, 1M Kontext, 384K maximale Ausgabe, Denk- und Nicht-Denk-Modi. Reine-Text-Fähigkeit auf Augenhöhe mit V4 Flash; multimodale Agent-Fähigkeit nahe Opus 4.8.
OpenAI-kompatibel — behalte dein bisheriges SDK
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-flash-vision-exp",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)include_reasoninglogprobsmax_tokensreasoningresponse_formatstopstreamstream_optionstemperaturethinkingtool_choicetoolstop_logprobstop_puser_id| Eingabe / 1M Tokens · Nebenzeiten | $0.147 |
| Ausgabe / 1M Tokens · Nebenzeiten | $0.295 |
| Cache-Lesen / 1M · Nebenzeiten | $0.020 |
| Spitzenzeiten | 01:00–04:00, 06:00–10:00 ×2 (UTC) |
| Eingabe / 1M Tokens · ×2 | $0.294 |
| Ausgabe / 1M Tokens · ×2 | $0.590 |
| Cache-Lesen / 1M · ×2 | $0.040 |
| Währung | USD |
Schätzung auf Basis des Listenpreises
Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.
Worüber Entwickler diese Woche sprechen
GET /api/public/models/deepseek/deepseek-v4-flash-vision-expÖffnen @misc{orcarouter_deepseek_v4_flash_vision_exp,
title = {DeepSeek V4 Flash Vision (Exp) API},
author = {DeepSeek},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-vision-exp}
}DeepSeek. (2026). DeepSeek V4 Flash Vision (Exp) API. OrcaRouter. https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-vision-exp