DeepSeek alias voor V4 Flash denkmode — 1M context, open chain-of-thought reasoning (legacy alias, gepland voor uitfasering).
DeepSeek Reasoner is een tekstgebaseerd redeneermodel van DeepSeek, geoptimaliseerd voor taken die diepgaande logische deductie en uitgebreid contextbegrip vereisen. Het is toegankelijk via de…
DeepSeek Reasoner is het sterkst in taken die profiteren van uitgebreide redenering en grote contextvensters. Dit omvat het bewijzen van wiskundige stellingen, het oplossen van complexe woordproblemen, het genereren en debuggen van code over meerdere bestanden, en het beantwoorden van vragen die het samenvoegen van informatie uit vele delen van een document vereisen. Het kan ook meerdere conversatieronden aan waarbij elke ronde verwijst naar een grote gedeelde context zonder het overzicht te verliezen. Vanwege de hoge uitvoerlimiet is het nuttig voor het genereren van gestructureerde rapporten of lange uitleg. De tekst-only aard van het model beperkt het tot taken die beeldbegrip vereisen, maar binnen tekstuele domeinen voert het betrouwbaar diepgaand analytisch werk uit.
De prijzen van DeepSeek Reasoner zijn $0.44 input / $0.87 output per 1M tokens, wat hoger is dan veel kleinere of snellere modellen. Je moet dit model kiezen wanneer je taak het volledige contextvenster van 1M tokens of de diepe redeneercapaciteit vereist. Voor korte prompts (enkele duizenden tokens) die geen stapsgewijze logica vereisen, zou een goedkoper model zoals een kleinere instructie-getunede LLM kosteneffectiever zijn. Evenzo, als je applicatie lage latentie nodig heeft voor realtime reacties, kan een lichter model de voorkeur hebben. Echter, als je een groot document analyseert of een complex probleem oplost dat logische ketens vereist, kan de investering in DeepSeek Reasoner leiden tot hogere nauwkeurigheid en minder handmatige validatietijd.
De belangrijkste sterke punten van DeepSeek Reasoner zijn het enorme contextvenster, de hoge tokenlimiet voor uitvoer en de focus op logisch redeneren. Het kan samenhang behouden over honderden pagina's en lange, goed gestructureerde uitvoer produceren. Het model ondersteunt alleen tekstinvoer, maar begrijpt waarschijnlijk meerdere talen, hoewel dit niet expliciet is bevestigd. Door zijn redeneervermogen kan het zijn denkproces uitleggen, wat helpt bij foutopsporing en verificatie. Bovendien zijn er geen verborgen kosten, omdat OrcaRouter de tarieven van de aanbieder doorgeeft zonder opslag. Voor gebruikers die diepgaande analytische taken moeten schalen, biedt dit model een sterke combinatie van capaciteit en redeneertrouw.
Specifieke benchmarkresultaten voor DeepSeek Reasoner worden niet verstrekt in de beschikbare feiten. Het model maakt echter deel uit van DeepSeek's familie van redeneringsgerichte modellen, die in openbare evaluaties eerder sterke prestaties hebben getoond op het gebied van wiskunde (bijv. GSM8K, MATH) en programmeren (bijv. HumanEval). Gebruikers worden aangemoedigd om het model te testen op hun eigen datasets om de prestaties voor hun specifieke gebruikssituatie te valideren. Vanwege het grote contextvenster is het model bijzonder geschikt voor taken die het begrip van afhankelijkheden over lange afstand evalueren. Zonder officiële cijfers moeten objectieve vergelijkingen worden gemaakt door directe experimenten op de OrcaRouter API.
Ondanks zijn sterke punten heeft DeepSeek Reasoner beperkingen. Ten eerste accepteert het alleen tekstinvoer—geen afbeeldingen, audio of video. Ten tweede kan de grote contextgrootte leiden tot hogere latentie, vooral wanneer invoer bijna 1 miljoen tokens nadert; de tijd tot het eerste token kan aanzienlijk langer zijn dan bij kleinere modellen. Ten derde, hoewel het model sterk is in redeneren, kan het mogelijk niet tippen aan de creatieve vloeiendheid van sommige algemene modellen voor taken zoals poëzie of open verhalen vertellen. Ten vierde, omdat het een gespecialiseerd redeneermodel is, kan het eenvoudige verzoeken overanalyseren, waarbij het meer tokens gebruikt dan nodig. Tot slot, de prijsstelling, hoewel concurrerend voor zijn klasse, is nog steeds hoger dan lichtgewicht alternatieven, waardoor het oneconomisch is voor triviale queries.
DeepSeek Reasoner biedt een contextvenster van 1.048.576 tokens en een maximale uitvoer van 384.000 tokens. Dit maakt het een van de weinige modellen die in staat is om documenten langer dan veel volledige romans in één prompt te verwerken. Het contextvenster omvat zowel invoer als bestaande gespreksgeschiedenis; het model gebruikt het volledige venster om antwoorden te genereren. De uitvoerlimiet van 384.000 tokens maakt het mogelijk om zeer lange gegenereerde inhoud te produceren, zoals volledige codebases of uitgebreide rapporten. Gebruikers moeten er rekening mee houden dat het gebruik van de volledige context de latentie en kosten proportioneel kan verhogen. Deze specificaties zijn bevestigd in de feiten van het model en worden direct ondersteund bij het aanroepen van het model via de OpenAI-compatibele API van OrcaRouter.
Bij OrcaRouter zijn de prijzen voor DeepSeek Reasoner uitsluitend gebaseerd op het aantal verbruikte tokens, gefactureerd tegen het tarief van de provider zonder opslag. Invoertokens worden in rekening gebracht tegen $0.44 per 1M tokens, en uitvoertokens tegen $0.87 per 1M tokens. Er zijn geen extra platformkosten, abonnementskosten of verborgen kosten. Kosten worden per API-aanroep berekend op basis van het totale aantal verwerkte tokens. OrcaRouter factureert gebruikers rechtstreeks, en de kosten weerspiegelen het onbewerkte providerstarief. Dit transparante prijsmodel stelt ontwikkelaars in staat om het gebruik voorspelbaar op te schalen zonder zich zorgen te maken over winstmarges die door de gateway worden toegevoegd.
De kostprijs per token kan worden afgeleid van de tarieven per miljoen: input tokens kosten $0,00000044 per token, en output tokens kosten $0,00000087 per token. In de praktijk zou een typische aanvraag van 10.000 input tokens en 1.000 output tokens ongeveer $0,0044 + $0,00087 = $0,00527 kosten. Omdat het contextvenster tot 1.048.576 input tokens groot kan zijn, zou een verzoek met volledige context alleen al voor de input ongeveer $0,46 kosten. De uitvoerlimiet van 384.000 tokens zou maximaal $0,334 kosten als deze volledig wordt benut. Deze kosten schalen lineair, dus gebruikers moeten het tokenverbruik in de gaten houden, vooral bij het benutten van de maximale context- en uitvoercapaciteiten.
OrcaRouter stelt expliciet dat DeepSeek Reasoner wordt geprijsd tegen het tarief van de aanbieder zonder enige opslag. Dit betekent dat er geen extra kosten zijn bovenop de vermelde prijs per token. Er zijn geen minimumbedragen per maand, installatiekosten of kosten voor API-toegang. De enige kosten die worden gemaakt, zijn voor verbruikte tokens. Gebruikers kunnen de kosten verifiëren door het gefactureerde bedrag te vergelijken met de logs van het tokenverbruik. De prijstransparantie van OrcaRouter zorgt ervoor dat wat je ziet ook is wat je betaalt, zonder onverwachte toeslagen voor hoog volume gebruik of speciale functies.
De beschikbare feiten vermelden geen cachingmechanismen of volumekortingen voor DeepSeek Reasoner op OrcaRouter. Het is mogelijk dat OrcaRouter standaardcaching biedt voor veelvoorkomende prompts, maar dit is niet bevestigd. Evenmin worden er kortingstreden beschreven. De prijsstelling is strikt per token tegen het tarief van de provider. Gebruikers moeten ervan uitgaan dat er geen ingebouwde caching of kortingen zijn, tenzij dit expliciet door OrcaRouter wordt gecommuniceerd. Voor gebruik met een hoog volume kunt u contact opnemen met de ondersteuning van OrcaRouter om te informeren naar eventuele aangepaste regelingen, maar op basis van de verstrekte gegevens is het prijsmodel eenvoudig pay-as-you-go.
Om DeepSeek Reasoner via OrcaRouter aan te roepen, gebruik je het OpenAI-compatibele eindpunt met base_url https://api.orcarouter.ai/v1. Stel de modelnaam in op "deepseek/deepseek-reasoner". Alle standaard OpenAI chat completion-parameters worden ondersteund, waaronder messages, max_tokens, temperature, top_p en stop sequences. Een voorbeeld van een verzoek ziet er als volgt uit: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -d '{"model":"deepseek/deepseek-reasoner","messages":[{"role":"user","content":"Solve this math problem..."}],"max_tokens":10000}'. De API retourneert completions in hetzelfde formaat als het chat-eindpunt van OpenAI, wat de integratie eenvoudig maakt voor bestaande toepassingen.
Naast de standaard chatparameters ondersteunt DeepSeek Reasoner de gebruikelijke OpenAI-compatibele configuratieopties: temperature (standaard 1, bereik 0-2), top_p (standaard 1), frequency_penalty, presence_penalty, stop en max_tokens (tot 384.000). Omdat het een redeneermodel is, beïnvloeden temperature-instellingen de willekeur van de redeneerketen; lagere temperaturen leveren meer deterministische uitvoer op. Er is geen specifieke redeneerparameter in de API beschikbaar—het redeneergedrag is intrinsiek aan het model. Gebruikers kunnen ook streaming gebruiken via de stream-parameter om tokens stapsgewijs te ontvangen. Alle parameters moeten worden doorgegeven in de JSON-body van de POST-aanvraag naar het chat completions-eindpunt.
Migreren naar OrcaRouter is eenvoudig omdat de API volledig compatibel is met het chat completion-formaat van OpenAI. Vervang uw bestaande basis-URL door https://api.orcarouter.ai/v1 en werk de modelnaam bij naar "deepseek/deepseek-reasoner". Genereer een API-sleutel via het dashboard van OrcaRouter en voeg deze toe aan de Authorization header. Pas uw code aan om de nieuwe basis-URL en modelidentificatie te gebruiken. De rest van uw logica, inclusief berichtopmaak, parameternamen en verwerking van antwoorden, blijft ongewijzigd. Dankzij deze compatibiliteit kunt u met minimale codewijzigingen van provider wisselen, vaak slechts enkele regels in de clientconfiguratie. Test met een kleine payload om de connectiviteit en prijzen te bevestigen voordat u opschaalt.
Vergeleken met OpenAI's GPT-4-serie biedt DeepSeek Reasoner een aanzienlijk groter contextvenster (1M tokens vs. 8K-128K voor GPT-4 Turbo) en een hogere outputlimiet (384K vs. 4K-32K). De prijs per token is lager ($0.44/$0.87 vs. GPT-4 Turbo's ongeveer $10/$30 per 1M tokens), waardoor het kosteneffectiever is voor taken met lange contexten. GPT-4 Turbo ondersteunt echter multimodale input (afbeeldingen, audio) en kan een bredere wereldkennis hebben. DeepSeek Reasoner richt zich specifiek op redeneren en kan meer gedetailleerde chain-of-thought-reacties produceren. Voor taken die geen extreem lange context of diep redeneren vereisen, zijn de bredere mogelijkheden van GPT-4 Turbo wellicht de voorkeur.
Anthropic's Claude 2 en Claude 3 Opus hebben contextvensters van 100K-200K tokens, wat kleiner is dan DeepSeek Reasoner's 1M tokens. Claude-modellen ondersteunen ook enkele multimodale invoeren in nieuwere versies. DeepSeek Reasoner's prijzen zijn aanzienlijk lager (ongeveer een tiende van de kosten van Claude 3 Opus voor invoertokens). Claude-modellen leggen de nadruk op veiligheid en behulpzaamheid, terwijl DeepSeek Reasoner is geoptimaliseerd voor redeneerdiepte. Als uw toepassing het verwerken van zeer lange documenten tegen lagere kosten vereist, heeft DeepSeek Reasoner een voordeel. Voor taken die veiligheidsmaatregelen en multimodale ondersteuning nodig hebben, kan Claude geschikter zijn. Beide zijn toegankelijk via OrcaRouter's API.
Kies voor DeepSeek Reasoner wanneer uw workload een contextvenster van meer dan 200K tokens vereist, of wanneer u outputs van meer dan 32K tokens moet genereren. Het is ideaal voor systematische redeneertaken waarbij het tonen van de tussenliggende logische stappen waardevol is. Het kostenvoordeel is het meest uitgesproken voor toepassingen met een hoog volume en lange context, aangezien de prijs per token aanzienlijk lager is dan bij premium modellen van OpenAI of Anthropic. Als uw taken echter kort zijn, multimodale invoer vereisen of profiteren van grotere trainingsdatasets, kunnen alternatieven beter zijn. Evalueer uw tokenverbruikspatronen en redeneervereisten om te bepalen of de sterke punten van DeepSeek Reasoner aansluiten bij uw prioriteiten.
OpenAI-compatibel — behoud je huidige SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="deepseek/deepseek-reasoner",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstream| Invoer / 1M tokens | $0.147 |
| Uitvoer / 1M tokens | $0.295 |
| Cache lezen / 1M | $0.028 |
| Valuta | USD |
Schatting op basis van catalogusprijs
Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.
GET /api/public/models/deepseek/deepseek-reasonerOpenen @misc{orcarouter_deepseek_reasoner,
title = {deepseek/deepseek-reasoner API},
author = {deepseek},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/deepseek/deepseek-reasoner}
}deepseek. (n.d.). deepseek/deepseek-reasoner API. OrcaRouter. https://www.orcarouter.ai/models/deepseek/deepseek-reasoner