Die DeepSeek V3.1 API ließ uns zwei getrennte Modelle streichen — Denken für die harten Tickets, direkt für den Rest, alles hinter einem Aufruf.
Loading model information...
DeepSeek V3.1 API — Ein Modell, denken und direkt
Die DeepSeek V3.1 API betreibt DeepSeek V3.1, ein Hybridmodell, das Schritt für Schritt schließen oder direkt antworten kann — du wählst den Modus pro Anfrage.
DeepSeek V3.1 fasst zwei Verhaltensweisen in einem Modell zusammen: einen Denkmodus, der Schritt für Schritt schließt, und einen Direktmodus, der sofort antwortet. Die DeepSeek V3.1 API lässt dich pro Anfrage zwischen ihnen wechseln, sodass harte Probleme Überlegung bekommen und einfache eine schnelle, günstige Antwort — kein zweites Modell, kein zweiter Endpoint. Sie behält die Stärken von V3 bei Code und Tool use, mit einem 128K-Kontextfenster für lange Dateien und Transkripte.
Du rufst die DeepSeek V3.1 API über RouterBase per OpenAI-chat-completions-Protokoll auf; setze das Modell auf deepseek-v3-1, und dein bestehender Client läuft unverändert. Die DeepSeek V3.1 API berechnet $0.27 pro 1M Eingabe-Tokens, $1.10 pro 1M Ausgabe und $0.07 für zwischengespeicherte Eingabe — 5% unter Liste, mit einem Schlüssel für den ganzen Katalog.
Was die DeepSeek V3.1 API bietet
Überlegung, wenn sie hilft, direkte Antwort, wenn nicht.
Zwei Modi, ein Modell
Die DeepSeek V3.1 API wechselt pro Anfrage zwischen Denken und direkter Antwort, sodass du den Aufwand an die Aufgabe anpasst, ohne das Modell zu tauschen.
Schließt, wenn es hilft
Schalte das Denken ein, und die DeepSeek V3.1 API arbeitet Mathe, Code und mehrschrittige Probleme durch, bevor sie antwortet.
Antwortet, wenn nicht
Im Direktmodus antwortet die DeepSeek V3.1 API geradeaus und hält Latenz und Kosten bei Routineaufrufen niedrig.
Code und Tools
Starker Code plus zuverlässiges Function Calling machen die DeepSeek V3.1 API zu einem soliden Rückgrat für IDE-Assistenten und Agenten.
128K-Kontext
Ein 128K-Fenster lässt die DeepSeek V3.1 API lange Dateien, Transkripte und Tool-Traces in einem Aufruf halten.
Günstig, mit Caching
Bei $0.27 Eingabe und $1.10 Ausgabe — plus $0.07 zwischengespeicherter Eingabe — bleibt die DeepSeek V3.1 API bei Volumen erschwinglich, 5% unter Liste.

Erster Aufruf der DeepSeek V3.1 API in drei Schritten
Einmal anbinden, dann Modi nach Belieben wechseln.
Schlüssel erstellen
Ein RouterBase-Schlüssel erreicht die DeepSeek V3.1 API und jedes andere Modell im Katalog.
Zeigen und Modus wählen
Schick einen beliebigen OpenAI-Client an routerbase.com/v1 mit model=deepseek/deepseek-v3.1 und schalte das Denken pro Anfrage ein oder aus.
Nutzung sehen
Die DeepSeek V3.1 API liefert die Token-Nutzung pro Antwort, sodass Kosten und Latenz bei jedem Aufruf sichtbar bleiben.
Nur für die Nutzung zahlen
RouterBase reicht Partner-Tier-Preise durch. Verglichen mit dem offiziellen API-Tarif des Modells.
Teams, die auf der DeepSeek V3.1 API bauen
Schließen und direkte Antwort hinter einem einzigen Aufruf.
Das Denken bei Lookups abzuschalten senkte Latenz und Rechnung, ohne die Qualität des harten Pfads anzutasten.
Ein Modell mit zwei Modi hieß, die DeepSeek V3.1 API ersetzte einen Router, den wir von Hand pflegten.
Bei $0.27 Eingabe mit Cache-Reads zu $0.07 hielt die DeepSeek V3.1 API unsere Kosten flach, während der Traffic wuchs.
Function Calling ist zuverlässig, also läuft unser ganzer Agenten-Stack auf der DeepSeek V3.1 API.
Wir schalten das Denken für Evals ein und in Produktion aus — dasselbe Modell, derselbe Schlüssel.
Das 128K-Fenster ließ die DeepSeek V3.1 API unsere ganze Repo-Datei in einem Durchgang lesen.
Der Wechsel von unserem alten Endpoint zur DeepSeek V3.1 API war ein String; der Hybridmodus war ein Bonus.
Wir leiten hartes Schließen und schnellen Chat an dieselbe DeepSeek V3.1 API und flippen nur den Modus.
DeepSeek V3.1 API — häufige Fragen
Was du wissen solltest, bevor du Traffic dorthin leitest.
Der gehostete Zugang von RouterBase zu DeepSeek V3.1, einem Hybridmodell, das Schritt für Schritt schließen oder direkt antworten kann, über einen OpenAI-kompatiblen Endpoint.