La DeepSeek V3.1 API nous a permis de supprimer deux modèles distincts — réflexion pour les tickets durs, direct pour le reste, le tout derrière un appel.
Loading model information...
DeepSeek V3.1 API — Un modèle, penser et répondre
La DeepSeek V3.1 API exécute DeepSeek V3.1, un modèle hybride qui peut raisonner pas à pas ou répondre directement — vous choisissez le mode par requête.
DeepSeek V3.1 réunit deux comportements dans un seul modèle : un mode réflexion qui raisonne pas à pas et un mode direct qui répond aussitôt. La DeepSeek V3.1 API vous laisse basculer entre eux par requête, si bien que les problèmes difficiles reçoivent de la délibération et les simples une réponse rapide et bon marché — sans second modèle ni second endpoint. Elle garde les forces de V3 en code et tool use, avec une fenêtre de contexte de 128K pour les fichiers et transcriptions longs.
Vous appelez la DeepSeek V3.1 API via RouterBase avec le protocole chat-completions d'OpenAI ; réglez le modèle sur deepseek-v3-1 et votre client actuel fonctionne sans changement. La DeepSeek V3.1 API facture 0,27 $ par 1M de tokens en entrée, 1,10 $ par 1M en sortie et 0,07 $ pour l'entrée en cache — 5 % sous le tarif, sur une clé qui atteint tout le catalogue.
Ce que donne la DeepSeek V3.1 API
De la délibération quand elle aide, une réponse directe sinon.
Deux modes, un modèle
La DeepSeek V3.1 API bascule entre réflexion et réponse directe par requête, si bien que vous ajustez l'effort à la tâche sans changer de modèle.
Raisonne quand ça aide
Activez la réflexion et la DeepSeek V3.1 API travaille les maths, le code et les problèmes multi-étapes avant de répondre.
Répond quand non
En mode direct, la DeepSeek V3.1 API répond tout droit, gardant basses la latence et le coût sur les appels de routine.
Code et outils
Un code solide et un appel de fonctions fiable font de la DeepSeek V3.1 API un socle robuste pour les assistants d'IDE et les agents.
Contexte de 128K
Une fenêtre de 128K laisse la DeepSeek V3.1 API tenir des fichiers, transcriptions et traces d'outils longs en un seul appel.
Bon marché, avec cache
À 0,27 $ en entrée et 1,10 $ en sortie — plus 0,07 $ d'entrée en cache — la DeepSeek V3.1 API reste abordable à l'échelle, 5 % sous le tarif.

Premier appel à la DeepSeek V3.1 API en trois étapes
Branchez une fois, puis changez de mode à volonté.
Créez une clé
Une clé RouterBase atteint la DeepSeek V3.1 API et tous les autres modèles du catalogue.
Pointez et choisissez le mode
Dirigez n'importe quel client OpenAI vers routerbase.com/v1 avec model=deepseek/deepseek-v3.1, et activez ou coupez la réflexion par requête.
Surveillez l'usage
La DeepSeek V3.1 API renvoie l'usage de tokens par réponse, donc coût et latence restent visibles à chaque appel.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Des équipes qui bâtissent sur la DeepSeek V3.1 API
Raisonnement et réponse directe derrière un seul appel.
Couper la réflexion sur les recherches a baissé notre latence et notre facture sans toucher la qualité du chemin difficile.
Un modèle à deux modes a signifié que la DeepSeek V3.1 API a remplacé un routeur qu'on maintenait à la main.
À 0,27 $ en entrée avec des lectures en cache à 0,07 $, la DeepSeek V3.1 API a gardé nos coûts plats à mesure que le trafic grandissait.
L'appel de fonctions est fiable, alors toute notre pile d'agents tourne sur la DeepSeek V3.1 API.
On active la réflexion pour les évals et on la coupe en production — même modèle, même clé.
La fenêtre de 128K a laissé la DeepSeek V3.1 API lire tout notre fichier de dépôt en une passe.
Passer de notre ancien endpoint à la DeepSeek V3.1 API a été une chaîne ; le mode hybride était un bonus.
Nous routons le raisonnement difficile et le chat rapide vers la même DeepSeek V3.1 API et changeons juste le mode.
DeepSeek V3.1 API — questions courantes
Ce qu'il faut savoir avant de lui envoyer du trafic.
L'accès hébergé de RouterBase à DeepSeek V3.1, un modèle hybride qui peut raisonner pas à pas ou répondre directement, via un endpoint compatible OpenAI.