Nous avons mis la DeepSeek R1 Distill Llama 70B API par défaut — elle raisonne comme R1 sans la facture de R1.
Loading model information...
DeepSeek R1 Distill Llama 70B API — Le raisonnement R1, sans la facture du 671B
La DeepSeek R1 Distill Llama 70B API distille la chaîne de pensée de DeepSeek-R1 dans un Llama 3.3 70B dense — la voie médiane quand un 8B est trop léger et le 671B complet plus que nécessaire.
Entre un distill minuscule et un fleuron de 671 milliards de paramètres se trouve le choix par défaut raisonnable. La DeepSeek R1 Distill Llama 70B API, c'est le raisonnement de DeepSeek-R1 distillé dans un Llama 3.3 70B dense : elle garde la chaîne de pensée pas à pas qui rend R1 utile, tourne plus vite et bien moins cher que le modèle complet, et reste nettement plus forte que le distill 8B en maths et logique réelles. Pour l'essentiel du travail de raisonnement, la DeepSeek R1 Distill Llama 70B API est le point d'équilibre.
Vous appelez la DeepSeek R1 Distill Llama 70B API via RouterBase avec le protocole chat-completions d'OpenAI ; réglez le modèle sur deepseek-r1-distill-llama-70b et votre client est prêt. La DeepSeek R1 Distill Llama 70B API facture un forfait de 0,80 $ par 1M de tokens, entrée comme sortie, 5 % sous le tarif, sur la même clé qui atteint tout le catalogue.
Pourquoi la DeepSeek R1 Distill Llama 70B API est un défaut raisonnable
Assez de profondeur pour un vrai raisonnement, à un prix qu'on peut laisser tourner.
Le distill équilibré
Plus fort que le 8B, moins cher et plus rapide que le 671B — la DeepSeek R1 Distill Llama 70B API est la voie médiane que la plupart des charges de raisonnement veulent vraiment.
Chaîne de pensée R1
Distillée de DeepSeek-R1, la DeepSeek R1 Distill Llama 70B API raisonne pas à pas et diffuse la trace, si bien que vous lisez le raisonnement, pas seulement le résultat.
Llama 3.3 70B dense
Un backbone dense de 70B donne une latence stable et de solides maths et logique, sans mixture-of-experts à ordonnancer.
Forfait 0,80 $ par 1M
Entrée et sortie au même prix — la DeepSeek R1 Distill Llama 70B API facture un tarif unique et prévisible, 5 % sous le tarif, facile à anticiper à l'échelle.
Poids ouverts
DeepSeek-R1-Distill-Llama-70B est à poids ouverts ; évaluez-le vous-même, puis laissez la DeepSeek R1 Distill Llama 70B API l'héberger sans GPU à faire tourner.
De forme OpenAI
Un endpoint chat-completions, une clé RouterBase — pointez vers routerbase.com/v1, nommez le modèle, sautez le SDK DeepSeek.

Premier appel à la DeepSeek R1 Distill Llama 70B API en trois étapes
De la clé à la chaîne de pensée en quelques minutes.
Créez une clé
Une clé RouterBase atteint la DeepSeek R1 Distill Llama 70B API et tous les autres modèles du catalogue.
Pointez et nommez
Envoyez n'importe quel client OpenAI vers routerbase.com/v1 avec model=deepseek/deepseek-r1-distill-llama-70b. Le streaming et la trace de raisonnement sont activés par défaut.
Lisez la trace
La chaîne de pensée arrive à côté de la réponse ; l'usage revient par réponse, donc le coût reste visible.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Des équipes qui adoptent par défaut la DeepSeek R1 Distill Llama 70B API
Le point d'équilibre, à l'échelle.
Le 8B était trop léger pour nos maths, le 671B trop cher à laisser allumé. La DeepSeek R1 Distill Llama 70B API a visé pile le milieu.
Le 70B dense signifie une latence prévisible ; la DeepSeek R1 Distill Llama 70B API ne surprend jamais nos SLO.
Un forfait 0,80 $ en entrée et sortie rend la prévision triviale — pas de calcul de ratio en fin de mois.
La chaîne de pensée diffusée par la DeepSeek R1 Distill Llama 70B API est assez bonne pour qu'on la garde telle quelle.
Les poids ouverts nous ont laissés la comparer au 671B, puis la DeepSeek R1 Distill Llama 70B API nous a laissés livrer la moins chère.
Une clé RouterBase, et on fait de l'A/B entre la DeepSeek R1 Distill Llama 70B API et Sonnet en changeant un seul champ.
Nous avons déplacé le raisonnement quotidien vers la DeepSeek R1 Distill Llama 70B API et le coût par tâche a baissé sans une plainte de qualité.
C'est le modèle de raisonnement vers lequel on va d'abord maintenant — assez de profondeur, prix raisonnable.
DeepSeek R1 Distill Llama 70B API — questions courantes
Ce qu'il faut peser avant d'en faire votre défaut.
L'accès hébergé de RouterBase à DeepSeek-R1-Distill-Llama-70B : le raisonnement de DeepSeek-R1 distillé dans un Llama 3.3 70B dense, via un endpoint compatible OpenAI.