chat.deepseek_r1_distill_llama_70b
chat.deepseek_r1_distill_llama_70b

Loading model information...

Input
DeepSeek R1 Distill Llama 70B
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
DeepSeek R1 Distill Llama 70B Online
Hi! I'm a helpful AI assistant. What can I do for you?

DeepSeek R1 Distill Llama 70B API — Le raisonnement R1, sans la facture du 671B

La DeepSeek R1 Distill Llama 70B API distille la chaîne de pensée de DeepSeek-R1 dans un Llama 3.3 70B dense — la voie médiane quand un 8B est trop léger et le 671B complet plus que nécessaire.

Entre un distill minuscule et un fleuron de 671 milliards de paramètres se trouve le choix par défaut raisonnable. La DeepSeek R1 Distill Llama 70B API, c'est le raisonnement de DeepSeek-R1 distillé dans un Llama 3.3 70B dense : elle garde la chaîne de pensée pas à pas qui rend R1 utile, tourne plus vite et bien moins cher que le modèle complet, et reste nettement plus forte que le distill 8B en maths et logique réelles. Pour l'essentiel du travail de raisonnement, la DeepSeek R1 Distill Llama 70B API est le point d'équilibre.

Vous appelez la DeepSeek R1 Distill Llama 70B API via RouterBase avec le protocole chat-completions d'OpenAI ; réglez le modèle sur deepseek-r1-distill-llama-70b et votre client est prêt. La DeepSeek R1 Distill Llama 70B API facture un forfait de 0,80 $ par 1M de tokens, entrée comme sortie, 5 % sous le tarif, sur la même clé qui atteint tout le catalogue.

La voie médiane

Pourquoi la DeepSeek R1 Distill Llama 70B API est un défaut raisonnable

Assez de profondeur pour un vrai raisonnement, à un prix qu'on peut laisser tourner.

Le distill équilibré

Plus fort que le 8B, moins cher et plus rapide que le 671B — la DeepSeek R1 Distill Llama 70B API est la voie médiane que la plupart des charges de raisonnement veulent vraiment.

Chaîne de pensée R1

Distillée de DeepSeek-R1, la DeepSeek R1 Distill Llama 70B API raisonne pas à pas et diffuse la trace, si bien que vous lisez le raisonnement, pas seulement le résultat.

Llama 3.3 70B dense

Un backbone dense de 70B donne une latence stable et de solides maths et logique, sans mixture-of-experts à ordonnancer.

Forfait 0,80 $ par 1M

Entrée et sortie au même prix — la DeepSeek R1 Distill Llama 70B API facture un tarif unique et prévisible, 5 % sous le tarif, facile à anticiper à l'échelle.

Poids ouverts

DeepSeek-R1-Distill-Llama-70B est à poids ouverts ; évaluez-le vous-même, puis laissez la DeepSeek R1 Distill Llama 70B API l'héberger sans GPU à faire tourner.

De forme OpenAI

Un endpoint chat-completions, une clé RouterBase — pointez vers routerbase.com/v1, nommez le modèle, sautez le SDK DeepSeek.

RouterBase dashboard preview
Branchez

Premier appel à la DeepSeek R1 Distill Llama 70B API en trois étapes

De la clé à la chaîne de pensée en quelques minutes.

  1. Créez une clé

    Une clé RouterBase atteint la DeepSeek R1 Distill Llama 70B API et tous les autres modèles du catalogue.

  2. Pointez et nommez

    Envoyez n'importe quel client OpenAI vers routerbase.com/v1 avec model=deepseek/deepseek-r1-distill-llama-70b. Le streaming et la trace de raisonnement sont activés par défaut.

  3. Lisez la trace

    La chaîne de pensée arrive à côté de la réponse ; l'usage revient par réponse, donc le coût reste visible.

Tarifs

Ne payez que ce que vous utilisez

RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.

Choisie en production

Des équipes qui adoptent par défaut la DeepSeek R1 Distill Llama 70B API

Le point d'équilibre, à l'échelle.

Camila RojasLead Engineer, Fathom

Nous avons mis la DeepSeek R1 Distill Llama 70B API par défaut — elle raisonne comme R1 sans la facture de R1.

Idris BelloCTO, Slate

Le 8B était trop léger pour nos maths, le 671B trop cher à laisser allumé. La DeepSeek R1 Distill Llama 70B API a visé pile le milieu.

Hana KimML Lead, Everline

Le 70B dense signifie une latence prévisible ; la DeepSeek R1 Distill Llama 70B API ne surprend jamais nos SLO.

Viktor NovakStaff Engineer, Groundwork

Un forfait 0,80 $ en entrée et sortie rend la prévision triviale — pas de calcul de ratio en fin de mois.

Renuka IyerFounder, Pathwise

La chaîne de pensée diffusée par la DeepSeek R1 Distill Llama 70B API est assez bonne pour qu'on la garde telle quelle.

Otto LindgrenPrincipal Engineer, Beacon Grid

Les poids ouverts nous ont laissés la comparer au 671B, puis la DeepSeek R1 Distill Llama 70B API nous a laissés livrer la moins chère.

Zoe AlmeidaHead of AI, Rill

Une clé RouterBase, et on fait de l'A/B entre la DeepSeek R1 Distill Llama 70B API et Sonnet en changeant un seul champ.

Jamal CarterBackend Lead, Overstory

Nous avons déplacé le raisonnement quotidien vers la DeepSeek R1 Distill Llama 70B API et le coût par tâche a baissé sans une plainte de qualité.

Nina FalkEngineering Manager, Cindergrid

C'est le modèle de raisonnement vers lequel on va d'abord maintenant — assez de profondeur, prix raisonnable.

DeepSeek R1 Distill Llama 70B API — questions courantes

Ce qu'il faut peser avant d'en faire votre défaut.

L'accès hébergé de RouterBase à DeepSeek-R1-Distill-Llama-70B : le raisonnement de DeepSeek-R1 distillé dans un Llama 3.3 70B dense, via un endpoint compatible OpenAI.