既定を DeepSeek R1 Distill Llama 70B API にしました——R1 のように推論して、R1 の請求書は来ません。
Loading model information...
DeepSeek R1 Distill Llama 70B API —— 671B の請求書なしの R1 推論
DeepSeek R1 Distill Llama 70B API は DeepSeek-R1 の思考連鎖を密な Llama 3.3 70B に蒸留します——8B では軽すぎ、完全な 671B では過剰なときの中間の道です。
小さな蒸留と 6710 億パラメータの旗艦の間に、理にかなった既定があります。DeepSeek R1 Distill Llama 70B API は、DeepSeek-R1 の推論を密な Llama 3.3 70B に蒸留したモデルです。R1 を使う価値にしている段階的な思考連鎖を保ち、完全なモデルより速く大幅に安く、実際の数学・論理で 8B 蒸留よりはっきり強いままです。ほとんどの推論作業にとって、DeepSeek R1 Distill Llama 70B API が釣り合いの点です。
DeepSeek R1 Distill Llama 70B API は RouterBase 経由、OpenAI chat-completions 協議で呼び出します。モデルを deepseek-r1-distill-llama-70b に設定すればクライアントは完了です。DeepSeek R1 Distill Llama 70B API は入力・出力とも 100 万トークン一律 $0.80、標準より 5% 安く、カタログ全体と同じキーで使えます。
DeepSeek R1 Distill Llama 70B API が理にかなった既定である理由
本物の推論に足る深さを、動かし続けられる価格で。
バランスの取れた蒸留
8B より強く、671B より安く速い——DeepSeek R1 Distill Llama 70B API は多くの推論負荷が実は求める中間の道です。
R1 の思考連鎖
DeepSeek-R1 から蒸留され、DeepSeek R1 Distill Llama 70B API は段階的に考えてトレースをストリーミングするので、結果だけでなく推論を読めます。
密な Llama 3.3 70B
密な 70B 基盤が安定したレイテンシと強い数学・論理をもたらし、Mixture-of-Experts のスケジューリングは不要です。
100 万あたり一律 $0.80
入力も出力も同額——DeepSeek R1 Distill Llama 70B API は予測しやすい単一レートで課金、標準より 5% 安、規模でも見積もりやすい。
オープンウェイト
DeepSeek-R1-Distill-Llama-70B はオープンウェイト。自分で評価し、その後 DeepSeek R1 Distill Llama 70B API にホストさせれば、GPU を回す必要はありません。
OpenAI 形状
1 つの chat-completions エンドポイント、1 つの RouterBase キー——routerbase.com/v1 に向け、モデル名を書き、DeepSeek SDK は省略。

DeepSeek R1 Distill Llama 70B API への最初の呼び出しを 3 ステップで
キーから思考連鎖まで数分。
キーを作る
1 つの RouterBase キーで DeepSeek R1 Distill Llama 70B API とカタログの他すべてに届きます。
向けて命名
任意の OpenAI クライアントを routerbase.com/v1 へ、model=deepseek/deepseek-r1-distill-llama-70b。ストリーミングと推論トレースは既定でオンです。
トレースを読む
思考連鎖が答えの横に届きます。使用量は応答ごとに返り、コストが見えます。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
DeepSeek R1 Distill Llama 70B API を既定にするチーム
規模で動く釣り合いの点。
8B は数学に軽すぎ、671B は常時稼働には高すぎた。DeepSeek R1 Distill Llama 70B API がちょうど中間に当たりました。
密な 70B は予測可能なレイテンシ。DeepSeek R1 Distill Llama 70B API は SLO を驚かせません。
入出力とも $0.80 なので見積もりは簡単——月末に入出力比を計算しなくて済みます。
DeepSeek R1 Distill Llama 70B API がストリームする思考連鎖は、そのまま残せるほど良いです。
オープンウェイトで 671B とベンチマークし、その後 DeepSeek R1 Distill Llama 70B API で安い方を出せました。
1 つの RouterBase キーで、フィールドを 1 つ変えるだけで DeepSeek R1 Distill Llama 70B API と Sonnet を A/B できます。
日常の推論を DeepSeek R1 Distill Llama 70B API に移し、タスクあたりのコストが下がっても品質の苦情は出ませんでした。
今では最初に手を伸ばす推論モデルです——十分な深さ、正気の価格。
DeepSeek R1 Distill Llama 70B API —— よくある質問
既定にする前に見極めること。
RouterBase による DeepSeek-R1-Distill-Llama-70B へのホスト型アクセスです——DeepSeek-R1 の推論を密な Llama 3.3 70B に蒸留したモデルで、OpenAI 互換エンドポイントで提供されます。