多言語ボットを Qwen2.5 72B Instruct API に移し、128K で長い履歴の分割をやめました。
Qwen2.5 72B Instruct は Alibaba Qwen による密な 72B 命令チューニング LLM で、128K コンテキストを備え、多言語・コーディング・数学に強いです。RouterBase 上で OpenAI 互換エンドポイントから提供、入力 $0.38 / 1M、出力 $0.40 / 1M、標準より 5% 安。
Qwen2.5 72B Instruct API —— 密な 72B、128K コンテキスト
Qwen2.5 72B Instruct API は Qwen2.5 72B Instruct を提供します。密な 72B 命令チューニング LLM で、128K コンテキストを備え、多言語、コーディング、数学に強いです。
Qwen2.5 72B Instruct API は Alibaba Qwen2.5 72B Instruct、密な 720 億パラメータの命令チューニング LLM を提供します。MoE と違い完全に密なネットワークなので、全パラメータが全トークンに寄与し、チャット、コーディング、数学、推論で安定した品質が得られます。128K コンテキストは長いファイル、トランスクリプト、ツールトレースを 1 回の呼び出しに収めます。Qwen2.5 72B Instruct API には RouterBase 経由で OpenAI chat-completions からアクセスするので、既存クライアントはそのまま動きます。新しい SDK は不要で、一つのキーがカタログ全体を覆います。
Qwen2.5 72B Instruct は開発者が実際に出荷する作業に向けてチューニングされています。29+ 言語の多言語アシスタント、コード生成とレビュー、構造化 JSON 抽出、多段ツール利用です。Qwen2.5 72B Instruct API の課金は入力 100 万トークン $0.38、出力 $0.40 で、$0.40 / $0.42 の標準より 5% 安く、トークン単位でリクエスト料なし。生成しながらストリームし、ツール呼び出しを標準 OpenAI スキーマで返すので、Qwen2.5 72B Instruct API をエージェント、IDE アシスタント、バッチに接着コードなしで組み込めます。
Qwen2.5 72B Instruct API が与えるもの
トークンごとに練られた品質。
密な 72B モデル
Qwen2.5 72B Instruct API は完全に密な 720 億パラメータで動き、チャット、コーディング、推論で品質が一貫します。
128K コンテキスト
128K ウィンドウで長いファイルやツールトレースを 1 回に保持でき、この API への入力分割はほぼ不要です。
設計から多言語
29+ 言語で訓練され、Qwen2.5 72B Instruct API は英語、中国語ほかで多言語チャット、翻訳、サポートに使えます。
コーディングと数学
強力なコード生成、レビュー、数学推論で Qwen2.5 72B Instruct API は開発者ツールの基盤になります。
ツールと JSON
関数呼び出しと構造化 JSON を標準 OpenAI スキーマで返すので Qwen2.5 72B Instruct API はエージェントに適合します。
ストリーミング
Qwen2.5 72B Instruct API はトークンをストリームし、入力 $0.38、出力 $0.40、標準より 5% 安、リクエスト料なし。

3 ステップで Qwen2.5 72B Instruct API を呼ぶ
一度つないだら、あとはストリーム。
キーを作成
一つの RouterBase キーが Qwen2.5 72B Instruct API とカタログの全モデルに届きます。
クライアントを向ける
OpenAI クライアントを routerbase.com/v1 へ、model=qwen/qwen-2.5-72b-instruct と messages で送ると Qwen2.5 72B Instruct API が答えます。
ストリームと使用量
モデルはトークンをストリームし使用量を返すので、Qwen2.5 72B Instruct API の各呼び出しでコストと遅延が見えます。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
| 解像度 | RouterBase | 公式 | 節約 |
|---|---|---|---|
| Input (per 1M) | $0.380 | −5% | |
| Output (per 1M) | $0.400 | −5% |
デフォルト設定(Input (per 1M))では 1 回あたり $0.380 です。$1 でこのモデルを約 2 回呼び出せます。
標準価格 = Alibaba Qwen の Qwen2.5 72B Instruct 掲載レート(入力 100 万 $0.40、出力 100 万 $0.42)。RouterBase は Qwen2.5 72B Instruct API を $0.38 / $0.40、標準より 5% 安く提供します。
Qwen2.5 72B Instruct API 上で構築するチーム
多言語チャットとコーディングが一つの呼び出しに。
密な重みで出力が予測可能——Qwen2.5 72B Instruct API はどのチケットでも同じ品質です。
標準スキーマのおかげでエージェントは初日から Qwen2.5 72B Instruct API 上で動きました。
入力 $0.38、出力 $0.40 で、Qwen2.5 72B Instruct API はトークン単価を平らに保ちました。
Qwen2.5 72B Instruct API のストリーミングは滑らかで、UI は逐次描画します。
コードレビューと JSON 抽出を Qwen2.5 72B Instruct API に回すと毎回きれいに返ります。
128K で Qwen2.5 72B Instruct API はファイルとテストを 1 パスで読みます。
別社から Qwen2.5 72B Instruct API への切り替えは 1 文字列だけでした。
多言語カバレッジこそ Qwen2.5 72B Instruct API に標準化した理由です。
Qwen2.5 72B Instruct API —— よくある質問
トラフィックを流す前に。
Alibaba Qwen2.5 72B Instruct への RouterBase ホスト型アクセスで、密な 72B 命令チューニング LLM を OpenAI 互換で提供します。