エージェントを Qwen3.5 122B A10B API に移し、p95 遅延がほぼ半分になりました。
Qwen3.5 122B A10B は Alibaba Qwen による MoE LLM で、総パラメータ 122B、アクティブ約 10B、256K コンテキストを備え、推論・コーディング・多言語に強いです。RouterBase 上で OpenAI 互換エンドポイントから提供、入力 $0.34 / 1M、出力 $2.72 / 1M、標準より 15% 安。
Qwen3.5 122B A10B API —— 122B MoE、10B アクティブ、256K
Qwen3.5 122B A10B API は総 122B、アクティブ約 10B の MoE LLM を提供し、256K コンテキストで推論とコーディングに強いです。
Qwen3.5 122B A10B API は Alibaba Qwen3.5 122B A10B、総パラメータ 1220 億、アクティブ約 100 億の MoE LLM を提供します。スパースなルーティングにより、小型モデル並みの遅延と単価で大型級の品質が得られ、256K コンテキストが長いファイルやツールトレースを 1 回の呼び出しに収めます。Qwen3.5 122B A10B API には RouterBase 経由で OpenAI chat-completions からアクセスでき、既存クライアントはそのまま動き、一つのキーがカタログ全体を覆います。
Qwen3.5 122B A10B は多段推論、コード生成とレビュー、ツール利用、JSON 抽出、100+ 言語対応に向けてチューニングされています。課金は入力 100 万トークン $0.34、出力 $2.72 で、$0.40 / $3.20 の標準より 15% 安く、リクエスト料はありません。ストリーミングと標準 OpenAI スキーマのツール呼び出しにより、Qwen3.5 122B A10B API はエージェント、IDE アシスタント、バッチに接着コードなしで組み込め、本番までそのまま伸ばせます。
Qwen3.5 122B A10B API が与えるもの
10B アクティブで旗艦級の品質。
122B MoE、10B アクティブ
Qwen3.5 122B A10B API は各トークンを少数エキスパートに通し、大きな密モデルに近い品質を低遅延で出します。
256K コンテキスト
256K の窓が長いファイルやツールトレースを 1 回に保持し、Qwen3.5 122B A10B API への入力分割はほぼ不要です。
崩れない推論
Qwen3.5 世代は多段推論と指示追従を磨き、Qwen3.5 122B A10B API は難問でも脱線せずに解き進めます。
コーディングとエージェント
強力なコード生成、レビュー、ツール利用で、Qwen3.5 122B A10B API は開発者ツールの基盤になります。
ツールと JSON
関数呼び出しと構造化 JSON を標準 OpenAI スキーマで返すので、Qwen3.5 122B A10B API はエージェントに適合します。
ストリーミング
トークンをストリームし、入力 $0.34、出力 $2.72、標準より 15% 安、リクエスト料なしで課金します。

3 ステップで Qwen3.5 122B A10B API を呼ぶ
一度つなげば、あとはストリーム。
キーを作成
一つの RouterBase キーが Qwen3.5 122B A10B API とカタログの全モデルに届きます。
クライアントを向ける
OpenAI クライアントを routerbase.com/v1 へ、model=qwen/qwen3.5-122b-a10b と messages で送ると Qwen3.5 122B A10B API が答えます。
ストリームと使用量
モデルは使用量を応答ごとに返すので、Qwen3.5 122B A10B API の各呼び出しでコストと遅延が見えます。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
| 解像度 | RouterBase | 公式 | 節約 |
|---|---|---|---|
| Input (per 1M) | $0.340 | −15% | |
| Output (per 1M) | $2.720 | −15% |
デフォルト設定(Input (per 1M))では 1 回あたり $0.340 です。$1 でこのモデルを約 2 回呼び出せます。
標準価格 = Alibaba Qwen の Qwen3.5 122B A10B 掲載レート(入力 100 万 $0.40、出力 100 万 $3.20)。RouterBase は Qwen3.5 122B A10B API を $0.34 / $2.72、標準より 15% 安く提供します。
Qwen3.5 122B A10B API 上で構築するチーム
推論もエージェントも一つの呼び出しに。
256K で Qwen3.5 122B A10B API は資料とトレースを 1 パスで読みます。
標準スキーマのおかげで初日から Qwen3.5 122B A10B API 上で動きました。
入力 $0.34、出力 $2.72 で、Qwen3.5 122B A10B API はタスク単価を予測可能に保ちました。
Qwen3.5 122B A10B API のストリーミングは滑らかで、UI は逐次描画します。
JSON 抽出を Qwen3.5 122B A10B API に回すと毎回きれいに返ります。
Qwen3.5 122B A10B API は高価なモデルが要った多段チケットを解きます。
別社から Qwen3.5 122B A10B API への切り替えは 1 文字列だけでした。
多言語カバレッジこそ Qwen3.5 122B A10B API に標準化した理由です。
Qwen3.5 122B A10B API —— よくある質問
トラフィックを流す前に。
Alibaba Qwen3.5 122B A10B への RouterBase ホスト型アクセスで、総 122B、アクティブ 10B の MoE LLM を OpenAI 互換で提供します。