我們把代理棧遷到 Qwen3.5 122B A10B API,10B 啟用預算讓 p95 延遲幾乎減半,品質不變。
Qwen3.5 122B A10B 是阿里 Qwen 出品的 MoE 大模型,122B 總參數、約 10B 啟用,帶 256K 上下文,推理、程式設計與多語言能力都很強。在 RouterBase 上透過相容 OpenAI 的端點提供,輸入 $0.34 / 1M、輸出 $2.72 / 1M,比標準價低 15%。
Qwen3.5 122B A10B API —— 122B MoE、10B 啟用、256K 上下文
Qwen3.5 122B A10B API 執行 122B 總參數、約 10B 啟用的 MoE 大模型,帶 256K 上下文,推理、程式設計與多語言對話都很強。
Qwen3.5 122B A10B API 提供 Alibaba Qwen3.5 122B A10B,一個 122B 總參數、約 10B 啟用的專家混合(MoE)大語言模型。稀疏路由讓每個 token 只經過一小組專家,你用小模型的延遲與單 token 成本,拿到接近超大稠密網路的回答品質;256K token 上下文視窗能把長檔案、對話記錄與工具軌跡輕鬆裝進一次呼叫,指令微調讓回答直接、不偏題。你透過 RouterBase、以 OpenAI chat-completions 協定存取 Qwen3.5 122B A10B API,現有用戶端指過來就能原樣運作,沒有新 SDK 要學,一把金鑰覆蓋整個目錄。
在底層,Qwen3.5 122B A10B 針對多步推理、程式碼生成與審查、代理工具呼叫、結構化 JSON 抽取以及覆蓋 100+ 種語言的多語言助手做了針對性調優。計費為每百萬輸入 token $0.34、每百萬輸出 token $2.72,比 $0.40 / $3.20 的標價低 15%,按 token 計費,無每請求費,成本可預期。模型隨生成串流回傳 token,並以標準 OpenAI 模式回傳工具呼叫,因此 Qwen3.5 122B A10B API 能直接接進代理迴圈、IDE 助手與批次流水線,無需編寫廠商專屬的膠水程式碼,從原型擴到生產都穩。
Qwen3.5 122B A10B API 給你什麼
10B 啟用預算下的旗艦級品質。
122B MoE、10B 啟用
Qwen3.5 122B A10B API 讓每個 token 只經過 1220 億參數網路中的一小組專家,品質接近更大的稠密模型,延遲卻保持很低。
256K 上下文
256K token 視窗讓模型在一次呼叫裡容納長檔案、對話記錄與工具軌跡,因此你很少需要為 Qwen3.5 122B A10B API 切分輸入。
扛得住的推理
Qwen3.5 世代強化了多步推理與指令遵循,Qwen3.5 122B A10B API 能啃下硬問題而不偏題。
程式設計與代理
強程式碼生成、審查與代理工具呼叫,讓 Qwen3.5 122B A10B API 成為開發者工具與自動化流程的可靠骨幹。
工具與 JSON
以標準 OpenAI 模式回傳函式呼叫與結構化 JSON,Qwen3.5 122B A10B API 適配代理與資料流水線。
串流、按 token
隨生成串流回傳 token,按 token 計費,輸入 $0.34、輸出 $2.72,比標價低 15%,無請求費。

三步完成對 Qwen3.5 122B A10B API 的首次呼叫
接一次線,之後隨意串流。
建立金鑰
一把 RouterBase 金鑰即可存取 Qwen3.5 122B A10B API 及目錄裡的每個模型,沒有廠商專屬的東西要設定。
指向用戶端
把任意 OpenAI 用戶端發往 routerbase.com/v1,model=qwen/qwen3.5-122b-a10b,帶上 messages 陣列;Qwen3.5 122B A10B API 在同樣的 chat-completions 形態上作答。
串流並盯用量
模型隨生成串流回傳 token,並按回應回傳 token 用量,因此每次呼叫 Qwen3.5 122B A10B API 的成本與延遲都可見。
按使用量付費
RouterBase 透傳合作方價格,與模型官方公開 API 價格對比。
按使用量付費
RouterBase 透傳合作方價格,與模型官方公開 API 價格對比。
| 解析度 | RouterBase | 官方 | 節省 |
|---|---|---|---|
| Input (per 1M) | $0.340 | −15% | |
| Output (per 1M) | $2.720 | −15% |
預設配置(Input (per 1M))單次呼叫 $0.340。$1 大約可以呼叫本模型 2 次。
官方價 = Alibaba Qwen 對 Qwen3.5 122B A10B 的標價(每百萬輸入 $0.40、每百萬輸出 $3.20)。RouterBase 以 $0.34 / $2.72 提供 Qwen3.5 122B A10B API,比標價低 15%。
正在基於 Qwen3.5 122B A10B API 建構的團隊
推理、代理與對話同在一次呼叫背後。
256K 上下文讓 Qwen3.5 122B A10B API 一次讀完整份設計文件加工具軌跡——再也不用切分。
標準模式的函式呼叫,意味著我們的代理第一天就跑在 Qwen3.5 122B A10B API 上,零自訂解析。
輸入 $0.34、輸出 $2.72,Qwen3.5 122B A10B API 讓我們在流量攀升時把每任務成本保持可預期。
從 Qwen3.5 122B A10B API 串流很順,我們的聊天 UI 逐 token 渲染,無需額外緩衝工作。
我們把程式碼審查與 JSON 抽取交給 Qwen3.5 122B A10B API,結構化輸出每次都乾淨地回傳。
推理品質讓我們意外——Qwen3.5 122B A10B API 能啃下過去要用更貴模型才能做的多步工單。
從另一家切到 Qwen3.5 122B A10B API 只改了一個字串——OpenAI 形態完全沒動。
多語言覆蓋正是我們統一到 Qwen3.5 122B A10B API 的原因;葡萄牙語與英語的回答一樣出色。
Qwen3.5 122B A10B API —— 常見問題
把流量導過來之前該知道的。
它是 RouterBase 對 Alibaba Qwen3.5 122B A10B 的託管接入——一個 122B 總參數、10B 啟用的 MoE 大模型,透過相容 OpenAI 的端點提供。