chat.qwen2_5_72b_instruct
alibaba/qwen2-5-72b-instruct

Qwen2.5 72B Instruct 是阿里 Qwen 出品的稠密 72B 指令微調大模型,帶 128K 上下文,多語言、程式設計與數學能力都很強。在 RouterBase 上透過相容 OpenAI 的端點提供,輸入 $0.38 / 1M、輸出 $0.40 / 1M,比標準價低 5%。

Input
Qwen2.5 72B Instruct
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Qwen2.5 72B Instruct Online
Hi! I'm a helpful AI assistant. What can I do for you?

Qwen2.5 72B Instruct API —— 稠密 72B,128K 上下文

Qwen2.5 72B Instruct API 執行 Qwen2.5 72B Instruct,一個稠密的 72B 指令微調大模型,帶 128K 上下文,在多語言對話、程式設計與數學上都很強。

Qwen2.5 72B Instruct API 提供 Alibaba Qwen2.5 72B Instruct,一個稠密的 720 億參數指令微調大語言模型。專家混合(MoE)架構會讓每個 token 只經過一小部分權重,而這個模型跑的是完全稠密的網路,因此每個參數都參與到每個 token。這帶來跨對話、程式設計、數學與推理的穩定、可預期的品質,而 128K token 上下文視窗意味著長檔案、對話記錄與工具軌跡都能裝進一次呼叫。你透過 RouterBase、以 OpenAI chat-completions 協定存取 Qwen2.5 72B Instruct API,因此你已經在用的用戶端指過來那一刻就能原樣運作。沒有新 SDK 要學,也不用在不同廠商間調度配額——一把金鑰覆蓋整個目錄,你在別處發的同樣請求體,會從這個端點回傳同樣的回應結構。

在底層,Qwen2.5 72B Instruct 面向開發者真正要交付的工作做了調優:跨 29+ 種語言的多語言助手、程式碼生成與審查、結構化 JSON 抽取以及多步工具呼叫。Qwen2.5 72B Instruct API 把這些都放在一個端點、一把金鑰背後回答。計費為每百萬輸入 token $0.38、每百萬輸出 token $0.40,比 $0.40 輸入 / $0.42 輸出的標價低 5%,按 token 計費,無每請求費。因為模型隨生成串流回傳 token,並以標準 OpenAI 模式回傳工具呼叫,你可以把 Qwen2.5 72B Instruct API 接進代理迴圈、IDE 助手或批次流水線,而不用寫廠商專屬的膠水程式碼。看重長上下文與多語言覆蓋的團隊往往最先選它,稠密架構讓延遲與品質在你從原型擴展到生產流量時保持穩定。

稠密、長上下文、多語言

Qwen2.5 72B Instruct API 給你什麼

每個 token 都是深思熟慮的品質。

稠密 72B 模型

請參見描述。Qwen2.5 72B Instruct API 跑完全稠密的 720 億參數網路,因此在對話、程式設計與推理上品質一致,沒有專家路由帶來的意外。

128K 上下文

128K token 視窗讓模型在一次呼叫裡容納長檔案、對話記錄與工具軌跡,因此你很少需要為該 API 切分輸入。

天生多語言

在 29+ 種語言上訓練,Qwen2.5 72B Instruct API 能處理英語、中文以及數十種語言,用於多語言對話、翻譯與支援。

程式設計與數學

強程式碼生成、審查與數學推理,讓 Qwen2.5 72B Instruct API 成為開發者工具與技術助手的可靠骨幹。

工具與 JSON

以標準 OpenAI 模式回傳函式呼叫與結構化 JSON,Qwen2.5 72B Instruct API 適配代理與資料流水線。

串流、按 token

隨生成串流回傳 token,按 token 計費,輸入 $0.38、輸出 $0.40,比標價低 5%,無請求費。

RouterBase dashboard preview
開跑

三步完成對 Qwen2.5 72B Instruct API 的首次呼叫

接一次線,之後隨意串流。

  1. 建立金鑰

    一把 RouterBase 金鑰即可存取 Qwen2.5 72B Instruct API 及目錄裡的每個模型,沒有廠商專屬的東西要設定。

  2. 指向用戶端

    把任意 OpenAI 用戶端發往 routerbase.com/v1,model=qwen/qwen-2.5-72b-instruct,帶上 messages 陣列;Qwen2.5 72B Instruct API 在同樣的 chat-completions 形態上作答。

  3. 串流並盯用量

    模型隨生成串流回傳 token,並按回應回傳 token 用量,因此每次呼叫 Qwen2.5 72B Instruct API 的成本與延遲都可見。

定價

按使用量付費

RouterBase 透傳合作方價格,與模型官方公開 API 價格對比。

定價

按使用量付費

RouterBase 透傳合作方價格,與模型官方公開 API 價格對比。

解析度RouterBase官方節省
Input (per 1M) $0.380$0.400−5%
Output (per 1M) $0.400$0.420−5%

預設配置(Input (per 1M))單次呼叫 $0.380$1 大約可以呼叫本模型 2 次。

官方價 = Alibaba Qwen 對 Qwen2.5 72B Instruct 的標價(每百萬輸入 $0.40、每百萬輸出 $0.42)。RouterBase 以 $0.38 / $0.40 提供 Qwen2.5 72B Instruct API,比標價低 5%。

基於 Qwen2.5 交付

正在基於 Qwen2.5 72B Instruct API 建構的團隊

多語言對話與程式設計同在一次呼叫背後。

Marisol ReyesHead of AI, Cardinal

我們把多語言支援機器人遷到 Qwen2.5 72B Instruct API,128K 上下文讓我們一夜之間不再切分長對話歷史。

Tobias FrankStaff Engineer, Halden

稠密權重讓輸出可預期——Qwen2.5 72B Instruct API 在每個工單上給出同樣的品質,我們的評測很喜歡。

Priya DeshpandeCTO, Meridian Labs

標準模式的函式呼叫,意味著我們的代理棧第一天就跑在 Qwen2.5 72B Instruct API 上,零自訂解析。

Omar HaddadFounder, Sable

輸入 $0.38、輸出 $0.40,Qwen2.5 72B Instruct API 讓我們在一季流量攀升時把每 token 成本壓得很平。

Klara NovakBackend Lead, Vireo

從 Qwen2.5 72B Instruct API 串流很順,我們的聊天 UI 逐 token 渲染,無需額外緩衝工作。

Daniel OkaforML Lead, Beacon Grid

我們把程式碼審查與 JSON 抽取交給 Qwen2.5 72B Instruct API,結構化輸出每次都乾淨地回傳。

Hana KimPrincipal Engineer, Northwind

128K 視窗讓 Qwen2.5 72B Instruct API 一次讀完整個服務檔案加它的測試,加快了我們的評審。

Leo FontaineFounder, Coteau

從另一家切到 Qwen2.5 72B Instruct API 只改了一個字串——OpenAI 形態完全沒動。

Mateus AlvesEngineering Manager, Praia Tech

多語言覆蓋正是我們統一到 Qwen2.5 72B Instruct API 的原因;葡萄牙語與英語的回答一樣出色。

Qwen2.5 72B Instruct API —— 常見問題

把流量導過來之前該知道的。

它是 RouterBase 對 Alibaba Qwen2.5 72B Instruct 的託管接入——一個稠密的 72B 指令微調大模型,透過相容 OpenAI 的端點提供。