過去把預算撐爆的長上下文任務,如今在 DeepSeek V3.2 API 上只花零頭。
Loading model information...
DeepSeek V3.2 API —— 長上下文,稀疏注意力,價格驟降
DeepSeek V3.2 API 執行 DeepSeek V3.2,用稀疏注意力以舊成本的零頭承載長上下文——每百萬輸入 $0.028。
DeepSeek V3.2 圍繞 DeepSeek 稀疏注意力(DSA)重建了注意力層,長上下文的成本不再按舊規律膨脹。DeepSeek V3.2 API 把這份效率直接給你:每百萬輸入 token $0.028、輸出 $0.42——大約是上一代的一半——同時保留混合設計,讓你按請求逐步思考或直接作答。長檔案、長記錄、長工具軌跡在大規模下依舊划算。
你透過 RouterBase、以 OpenAI chat-completions 協議呼叫 DeepSeek V3.2 API;把模型設為 deepseek-v3-2,客戶端無需改動。DeepSeek V3.2 API 計費為每百萬輸入 $0.028、輸出 $0.42、快取輸入 $0.028——比標價低 5%,一把金鑰貫通整個目錄。
DeepSeek V3.2 API 給你什麼
稀疏注意力把長上下文的帳單壓下來。
稀疏注意力
DeepSeek 稀疏注意力讓 DeepSeek V3.2 API 承載長上下文時不再走舊的成本曲線。
價格驟降
輸入 $0.028、輸出 $0.42,DeepSeek V3.2 API 大約以上一代的一半運行——比標價低 5%。
長上下文,低成本
長檔案與記錄依舊划算,DeepSeek V3.2 API 適配高並發、長輸入的工作。
保留混合思考
按請求逐步思考或直接作答;DeepSeek V3.2 API 把兩種模式裝進一個模型。
程式設計與工具
強程式設計加可靠的函式呼叫,讓 DeepSeek V3.2 API 成為助手與代理的扎實骨幹。
OpenAI 形態
一個 chat-completions 端點、一把 RouterBase 金鑰——指向 routerbase.com/v1、寫上模型名,跳過 DeepSeek SDK。

三步完成對 DeepSeek V3.2 API 的首次呼叫
接一次線,然後餵給它長輸入。
建立金鑰
一把 RouterBase 金鑰即可存取 DeepSeek V3.2 API 及目錄裡的每個模型。
指向並選模式
把任意 OpenAI 客戶端發往 routerbase.com/v1,model=deepseek/deepseek-v3.2,並按請求開關思考。
盯住用量
DeepSeek V3.2 API 隨每個回應返回 token 用量,成本與延遲按次可見。
按使用量付費
RouterBase 透傳合作方價格,與模型官方公開 API 價格對比。
正在基於 DeepSeek V3.2 API 打造的團隊
長上下文終於裝進了預算。
每百萬輸入 $0.028,DeepSeek V3.2 API 讓我們不用再為省錢裁剪提示。
正是稀疏注意力,讓我們的長記錄終於在 DeepSeek V3.2 API 上裝進了預算。
換到 DeepSeek V3.2 API,我們保留了混合模式,帳單卻大約減半。
即便上下文視窗變大,DeepSeek V3.2 API 依舊便宜,這是舊模型做不到的。
函式呼叫很穩,我們的代理無需重寫就遷到了 DeepSeek V3.2 API。
相較舊端點只改了一個字串;DeepSeek V3.2 API 的成本下降立竿見影。
現在我們把整份文件餵給 DeepSeek V3.2 API,因為長上下文的價格終於說得通了。
同一把金鑰、更便宜的長上下文——DeepSeek V3.2 API 對我們是很容易的選擇。
DeepSeek V3.2 API —— 常見問題
把流量導過來之前該知道的。
RouterBase 對 DeepSeek V3.2 的託管接入——它用稀疏注意力實現更便宜的長上下文推理,透過相容 OpenAI 的端點提供。