Trabalhos de contexto longo que antes estouravam nosso orçamento agora rodam na DeepSeek V3.2 API por uma fração do custo.
Loading model information...
DeepSeek V3.2 API — Contexto longo, atenção esparsa, radicalmente mais barato
A DeepSeek V3.2 API executa o DeepSeek V3.2, que usa atenção esparsa para sustentar contexto longo por uma fração do custo antigo — $0.028 por 1M de entrada.
O DeepSeek V3.2 reconstrói a camada de atenção em torno da DeepSeek Sparse Attention, então o trabalho de contexto longo já não escala como antes. A DeepSeek V3.2 API passa essa eficiência direto para você: $0.028 por 1M de tokens de entrada e $0.42 por 1M de saída — cerca da metade da geração anterior — mantendo o design híbrido que deixa você pensar passo a passo ou responder direto por requisição. Arquivos longos, transcrições longas e traços de ferramentas longos seguem acessíveis em escala.
Você chama a DeepSeek V3.2 API pela RouterBase no protocolo chat-completions da OpenAI; defina o modelo como deepseek-v3-2 e seu cliente não muda. A DeepSeek V3.2 API cobra $0.028 por 1M de entrada, $0.42 por 1M de saída e $0.028 por entrada em cache — 5% abaixo da tabela, com uma chave que alcança todo o catálogo.
O que a DeepSeek V3.2 API entrega
A atenção esparsa baixa a conta do contexto longo.
Atenção esparsa
A DeepSeek Sparse Attention deixa a DeepSeek V3.2 API lidar com contexto longo sem a curva de custo habitual.
Radicalmente mais barata
A $0.028 de entrada e $0.42 de saída, a DeepSeek V3.2 API roda a cerca da metade da geração anterior — 5% abaixo da tabela.
Contexto longo, baixo custo
Arquivos e transcrições longos seguem acessíveis, então a DeepSeek V3.2 API encaixa em trabalho de alto volume e entrada longa.
Mantém o pensamento híbrido
Pense passo a passo ou responda direto por requisição; a DeepSeek V3.2 API leva os dois modos em um modelo.
Código e ferramentas
Código forte mais chamada de funções confiável fazem da DeepSeek V3.2 API um backbone sólido para assistentes e agentes.
No formato OpenAI
Um endpoint chat-completions, uma chave da RouterBase — aponte para routerbase.com/v1, nomeie o modelo e pule o SDK da DeepSeek.

Primeira chamada à DeepSeek V3.2 API em três passos
Conecte uma vez e depois mande entradas longas.
Crie uma chave
Uma chave da RouterBase alcança a DeepSeek V3.2 API e todos os demais modelos do catálogo.
Aponte e escolha o modo
Envie qualquer cliente OpenAI para routerbase.com/v1 com model=deepseek/deepseek-v3.2, e ligue ou desligue o pensamento por requisição.
Olhe o uso
A DeepSeek V3.2 API devolve o uso de tokens por resposta, então custo e latência ficam à vista em cada chamada.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
Equipes construindo sobre a DeepSeek V3.2 API
Contexto longo que enfim cabe no orçamento.
A $0.028 por 1M de entrada, a DeepSeek V3.2 API nos deixou parar de cortar prompts para economizar.
A atenção esparsa é o motivo de nossas transcrições longas enfim caberem no orçamento na DeepSeek V3.2 API.
Mantivemos os modos híbridos e quase dividimos ao meio nossa conta ao mudar para a DeepSeek V3.2 API.
A DeepSeek V3.2 API seguiu barata mesmo quando nossas janelas de contexto cresceram, algo que os modelos antigos nunca fizeram.
A chamada de funções aguentou, então nossos agentes migraram para a DeepSeek V3.2 API sem reescrita.
Uma string mudada do nosso endpoint antigo; a queda de custo na DeepSeek V3.2 API foi imediata.
Agora damos documentos inteiros à DeepSeek V3.2 API porque o preço de contexto longo enfim faz sentido.
Mesma chave, contexto longo mais barato — a DeepSeek V3.2 API foi uma decisão fácil para nós.
DeepSeek V3.2 API — perguntas comuns
O que saber antes de mandar tráfego para ela.
O acesso hospedado da RouterBase ao DeepSeek V3.2, que usa atenção esparsa para uma inferência de contexto longo mais barata, por um endpoint compatível com OpenAI.