Fizemos um piloto da DeepSeek V3.2 Exp API para ver a atenção esparsa nos nossos próprios dados antes de nos comprometermos.
Loading model information...
DeepSeek V3.2 Exp API — A prévia experimental de atenção esparsa
A DeepSeek V3.2 Exp API serve o DeepSeek-V3.2-Exp, o lançamento experimental onde a DeepSeek Sparse Attention estreou — uma prévia da arquitetura de próxima geração pelo mesmo preço baixo.
O DeepSeek-V3.2-Exp é o modelo experimental que introduziu a DeepSeek Sparse Attention, construído sobre a base do V3.1-Terminus como um passo intermediário rumo à arquitetura de próxima geração. A DeepSeek V3.2 Exp API deixa você testar essa nova atenção em cargas reais cedo: qualidade próxima do V3.1-Terminus com o custo de contexto longo cortado a fundo, mantendo o design híbrido que deixa você pensar passo a passo ou responder direto por requisição. É o lugar para validar a atenção esparsa antes que ela vire seu padrão.
Você chama a DeepSeek V3.2 Exp API pela RouterBase no protocolo chat-completions da OpenAI; defina o modelo como deepseek-v3-2-exp e seu cliente não muda. A DeepSeek V3.2 Exp API cobra $0.028 por 1M de entrada, $0.42 por 1M de saída e $0.028 por entrada em cache — 5% abaixo da tabela, com uma chave que alcança todo o catálogo.
O que a DeepSeek V3.2 Exp API entrega
Onde a atenção esparsa foi enviada primeiro.
Prévia experimental
A DeepSeek V3.2 Exp API é o lançamento experimental onde a atenção esparsa estreou — uma prévia da arquitetura de próxima geração.
Atenção esparsa, primeiro
A DeepSeek Sparse Attention chegou aqui primeiro, então a DeepSeek V3.2 Exp API corta a fundo o custo de contexto longo.
Sobre o V3.1-Terminus
Partindo da base do V3.1-Terminus, a DeepSeek V3.2 Exp API mantém qualidade quase à altura enquanto testa a nova atenção.
Mantém o pensamento híbrido
Pense passo a passo ou responda direto por requisição; a DeepSeek V3.2 Exp API leva os dois modos em um modelo.
Mesmo preço baixo
A $0.028 de entrada e $0.42 de saída, a DeepSeek V3.2 Exp API custa o mesmo que a linha estável — 5% abaixo da tabela.
No formato OpenAI
Um endpoint chat-completions, uma chave da RouterBase — aponte para routerbase.com/v1, nomeie o modelo e pule o SDK da DeepSeek.

Primeira chamada à DeepSeek V3.2 Exp API em três passos
Conecte uma vez e depois compare com seu modelo atual.
Crie uma chave
Uma chave da RouterBase alcança a DeepSeek V3.2 Exp API e todos os demais modelos do catálogo.
Aponte e escolha o modo
Envie qualquer cliente OpenAI para routerbase.com/v1 com model=deepseek/deepseek-v3.2-exp, e ligue ou desligue o pensamento por requisição.
Teste e compare
A DeepSeek V3.2 Exp API devolve o uso de tokens por resposta, então você pesa qualidade e custo contra seu modelo atual.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
Equipes testando a DeepSeek V3.2 Exp API
Atenção esparsa, testada em cargas reais.
Qualidade próxima do Terminus por uma fração do custo de contexto longo — a DeepSeek V3.2 Exp API valeu o experimento.
Rodar a DeepSeek V3.2 Exp API ao lado do nosso modelo estável tornou a comparação fácil.
A $0.028 de entrada, testar a DeepSeek V3.2 Exp API quase não nos custou nada.
Trocamos uma string e a DeepSeek V3.2 Exp API já respondia aos nossos prompts de contexto longo.
Os modos híbridos vieram junto, então nosso arnês de avaliação rodou na DeepSeek V3.2 Exp API sem mudanças.
A atenção esparsa aguentou nos nossos documentos mais longos quando testamos a DeepSeek V3.2 Exp API.
A DeepSeek V3.2 Exp API nos deixou ver a arquitetura de próxima geração sem uma migração.
Mantivemos nosso modelo estável em produção e usamos a DeepSeek V3.2 Exp API para planejar a troca.
DeepSeek V3.2 Exp API — perguntas comuns
O que saber antes de fazer o piloto.
O acesso hospedado da RouterBase ao DeepSeek-V3.2-Exp, o lançamento experimental que introduziu a DeepSeek Sparse Attention, por um endpoint compatível com OpenAI.