A DeepSeek V3.1 API nos deixou eliminar dois modelos separados — pensar para os tickets difíceis, direto para o resto, tudo atrás de uma chamada.
Loading model information...
DeepSeek V3.1 API — Um modelo, pensar e responder
A DeepSeek V3.1 API executa o DeepSeek V3.1, um modelo híbrido que pode raciocinar passo a passo ou responder direto — você escolhe o modo por requisição.
O DeepSeek V3.1 reúne dois comportamentos em um modelo: um modo de pensamento que raciocina passo a passo e um modo direto que responde na hora. A DeepSeek V3.1 API deixa você alternar entre eles por requisição, então problemas difíceis recebem deliberação e os simples uma resposta rápida e barata — sem segundo modelo, sem segundo endpoint. Ela mantém as forças do V3 em código e tool use, com uma janela de contexto de 128K para arquivos e transcrições longas.
Você chama a DeepSeek V3.1 API pela RouterBase no protocolo chat-completions da OpenAI; defina o modelo como deepseek-v3-1 e seu cliente atual funciona sem mudanças. A DeepSeek V3.1 API cobra $0.27 por 1M de tokens de entrada, $1.10 por 1M de saída e $0.07 por entrada em cache — 5% abaixo da tabela, com uma chave que alcança todo o catálogo.
O que a DeepSeek V3.1 API entrega
Deliberação quando ajuda, resposta direta quando não.
Dois modos, um modelo
A DeepSeek V3.1 API alterna entre pensar e responder direto por requisição, então você ajusta o esforço à tarefa sem trocar de modelo.
Raciocina quando ajuda
Ligue o pensamento e a DeepSeek V3.1 API trabalha matemática, código e problemas de vários passos antes de responder.
Responde quando não
No modo direto a DeepSeek V3.1 API responde reto, mantendo baixas a latência e o custo em chamadas de rotina.
Código e ferramentas
Código forte mais chamada de funções confiável fazem da DeepSeek V3.1 API um backbone sólido para assistentes de IDE e agentes.
Contexto de 128K
Uma janela de 128K deixa a DeepSeek V3.1 API segurar arquivos, transcrições e traços de ferramentas longos numa única chamada.
Barata, com cache
A $0.27 de entrada e $1.10 de saída — mais $0.07 de entrada em cache — a DeepSeek V3.1 API segue acessível em escala, 5% abaixo da tabela.

Primeira chamada à DeepSeek V3.1 API em três passos
Conecte uma vez e depois troque de modo à vontade.
Crie uma chave
Uma chave da RouterBase alcança a DeepSeek V3.1 API e todos os demais modelos do catálogo.
Aponte e escolha o modo
Envie qualquer cliente OpenAI para routerbase.com/v1 com model=deepseek/deepseek-v3.1, e ligue ou desligue o pensamento por requisição.
Olhe o uso
A DeepSeek V3.1 API devolve o uso de tokens por resposta, então custo e latência ficam à vista em cada chamada.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
Equipes construindo sobre a DeepSeek V3.1 API
Raciocínio e resposta direta atrás de uma única chamada.
Desligar o pensamento nas buscas baixou nossa latência e conta sem tocar na qualidade do caminho difícil.
Um modelo com dois modos significou que a DeepSeek V3.1 API substituiu um roteador que mantínhamos à mão.
A $0.27 de entrada com leituras em cache a $0.07, a DeepSeek V3.1 API manteve nossos custos planos com o crescimento do tráfego.
A chamada de funções é confiável, então toda a nossa pilha de agentes roda sobre a DeepSeek V3.1 API.
Ligamos o pensamento para avaliações e desligamos em produção — mesmo modelo, mesma chave.
A janela de 128K deixou a DeepSeek V3.1 API ler o arquivo inteiro do nosso repo numa passada.
Trocar do nosso endpoint antigo para a DeepSeek V3.1 API foi uma string; o modo híbrido foi um bônus.
Roteamos raciocínio difícil e chat rápido para a mesma DeepSeek V3.1 API e só trocamos o modo.
DeepSeek V3.1 API — perguntas comuns
O que saber antes de mandar tráfego para ela.
O acesso hospedado da RouterBase ao DeepSeek V3.1, um modelo híbrido que pode raciocinar passo a passo ou responder direto, por um endpoint compatível com OpenAI.