chat.deepseek_v3_2
chat.deepseek_v3_2

Loading model information...

Input
DeepSeek V3.2
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
DeepSeek V3.2 Online
Hi! I'm a helpful AI assistant. What can I do for you?

DeepSeek V3.2 API — Contexto longo, atenção esparsa, radicalmente mais barato

A DeepSeek V3.2 API executa o DeepSeek V3.2, que usa atenção esparsa para sustentar contexto longo por uma fração do custo antigo — $0.028 por 1M de entrada.

O DeepSeek V3.2 reconstrói a camada de atenção em torno da DeepSeek Sparse Attention, então o trabalho de contexto longo já não escala como antes. A DeepSeek V3.2 API passa essa eficiência direto para você: $0.028 por 1M de tokens de entrada e $0.42 por 1M de saída — cerca da metade da geração anterior — mantendo o design híbrido que deixa você pensar passo a passo ou responder direto por requisição. Arquivos longos, transcrições longas e traços de ferramentas longos seguem acessíveis em escala.

Você chama a DeepSeek V3.2 API pela RouterBase no protocolo chat-completions da OpenAI; defina o modelo como deepseek-v3-2 e seu cliente não muda. A DeepSeek V3.2 API cobra $0.028 por 1M de entrada, $0.42 por 1M de saída e $0.028 por entrada em cache — 5% abaixo da tabela, com uma chave que alcança todo o catálogo.

Contexto longo barato

O que a DeepSeek V3.2 API entrega

A atenção esparsa baixa a conta do contexto longo.

Atenção esparsa

A DeepSeek Sparse Attention deixa a DeepSeek V3.2 API lidar com contexto longo sem a curva de custo habitual.

Radicalmente mais barata

A $0.028 de entrada e $0.42 de saída, a DeepSeek V3.2 API roda a cerca da metade da geração anterior — 5% abaixo da tabela.

Contexto longo, baixo custo

Arquivos e transcrições longos seguem acessíveis, então a DeepSeek V3.2 API encaixa em trabalho de alto volume e entrada longa.

Mantém o pensamento híbrido

Pense passo a passo ou responda direto por requisição; a DeepSeek V3.2 API leva os dois modos em um modelo.

Código e ferramentas

Código forte mais chamada de funções confiável fazem da DeepSeek V3.2 API um backbone sólido para assistentes e agentes.

No formato OpenAI

Um endpoint chat-completions, uma chave da RouterBase — aponte para routerbase.com/v1, nomeie o modelo e pule o SDK da DeepSeek.

RouterBase dashboard preview
Vamos lá

Primeira chamada à DeepSeek V3.2 API em três passos

Conecte uma vez e depois mande entradas longas.

  1. Crie uma chave

    Uma chave da RouterBase alcança a DeepSeek V3.2 API e todos os demais modelos do catálogo.

  2. Aponte e escolha o modo

    Envie qualquer cliente OpenAI para routerbase.com/v1 com model=deepseek/deepseek-v3.2, e ligue ou desligue o pensamento por requisição.

  3. Olhe o uso

    A DeepSeek V3.2 API devolve o uso de tokens por resposta, então custo e latência ficam à vista em cada chamada.

Preços

Paga apenas pelo que usas

A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.

Barata em escala

Equipes construindo sobre a DeepSeek V3.2 API

Contexto longo que enfim cabe no orçamento.

Camila RossiHead of Data, Larkspur

Trabalhos de contexto longo que antes estouravam nosso orçamento agora rodam na DeepSeek V3.2 API por uma fração do custo.

Anders HolmStaff Engineer, Kvarn

A $0.028 por 1M de entrada, a DeepSeek V3.2 API nos deixou parar de cortar prompts para economizar.

Meera IyerCTO, Tidewater

A atenção esparsa é o motivo de nossas transcrições longas enfim caberem no orçamento na DeepSeek V3.2 API.

Julien RoyFounder, Maree

Mantivemos os modos híbridos e quase dividimos ao meio nossa conta ao mudar para a DeepSeek V3.2 API.

Wei ChenBackend Lead, Greywater

A DeepSeek V3.2 API seguiu barata mesmo quando nossas janelas de contexto cresceram, algo que os modelos antigos nunca fizeram.

Nomvula DlaminiML Lead, Baobab Grid

A chamada de funções aguentou, então nossos agentes migraram para a DeepSeek V3.2 API sem reescrita.

Sana QureshiPrincipal Engineer, Almond

Uma string mudada do nosso endpoint antigo; a queda de custo na DeepSeek V3.2 API foi imediata.

Pedro RamosFounder, Cala

Agora damos documentos inteiros à DeepSeek V3.2 API porque o preço de contexto longo enfim faz sentido.

Elin VikstromEngineering Manager, Snofall

Mesma chave, contexto longo mais barato — a DeepSeek V3.2 API foi uma decisão fácil para nós.

DeepSeek V3.2 API — perguntas comuns

O que saber antes de mandar tráfego para ela.

O acesso hospedado da RouterBase ao DeepSeek V3.2, que usa atenção esparsa para uma inferência de contexto longo mais barata, por um endpoint compatível com OpenAI.