Enviamos o nosso raciocínio mais difícil para a Kimi K2 Thinking API —— o pensamento passo a passo resolve casos que o nosso modelo direto continuava a falhar.
A Kimi K2 Thinking API é o modelo de raciocínio Kimi K2 de pesos abertos da Moonshot AI —— raciocina os problemas passo a passo com chain-of-thought estendido para tarefas difíceis de raciocínio, matemática e agentes, com tool calling nativo, saídas estruturadas e uma janela de contexto longa. A Kimi K2 Thinking API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e defina o modelo como kimi-k2-thinking. Entrada a $0.51 / 1M tokens, saída a $2.125 / 1M —— 15% abaixo do oficial, tudo por um endpoint REST.
Kimi K2 Thinking API: Chat
Use a Kimi K2 Thinking API para executar o modelo de raciocínio da Moonshot AI —— a Kimi K2 Thinking raciocina os problemas passo a passo com chain-of-thought estendido, para as tarefas mais difíceis de raciocínio, matemática e agentes, de pesos abertos.
A Kimi K2 Thinking API é o modelo de raciocínio Kimi K2 de pesos abertos da Moonshot AI —— raciocina os problemas com chain-of-thought estendido para tarefas difíceis de raciocínio, matemática e agentes, com tool calling nativo, saídas estruturadas e uma janela de contexto longa. Através da RouterBase, a Kimi K2 Thinking API é totalmente compatível com OpenAI: aponte qualquer SDK existente para a base URL da RouterBase, defina o modelo como kimi-k2-thinking e a sua primeira chamada à Kimi K2 Thinking API passa de imediato.
O preço da Kimi K2 Thinking API é $0.51 / 1M de entrada e $2.125 / 1M de saída — 15% abaixo da tarifa oficial, com uma chave RouterBase (sem conta Moonshot AI).
Seis razões para usar a Kimi K2 Thinking API
De um raciocínio profundo e passo a passo ao preço com 15% de desconto —— o que distingue a Kimi K2 Thinking API.
Pensa antes de responder
A Kimi K2 Thinking gasta computação em tempo de teste a raciocinar um problema —— chain-of-thought estendido que resolve matemática, lógica e planeamento de vários passos onde os modelos diretos adivinham.
Código e agentes de nível raciocínio
A Kimi K2 Thinking API raciocina ao longo de longas cadeias de ferramentas —— planeia, autocorrige-se e resolve tarefas complexas de código e agentes em vez de as despachar de uma vez.
Tool calling nativo
A Kimi K2 Thinking API chama ferramentas no formato OpenAI e raciocina entre chamadas —— a Kimi K2 foi construída para o uso de ferramentas, por isso os agentes que pensam encaixam sem cola à medida.
Janela de contexto longa
A Kimi K2 Thinking API aceita contexto longo —— ponha bases de código completas, documentos longos ou uma trajetória inteira de raciocínio numa única chamada.
Compatível com OpenAI, uma chave
A Kimi K2 Thinking API usa o formato chat-completions da OpenAI, por isso uma chave RouterBase coloca a Kimi K2 Thinking ao lado de GPT-5.5, Claude, Gemini e mais de 200 modelos.
15% abaixo do preço de tabela
A Kimi K2 Thinking custa 15% menos que a tarifa publicada da Moonshot AI —— $0.51 / 1M entrada, $2.125 / 1M saída. Raciocínio de nível fronteira a preços de pesos abertos, cobrado por token.

Comece a usar a Kimi K2 Thinking API em 3 passos
Do registo à primeira resposta em menos de 5 minutos.
Crie uma chave RouterBase
Registe-se e crie uma chave —— chega à Kimi K2 Thinking e a todos os outros modelos do catálogo da RouterBase a partir de uma só conta.
Envie a primeira mensagem
Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como kimi-k2-thinking. Streaming, chamadas de ferramentas e saídas estruturadas seguem todos o esquema padrão chat-completions.
Inspecione o uso
Cada resposta da Kimi K2 Thinking API devolve um detalhe de tokens —— entrada e saída —— para que o custo fique visível em cada chamada.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
O que as equipas constroem com a Kimi K2 Thinking API
Cargas de produção reais sobre o catálogo de mais de 200 modelos da RouterBase.
A Kimi K2 Thinking é o nosso modelo para planeamento complexo pela RouterBase —— raciocina toda a tarefa em vez de adivinhar o primeiro passo.
Os nossos agentes raciocinam entre chamadas de ferramentas na Kimi K2 Thinking API —— menos becos sem saída em trabalhos longos de vários passos.
Fazemos A/B da Kimi K2 Thinking API contra raciocinadores de fronteira atrás de uma só chave RouterBase —— aguenta nas nossas evals de matemática e lógica por muito menos.
Passar os nossos prompts difíceis para a Kimi K2 Thinking API foi uma só troca de base URL, e as respostas voltaram realmente raciocinadas.
As refatorações de vários passos ficaram mais fiáveis assim que as encaminhámos para a Kimi K2 Thinking API —— planeia a alteração antes de a escrever.
Para o que é complicado recorro à Kimi K2 Thinking API —— pesos abertos, raciocínio a sério e barata o suficiente para a deixar pensar.
No nosso conjunto de evals mais difícil, a Kimi K2 Thinking API é o melhor valor de raciocínio que testámos —— quase de fronteira a custo de modelo aberto.
A cobrança por token mantém a Kimi K2 Thinking API acessível mesmo quando gasta tokens a raciocinar —— orçamentamos para os pedidos difíceis.
Perguntas frequentes
Perguntas comuns sobre a Kimi K2 Thinking API.
A Kimi K2 Thinking API é a ligação direta da RouterBase à Kimi K2 Thinking da Moonshot AI —— o modelo de raciocínio Kimi K2 de pesos abertos que raciocina os problemas passo a passo com chain-of-thought estendido, servido por uma interface REST compatível com OpenAI com tool calling nativo e saídas estruturadas.