chat.kimi_k3
moonshotai/kimi-k3

O Kimi K3 e o modelo de chat de nova geracao da Moonshot AI e o sucessor do Kimi K2, feito para fluxos agenticos, raciocinio de contexto longo, chamada de ferramentas e codificacao. Servido na RouterBase por um endpoint compativel com OpenAI a $2.85 / $14.25 por 1M, 5% abaixo da tabela.

Input
Kimi K3
max_tokens4096
presence_penalty0
frequency_penalty0
Kimi K3 Online
Hi! I'm a helpful AI assistant. What can I do for you?

Kimi K3 API - Modelo Agentico de Nova Geracao

A Kimi K3 API executa o Kimi K3, o modelo de nova geracao da linha Moonshot AI Kimi e o sucessor do Kimi K2, feito para fluxos agenticos, raciocinio de contexto longo, chamada de ferramentas e codificacao.

A Kimi K3 API serve o Moonshot AI Kimi K3, a geracao mais recente da linha de chat Kimi e o sucessor do Kimi K2. O modelo foi construido para o trabalho agentico real: raciocinio de contexto longo sobre entradas grandes, chamada de ferramentas confiavel, planejamento de varios passos e codificacao que abrange um repositorio inteiro, de gerar funcoes e refatorar modulos a rastrear bugs e revisar diffs. Voce acessa a Kimi K3 API atraves da RouterBase sobre o protocolo chat-completions da OpenAI, entao seu cliente funciona sem mudancas e uma unica chave cobre todo o catalogo.

O Kimi K3 foi construido para o que os times realmente entregam: assistentes e chatbots, agentes autonomos, pesquisa e analise, bots de revisao e fluxos de documentos longos. A cobranca e de $2.85 por 1M de tokens de entrada e $14.25 por 1M de saida, 5% abaixo da tarifa de tabela de $3.00 e $15.00, mais apenas $0.285 por 1M de entrada em cache, sem taxa por requisicao. As chamadas de ferramentas voltam no esquema padrao da OpenAI, entao a Kimi K3 API encaixa em um loop de agente ou um job de CI sem cola do provedor.

Agentico, raciocinio, streaming

O que a Kimi K3 API te da

Um modelo de chat que raciocina, chama ferramentas e entrega.

Modelo Kimi de nova geracao

A Kimi K3 API executa a geracao mais recente da linha Kimi, o sucessor do Kimi K2, ajustada de ponta a ponta para raciocinio agentico, uso de ferramentas e codificacao em trabalho real.

Loops de codificacao agentica

Planejar, chamar ferramentas, editar e retestar: a Kimi K3 API devolve chamadas de funcoes no esquema padrao da OpenAI, entao agentes de codigo rodam tarefas de varios passos sem parse personalizado.

Sessoes longas de codigo

Arquivos grandes, suites de testes e tracos de ferramentas seguem em jogo durante toda a sessao, entao a Kimi K3 API nao perde o rumo em tarefas em escala de repositorio.

Revisao e refatoracao

Revisao de diffs, rastreio de bugs e refatoracao em lote sao trabalhos de primeira classe para a Kimi K3 API.

Saida estruturada

A Kimi K3 API devolve JSON confiavel e respostas ligadas a esquema, entao codemods, extracao e passos de pipeline continuam faceis de analisar.

Streaming, por token

A Kimi K3 API transmite tokens conforme sao gerados e cobra por token a $2.85 de entrada e $14.25 de saida, 5% abaixo da tabela, sem taxa por requisicao.

RouterBase dashboard preview
Maos a obra

Primeira chamada a Kimi K3 API em tres passos

Conecte uma vez, depois transmita.

  1. Crie uma chave

    Uma chave da RouterBase alcanca a Kimi K3 API e todos os outros modelos do catalogo, entao nao ha nada especifico do provedor para configurar.

  2. Aponte seu cliente

    Envie qualquer cliente OpenAI para routerbase.com/v1 com model=moonshotai/kimi-k3 e um array de mensagens; a Kimi K3 API responde com a mesma forma chat-completions.

  3. Transmita e veja o uso

    O modelo transmite tokens conforme sao gerados e devolve o uso de tokens por resposta, entao o custo e a latencia ficam visiveis em cada chamada a Kimi K3 API.

Preços

Paga apenas pelo que usas

A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.

Preços

Paga apenas pelo que usas

A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.

ResoluçãoRouterBaseOficialPoupança
Input (per 1M) $2.850$3.000−5%
Output (per 1M) $14.250$15.000−5%

Uma execução com a configuração padrão (Input (per 1M)) custa $2.850.

Preco oficial = tarifa de tabela da Moonshot AI para Kimi K3 ($3.00 por 1M de entrada, $15.00 por 1M de saida). A RouterBase serve a Kimi K3 API a $2.85 / $14.25, 5% abaixo da tabela.

Entregando com Kimi

Times construindo sobre a Kimi K3 API

Agentes de codigo e bots de revisao atras de uma chamada.

Ingrid SolbergLider de Plataforma, Fjordline

Trocamos nosso agente de codigo para a Kimi K3 API e os refactors de varios arquivos passaram a ficar verdes na primeira tentativa com muito mais frequencia.

Marco BeltramiCTO, Lanterna

As chamadas de ferramentas voltam no esquema padrao, entao nosso loop de agente rodou sobre a Kimi K3 API na mesma tarde em que criamos a chave.

Aiko TanakaEngenheira Staff, Kitsune Labs

Os comentarios de revisao da Kimi K3 API parecem escritos por um engenheiro senior cuidadoso, e os diffs propostos realmente se aplicam.

Ravi MenonFundador, Slipstream

A $2.85 de entrada e $14.25 de saida, a Kimi K3 API nos deixou rodar jobs agenticos toda noite sem a fatura disparar.

Charlotte ByrneLider de Backend, Harborview

O streaming da Kimi K3 API e suave, entao nossa extensao de editor renderiza os completions token por token.

Yusuf DemirLider de ML, Meridian Forge

Roteamos codemods e extracao de JSON pela Kimi K3 API e a saida estruturada analisa limpa em cada execucao.

Elena PetrovaEngenheira Principal, Quartzline

As sessoes longas se sustentam: a Kimi K3 API manteve um servico inteiro mais seus testes em jogo durante um refactor de duas horas.

Nathan ColeFundador, Driftwood AI

Migrar de outro provedor para a Kimi K3 API foi uma unica troca de string; a forma da OpenAI nao se moveu nada.

Beatriz RochaGerente de Engenharia, Maracana Tech

Nosso bot de PRs padronizou na Kimi K3 API porque a qualidade da revisao se manteve estavel ao escalar entre repositorios.

Kimi K3 API - perguntas comuns

O que saber antes de rotear trafego.

A Kimi K3 API e o acesso hospedado da RouterBase ao Moonshot AI Kimi K3, o modelo de codificacao de nova geracao da familia Kimi, sobre um endpoint compativel com OpenAI.