Movemos nosso agente de código para a MiniMax M2 API e o loop de ferramentas rodou mais limpo.
O MiniMax M2 é um modelo de nova geração feito para fluxos agênticos e código — chamar ferramentas, escrever e corrigir código e executar tarefas de vários passos de ponta a ponta, rápido e barato sob tráfego real. Servido na RouterBase por um endpoint compatível com OpenAI a $0.30 / 1M de entrada e $1.20 / 1M de saída, com entrada em cache a apenas $0.03, 5% abaixo da tabela; recorra a ele quando o uso de ferramentas e o código importam mais que uma única resposta longa.
MiniMax M2 API — Feito para agentes e código
A MiniMax M2 API serve o MiniMax M2, um modelo de nova geração ajustado para fluxos agênticos e código — rápido, habilidoso com ferramentas e barato.
O MiniMax M2 é feito para o trabalho que os agentes realmente fazem: chamar ferramentas, escrever e corrigir código e executar tarefas de vários passos de ponta a ponta. A MiniMax M2 API combina esse foco agêntico com um design eficiente, então se mantém rápida e barata sob tráfego real — $0.30 por 1M de tokens de entrada e $1.20 por 1M de saída, com entrada em cache a apenas $0.03. É o modelo a que recorrer quando o uso de ferramentas e o código importam mais que uma única resposta longa.
Você chama a MiniMax M2 API pela RouterBase no protocolo chat-completions da OpenAI; defina o modelo como minimax-m2 e seu cliente não muda. A MiniMax M2 API cobra $0.30 por 1M de entrada, $1.20 por 1M de saída e $0.03 por entrada em cache — 5% abaixo da tabela, com uma chave que alcança todo o catálogo.
O que a MiniMax M2 API entrega
Loops de ferramentas e código, rápidos e baratos.
Feita para agentes
A MiniMax M2 API é ajustada para fluxos agênticos — chamadas de ferramentas, tarefas de vários passos e loops de longa duração.
Forte em código
Escrever, corrigir e raciocinar sobre código é onde a MiniMax M2 API mostra seu valor.
Rápida e eficiente
Um design eficiente mantém a MiniMax M2 API rápida sob tráfego real, então encaixa em rotas interativas e de alto volume.
Preço baixo
A $0.30 de entrada e $1.20 de saída, a MiniMax M2 API é barata o bastante para loops de agente pesados — 5% abaixo da tabela.
Leituras em cache quase de graça
A entrada em cache é apenas $0.03 por 1M, então o contexto repetido na MiniMax M2 API quase não custa nada.
No formato OpenAI
Um endpoint chat-completions, uma chave da RouterBase — aponte para routerbase.com/v1, nomeie o modelo e pule o SDK da MiniMax.

Primeira chamada à MiniMax M2 API em três passos
Rápido de conectar, pronto para conduzir um loop de ferramentas.
Crie uma chave
Uma chave da RouterBase alcança a MiniMax M2 API e todos os demais modelos do catálogo.
Aponte e nomeie
Envie qualquer cliente OpenAI para routerbase.com/v1 com model=minimax/minimax-m2. O streaming e a chamada de funções funcionam de fábrica.
Conecte suas ferramentas
Dê à MiniMax M2 API seus esquemas de função e deixe-a conduzir o loop; o uso volta por resposta para o custo ficar à vista.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
Equipes construindo sobre a MiniMax M2 API
Loops de ferramentas e código, rodando barato.
A MiniMax M2 API tratou tarefas de vários passos de ponta a ponta sem cuidarmos do loop.
Código forte a $0.30 de entrada fez da MiniMax M2 API nosso padrão para trabalho de agentes.
Leituras em cache a $0.03 mantiveram nossos loops de agente longos na MiniMax M2 API praticamente de graça.
A chamada de funções é confiável, então toda a nossa camada de ferramentas roda na MiniMax M2 API.
A MiniMax M2 API foi rápida o bastante para sentar dentro do nosso assistente de código ao vivo.
Uma string mudada do nosso modelo antigo; a MiniMax M2 API ficou mais barata e melhor com ferramentas no mesmo dia.
Roteamos o tráfego de agentes e código para a MiniMax M2 API e mantemos tudo numa chave.
Nossas execuções de código autônomo ficaram bem mais estáveis na MiniMax M2 API.
MiniMax M2 API — perguntas comuns
O que saber antes de mandar tráfego para ela.
O acesso hospedado da RouterBase ao MiniMax M2, um modelo de nova geração feito para fluxos agênticos e código, por um endpoint compatível com OpenAI.