La Kimi K2 Instruct API est notre choix par défaut pour le chat à fort débit —— des réponses directes, pas de tokens de raisonnement à payer, et la facture reste basse.
La Kimi K2 Instruct API est le modèle Kimi K2 standard instruction-tuned et à poids ouverts de Moonshot AI —— des réponses rapides et directes, avec un suivi d'instructions fiable et un usage d'outils natif, plus des sorties structurées et une longue fenêtre de contexte. La Kimi K2 Instruct API est compatible OpenAI : pointez un SDK vers RouterBase et réglez le modèle sur kimi-k2-instruct. Entrée 0,48 $ / 1M tokens, sortie 1,95 $ / 1M —— 15% sous le tarif officiel, le tout par un endpoint REST.
Kimi K2 Instruct API : Chat
Utilisez la Kimi K2 Instruct API pour exécuter le Kimi K2 standard instruction-tuned de Moonshot AI —— des réponses rapides et directes, avec un suivi d'instructions fiable et un usage d'outils natif, sans raisonnement étendu, à des prix de modèle ouvert.
La Kimi K2 Instruct API est le Kimi K2 standard instruction-tuned et à poids ouverts de Moonshot AI —— des réponses rapides et directes, avec un suivi d'instructions fiable et un usage d'outils natif, plus des sorties structurées et une longue fenêtre de contexte. Via RouterBase, la Kimi K2 Instruct API est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers la base URL de RouterBase, réglez le modèle sur kimi-k2-instruct, et votre premier appel à la Kimi K2 Instruct API passe immédiatement.
Le tarif de la Kimi K2 Instruct API est de 0,48 $ / 1M en entrée et 1,95 $ / 1M en sortie — 15% sous le tarif officiel, avec une clé RouterBase (sans compte Moonshot AI).
Six raisons de choisir la Kimi K2 Instruct API
De réponses vives et directes à un tarif à -15% —— ce qui fait de la Kimi K2 Instruct API le Kimi K2 du quotidien.
Réponses directes, faible latence
Kimi K2 Instruct répond aussitôt —— pas de tokens de raisonnement cachés à payer ou à attendre, ce qui en fait le choix rapide par défaut pour le chat, les outils et les apps à fort débit.
Suit les instructions
Donnez à la Kimi K2 Instruct API un format, un system prompt ou un schéma d'outils et elle s'y tient —— le Kimi K2 instruction-tuned conçu pour une sortie prévisible.
Tool calling natif
La Kimi K2 Instruct API fait du function / tool calling au format OpenAI —— Kimi K2 a été construit autour de l'usage d'outils, donc les agents s'intègrent sans colle sur mesure.
Longue fenêtre de contexte
La Kimi K2 Instruct API accepte un long contexte —— faites tenir de gros documents, des bases de code entières ou tout l'historique de conversation en un seul appel.
Compatible OpenAI, une clé
La Kimi K2 Instruct API parle le format chat-completions d'OpenAI ; une seule clé RouterBase glisse Kimi K2 Instruct aux côtés de GPT-5.5, Claude, Gemini et plus de 200 autres modèles.
15% de réduction sur le tarif catalogue
Kimi K2 Instruct tourne 15% sous le tarif publié de Moonshot AI —— 0,48 $ / 1M entrée, 1,95 $ / 1M sortie. Des prix à poids ouverts, facturés au token, rien par requête.

Démarrez avec la Kimi K2 Instruct API en 3 étapes
De l'inscription à votre première réponse en moins de 5 minutes.
Créez une clé RouterBase
Inscrivez-vous et créez une clé API —— elle atteint Kimi K2 Instruct et tous les autres modèles du catalogue RouterBase depuis un seul compte.
Envoyez votre premier message
Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et réglez le modèle sur kimi-k2-instruct. Le streaming, les appels d'outils et les sorties structurées suivent tous le schéma standard chat-completions.
Inspectez l'usage
Chaque réponse de la Kimi K2 Instruct API renvoie un détail des tokens —— entrée et sortie —— pour que le coût reste visible à chaque appel.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Ce que les équipes construisent avec la Kimi K2 Instruct API
Des charges de production réelles sur le catalogue de plus de 200 modèles de RouterBase.
Nous routons la plupart des requêtes utilisateur vers la Kimi K2 Instruct API —— elle suit nos instructions de format à chaque fois et répond vite.
Les appels d'outils sur la Kimi K2 Instruct API s'intègrent directement dans notre boucle d'agent —— instruction-tuned, prévisible, le même format OpenAI.
Nous faisons de l'A/B entre la Kimi K2 Instruct API, GPT et Claude derrière une seule clé RouterBase —— sur les tâches directes elle les égale pour une fraction du coût.
Pointer notre SDK OpenAI vers la Kimi K2 Instruct API a demandé un seul changement de base URL, et la latence a baissé par rapport aux modèles de raisonnement que nous avions essayés.
Les sorties structurées de la Kimi K2 Instruct API reviennent propres —— elle fait ce que dit le schéma sans détour par le raisonnement.
En tant que dev solo, la Kimi K2 Instruct API est mon cheval de bataille —— rapide, économique, et elle suit les instructions sans surprises.
Pour nos endpoints à fort volume, la Kimi K2 Instruct API offre le meilleur coût par réponse que nous ayons testé —— rapide et fidèle à l'instruction.
La facturation au token et l'absence de tokens de raisonnement font que la Kimi K2 Instruct API garde notre coût stable à l'échelle.
Questions fréquentes
Questions courantes sur la Kimi K2 Instruct API.
La Kimi K2 Instruct API est le passthrough de RouterBase vers la Kimi K2 Instruct de Moonshot AI —— le Kimi K2 standard instruction-tuned et à poids ouverts pour des réponses rapides et directes, le suivi d'instructions et l'usage d'outils, servi via une interface REST compatible OpenAI avec tool calling natif et sorties structurées.