chat.kimi_k2_5
moonshotai/kimi-k2-5

La Kimi K2.5 API est le modèle Kimi K2 à poids ouverts d'entrée de gamme de Moonshot AI —— un modèle généraliste et agentique compétent qui offre chat généraliste, raisonnement, code et agents à des prix de modèle ouvert, avec tool calling natif, sorties structurées et une longue fenêtre de contexte. La Kimi K2.5 API est compatible OpenAI : pointez un SDK vers RouterBase et réglez le modèle sur kimi-k2-5. Entrée 0,57 $ / 1M tokens, sortie 2,85 $ / 1M —— 5% sous le tarif officiel, le tout par un endpoint REST.

Input
Kimi K2.5
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Kimi K2.5 Online
Hi! I'm a helpful AI assistant. What can I do for you?

Kimi K2.5 API : Chat

Utilisez la Kimi K2.5 API pour exécuter le modèle ouvert d'entrée de gamme de Moonshot AI —— Kimi K2.5 est un modèle Kimi K2 généraliste et agentique compétent qui tient la route sur du travail réel tout en coûtant une fraction des API de frontière.

La Kimi K2.5 API est le modèle ouvert d'entrée de gamme de Moonshot AI —— un modèle Kimi K2 généraliste et agentique compétent à des prix de modèle ouvert, avec tool calling natif, sorties structurées et une longue fenêtre de contexte. Via RouterBase, la Kimi K2.5 API est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers la base URL de RouterBase, réglez le modèle sur kimi-k2-5, et votre premier appel à la Kimi K2.5 API passe immédiatement.

Le tarif de la Kimi K2.5 API est de 0,57 $ / 1M en entrée et 2,85 $ / 1M en sortie — 5% sous le tarif officiel, avec une clé RouterBase (sans compte Moonshot AI).

Pourquoi ce modèle

Six raisons de choisir la Kimi K2.5 API

D'une sortie quotidienne compétente à un tarif à -5% —— pourquoi les équipes font tourner des charges à fort volume sur la Kimi K2.5 API.

Compétente à bas prix

Kimi K2.5 couvre l'essentiel du travail de production réel —— chat, raisonnement, agents et code —— à un prix assez bas pour tourner à fort volume sans surveiller le compteur.

La valeur des poids ouverts

La Kimi K2.5 API est un modèle Kimi K2 à poids ouverts, vous obtenez donc une capacité généraliste solide à l'économie d'un modèle ouvert —— bien en dessous des prix de frontière fermés.

Tool calling natif

La Kimi K2.5 API fait du function / tool calling au format OpenAI —— Kimi K2 a été conçu pour l'usage d'outils, donc il s'intègre aux agents sans colle sur mesure.

Longue fenêtre de contexte

La Kimi K2.5 API accepte un long contexte —— faites tenir des documents entiers, des bases de code ou tout l'historique de conversation en un seul appel.

Compatible OpenAI, une clé

La Kimi K2.5 API parle le format chat-completions d'OpenAI ; une seule clé RouterBase glisse Kimi K2.5 aux côtés de GPT-5.5, Claude, Gemini et plus de 200 autres modèles.

5% de réduction sur le tarif catalogue

Kimi K2.5 tourne 5% sous le tarif publié de Moonshot AI —— 0,57 $ / 1M entrée, 2,85 $ / 1M sortie. Des prix de modèle ouvert qui passent à l'échelle à bas coût, facturés au token, rien par requête.

RouterBase dashboard preview
Démarrage rapide

Démarrez avec la Kimi K2.5 API en 3 étapes

De l'inscription à votre première réponse en moins de 5 minutes.

  1. Créez une clé RouterBase

    Inscrivez-vous et créez une clé API —— elle atteint Kimi K2.5 et tous les autres modèles du catalogue RouterBase depuis un seul compte.

  2. Envoyez votre premier message

    Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et réglez le modèle sur kimi-k2-5. Le streaming, les appels d'outils et les sorties structurées suivent tous le schéma standard chat-completions.

  3. Inspectez l'usage

    Chaque réponse de la Kimi K2.5 API renvoie un détail des tokens —— entrée et sortie —— pour que le coût reste visible à chaque appel.

Tarifs

Ne payez que ce que vous utilisez

RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.

Témoignages clients

Ce que les équipes construisent avec la Kimi K2.5 API

Des charges de production réelles sur le catalogue de plus de 200 modèles de RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Nous avons basculé notre classification et résumé à fort volume vers la Kimi K2.5 API —— la qualité suffit largement et la facture a fortement chuté.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Via RouterBase, Kimi K2.5 est notre modèle bon marché par défaut —— assez bon pour la plupart des requêtes, et on n'escalade que les rares cas difficiles.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Nous lançons des milliers d'étapes d'agent par jour sur la Kimi K2.5 API —— à ce prix, on a arrêté de rationner les appels.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

Nous faisons de l'A/B entre la Kimi K2.5 API et des modèles plus chers derrière une seule clé RouterBase —— pour l'essentiel de notre trafic, le moins cher gagne au coût par bonne réponse.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Pointer notre SDK OpenAI vers la Kimi K2.5 API a demandé un seul changement de base URL, et notre coût par requête a chuté du jour au lendemain.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Les longs documents entrent directement dans la Kimi K2.5 API sans gymnastique de découpage —— le contexte bon marché a simplifié notre pipeline.

Jonas Keller
Jonas KellerIndie Developer

En tant que dev solo, la Kimi K2.5 API est le modèle ouvert que je mets vraiment en production —— compétent, et assez bon marché pour le laisser tourner.

Sophia Martín
Sophia MartínCTO, Relay

Au coût par token, la Kimi K2.5 API est le meilleur rapport qualité-prix de notre suite d'évals —— nous y routons l'essentiel du trafic.

David Okonkwo
David OkonkwoCo-founder, Figment

La facturation au token plus les tarifs de Kimi K2.5 font que nos marges survivent même à fort volume de requêtes.

Questions fréquentes

Questions courantes sur la Kimi K2.5 API.

La Kimi K2.5 API est le passthrough de RouterBase vers la Kimi K2.5 de Moonshot AI —— un modèle Kimi K2 à poids ouverts qui gère le chat généraliste, le raisonnement, le code et les agents à bas coût, servi via une interface REST compatible OpenAI avec tool calling natif et sorties structurées.