chat.kimi_k2_instruct
moonshotai/kimi-k2-instruct

La Kimi K2 Instruct API es el modelo Kimi K2 estándar instruction-tuned y de pesos abiertos de Moonshot AI —— respuestas rápidas y directas, con seguimiento de instrucciones fiable y uso de herramientas nativo, además de salidas estructuradas y una ventana de contexto larga. La Kimi K2 Instruct API es compatible con OpenAI: apunta cualquier SDK a RouterBase y pon el modelo en kimi-k2-instruct. Entrada a $0.48 / 1M tokens, salida a $1.95 / 1M —— un 15% por debajo del oficial, todo por un endpoint REST.

Input
Kimi K2 Instruct
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Kimi K2 Instruct Online
Hi! I'm a helpful AI assistant. What can I do for you?

Kimi K2 Instruct API: Chat

Usa la Kimi K2 Instruct API para ejecutar el Kimi K2 estándar instruction-tuned de Moonshot AI —— respuestas rápidas y directas, con seguimiento de instrucciones fiable y uso de herramientas nativo, sin razonamiento extendido, a precios de modelo abierto.

La Kimi K2 Instruct API es el Kimi K2 estándar instruction-tuned y de pesos abiertos de Moonshot AI —— respuestas rápidas y directas, con seguimiento de instrucciones fiable y uso de herramientas nativo, además de salidas estructuradas y una ventana de contexto larga. A través de RouterBase, la Kimi K2 Instruct API es totalmente compatible con OpenAI: apunta cualquier SDK existente a la base URL de RouterBase, pon el modelo en kimi-k2-instruct y tu primera llamada a la Kimi K2 Instruct API pasa de inmediato.

El precio de la Kimi K2 Instruct API es $0.48 / 1M de entrada y $1.95 / 1M de salida — un 15% por debajo de la tarifa oficial, con una clave de RouterBase (sin cuenta de Moonshot AI).

Por qué este modelo

Seis razones para usar la Kimi K2 Instruct API

De respuestas ágiles y directas al precio con 15% de descuento —— lo que hace de la Kimi K2 Instruct API el Kimi K2 de cada día.

Respuestas directas y de baja latencia

Kimi K2 Instruct responde de inmediato —— sin tokens de razonamiento ocultos que pagar o esperar, lo que lo hace la opción rápida por defecto para chat, herramientas y apps de alto volumen.

Sigue instrucciones

Dale a la Kimi K2 Instruct API un formato, un system prompt o un esquema de herramientas y se ciñe a ello —— el Kimi K2 instruction-tuned hecho para una salida predecible.

Tool calling nativo

La Kimi K2 Instruct API hace function / tool calling en formato OpenAI —— Kimi K2 se construyó en torno al uso de herramientas, así que los agentes encajan sin pegamento a medida.

Ventana de contexto larga

La Kimi K2 Instruct API acepta contexto largo —— mete documentos grandes, bases de código completas o todo el historial de conversación en una sola llamada.

Compatible con OpenAI, una clave

La Kimi K2 Instruct API usa el formato chat-completions de OpenAI, así que una clave de RouterBase pone Kimi K2 Instruct junto a GPT-5.5, Claude, Gemini y más de 200 modelos.

15% bajo el precio de lista

Kimi K2 Instruct cuesta un 15% menos que la tarifa publicada de Moonshot AI —— $0.48 / 1M entrada, $1.95 / 1M salida. Precio de pesos abiertos, facturado por token, nada por solicitud.

RouterBase dashboard preview
Inicio rápido

Empieza con la Kimi K2 Instruct API en 3 pasos

Del registro a tu primera respuesta en menos de 5 minutos.

  1. Crea una clave de RouterBase

    Regístrate y crea una clave —— llega a Kimi K2 Instruct y a todos los demás modelos del catálogo de RouterBase desde una sola cuenta.

  2. Envía tu primer mensaje

    Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y pon el modelo en kimi-k2-instruct. El streaming, las llamadas a herramientas y las salidas estructuradas siguen el esquema estándar de chat-completions.

  3. Revisa el uso

    Cada respuesta de la Kimi K2 Instruct API devuelve un desglose de tokens —— entrada y salida —— para que el coste quede visible en cada llamada.

Precios

Paga sólo por lo que usas

RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.

Historias de clientes

Lo que los equipos construyen con la Kimi K2 Instruct API

Cargas de producción reales sobre el catálogo de más de 200 modelos de RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Kimi K2 Instruct API es nuestro valor por defecto para chat de alto volumen —— respuestas directas, sin tokens de razonamiento que pagar, y la factura se mantiene baja.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Enrutamos la mayoría de las peticiones de usuario a la Kimi K2 Instruct API —— sigue nuestras instrucciones de formato cada vez y responde rápido.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Las llamadas a herramientas en la Kimi K2 Instruct API encajan directo en nuestro bucle de agente —— instruction-tuned, predecible, mismo formato OpenAI.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

Hacemos A/B de la Kimi K2 Instruct API contra GPT y Claude tras una sola clave de RouterBase —— en tareas directas las iguala por una fracción del coste.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Apuntar nuestro SDK de OpenAI a la Kimi K2 Instruct API fue un cambio de base URL, y la latencia bajó frente a los modelos de razonamiento que probamos.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Las salidas estructuradas de la Kimi K2 Instruct API vuelven limpias —— hace lo que dice el esquema sin desviarse a razonar.

Jonas Keller
Jonas KellerIndie Developer

Como dev en solitario, la Kimi K2 Instruct API es mi caballo de batalla —— rápida, barata y sigue instrucciones sin sorpresas.

Sophia Martín
Sophia MartínCTO, Relay

Para nuestros endpoints de alto volumen, la Kimi K2 Instruct API es el mejor coste por respuesta que probamos —— rápida y fiel a la instrucción.

David Okonkwo
David OkonkwoCo-founder, Figment

La facturación por token más la ausencia de tokens de razonamiento hacen que la Kimi K2 Instruct API mantenga nuestro coste plano a escala.

Preguntas frecuentes

Preguntas comunes sobre la Kimi K2 Instruct API.

La Kimi K2 Instruct API es el paso directo de RouterBase a la Kimi K2 Instruct de Moonshot AI —— el Kimi K2 estándar instruction-tuned y de pesos abiertos para respuestas rápidas y directas, seguimiento de instrucciones y uso de herramientas, servido por una interfaz REST compatible con OpenAI con tool calling nativo y salidas estructuradas.