La DeepSeek V3.1 API nos dejó eliminar dos modelos separados — pensar para los tickets difíciles, directo para el resto, todo tras una llamada.
Loading model information...
DeepSeek V3.1 API — Un modelo, pensar y responder
La DeepSeek V3.1 API ejecuta DeepSeek V3.1, un modelo híbrido que puede razonar paso a paso o responder directo — tú eliges el modo por solicitud.
DeepSeek V3.1 reúne dos comportamientos en un modelo: un modo de pensamiento que razona paso a paso y un modo directo que responde de inmediato. La DeepSeek V3.1 API te deja alternarlos por solicitud, así los problemas difíciles reciben deliberación y los simples una respuesta rápida y barata — sin segundo modelo ni segundo endpoint. Conserva las fortalezas de V3 en código y tool use, con una ventana de contexto de 128K para archivos y transcripciones largas.
Llamas a la DeepSeek V3.1 API por RouterBase con el protocolo chat-completions de OpenAI; fija el modelo en deepseek-v3-1 y tu cliente actual funciona sin cambios. La DeepSeek V3.1 API cobra $0.27 por 1M de tokens de entrada, $1.10 por 1M de salida y $0.07 por entrada en caché — 5% bajo lista, con una clave que alcanza todo el catálogo.
Qué te da la DeepSeek V3.1 API
Deliberación cuando ayuda, respuesta directa cuando no.
Dos modos, un modelo
La DeepSeek V3.1 API alterna entre pensar y responder directo por solicitud, así ajustas el esfuerzo a la tarea sin cambiar de modelo.
Razona cuando ayuda
Activa el pensamiento y la DeepSeek V3.1 API trabaja las matemáticas, el código y los problemas de varios pasos antes de responder.
Responde cuando no
En modo directo la DeepSeek V3.1 API contesta recto, manteniendo baja la latencia y el costo en llamadas de rutina.
Código y herramientas
Código fuerte más llamada a funciones fiable hacen de la DeepSeek V3.1 API un backbone sólido para asistentes de IDE y agentes.
Contexto de 128K
Una ventana de 128K deja a la DeepSeek V3.1 API sostener archivos, transcripciones y trazas de herramientas largas en una sola llamada.
Barata, con caché
A $0.27 de entrada y $1.10 de salida — más $0.07 de entrada en caché — la DeepSeek V3.1 API sigue siendo asequible a escala, 5% bajo lista.

Primera llamada a la DeepSeek V3.1 API en tres pasos
Conéctala una vez y luego cambia de modo a voluntad.
Crea una clave
Una clave de RouterBase llega a la DeepSeek V3.1 API y a todos los demás modelos del catálogo.
Apunta y elige modo
Envía cualquier cliente OpenAI a routerbase.com/v1 con model=deepseek/deepseek-v3.1, y activa o desactiva el pensamiento por solicitud.
Mira el uso
La DeepSeek V3.1 API devuelve el uso de tokens por respuesta, así costo y latencia quedan a la vista en cada llamada.
Paga sólo por lo que usas
RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.
Equipos que construyen sobre la DeepSeek V3.1 API
Razonamiento y respuesta directa tras una sola llamada.
Apagar el pensamiento en las búsquedas bajó nuestra latencia y factura sin tocar la calidad del camino difícil.
Un modelo con dos modos significó que la DeepSeek V3.1 API reemplazó un router que manteníamos a mano.
A $0.27 de entrada con lecturas en caché a $0.07, la DeepSeek V3.1 API mantuvo planos nuestros costos al crecer el tráfico.
La llamada a funciones es fiable, así que toda nuestra pila de agentes corre sobre la DeepSeek V3.1 API.
Encendemos el pensamiento para evaluaciones y lo apagamos en producción — mismo modelo, misma clave.
La ventana de 128K dejó a la DeepSeek V3.1 API leer nuestro archivo de repo entero de una pasada.
Pasar de nuestro viejo endpoint a la DeepSeek V3.1 API fue una cadena; el modo híbrido fue un extra.
Enrutamos el razonamiento difícil y el chat rápido a la misma DeepSeek V3.1 API y solo cambiamos el modo.
DeepSeek V3.1 API — preguntas comunes
Qué saber antes de enviarle tráfico.
El acceso alojado de RouterBase a DeepSeek V3.1, un modelo híbrido que puede razonar paso a paso o responder directo, por un endpoint compatible con OpenAI.