Los trabajos de contexto largo que antes reventaban nuestro presupuesto ahora corren en la DeepSeek V3.2 API por una fracción del costo.
Loading model information...
DeepSeek V3.2 API — Contexto largo, atención dispersa, radicalmente más barato
La DeepSeek V3.2 API ejecuta DeepSeek V3.2, que usa atención dispersa para sostener contexto largo a una fracción del costo anterior — $0.028 por 1M de entrada.
DeepSeek V3.2 reconstruye la capa de atención en torno a DeepSeek Sparse Attention, así que el trabajo de contexto largo ya no escala como antes. La DeepSeek V3.2 API te pasa esa eficiencia directo: $0.028 por 1M de tokens de entrada y $0.42 por 1M de salida — cerca de la mitad de la generación previa — mientras conserva el diseño híbrido que te deja pensar paso a paso o responder directo por solicitud. Archivos largos, transcripciones largas y trazas de herramientas largas se mantienen asequibles a escala.
Llamas a la DeepSeek V3.2 API por RouterBase con el protocolo chat-completions de OpenAI; fija el modelo en deepseek-v3-2 y tu cliente no cambia. La DeepSeek V3.2 API cobra $0.028 por 1M de entrada, $0.42 por 1M de salida y $0.028 por entrada en caché — 5% bajo lista, con una clave que alcanza todo el catálogo.
Qué te da la DeepSeek V3.2 API
La atención dispersa baja la factura del contexto largo.
Atención dispersa
DeepSeek Sparse Attention deja a la DeepSeek V3.2 API manejar contexto largo sin la curva de costo habitual.
Radicalmente más barata
A $0.028 de entrada y $0.42 de salida, la DeepSeek V3.2 API corre a cerca de la mitad de la generación previa — 5% bajo lista.
Contexto largo, bajo costo
Archivos y transcripciones largos siguen asequibles, así la DeepSeek V3.2 API encaja en trabajo de alto volumen y entrada larga.
Mantiene el pensamiento híbrido
Piensa paso a paso o responde directo por solicitud; la DeepSeek V3.2 API lleva ambos modos en un modelo.
Código y herramientas
Código fuerte más llamada a funciones fiable hacen de la DeepSeek V3.2 API un backbone sólido para asistentes y agentes.
Con forma de OpenAI
Un endpoint chat-completions, una clave de RouterBase — apunta a routerbase.com/v1, nombra el modelo y salta el SDK de DeepSeek.

Primera llamada a la DeepSeek V3.2 API en tres pasos
Conéctala una vez y luego mándale entradas largas.
Crea una clave
Una clave de RouterBase llega a la DeepSeek V3.2 API y a todos los demás modelos del catálogo.
Apunta y elige modo
Envía cualquier cliente OpenAI a routerbase.com/v1 con model=deepseek/deepseek-v3.2, y activa o desactiva el pensamiento por solicitud.
Mira el uso
La DeepSeek V3.2 API devuelve el uso de tokens por respuesta, así costo y latencia quedan a la vista en cada llamada.
Paga sólo por lo que usas
RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.
Equipos que construyen sobre la DeepSeek V3.2 API
Contexto largo que por fin cabe en el presupuesto.
A $0.028 por 1M de entrada, la DeepSeek V3.2 API nos dejó dejar de recortar prompts para ahorrar.
La atención dispersa es por lo que nuestras transcripciones largas por fin cupieron en el presupuesto en la DeepSeek V3.2 API.
Conservamos los modos híbridos y casi dividimos a la mitad nuestra factura al pasar a la DeepSeek V3.2 API.
La DeepSeek V3.2 API se mantuvo barata incluso cuando crecieron nuestras ventanas de contexto, algo que los modelos viejos nunca lograron.
La llamada a funciones aguantó, así que nuestros agentes pasaron a la DeepSeek V3.2 API sin reescritura.
Una cadena cambiada desde nuestro viejo endpoint; la caída de costo en la DeepSeek V3.2 API fue inmediata.
Ahora le damos documentos enteros a la DeepSeek V3.2 API porque el precio de contexto largo por fin tiene sentido.
Misma clave, contexto largo más barato — la DeepSeek V3.2 API fue una decisión fácil para nosotros.
DeepSeek V3.2 API — preguntas comunes
Qué saber antes de enviarle tráfico.
El acceso alojado de RouterBase a DeepSeek V3.2, que usa atención dispersa para una inferencia de contexto largo más barata, por un endpoint compatible con OpenAI.