chat.gpt_4_1_nano
openai/gpt-4-1-nano

La GPT-4.1 nano API es el modelo 4.1 más rápido y económico de OpenAI —— ventana de contexto de 1M tokens, visión (entrada de texto + imagen), function calling y salidas JSON estructuradas, optimizado para baja latencia y alto rendimiento. La GPT-4.1 nano API es compatible con OpenAI: apunta cualquier SDK a RouterBase y configura el modelo en gpt-4-1-nano. Entrada a $0.06 / 1M, salida a $0.24 / 1M, lecturas en caché a $0.015 / 1M —— 5% por debajo de la tarifa estándar, todo por un endpoint REST.

Input
GPT-4.1 nano
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
GPT-4.1 nano Online
Hi! I'm a helpful AI assistant. What can I do for you?

GPT-4.1 nano API: Chat

Usa la GPT-4.1 nano API para ejecutar el modelo 4.1 más rápido y económico de OpenAI, con una ventana de contexto de 1M de tokens y visión.

La GPT-4.1 nano API es el modelo 4.1 más pequeño y rentable de OpenAI: una ventana de contexto de 1M de tokens, visión (entrada de texto + imagen), function calling y salidas JSON estructuradas, optimizado para baja latencia y alto rendimiento. Enrutado a través de RouterBase, es totalmente compatible con OpenAI: apunta cualquier SDK existente a la URL base de RouterBase, configura el modelo en gpt-4-1-nano y tu primera llamada se ejecuta de inmediato.

El precio es de $0.06 / 1M tokens de entrada, $0.24 / 1M tokens de salida y $0.015 / 1M de lecturas de entrada en caché, un 5% por debajo de la tarifa estándar. Una sola clave de RouterBase, sin necesidad de credenciales separadas de OpenAI.

Por qué este modelo

Seis razones por las que los equipos producen con la GPT-4.1 nano API

Desde el contexto de 1M de tokens hasta el precio con 5% de descuento: lo que hace destacar a GPT-4.1 nano.

Contexto de 1M de tokens

Acepta hasta 1 millón de tokens por solicitud: documentos largos, código de múltiples archivos o un historial de chat extenso caben en una sola llamada a la GPT-4.1 nano API.

Entrada de visión

La GPT-4.1 nano API acepta imágenes junto con texto. Pasa una URL de imagen o base64 en la misma solicitud para describir, extraer o razonar sobre contenido visual.

El nivel 4.1 más rápido y económico

Diseñado para cargas de alto volumen: la GPT-4.1 nano API es el modelo de menor costo de la familia 4.1, a $0.06 / 1M tokens de entrada, ideal para clasificación, autocompletado, extracción y enrutamiento a escala.

Function calling y JSON

Define herramientas y solicita un esquema JSON; la GPT-4.1 nano API devuelve llamadas a herramientas estructuradas y JSON estrictamente válido para pipelines fiables de agentes y extracción.

Endpoint compatible con OpenAI

La GPT-4.1 nano API habla el formato de transmisión chat-completions de OpenAI. Cualquier SDK de Python, Node, Go o Rust que funcione con OpenAI funciona aquí: solo actualiza la URL base.

Una clave para 200+ modelos

La misma clave de RouterBase que llama a la GPT-4.1 nano API también enruta a GPT-5, Claude Opus 4.8, Gemini 3.5 Flash y 200+ modelos más, sin gestión de credenciales por proveedor.

RouterBase dashboard preview
Inicio rápido

Comienza con la GPT-4.1 nano API en 3 pasos

Del registro a tu primera respuesta en menos de 5 minutos.

  1. Crea una clave de API de RouterBase

    Regístrate y genera una clave de API: una sola clave llega a la GPT-4.1 nano API y a todos los demás modelos del catálogo.

  2. Envía tu primer mensaje

    Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y configura el modelo en gpt-4-1-nano. La respuesta sigue el esquema estándar de chat-completions, con soporte para streaming y visión.

  3. Inspecciona el uso

    Cada respuesta incluye un desglose detallado de tokens (entrada, salida y tokens de lectura de caché), de modo que el costo y la tasa de aciertos de caché son visibles en cada llamada.

Precios

Paga sólo por lo que usas

RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.

Historias de clientes

Lo que los equipos construyen con la GPT-4.1 nano API

Cargas de producción reales ejecutándose sobre la GPT-4.1 nano API y el catálogo de modelos de RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Enrutamos el 90% de nuestro tráfico a través de la GPT-4.1 nano API: clasificación y extracción a una fracción del costo. El 5% de descuento de RouterBase es margen puro.

Priya Lakshmi
Priya LakshmiFounder, Quillo

La visión en la GPT-4.1 nano API reemplazó un pipeline de OCR: una sola llamada rápida y económica describe y extrae, texto e imagen juntos.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Las salidas JSON estructuradas de la GPT-4.1 nano API acabaron con nuestro inestable análisis con regex. JSON estrictamente válido siempre, cero reintentos.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

A nuestro volumen, GPT-4.1 nano es el único modelo de clase 4.1 que sale a cuenta. RouterBase lo hace un 5% más barato aún.

Jonas Keller
Jonas KellerIndie Developer

El function calling en la GPT-4.1 nano API se conecta directo a mi bucle de agente. Tan barato que dejé de contar tokens.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase pone la GPT-4.1 nano API y 200+ modelos más detrás de una sola clave. Nuestro equipo dejó de presentar solicitudes de nuevas cuentas de proveedores.

Sophia Martín
Sophia MartínCTO, Relay

Hacemos A/B de la GPT-4.1 nano API contra GPT-4.1 por solicitud: el mismo SDK, un solo campo de modelo. La mayoría del tráfico se queda en nano y la factura bajó un 70%.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Migramos 42 servicios a la GPT-4.1 nano API en un fin de semana. El único comentario en el PR fue: "espera, ¿eso es todo?".

David Okonkwo
David OkonkwoCo-founder, Figment

A $0.06 / 1M de entrada menos 5%, la GPT-4.1 nano API hizo que nuestras funciones de alto volumen fueran realmente rentables. El cálculo del ROI fue instantáneo.

Preguntas frecuentes

Preguntas comunes sobre la GPT-4.1 nano API.

Es el acceso directo de RouterBase a GPT-4.1 nano de OpenAI: el endpoint de chat más rápido y económico de la familia 4.1, con un contexto de 1M de tokens, entrada de visión, function calling y salidas estructuradas, servido a través de una interfaz REST compatible con OpenAI.