Apuntamos nuestra tuberia de facturas a la Qwen3 VL 30B A3B Instruct API y el OCR mas la extraccion JSON reemplazo dos servicios.
Qwen3 VL 30B A3B Instruct es un modelo de vision-lenguaje MoE de Alibaba Qwen con 30B totales y unos 3B activos, que lee imagenes y texto en una llamada con fuerte OCR y comprension de graficos. Servido en RouterBase por un endpoint compatible con OpenAI a $0.17 / 1M de entrada y $0.595 / 1M de salida, 15% bajo lista.
Qwen3 VL 30B A3B Instruct API - MoE de Vision-Lenguaje, 3B Activos
La Qwen3 VL 30B A3B Instruct API ejecuta un modelo de vision-lenguaje MoE con 30B totales y 3B activos que lee imagenes y texto.
La Qwen3 VL 30B A3B Instruct API sirve Alibaba Qwen3 VL 30B A3B Instruct, un modelo de vision-lenguaje de mezcla de expertos que activa solo unos 3B de sus 30B parametros por token, con percepcion de red grande a costo de modelo pequeno. Capturas, fotos, escaneos y graficos viajan junto a tu prompt como partes image_url estandar, asi que la Qwen3 VL 30B A3B Instruct API funciona con cualquier cliente OpenAI sin cambios y una clave cubre el catalogo.
Ajustado a instrucciones para respuestas directas, el modelo cubre OCR de fotos y escaneos, comprension de documentos y graficos, analisis de capturas y anclaje visual. La Qwen3 VL 30B A3B Instruct API cobra $0.17 por 1M de entrada y $0.595 por 1M de salida, 15% bajo la lista de $0.20 y $0.70, sin tarifa por solicitud. El streaming y las herramientas en esquema estandar dejan conectar la Qwen3 VL 30B A3B Instruct API a una tuberia de documentos o un agente de GUI sin pegamento del proveedor.
Lo que te da la Qwen3 VL 30B A3B Instruct API
Calidad de vision-lenguaje a costo de 3B activos.
Imagen mas texto
La Qwen3 VL 30B A3B Instruct API toma imagenes y texto en la misma solicitud, y capturas, fotos, escaneos y graficos viajan junto a tu prompt.
MoE con 3B activos
Una red de mezcla de expertos con 30B totales activa solo unos 3B por token, asi que la Qwen3 VL 30B A3B Instruct API responde con percepcion de modelo grande a costo de modelo pequeno.
OCR y documentos
Un fuerte reconocimiento de texto en fotos, escaneos y paginas hace de la Qwen3 VL 30B A3B Instruct API una base fiable para leer recibos, formularios y extraer documentos.
Graficos, UIs, anclaje
Lee graficos y tablas, entiende capturas y GUIs, y localiza objetos, asi que la Qwen3 VL 30B A3B Instruct API encaja en agentes que miran antes de actuar.
Herramientas y JSON
La Qwen3 VL 30B A3B Instruct API devuelve llamadas a funciones y JSON estructurado en el esquema estandar de OpenAI, listos para agentes multimodales y tuberias de datos.
Streaming, por token
La Qwen3 VL 30B A3B Instruct API transmite tokens al generarlos y cobra por token a $0.17 de entrada y $0.595 de salida, 15% bajo lista, sin tarifa por solicitud.

Primera llamada a la Qwen3 VL 30B A3B Instruct API en tres pasos
Conectala una vez, luego transmite.
Crea una clave
Una clave de RouterBase alcanza la Qwen3 VL 30B A3B Instruct API y todos los modelos del catalogo; nada del proveedor que configurar.
Apunta tu cliente
Envia cualquier cliente OpenAI a routerbase.com/v1 con model=qwen/qwen3-vl-30b-a3b-instruct y mensajes que mezclen texto y partes image_url; la Qwen3 VL 30B A3B Instruct API responde con la misma forma chat-completions.
Transmite y observa el uso
El modelo transmite tokens al generarlos y devuelve el uso por respuesta; costo y latencia quedan visibles en cada llamada a la Qwen3 VL 30B A3B Instruct API.
Paga sólo por lo que usas
RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.
Paga sólo por lo que usas
RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.
| Resolución | RouterBase | Oficial | Ahorro |
|---|---|---|---|
| Input (per 1M) | $0.170 | −15% | |
| Output (per 1M) | $0.595 | −15% |
Una ejecución con la configuración predeterminada (Input (per 1M)) cuesta $0.170.Con $1 puedes ejecutar este modelo aproximadamente 5 veces.
Precio oficial = tarifa de lista de Alibaba Qwen para Qwen3 VL 30B A3B Instruct ($0.20 por 1M de entrada, $0.70 por 1M de salida). RouterBase sirve la Qwen3 VL 30B A3B Instruct API a $0.17 / $0.595, 15% bajo lista.
Equipos construyendo sobre la Qwen3 VL 30B A3B Instruct API
Pantallas, escaneos y fotos detras de una llamada.
Con 3B activos la Qwen3 VL 30B A3B Instruct API responde sobre capturas mas rapido que nuestro viejo VL denso, a una fraccion del costo.
Las partes image_url estandar hicieron que nuestra pila multimodal corriera sobre la Qwen3 VL 30B A3B Instruct API sin plomeria personalizada.
A $0.17 de entrada y $0.595 de salida la Qwen3 VL 30B A3B Instruct API hizo el analisis de documentos tan barato que corre en cada carga.
El streaming desde la Qwen3 VL 30B A3B Instruct API es suave, y nuestra UI renderiza respuestas sobre imagenes token por token.
Enviamos capturas de graficos a la Qwen3 VL 30B A3B Instruct API y los numeros vuelven como JSON estructurado limpio cada vez.
Nuestro agente de GUI lee pantallas a traves de la Qwen3 VL 30B A3B Instruct API y ancla los botones que debe pulsar.
Cambiar de otro proveedor a la Qwen3 VL 30B A3B Instruct API fue un solo string: la forma de OpenAI no se movio.
El OCR multilingue es la razon por la que estandarizamos en la Qwen3 VL 30B A3B Instruct API; los recibos en portugues salen igual de limpios.
Qwen3 VL 30B A3B Instruct API - preguntas comunes
Lo que debes saber antes de enrutar trafico.
La Qwen3 VL 30B A3B Instruct API es acceso alojado de RouterBase a Alibaba Qwen3 VL 30B A3B Instruct, un modelo de vision-lenguaje MoE con 30B totales y 3B activos, sobre un endpoint compatible con OpenAI.