Nous avons pointe notre pipeline de factures vers la Qwen3 VL 30B A3B Instruct API et l'OCR plus l'extraction JSON a remplace deux services.
Qwen3 VL 30B A3B Instruct est un modele vision-langage MoE d'Alibaba Qwen avec 30B au total et environ 3B actifs, qui lit images et texte en un appel avec un fort OCR et une bonne comprehension des graphiques. Servi sur RouterBase via un endpoint compatible OpenAI a 0,19 $ / 1M en entree et 0,665 $ / 1M en sortie, -15 %.
Qwen3 VL 30B A3B Instruct API - MoE vision-langage, 3B actifs
La Qwen3 VL 30B A3B Instruct API execute un modele vision-langage MoE avec 30B au total et 3B actifs, qui lit images et texte.
La Qwen3 VL 30B A3B Instruct API sert Alibaba Qwen3 VL 30B A3B Instruct, un modele vision-langage a melange d'experts qui active seulement environ 3B de ses 30B parametres par token, avec une perception de grand reseau au cout d'un petit modele. Captures, photos, scans et graphiques voyagent a cote de votre prompt comme parties image_url standard, donc la Qwen3 VL 30B A3B Instruct API fonctionne avec tout client OpenAI sans changement et une cle couvre le catalogue.
Ajuste aux instructions pour des reponses directes, le modele couvre OCR de photos et de scans, comprehension de documents et de graphiques, analyse de captures et ancrage visuel. La Qwen3 VL 30B A3B Instruct API facture 0,17 $ par 1M en entree et 0,595 $ par 1M en sortie, 15 % sous le catalogue de 0,20 $ et 0,70 $, sans frais par requete. Le streaming et les outils au schema standard laissent brancher la Qwen3 VL 30B A3B Instruct API dans un pipeline documentaire ou un agent GUI sans colle du fournisseur.
Ce que la Qwen3 VL 30B A3B Instruct API vous donne
La qualite vision-langage au cout de 3B actifs.
Image plus texte
La Qwen3 VL 30B A3B Instruct API prend images et texte dans la meme requete : captures, photos, scans et graphiques voyagent a cote de votre prompt.
MoE avec 3B actifs
Un reseau MoE de 30B au total active seulement environ 3B par token, donc la Qwen3 VL 30B A3B Instruct API repond avec une perception de grand modele au cout d'un petit.
OCR et documents
Une forte reconnaissance de texte sur photos, scans et pages fait de la Qwen3 VL 30B A3B Instruct API une base fiable pour recus, formulaires et extraction.
Graphiques, UIs, ancrage
Le modele lit graphiques et tableaux, comprend captures et GUIs, et localise des objets, donc la Qwen3 VL 30B A3B Instruct API convient aux agents qui regardent avant d'agir.
Outils et JSON
La Qwen3 VL 30B A3B Instruct API renvoie appels de fonctions et JSON structure dans le schema OpenAI standard, prets pour agents multimodaux et pipelines de donnees.
Streaming, au token
La Qwen3 VL 30B A3B Instruct API diffuse les tokens au fil de la generation et facture au token 0,19 $ en entree et 0,665 $ en sortie, 15 % sous catalogue, sans frais par requete.

Premier appel a la Qwen3 VL 30B A3B Instruct API en trois etapes
Branchez une fois, puis diffusez.
Creez une cle
Une cle RouterBase atteint la Qwen3 VL 30B A3B Instruct API et tous les modeles du catalogue ; rien a configurer cote fournisseur.
Pointez votre client
Envoyez n'importe quel client OpenAI vers routerbase.com/v1 avec model=qwen/qwen3-vl-30b-a3b-instruct et des messages melant texte et image_url ; la Qwen3 VL 30B A3B Instruct API repond dans la meme forme chat-completions.
Diffusez et suivez l'usage
Le modele diffuse les tokens et renvoie l'usage par reponse ; cout et latence restent visibles a chaque appel a la Qwen3 VL 30B A3B Instruct API.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
| Résolution | RouterBase | Officiel | Économie |
|---|---|---|---|
| Input (per 1M) | $0.170 | −15% | |
| Output (per 1M) | $0.595 | −15% |
Un appel avec la configuration par défaut (Input (per 1M)) coûte $0.170.Avec 1 $ vous pouvez exécuter ce modèle environ 5 fois.
Prix officiel = tarif catalogue Alibaba Qwen pour Qwen3 VL 30B A3B Instruct (0,20 $ par 1M en entree, 0,70 $ par 1M en sortie). RouterBase sert la Qwen3 VL 30B A3B Instruct API a 0,19 $ / 0,665 $, 15 % sous catalogue.
Des equipes qui construisent sur la Qwen3 VL 30B A3B Instruct API
Ecrans, scans et photos derriere un appel.
Avec 3B actifs, la Qwen3 VL 30B A3B Instruct API repond sur captures plus vite que notre ancien VL dense, pour une fraction du cout.
Les parties image_url standard ont fait tourner notre pile multimodale sur la Qwen3 VL 30B A3B Instruct API sans plomberie personnalisee.
A 0,19 $ en entree et 0,665 $ en sortie, la Qwen3 VL 30B A3B Instruct API a rendu l'analyse documentaire assez bon marche pour chaque upload.
Le streaming depuis la Qwen3 VL 30B A3B Instruct API est fluide, et notre UI rend les reponses image token par token.
Nous envoyons des captures de graphiques a la Qwen3 VL 30B A3B Instruct API et les chiffres reviennent chaque fois en JSON structure propre.
Notre agent GUI lit les ecrans via la Qwen3 VL 30B A3B Instruct API et ancre les boutons a cliquer.
Passer d'un autre fournisseur a la Qwen3 VL 30B A3B Instruct API fut une seule chaine : la forme OpenAI n'a pas bouge.
L'OCR multilingue est la raison pour laquelle nous avons standardise sur la Qwen3 VL 30B A3B Instruct API ; les recus en portugais sortent aussi propres.
Qwen3 VL 30B A3B Instruct API - questions frequentes
Ce qu'il faut savoir avant de router du trafic.
La Qwen3 VL 30B A3B Instruct API est l'acces heberge par RouterBase a Alibaba Qwen3 VL 30B A3B Instruct, un modele vision-langage MoE avec 30B au total et 3B actifs, via un endpoint compatible OpenAI.