請求書処理を Qwen3 VL 30B A3B Instruct API に向けたら、OCR と JSON 抽出がサービス二つを置き換えました。
Qwen3 VL 30B A3B Instruct は Alibaba Qwen による MoE 視覚言語モデルで、総 30B、アクティブ約 3B。一度の呼び出しで画像とテキストを読み、OCR とチャート理解に強いです。RouterBase 上で OpenAI 互換エンドポイントから提供、入力 $0.17 / 1M、出力 $0.595 / 1M、標準より 15% 安。
Qwen3 VL 30B A3B Instruct API —— 視覚言語 MoE、3B アクティブ
Qwen3 VL 30B A3B Instruct API は総 30B、アクティブ約 3B の MoE 視覚言語モデルを提供し、一度の呼び出しで画像と文を読みます。
Qwen3 VL 30B A3B Instruct API は Alibaba Qwen3 VL 30B A3B Instruct を提供します。トークンごとに総 300 億のうち約 30 億だけが動く Mixture-of-Experts 視覚言語モデルで、小型モデルの遅延とコストで大型並みの知覚を返します。スクリーンショット、写真、スキャン、チャートは標準の image_url パートとしてプロンプトと一緒に送るだけで、Qwen3 VL 30B A3B Instruct API はどの OpenAI クライアントでもそのまま動き、一つのキーがカタログ全体を覆います。
モデルは実際の視覚タスク向けに命令チューニングされ、直接答えます。写真やスキャンの OCR、文書とチャートの理解、画面分析、グラウンディングまで扱います。Qwen3 VL 30B A3B Instruct API の課金は入力 100 万トークン $0.17、出力 $0.595 で、標準の $0.20 / $0.70 より 15% 安、リクエスト料なし。ストリーミングと標準 OpenAI スキーマのツール呼び出しで、Qwen3 VL 30B A3B Instruct API を文書処理や GUI エージェントにそのまま組み込めます。
Qwen3 VL 30B A3B Instruct API が与えるもの
3B アクティブのコストで視覚言語品質を。
画像とテキスト入力
Qwen3 VL 30B A3B Instruct API は同じリクエストで画像とテキストを受け取り、画面やスキャン、チャートがプロンプトの隣に並びます。
MoE、3B アクティブ
総 30B の MoE がトークンごとに約 3B だけを起動するので、Qwen3 VL 30B A3B Instruct API は大モデルの知覚を小モデルのコストで返します。
OCR と文書
写真、スキャン、文書ページへの強い文字認識で、Qwen3 VL 30B A3B Instruct API は領収書解析やフォーム読み取りの基盤になります。
チャート、UI、定位
チャートや表を読み、アプリ画面と GUI を理解し、物体を特定するので、Qwen3 VL 30B A3B Instruct API は先に見て動くエージェントに合います。
ツールと JSON
関数呼び出しと構造化 JSON を標準 OpenAI スキーマで返すので、この API はマルチモーダルエージェントに適合します。
ストリーミング
Qwen3 VL 30B A3B Instruct API はトークンをストリームし、入力 $0.17、出力 $0.595、標準より 15% 安、リクエスト料なし。

3 ステップで Qwen3 VL 30B A3B Instruct API を呼ぶ
一度つないだら、あとはストリーム。
キーを作成
一つの RouterBase キーが Qwen3 VL 30B A3B Instruct API とカタログの全モデルに届きます。
クライアントを向ける
OpenAI クライアントを routerbase.com/v1 へ、model=qwen/qwen3-vl-30b-a3b-instruct とテキストと image_url を混ぜた messages で送ると Qwen3 VL 30B A3B Instruct API が答えます。
ストリームと使用量
モデルはトークンをストリームし使用量を返すので、Qwen3 VL 30B A3B Instruct API の各呼び出しでコストと遅延が見えます。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
| 解像度 | RouterBase | 公式 | 節約 |
|---|---|---|---|
| Input (per 1M) | $0.170 | −15% | |
| Output (per 1M) | $0.595 | −15% |
デフォルト設定(Input (per 1M))では 1 回あたり $0.170 です。$1 でこのモデルを約 5 回呼び出せます。
標準価格 = Alibaba Qwen の Qwen3 VL 30B A3B Instruct 掲載レート(入力 100 万 $0.20、出力 100 万 $0.70)。RouterBase は Qwen3 VL 30B A3B Instruct API を $0.17 / $0.595、標準より 15% 安く提供します。
Qwen3 VL 30B A3B Instruct API 上で構築するチーム
画面もスキャンも写真も、一つの呼び出しで。
3B アクティブで Qwen3 VL 30B A3B Instruct API は密な VL モデルより速く、安いです。
標準の image_url パートで、スタックは初日から Qwen3 VL 30B A3B Instruct API 上で動きました。
入力 $0.17、出力 $0.595 で、Qwen3 VL 30B A3B Instruct API は文書分析を安くしました。
この API のストリームは滑らかで、画像への回答を UI が逐次描画します。
チャートを Qwen3 VL 30B A3B Instruct API に送ると、数値が毎回きれいな JSON で返ります。
GUI エージェントは Qwen3 VL 30B A3B Instruct API で画面を読み、押すボタンを確実に特定します。
別社から Qwen3 VL 30B A3B Instruct API への切り替えは 1 文字列だけでした。
多言語 OCR こそ Qwen3 VL 30B A3B Instruct API に標準化した理由です。
Qwen3 VL 30B A3B Instruct API —— よくある質問
トラフィックを流す前に。
Alibaba Qwen3 VL 30B A3B Instruct への RouterBase ホスト型アクセスで、総 30B、活性 3B の MoE 視覚言語モデルを OpenAI 互換で提供します。