chat.qwen3_5_35b_a3b
alibaba/qwen3-5-35b-a3b

Qwen3.5 35B A3B は Alibaba Qwen による Mixture-of-Experts チャットモデルで、総 35B・アクティブ約 3B。高速かつ低コストで、対話・コーディング・多言語に向きます。RouterBase 上で OpenAI 互換エンドポイントから提供、入力 $0.213 / 1M、出力 $1.70 / 1M、標準より 15% 安。

Input
Qwen3.5 35B A3B
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Qwen3.5 35B A3B Online
Hi! I'm a helpful AI assistant. What can I do for you?

Qwen3.5 35B A3B API —— 高効率 MoE、3B アクティブ

Qwen3.5 35B A3B API は総 35B・アクティブ約 3B の Qwen3.5 MoE モデルを提供し、高速・低コストの対話、コーディング、多言語処理に向きます。

Qwen3.5 35B A3B API は Alibaba Qwen3.5 35B A3B、総パラメータ 350 億・トークンごとにアクティブ約 30 億の Mixture-of-Experts モデルを提供します。ルーターが各ステップで少数のエキスパートだけを選ぶため、小さなモデルの遅延とコストで答えつつ、大きな知識を引き出せます。このため Qwen3.5 35B A3B API は大量チャット、要約、コーディング支援、多言語アシスタントに適し、コスト重視の本番運用でこそ差が出ます。

RouterBase 経由の OpenAI chat-completions 互換なので、既存クライアントはそのまま動き、一つのキーがカタログ全体を覆います。課金は入力 100 万トークン $0.213、出力 $1.70 で、$0.25 / $2.00 の標準より 15% 安、リクエスト料なし。ストリーミングと標準のツール呼び出しにより、Qwen3.5 35B A3B API をエージェント、IDE アシスタント、バッチに接着コードなしで組み込め、使用量とコストはダッシュボードで一目で確認できます。

スパース、高速、低コスト

Qwen3.5 35B A3B API が与えるもの

大モデルの知識を小モデルのコストで。

高効率 MoE 設計

Qwen3.5 35B A3B API は総 35B・アクティブ約 3B の MoE で、密モデルの遅延なしに深い知識を出します。

Qwen3.5 世代

指示追従と推論が以前の小型 Qwen より強く、エンドポイントの形は変わりません。

速くて安い

小さなアクティブスライスで Qwen3.5 35B A3B API は低遅延、入力 $0.213、出力 $1.70、15% 安。

多言語チャット

英語、中国語ほか多数の言語を扱い、Qwen3.5 35B A3B API は多言語アシスタントや翻訳を覆います。

ツールと JSON

Qwen3.5 35B A3B API は関数呼び出しと JSON を標準スキーマで返し、エージェントに適合します。

ストリーミング

チャンク HTTP で生成と同時にストリームし、トークン単位課金でリクエスト料なし。

RouterBase dashboard preview
始めよう

3 ステップで Qwen3.5 35B A3B API を呼ぶ

一度つなげば、あとはストリーム。

  1. キーを作成

    一つの RouterBase キーが Qwen3.5 35B A3B API とカタログの全モデルに届きます。

  2. クライアントを向ける

    OpenAI クライアントを routerbase.com/v1 へ、model=qwen/qwen3.5-35b-a3b と messages で送ると Qwen3.5 35B A3B API が答えます。

  3. ストリームと使用量

    トークンをストリームし使用量を返すので、Qwen3.5 35B A3B API の各呼び出しでコストが見えます。

料金

使った分だけ支払う

RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。

料金

使った分だけ支払う

RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。

解像度RouterBase公式節約
Input (per 1M) $0.213$0.250−15%
Output (per 1M) $1.700$2.000−15%

デフォルト設定(Input (per 1M))では 1 回あたり $0.213 です。$1 でこのモデルを約 4 回呼び出せます。

標準価格 = Alibaba Qwen の掲載レート(入力 100 万 $0.25、出力 $2.00)。RouterBase は Qwen3.5 35B A3B API を $0.213 / $1.70、15% 安く提供します。

Qwen3.5 で出荷

Qwen3.5 35B A3B API 上で構築するチーム

小モデルのコストで大量チャットを。

Ingrid Solbergプラットフォームリード, Fjordline

サポートチャットを Qwen3.5 35B A3B API に回すと、遅延が気にならなくなりました。

Rafael OrtegaCTO, Lumen Foundry

入力 $0.213、出力 $1.70 で、Qwen3.5 35B A3B API は予算据え置きで要約量を 3 倍にしました。

Aisha Belloエンジニアリング責任者, Kite Systems

3B アクティブが鍵——Qwen3.5 35B A3B API は大きなモデルのように答え、即座に流れます。

Petr HavelStaff Engineer, Moravia Labs

標準スキーマの関数呼び出しで、エージェントは Qwen3.5 35B A3B API 上で独自パースなしに動きました。

Yuki TanakaML エンジニア, Harborline

毎回ベンチしますが、Qwen3.5 35B A3B API はコスト品質比が最高です。

Camille Roche創業者, Atelier Nord

密モデルから Qwen3.5 35B A3B API への切替は文字列一つでした。

Sofia Marinoプロダクトエンジニア, Vellum Works

多言語の回答が等しく良く、当社のチャットは今日 Qwen3.5 35B A3B API で動いています。

Jonas Weberバックエンドリード, Glaswerk

Qwen3.5 35B A3B API のストリーミングは滑らかで、UI は逐次描画できます。

Nadia Rahmanエンジニアリングマネージャー, Quill Stack

大モデルが要った JSON 抽出が、Qwen3.5 35B A3B API で安く通ります。

Qwen3.5 35B A3B API —— よくある質問

流す前に知ること。

Alibaba Qwen3.5 35B A3B への RouterBase ホスト型アクセスで、MoE モデルを OpenAI 互換で提供します。