chat.qwen3_5_122b_a10b
alibaba/qwen3-5-122b-a10b

Qwen3.5 122B A10B ist ein Mixture-of-Experts-LLM von Alibaba Qwen mit 122B gesamt und rund 10B aktiv, 256K-Kontext und starken Reasoning-, Code- und mehrsprachigen Faehigkeiten. Auf RouterBase ueber einen OpenAI-kompatiblen Endpoint zu $0.34 / 1M Eingabe und $2.72 / 1M Ausgabe, 15% unter Liste.

Input
Qwen3.5 122B A10B
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Qwen3.5 122B A10B Online
Hi! I'm a helpful AI assistant. What can I do for you?

Qwen3.5 122B A10B API - 122B MoE, 10B aktiv, 256K-Kontext

Die Qwen3.5 122B A10B API fuehrt ein 122B-MoE mit rund 10B aktiven Parametern aus - 256K-Kontext, starkes Reasoning, Code und mehrsprachiger Chat.

Die Qwen3.5 122B A10B API bedient Alibaba Qwen3.5 122B A10B, ein Mixture-of-Experts-Modell mit 122 Milliarden Parametern insgesamt und rund 10 Milliarden aktiv pro Token. Sparsames Routing liefert Qualitaet auf Grossmodell-Niveau bei der Latenz und den Kosten eines viel kleineren Netzes, und ein 256K-Token-Kontextfenster fasst lange Dateien, Transkripte und Tool-Traces in einem Aufruf. Du erreichst die Qwen3.5 122B A10B API ueber RouterBase auf dem OpenAI-Chat-Completions-Protokoll: dein bestehender Client funktioniert unveraendert, und ein Schluessel deckt den ganzen Katalog ab.

Qwen3.5 122B A10B wurde fuer mehrstufiges Reasoning, Codegenerierung und -pruefung, agentische Tool-Nutzung, strukturiertes JSON und Chat in mehr als 100 Sprachen optimiert. Die Abrechnung betraegt $0.34 pro 1M Eingabetokens und $2.72 pro 1M Ausgabe, 15% unter dem Listenpreis von $0.40 und $3.20, ohne Gebuehr pro Anfrage. Mit Streaming und Tool-Aufrufen im Standard-OpenAI-Schema passt die Qwen3.5 122B A10B API in Agentenschleifen, IDE-Assistenten und Batch-Pipelines, ganz ohne anbieterspezifischen Klebecode.

Sparsam, langer Kontext, agentenbereit

Was die Qwen3.5 122B A10B API dir gibt

Flaggschiff-Qualitaet mit einem aktiven Budget von 10B.

122B MoE, 10B aktiv

Die Qwen3.5 122B A10B API leitet jeden Token durch eine kleine Gruppe von Experten in einem 122B-Parameter-Netzwerk, sodass die Qualitaet nahe an viel groesseren dichten Modellen landet, waehrend die Latenz niedrig bleibt.

256K-Kontext

Ein 256K-Token-Fenster laesst das Modell lange Dateien, Transkripte und Tool-Traces in einem einzigen Aufruf halten, sodass du Eingaben fuer die Qwen3.5 122B A10B API selten stueckeln musst.

Reasoning, das haelt

Die Qwen3.5-Generation schaerft mehrstufiges Reasoning und Instruktionsbefolgung, sodass die Qwen3.5 122B A10B API harte Probleme durcharbeitet, ohne vom Kurs abzukommen.

Code und Agenten

Starke Codegenerierung, -pruefung und agentische Tool-Nutzung machen die Qwen3.5 122B A10B API zu einem verlaesslichen Rueckgrat fuer Entwicklertools und autonome Workflows.

Tools und JSON

Die Qwen3.5 122B A10B API gibt Funktionsaufrufe und strukturiertes JSON im Standard-OpenAI-Schema zurueck, bereit fuer Agenten und Datenpipelines.

Streaming, pro Token

Die Qwen3.5 122B A10B API streamt Tokens beim Generieren und rechnet pro Token zu $0.34 Eingabe und $2.72 Ausgabe ab, 15% unter Liste, ohne Anfragegebuehr.

RouterBase dashboard preview
Loslegen

Erster Aufruf der Qwen3.5 122B A10B API in drei Schritten

Einmal verdrahten, dann streamen.

  1. Schluessel erstellen

    Ein RouterBase-Schluessel erreicht die Qwen3.5 122B A10B API und jedes andere Modell im Katalog, sodass es nichts Anbieterspezifisches einzurichten gibt.

  2. Client ausrichten

    Schicke jeden OpenAI-Client an routerbase.com/v1 mit model=qwen/qwen3.5-122b-a10b und einem Messages-Array; die Qwen3.5 122B A10B API antwortet in derselben Chat-Completions-Form.

  3. Streamen und Nutzung beobachten

    Das Modell streamt Tokens beim Generieren und gibt die Token-Nutzung pro Antwort zurueck, sodass Kosten und Latenz bei jedem Aufruf der Qwen3.5 122B A10B API sichtbar bleiben.

Preise

Nur für die Nutzung zahlen

RouterBase reicht Partner-Tier-Preise durch. Verglichen mit dem offiziellen API-Tarif des Modells.

Preise

Nur für die Nutzung zahlen

RouterBase reicht Partner-Tier-Preise durch. Verglichen mit dem offiziellen API-Tarif des Modells.

AuflösungRouterBaseOffiziellErsparnis
Input (per 1M) $0.340$0.400−15%
Output (per 1M) $2.720$3.200−15%

Ein Aufruf mit der Standardkonfiguration (Input (per 1M)) kostet $0.340.Mit $1 kannst du dieses Modell etwa 2 Mal aufrufen.

Offizieller Preis = Alibaba-Qwen-Listenpreis fuer Qwen3.5 122B A10B ($0.40 pro 1M Eingabe, $3.20 pro 1M Ausgabe). RouterBase bietet die Qwen3.5 122B A10B API zu $0.34 / $2.72, 15% unter Liste.

Mit Qwen3.5 ausliefern

Teams, die auf der Qwen3.5 122B A10B API bauen

Reasoning, Agenten und Chat hinter einem Aufruf.

Ingrid SolheimLeiterin KI, Fjordline

Wir haben unseren Agenten-Stack auf die Qwen3.5 122B A10B API verlagert, und das aktive Budget von 10B hat unsere p95-Latenz bei gleicher Qualitaet fast halbiert.

Rafael OrtegaStaff Engineer, Lumen Works

Der 256K-Kontext liess die Qwen3.5 122B A10B API unser ganzes Design-Briefing plus seine Tool-Traces in einem Durchgang lesen - kein Stueckeln mehr.

Amara DialloCTO, Kite Analytics

Function Calling im Standard-Schema liess unsere Agenten ab Tag eins auf der Qwen3.5 122B A10B API laufen, mit null eigenem Parsing.

Jonas Keller
Jonas KellerGruender, Brightpath

Bei $0.34 Eingabe und $2.72 Ausgabe hielt die Qwen3.5 122B A10B API unsere Kosten pro Aufgabe vorhersagbar, waehrend der Traffic ueber das Quartal stieg.

Mei-Ling ChouBackend-Lead, Harborlight

Das Streaming von der Qwen3.5 122B A10B API ist glatt, sodass unsere Chat-UI Token fuer Token rendert, ohne zusaetzliche Pufferarbeit.

Viktor AntonovML-Lead, Northgate

Wir schicken Code-Review und JSON-Extraktion an die Qwen3.5 122B A10B API, und die strukturierte Ausgabe kommt jedes Mal sauber zurueck.

Sofia MarchettiPrincipal Engineer, Vellum Labs

Die Reasoning-Qualitaet hat uns ueberrascht: die Qwen3.5 122B A10B API arbeitet mehrstufige Tickets durch, die frueher ein viel teureres Modell brauchten.

Andre BoucherGruender, Quai Digital

Der Wechsel von einem anderen Anbieter zur Qwen3.5 122B A10B API war ein einziger String: die OpenAI-Form bewegte sich kein bisschen.

Lucia FerreiraEngineering Managerin, Mirante

Die mehrsprachige Abdeckung ist der Grund, warum wir auf die Qwen3.5 122B A10B API standardisiert haben; Deutsch und Englisch treffen gleich gut.

Qwen3.5 122B A10B API - haeufige Fragen

Was du wissen solltest, bevor du Traffic leitest.

Die Qwen3.5 122B A10B API ist RouterBase-gehosteter Zugang zu Alibaba Qwen3.5 122B A10B, einem Mixture-of-Experts-LLM mit 122B gesamt und 10B aktiv, ueber einen OpenAI-kompatiblen Endpoint.