chat.qwen3_5_122b_a10b
alibaba/qwen3-5-122b-a10b

O Qwen3.5 122B A10B e um LLM de mistura de especialistas da Alibaba Qwen com 122B totais e cerca de 10B ativos, contexto de 256K e solidas capacidades de raciocinio, codigo e multilingues. Servido na RouterBase por um endpoint compativel com OpenAI a $0.34 / 1M de entrada e $2.72 / 1M de saida, 15% abaixo da tabela.

Input
Qwen3.5 122B A10B
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Qwen3.5 122B A10B Online
Hi! I'm a helpful AI assistant. What can I do for you?

Qwen3.5 122B A10B API - MoE de 122B, 10B Ativos, Contexto de 256K

A Qwen3.5 122B A10B API executa um MoE de 122B com cerca de 10B ativos, contexto de 256K e solido raciocinio, codigo e chat multilingue.

A Qwen3.5 122B A10B API serve o Alibaba Qwen3.5 122B A10B, um modelo de mistura de especialistas com 122 bilhoes de parametros e cerca de 10 bilhoes ativos por token. O roteamento esparso da qualidade de modelo grande com a latencia e o custo de uma rede bem menor, e uma janela de 256K tokens admite arquivos longos, transcricoes e tracos de ferramentas em uma chamada. Voce acessa a Qwen3.5 122B A10B API via RouterBase sobre o protocolo chat-completions da OpenAI: seu cliente atual funciona sem mudancas e uma chave cobre todo o catalogo.

O Qwen3.5 122B A10B foi ajustado para raciocinio de varios passos, geracao e revisao de codigo, uso agentico de ferramentas, JSON estruturado e chat em mais de 100 idiomas. A cobranca e de $0.34 por 1M de entrada e $2.72 por 1M de saida, 15% abaixo da tarifa de tabela de $0.40 e $3.20, sem taxa por requisicao. Com streaming e chamadas de ferramentas no esquema padrao da OpenAI, a Qwen3.5 122B A10B API encaixa em loops de agente, assistentes de IDE e pipelines em lote sem cola do provedor.

Esparso, contexto longo, pronto para agentes

O que a Qwen3.5 122B A10B API te da

Qualidade de fronteira com orcamento de 10B ativos.

MoE de 122B, 10B ativos

A Qwen3.5 122B A10B API roteia cada token por um pequeno conjunto de especialistas em uma rede de 122B parametros: qualidade proxima de densos bem maiores com latencia baixa.

Contexto de 256K

Uma janela de 256K tokens retem arquivos longos e tracos de ferramentas em uma unica chamada, entao raramente voce fatia entradas para a Qwen3.5 122B A10B API.

Raciocinio que aguenta

A geracao Qwen3.5 afina o raciocinio de varios passos e o seguimento de instrucoes, entao a Qwen3.5 122B A10B API resolve problemas dificeis sem se desviar.

Codigo e agentes

Uma forte geracao de codigo, revisao e uso agentico de ferramentas fazem da Qwen3.5 122B A10B API uma base confiavel para ferramentas de dev e fluxos autonomos.

Ferramentas e JSON

A Qwen3.5 122B A10B API devolve chamadas de funcoes e JSON estruturado no esquema padrao da OpenAI, prontas para agentes e pipelines de dados.

Streaming, por token

A Qwen3.5 122B A10B API transmite tokens conforme sao gerados e cobra por token a $0.34 de entrada e $2.72 de saida, 15% abaixo da tabela, sem taxa por requisicao.

RouterBase dashboard preview
Maos a obra

Primeira chamada a Qwen3.5 122B A10B API em tres passos

Conecte uma vez, depois transmita.

  1. Crie uma chave

    Uma chave da RouterBase alcanca a Qwen3.5 122B A10B API e todos os outros modelos do catalogo, sem nada do provedor para configurar.

  2. Aponte seu cliente

    Envie qualquer cliente OpenAI para routerbase.com/v1 com model=qwen/qwen3.5-122b-a10b e um array de mensagens; a Qwen3.5 122B A10B API responde com a mesma forma chat-completions.

  3. Transmita e veja o uso

    O modelo transmite tokens conforme sao gerados e devolve o uso por resposta, entao o custo e a latencia ficam visiveis em cada chamada a Qwen3.5 122B A10B API.

Preços

Paga apenas pelo que usas

A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.

Preços

Paga apenas pelo que usas

A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.

ResoluçãoRouterBaseOficialPoupança
Input (per 1M) $0.340$0.400−15%
Output (per 1M) $2.720$3.200−15%

Uma execução com a configuração padrão (Input (per 1M)) custa $0.340.Com $1 podes executar este modelo aproximadamente 2 vezes.

Preco oficial = tarifa de tabela da Alibaba Qwen para Qwen3.5 122B A10B ($0.40 por 1M de entrada, $3.20 por 1M de saida). A RouterBase serve a Qwen3.5 122B A10B API a $0.34 / $2.72, 15% abaixo da tabela.

Entregando com Qwen3.5

Times construindo sobre a Qwen3.5 122B A10B API

Raciocinio, agentes e chat atras de uma chamada.

Ingrid SolheimChefe de IA, Fjordline

Movemos nossa pilha de agentes para a Qwen3.5 122B A10B API e o orcamento de 10B ativos cortou nossa latencia p95 quase pela metade.

Rafael OrtegaEngenheiro Staff, Lumen Works

O contexto de 256K fez a Qwen3.5 122B A10B API ler todo o nosso brief mais seus tracos de ferramentas em uma passada.

Amara DialloCTO, Kite Analytics

O esquema padrao fez nossos agentes rodarem sobre a Qwen3.5 122B A10B API sem parse personalizado desde o primeiro dia.

Jonas Keller
Jonas KellerFundador, Brightpath

A $0.34 de entrada e $2.72 de saida a Qwen3.5 122B A10B API manteve previsivel nosso custo por tarefa enquanto o trafego subia.

Mei-Ling ChouLider de Backend, Harborlight

O streaming da Qwen3.5 122B A10B API e suave, entao nossa UI de chat renderiza token por token sem trabalho extra.

Viktor AntonovLider de ML, Northgate

Enviamos revisao de codigo e JSON para a Qwen3.5 122B A10B API e a saida estruturada volta limpa toda vez.

Sofia MarchettiEngenheira Principal, Vellum Labs

A qualidade de raciocinio nos surpreendeu: a Qwen3.5 122B A10B API resolve tickets de varios passos que antes exigiam um modelo mais caro.

Andre BoucherFundador, Quai Digital

Trocar de outro provedor para a Qwen3.5 122B A10B API foi uma unica string: a forma da OpenAI nao se moveu.

Lucia FerreiraGerente de Engenharia, Mirante

A cobertura multilingue e a razao de padronizarmos na Qwen3.5 122B A10B API; portugues e ingles saem igualmente bem.

Qwen3.5 122B A10B API - perguntas comuns

O que saber antes de rotear trafego.

A Qwen3.5 122B A10B API e o acesso hospedado da RouterBase ao Alibaba Qwen3.5 122B A10B, um LLM de mistura de especialistas com 122B totais e 10B ativos, sobre um endpoint compativel com OpenAI.