Movemos nossa pilha de agentes para a Qwen3.5 122B A10B API e o orcamento de 10B ativos cortou nossa latencia p95 quase pela metade.
O Qwen3.5 122B A10B e um LLM de mistura de especialistas da Alibaba Qwen com 122B totais e cerca de 10B ativos, contexto de 256K e solidas capacidades de raciocinio, codigo e multilingues. Servido na RouterBase por um endpoint compativel com OpenAI a $0.34 / 1M de entrada e $2.72 / 1M de saida, 15% abaixo da tabela.
Qwen3.5 122B A10B API - MoE de 122B, 10B Ativos, Contexto de 256K
A Qwen3.5 122B A10B API executa um MoE de 122B com cerca de 10B ativos, contexto de 256K e solido raciocinio, codigo e chat multilingue.
A Qwen3.5 122B A10B API serve o Alibaba Qwen3.5 122B A10B, um modelo de mistura de especialistas com 122 bilhoes de parametros e cerca de 10 bilhoes ativos por token. O roteamento esparso da qualidade de modelo grande com a latencia e o custo de uma rede bem menor, e uma janela de 256K tokens admite arquivos longos, transcricoes e tracos de ferramentas em uma chamada. Voce acessa a Qwen3.5 122B A10B API via RouterBase sobre o protocolo chat-completions da OpenAI: seu cliente atual funciona sem mudancas e uma chave cobre todo o catalogo.
O Qwen3.5 122B A10B foi ajustado para raciocinio de varios passos, geracao e revisao de codigo, uso agentico de ferramentas, JSON estruturado e chat em mais de 100 idiomas. A cobranca e de $0.34 por 1M de entrada e $2.72 por 1M de saida, 15% abaixo da tarifa de tabela de $0.40 e $3.20, sem taxa por requisicao. Com streaming e chamadas de ferramentas no esquema padrao da OpenAI, a Qwen3.5 122B A10B API encaixa em loops de agente, assistentes de IDE e pipelines em lote sem cola do provedor.
O que a Qwen3.5 122B A10B API te da
Qualidade de fronteira com orcamento de 10B ativos.
MoE de 122B, 10B ativos
A Qwen3.5 122B A10B API roteia cada token por um pequeno conjunto de especialistas em uma rede de 122B parametros: qualidade proxima de densos bem maiores com latencia baixa.
Contexto de 256K
Uma janela de 256K tokens retem arquivos longos e tracos de ferramentas em uma unica chamada, entao raramente voce fatia entradas para a Qwen3.5 122B A10B API.
Raciocinio que aguenta
A geracao Qwen3.5 afina o raciocinio de varios passos e o seguimento de instrucoes, entao a Qwen3.5 122B A10B API resolve problemas dificeis sem se desviar.
Codigo e agentes
Uma forte geracao de codigo, revisao e uso agentico de ferramentas fazem da Qwen3.5 122B A10B API uma base confiavel para ferramentas de dev e fluxos autonomos.
Ferramentas e JSON
A Qwen3.5 122B A10B API devolve chamadas de funcoes e JSON estruturado no esquema padrao da OpenAI, prontas para agentes e pipelines de dados.
Streaming, por token
A Qwen3.5 122B A10B API transmite tokens conforme sao gerados e cobra por token a $0.34 de entrada e $2.72 de saida, 15% abaixo da tabela, sem taxa por requisicao.

Primeira chamada a Qwen3.5 122B A10B API em tres passos
Conecte uma vez, depois transmita.
Crie uma chave
Uma chave da RouterBase alcanca a Qwen3.5 122B A10B API e todos os outros modelos do catalogo, sem nada do provedor para configurar.
Aponte seu cliente
Envie qualquer cliente OpenAI para routerbase.com/v1 com model=qwen/qwen3.5-122b-a10b e um array de mensagens; a Qwen3.5 122B A10B API responde com a mesma forma chat-completions.
Transmita e veja o uso
O modelo transmite tokens conforme sao gerados e devolve o uso por resposta, entao o custo e a latencia ficam visiveis em cada chamada a Qwen3.5 122B A10B API.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
| Resolução | RouterBase | Oficial | Poupança |
|---|---|---|---|
| Input (per 1M) | $0.340 | −15% | |
| Output (per 1M) | $2.720 | −15% |
Uma execução com a configuração padrão (Input (per 1M)) custa $0.340.Com $1 podes executar este modelo aproximadamente 2 vezes.
Preco oficial = tarifa de tabela da Alibaba Qwen para Qwen3.5 122B A10B ($0.40 por 1M de entrada, $3.20 por 1M de saida). A RouterBase serve a Qwen3.5 122B A10B API a $0.34 / $2.72, 15% abaixo da tabela.
Times construindo sobre a Qwen3.5 122B A10B API
Raciocinio, agentes e chat atras de uma chamada.
O contexto de 256K fez a Qwen3.5 122B A10B API ler todo o nosso brief mais seus tracos de ferramentas em uma passada.
O esquema padrao fez nossos agentes rodarem sobre a Qwen3.5 122B A10B API sem parse personalizado desde o primeiro dia.
A $0.34 de entrada e $2.72 de saida a Qwen3.5 122B A10B API manteve previsivel nosso custo por tarefa enquanto o trafego subia.
O streaming da Qwen3.5 122B A10B API e suave, entao nossa UI de chat renderiza token por token sem trabalho extra.
Enviamos revisao de codigo e JSON para a Qwen3.5 122B A10B API e a saida estruturada volta limpa toda vez.
A qualidade de raciocinio nos surpreendeu: a Qwen3.5 122B A10B API resolve tickets de varios passos que antes exigiam um modelo mais caro.
Trocar de outro provedor para a Qwen3.5 122B A10B API foi uma unica string: a forma da OpenAI nao se moveu.
A cobertura multilingue e a razao de padronizarmos na Qwen3.5 122B A10B API; portugues e ingles saem igualmente bem.
Qwen3.5 122B A10B API - perguntas comuns
O que saber antes de rotear trafego.
A Qwen3.5 122B A10B API e o acesso hospedado da RouterBase ao Alibaba Qwen3.5 122B A10B, um LLM de mistura de especialistas com 122B totais e 10B ativos, sobre um endpoint compativel com OpenAI.