chat.qwen3_5_122b_a10b
alibaba/qwen3-5-122b-a10b

Qwen3.5 122B A10B es un LLM de mezcla de expertos de Alibaba Qwen con 122B totales y unos 10B activos, contexto de 256K y solidas capacidades de razonamiento, codigo y multilingues. Servido en RouterBase por un endpoint compatible con OpenAI a $0.34 / 1M de entrada y $2.72 / 1M de salida, 15% bajo lista.

Input
Qwen3.5 122B A10B
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Qwen3.5 122B A10B Online
Hi! I'm a helpful AI assistant. What can I do for you?

Qwen3.5 122B A10B API - MoE de 122B, 10B Activos, Contexto de 256K

La Qwen3.5 122B A10B API ejecuta un MoE de 122B con unos 10B activos, contexto de 256K y solido razonamiento, codigo y chat multilingue.

La Qwen3.5 122B A10B API sirve Alibaba Qwen3.5 122B A10B, un modelo de mezcla de expertos con 122 mil millones de parametros y unos 10 mil millones activos por token. El enrutamiento disperso da calidad de modelo grande con la latencia y el costo de una red mucho menor, y una ventana de 256K tokens admite archivos largos, transcripciones y trazas de herramientas en una llamada. Accedes a la Qwen3.5 122B A10B API via RouterBase sobre el protocolo chat-completions de OpenAI: tu cliente actual funciona sin cambios y una clave cubre todo el catalogo.

Qwen3.5 122B A10B fue ajustado para razonamiento de varios pasos, generacion y revision de codigo, uso agentico de herramientas, JSON estructurado y chat en mas de 100 idiomas. La facturacion es de $0.34 por 1M de entrada y $2.72 por 1M de salida, 15% bajo la tarifa de lista de $0.40 y $3.20, sin tarifa por solicitud. Con streaming y llamadas a herramientas en el esquema estandar de OpenAI, la Qwen3.5 122B A10B API encaja en bucles de agente, asistentes de IDE y pipelines por lotes sin pegamento del proveedor.

Disperso, contexto largo, listo para agentes

Lo que te da la Qwen3.5 122B A10B API

Calidad de frontera con un presupuesto de 10B activos.

MoE de 122B, 10B activos

La Qwen3.5 122B A10B API enruta cada token por un pequeno conjunto de expertos en una red de 122B parametros: calidad cercana a densos mucho mayores con latencia baja.

Contexto de 256K

Una ventana de 256K tokens permite retener archivos largos y trazas de herramientas en una sola llamada, asi que rara vez troceas entradas para la Qwen3.5 122B A10B API.

Razonamiento que aguanta

La generacion Qwen3.5 afina el razonamiento de varios pasos y el seguimiento de instrucciones, asi que la Qwen3.5 122B A10B API resuelve problemas dificiles sin desviarse.

Codigo y agentes

Una fuerte generacion de codigo, revision y uso agentico de herramientas hacen de la Qwen3.5 122B A10B API una base fiable para herramientas de desarrollo y flujos autonomos.

Herramientas y JSON

La Qwen3.5 122B A10B API devuelve llamadas a funciones y JSON estructurado en el esquema estandar de OpenAI, listas para agentes y tuberias de datos.

Streaming, por token

La Qwen3.5 122B A10B API transmite tokens al generarse y cobra por token a $0.34 de entrada y $2.72 de salida, 15% bajo lista, sin tarifa por solicitud.

RouterBase dashboard preview
Manos a la obra

Primera llamada a la Qwen3.5 122B A10B API en tres pasos

Conectala una vez, luego transmite.

  1. Crea una clave

    Una clave de RouterBase alcanza la Qwen3.5 122B A10B API y todos los demas modelos del catalogo, sin nada del proveedor que configurar.

  2. Apunta tu cliente

    Envia cualquier cliente OpenAI a routerbase.com/v1 con model=qwen/qwen3.5-122b-a10b y un arreglo de mensajes; la Qwen3.5 122B A10B API responde con la misma forma chat-completions.

  3. Transmite y observa el uso

    El modelo transmite tokens al generarse y devuelve el uso por respuesta, asi que el costo y la latencia quedan visibles en cada llamada a la Qwen3.5 122B A10B API.

Precios

Paga sólo por lo que usas

RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.

Precios

Paga sólo por lo que usas

RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.

ResoluciónRouterBaseOficialAhorro
Input (per 1M) $0.340$0.400−15%
Output (per 1M) $2.720$3.200−15%

Una ejecución con la configuración predeterminada (Input (per 1M)) cuesta $0.340.Con $1 puedes ejecutar este modelo aproximadamente 2 veces.

Precio oficial = tarifa de lista de Alibaba Qwen para Qwen3.5 122B A10B ($0.40 por 1M de entrada, $3.20 por 1M de salida). RouterBase sirve la Qwen3.5 122B A10B API a $0.34 / $2.72, 15% bajo lista.

Enviando con Qwen3.5

Equipos construyendo sobre la Qwen3.5 122B A10B API

Razonamiento, agentes y chat detras de una llamada.

Ingrid SolheimJefa de IA, Fjordline

Movimos nuestra pila de agentes a la Qwen3.5 122B A10B API y el presupuesto de 10B activos corto nuestra latencia p95 casi a la mitad.

Rafael OrtegaIngeniero Staff, Lumen Works

El contexto de 256K hizo que la Qwen3.5 122B A10B API leyera todo nuestro brief mas sus trazas en una pasada.

Amara DialloCTO, Kite Analytics

El esquema estandar hizo que nuestros agentes corrieran sobre la Qwen3.5 122B A10B API sin analisis personalizado desde el primer dia.

Jonas Keller
Jonas KellerFundador, Brightpath

A $0.34 de entrada y $2.72 de salida la Qwen3.5 122B A10B API mantuvo predecible nuestro costo por tarea mientras subia el trafico.

Mei-Ling ChouLider de Backend, Harborlight

El streaming desde la Qwen3.5 122B A10B API es suave, y nuestra UI de chat renderiza token por token sin trabajo extra.

Viktor AntonovLider de ML, Northgate

Enviamos revision de codigo y JSON a la Qwen3.5 122B A10B API y la salida vuelve limpia cada vez.

Sofia MarchettiIngeniera Principal, Vellum Labs

La calidad de razonamiento nos sorprendio: la Qwen3.5 122B A10B API resuelve tickets de varios pasos que antes exigian un modelo mas caro.

Andre BoucherFundador, Quai Digital

Cambiar de otro proveedor a la Qwen3.5 122B A10B API fue un solo string: la forma de OpenAI no se movio.

Lucia FerreiraGerente de Ingenieria, Mirante

La cobertura multilingue es la razon por la que estandarizamos en la Qwen3.5 122B A10B API; espanol e ingles salen igual de bien.

Qwen3.5 122B A10B API - preguntas comunes

Lo que debes saber antes de enrutar trafico.

La Qwen3.5 122B A10B API es acceso alojado de RouterBase a Alibaba Qwen3.5 122B A10B, un LLM de mezcla de expertos con 122B totales y 10B activos, sobre un endpoint compatible con OpenAI.