Movimos nuestra pila de agentes a la Qwen3.5 122B A10B API y el presupuesto de 10B activos corto nuestra latencia p95 casi a la mitad.
Qwen3.5 122B A10B es un LLM de mezcla de expertos de Alibaba Qwen con 122B totales y unos 10B activos, contexto de 256K y solidas capacidades de razonamiento, codigo y multilingues. Servido en RouterBase por un endpoint compatible con OpenAI a $0.34 / 1M de entrada y $2.72 / 1M de salida, 15% bajo lista.
Qwen3.5 122B A10B API - MoE de 122B, 10B Activos, Contexto de 256K
La Qwen3.5 122B A10B API ejecuta un MoE de 122B con unos 10B activos, contexto de 256K y solido razonamiento, codigo y chat multilingue.
La Qwen3.5 122B A10B API sirve Alibaba Qwen3.5 122B A10B, un modelo de mezcla de expertos con 122 mil millones de parametros y unos 10 mil millones activos por token. El enrutamiento disperso da calidad de modelo grande con la latencia y el costo de una red mucho menor, y una ventana de 256K tokens admite archivos largos, transcripciones y trazas de herramientas en una llamada. Accedes a la Qwen3.5 122B A10B API via RouterBase sobre el protocolo chat-completions de OpenAI: tu cliente actual funciona sin cambios y una clave cubre todo el catalogo.
Qwen3.5 122B A10B fue ajustado para razonamiento de varios pasos, generacion y revision de codigo, uso agentico de herramientas, JSON estructurado y chat en mas de 100 idiomas. La facturacion es de $0.34 por 1M de entrada y $2.72 por 1M de salida, 15% bajo la tarifa de lista de $0.40 y $3.20, sin tarifa por solicitud. Con streaming y llamadas a herramientas en el esquema estandar de OpenAI, la Qwen3.5 122B A10B API encaja en bucles de agente, asistentes de IDE y pipelines por lotes sin pegamento del proveedor.
Lo que te da la Qwen3.5 122B A10B API
Calidad de frontera con un presupuesto de 10B activos.
MoE de 122B, 10B activos
La Qwen3.5 122B A10B API enruta cada token por un pequeno conjunto de expertos en una red de 122B parametros: calidad cercana a densos mucho mayores con latencia baja.
Contexto de 256K
Una ventana de 256K tokens permite retener archivos largos y trazas de herramientas en una sola llamada, asi que rara vez troceas entradas para la Qwen3.5 122B A10B API.
Razonamiento que aguanta
La generacion Qwen3.5 afina el razonamiento de varios pasos y el seguimiento de instrucciones, asi que la Qwen3.5 122B A10B API resuelve problemas dificiles sin desviarse.
Codigo y agentes
Una fuerte generacion de codigo, revision y uso agentico de herramientas hacen de la Qwen3.5 122B A10B API una base fiable para herramientas de desarrollo y flujos autonomos.
Herramientas y JSON
La Qwen3.5 122B A10B API devuelve llamadas a funciones y JSON estructurado en el esquema estandar de OpenAI, listas para agentes y tuberias de datos.
Streaming, por token
La Qwen3.5 122B A10B API transmite tokens al generarse y cobra por token a $0.34 de entrada y $2.72 de salida, 15% bajo lista, sin tarifa por solicitud.

Primera llamada a la Qwen3.5 122B A10B API en tres pasos
Conectala una vez, luego transmite.
Crea una clave
Una clave de RouterBase alcanza la Qwen3.5 122B A10B API y todos los demas modelos del catalogo, sin nada del proveedor que configurar.
Apunta tu cliente
Envia cualquier cliente OpenAI a routerbase.com/v1 con model=qwen/qwen3.5-122b-a10b y un arreglo de mensajes; la Qwen3.5 122B A10B API responde con la misma forma chat-completions.
Transmite y observa el uso
El modelo transmite tokens al generarse y devuelve el uso por respuesta, asi que el costo y la latencia quedan visibles en cada llamada a la Qwen3.5 122B A10B API.
Paga sólo por lo que usas
RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.
Paga sólo por lo que usas
RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.
| Resolución | RouterBase | Oficial | Ahorro |
|---|---|---|---|
| Input (per 1M) | $0.340 | −15% | |
| Output (per 1M) | $2.720 | −15% |
Una ejecución con la configuración predeterminada (Input (per 1M)) cuesta $0.340.Con $1 puedes ejecutar este modelo aproximadamente 2 veces.
Precio oficial = tarifa de lista de Alibaba Qwen para Qwen3.5 122B A10B ($0.40 por 1M de entrada, $3.20 por 1M de salida). RouterBase sirve la Qwen3.5 122B A10B API a $0.34 / $2.72, 15% bajo lista.
Equipos construyendo sobre la Qwen3.5 122B A10B API
Razonamiento, agentes y chat detras de una llamada.
El contexto de 256K hizo que la Qwen3.5 122B A10B API leyera todo nuestro brief mas sus trazas en una pasada.
El esquema estandar hizo que nuestros agentes corrieran sobre la Qwen3.5 122B A10B API sin analisis personalizado desde el primer dia.
A $0.34 de entrada y $2.72 de salida la Qwen3.5 122B A10B API mantuvo predecible nuestro costo por tarea mientras subia el trafico.
El streaming desde la Qwen3.5 122B A10B API es suave, y nuestra UI de chat renderiza token por token sin trabajo extra.
Enviamos revision de codigo y JSON a la Qwen3.5 122B A10B API y la salida vuelve limpia cada vez.
La calidad de razonamiento nos sorprendio: la Qwen3.5 122B A10B API resuelve tickets de varios pasos que antes exigian un modelo mas caro.
Cambiar de otro proveedor a la Qwen3.5 122B A10B API fue un solo string: la forma de OpenAI no se movio.
La cobertura multilingue es la razon por la que estandarizamos en la Qwen3.5 122B A10B API; espanol e ingles salen igual de bien.
Qwen3.5 122B A10B API - preguntas comunes
Lo que debes saber antes de enrutar trafico.
La Qwen3.5 122B A10B API es acceso alojado de RouterBase a Alibaba Qwen3.5 122B A10B, un LLM de mezcla de expertos con 122B totales y 10B activos, sobre un endpoint compatible con OpenAI.