Nous avons deplace notre bot multilingue vers la Qwen2.5 72B Instruct API et le contexte de 128K nous a fait arreter de decouper les longs historiques.
Qwen2.5 72B Instruct est un LLM dense de 72B ajuste aux instructions d'Alibaba Qwen, avec un contexte de 128K et de solides capacites multilingues, de code et de mathematiques. Servi sur RouterBase via un endpoint compatible OpenAI a 0,38 $ / 1M en entree et 0,40 $ / 1M en sortie, -5 %.
Qwen2.5 72B Instruct API - 72B dense, contexte de 128K
La Qwen2.5 72B Instruct API execute Qwen2.5 72B Instruct, un LLM dense de 72B ajuste aux instructions avec un contexte de 128K, solide en chat multilingue, code et maths.
La Qwen2.5 72B Instruct API sert Alibaba Qwen2.5 72B Instruct, un grand modele de langage dense de 72 milliards de parametres ajuste aux instructions. La ou une conception a melange d'experts route chaque token par une fraction de ses poids, ce modele execute un reseau entierement dense, de sorte que chaque parametre contribue a chaque token. Cela donne une qualite stable en chat, code, maths et raisonnement, et une fenetre de contexte de 128K tokens signifie que les fichiers longs et les traces d'outils tiennent dans un seul appel. Vous atteignez la Qwen2.5 72B Instruct API via RouterBase sur le protocole chat-completions d'OpenAI, donc votre client fonctionne sans changement et une seule cle couvre tout le catalogue.
Sous le capot, Qwen2.5 72B Instruct a ete ajuste pour le travail que les developpeurs livrent vraiment : assistants multilingues sur plus de 29 langues, generation et revue de code, extraction de JSON structure et usage d'outils multi-etapes. La Qwen2.5 72B Instruct API repond a tout cela derriere un endpoint et une cle. La facturation est de 0,38 $ par 1M de tokens en entree et 0,40 $ par 1M en sortie, soit 5 % sous le tarif catalogue de 0,40 $ et 0,42 $, au token et sans frais par requete. Comme le modele diffuse les tokens a mesure qu'ils se generent et renvoie les appels d'outils dans le schema OpenAI standard, vous pouvez brancher la Qwen2.5 72B Instruct API dans une boucle d'agent ou un assistant d'IDE sans ecrire de colle propre au fournisseur.
Ce que la Qwen2.5 72B Instruct API vous donne
Une qualite reflechie a chaque token.
Modele dense de 72B
La Qwen2.5 72B Instruct API execute un reseau entierement dense de 72 milliards de parametres, donc la qualite reste coherente sans surprises de routage d'experts.
Contexte de 128K
Une fenetre de 128K tokens laisse le modele retenir fichiers longs et traces d'outils dans un seul appel, donc vous decoupez rarement les entrees vers la Qwen2.5 72B Instruct API.
Multilingue par conception
Entrainee sur plus de 29 langues, la Qwen2.5 72B Instruct API gere l'anglais, le chinois et des dizaines d'autres pour le chat, la traduction et le support.
Code et maths
Une forte generation de code, revue et raisonnement mathematique font de la Qwen2.5 72B Instruct API une base fiable pour les outils de dev et les assistants techniques.
Outils et JSON
La Qwen2.5 72B Instruct API renvoie les appels de fonctions et le JSON structure dans le schema OpenAI standard, prets pour les agents et les pipelines de donnees.
Streaming, au token
La Qwen2.5 72B Instruct API diffuse les tokens a mesure qu'ils se generent et facture au token a 0,38 $ en entree et 0,40 $ en sortie, 5 % sous catalogue, sans frais par requete.

Premier appel a la Qwen2.5 72B Instruct API en trois etapes
Branchez une fois, puis diffusez.
Creez une cle
Une cle RouterBase atteint la Qwen2.5 72B Instruct API et tous les autres modeles du catalogue.
Pointez votre client
Envoyez n'importe quel client OpenAI vers routerbase.com/v1 avec model=qwen/qwen-2.5-72b-instruct et un tableau de messages ; la Qwen2.5 72B Instruct API repond dans la meme forme chat-completions.
Diffusez et suivez l'usage
Le modele diffuse les tokens et renvoie l'usage par reponse, donc le cout et la latence restent visibles a chaque appel a la Qwen2.5 72B Instruct API.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
| Résolution | RouterBase | Officiel | Économie |
|---|---|---|---|
| Input (per 1M) | $0.380 | −5% | |
| Output (per 1M) | $0.400 | −5% |
Un appel avec la configuration par défaut (Input (per 1M)) coûte $0.380.Avec 1 $ vous pouvez exécuter ce modèle environ 2 fois.
Prix officiel = tarif catalogue Alibaba Qwen pour Qwen2.5 72B Instruct (0,40 $ par 1M en entree, 0,42 $ par 1M en sortie). RouterBase sert la Qwen2.5 72B Instruct API a 0,38 $ / 0,40 $, 5 % sous catalogue.
Des equipes qui construisent sur la Qwen2.5 72B Instruct API
Chat multilingue et code derriere un seul appel.
Les poids denses rendent la sortie previsible : la Qwen2.5 72B Instruct API donne la meme qualite sur chaque ticket.
Le schema standard a fait tourner notre pile d'agents sur la Qwen2.5 72B Instruct API sans parsing personnalise.
A 0,38 $ en entree et 0,40 $ en sortie, la Qwen2.5 72B Instruct API a garde notre cout au token a plat.
Le streaming depuis la Qwen2.5 72B Instruct API est fluide, donc notre UI rend token par token.
Nous envoyons la revue de code et l'extraction JSON a la Qwen2.5 72B Instruct API et la sortie revient propre a chaque fois.
La fenetre de 128K a laisse la Qwen2.5 72B Instruct API lire un fichier entier plus ses tests en une passe.
Passer d'un autre fournisseur a la Qwen2.5 72B Instruct API fut une seule chaine : la forme OpenAI n'a pas bouge.
La couverture multilingue est la raison pour laquelle nous avons standardise sur la Qwen2.5 72B Instruct API ; portugais et anglais sortent aussi bien.
Qwen2.5 72B Instruct API - questions frequentes
Ce qu'il faut savoir avant de router du trafic.
La Qwen2.5 72B Instruct API est l'acces heberge par RouterBase a Alibaba Qwen2.5 72B Instruct, un LLM dense de 72B ajuste aux instructions, via un endpoint compatible OpenAI.