Alibaba (Qwen)

Qwen2.5 72B Instruct

Type
modèle de langue
Contexte
131K tokens
Sortie maximale
4K
Sortie le
18 septembre 2024
Chaîne pour l'API
Qwen/Qwen2.5-72B-Instruct
Poids
ouverts

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
Abacus.AI $0,11 $0,38 31 juil. 2026
DeepInfra $0,12 $0,39 31 juil. 2026
Hyperbolic $0,12 $0,3 31 juil. 2026
Nebius Token Factory $0,13 $0,4 31 juil. 2026
alibaba-cn $0,574 $1,721 31 juil. 2026
siliconflow-cn $0,59 $0,59 31 juil. 2026
SiliconFlow $0,59 $0,59 31 juil. 2026
Fireworks AI $0,9 $0,9 1 août 2026
Alibaba (Qwen) $1,4 $5,6 31 juil. 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score, programmation 1 292,93 1 285–1 301 — —
Arena Score en anglais 1 282,77 1 278–1 288 — —
Arena Score, mathématiques 1 282,63 1 274–1 291 — —
Arena Score, requêtes longues 1 281,92 1 274–1 290 — —
Arena Score en français 1 278,91 1 246–1 312 — —
Arena Score, dialogue à plusieurs tours 1 271,85 1 264–1 280 — —
Arena Score, requêtes difficiles 1 270,92 1 265–1 277 — —
Arena Score, classement général 1 269,18 1 265–1 273 — —
Arena Score en russe 1 262,99 1 254–1 272 — —
Arena Score, respect des consignes 1 254,53 1 249–1 260 — —
Arena Score en espagnol 1 254,22 1 223–1 285 — —
Arena Score, questions d'expert 1 244,85 1 233–1 257 — —
Arena Score, écriture créative 1 221,67 1 213–1 230 — —
MATH, niveau de difficulté cinq 63,17 % · avec un harnais ajusté Epoch evaluations
GPQA Diamond — questions de niveau doctorat 32,2 % · avec un harnais ajusté Epoch evaluations
BALROG — environnements de jeu 16,2 % — Balrog Leaderboard
WeirdML — tâches d'apprentissage automatique inhabituelles 15,97 % — WeirdML Leaderboard
Mock AIME 2024–2025 — problèmes d'olympiade 7,96 % · avec un harnais ajusté Epoch evaluations
The Agent Company — tâches de travail en environnement de bureau 5,7 % — TheAgentCompany experiment results github