Anthropic

Claude 4.1 Opus

Type
modèle de langue
Contexte
200K tokens
Sortie maximale
32K
Sortie le
5 août 2025
Connaissances jusqu'à
mars 2025
Chaîne pour l'API
claude-opus-4-1-20250805

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
Jiekou.AI $13,5 $67,5 31 juil. 2026
NanoGPT $14,994 $75,004 31 juil. 2026
302.AI $15 $75 31 juil. 2026
Abacus.AI $15 $75 31 juil. 2026
Amazon Bedrock $15 $75 2 août 2026
Anthropic $15 $75 31 juil. 2026
Helicone $15 $75 31 juil. 2026
LLM Gateway $15 $75 31 juil. 2026
Merge Gateway $15 $75 31 juil. 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score, programmation 1 473,09 1 468–1 478 — —
Arena Score, requêtes longues 1 445,19 1 440–1 450 — —
Arena Score en espagnol 1 444,59 1 430–1 459 — —
Arena Score, dialogue à plusieurs tours 1 441,82 1 436–1 448 — —
Arena Score, requêtes difficiles 1 441,49 1 438–1 445 — —
Arena Score, respect des consignes 1 433,82 1 429–1 439 — —
Arena Score en anglais 1 428,72 1 425–1 433 — —
Arena Score en français 1 427,47 1 410–1 445 — —
Arena Score, questions d'expert 1 425,18 1 415–1 435 — —
Arena Score en russe 1 422,37 1 414–1 430 — —
Arena Score, mathématiques 1 421,84 1 413–1 430 — —
Arena Score, classement général 1 417,42 1 414–1 420 — —
Arena Score, écriture créative 1 410,22 1 404–1 416 — —
Arena Score, développement web 1 388,74 1 378–1 400 — —
Écriture créative (évaluation de Lech Mazur) 84,7 % — lechmazur/writing Github repository
SWE-bench Verified — correction de bugs dans des dépôts 73,35 % · avec un harnais ajusté Epoch evaluations
GPQA Diamond — questions de niveau doctorat 69,7 % budget de réflexion : 27K · avec un harnais ajusté Epoch evaluations
Mock AIME 2024–2025 — problèmes d'olympiade 68,86 % budget de réflexion : 27K · avec un harnais ajusté Epoch evaluations
SimpleBench — questions pièges 52 % — SimpleBench Leaderboard
DeepResearch Bench — recherche approfondie 49,7 % — DeepResearchBench Leaderboard
GDPval — tâches de métiers réels 43,6 % — —
WeirdML — tâches d'apprentissage automatique inhabituelles 42,76 % budget de réflexion : 16K WeirdML Leaderboard
Cybench — tâches de cybersécurité 42 % · avec un harnais ajusté Cybench leaderboard
Terminal-Bench — travail en ligne de commande 38 % · avec un harnais ajusté Terminal-Bench v2 Leaderboard
SimpleQA Verified — exactitude factuelle 34,8 % budget de réflexion : 27K Epoch evaluations
FrontierMath, niveaux 1–3 12,63 % budget de réflexion : 32K Epoch evaluations
Humanity’s Last Exam — questions d'expert 7,06 % — —
FrontierMath, niveau 4 — problèmes de recherche 2,44 % budget de réflexion : 32K Epoch evaluations
Problèmes d'échecs 2,15 % — Epoch evaluations