Anthropic

Claude Sonnet 3.7

Type
modèle de langue
Contexte
200K tokens
Sortie maximale
64K
Sortie le
19 février 2025
Connaissances jusqu'à
octobre 2024
Chaîne pour l'API
claude-3-7-sonnet-20250219

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
Abacus.AI $3 $15 1 août 2026
Amazon Bedrock anthropic.claude-3-7-sonnet-20250219-v1:0 $3 $15 2 août 2026
Anthropic $3 $15 1 août 2026
Merge Gateway $3 $15 1 août 2026
Amazon Bedrock bedrock/us-gov-west-1/anthropic.claude-3-7-sonnet-20250219-v1:0 $3,6 $18 2 août 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

Un même fournisseur apparaît plusieurs fois s'il vend ce modèle sous des identifiants différents et à des prix différents — par exemple à des précisions de poids différentes. L'identifiant est indiqué à côté du nom. Les offres identiques arrivées de deux sources sous des orthographes différentes sont fusionnées en une seule ligne.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score, requêtes longues 1 354,73 1 347–1 362 — —
Arena Score, programmation 1 338,88 1 331–1 346 — —
Arena Score, dialogue à plusieurs tours 1 338,32 1 331–1 346 — —
Arena Score, respect des consignes 1 325,19 1 319–1 331 — —
Arena Score, mathématiques 1 318,41 1 308–1 328 — —
Arena Score, écriture créative 1 316,76 1 309–1 325 — —
Arena Score, requêtes difficiles 1 315,07 1 309–1 321 — —
Arena Score en anglais 1 311,02 1 306–1 316 — —
Arena Score en russe 1 309,67 1 299–1 320 — —
Arena Score en français 1 302,75 1 275–1 330 — —
Arena Score, questions d'expert 1 300,32 1 287–1 313 — —
Arena Score, classement général 1 299,32 1 295–1 303 — —
Arena Score en espagnol 1 289,11 1 263–1 315 — —
Arena Score, reconnaissance de texte sur image 1 158,07 1 139–1 177 — —
Arena Score, compréhension de schémas 1 151,01 1 119–1 183 — —
Arena Score, travail sur images 1 151 1 142–1 160 — —
MATH, niveau de difficulté cinq 91,16 % budget de réflexion : 64K · avec un harnais ajusté Epoch evaluations
Fiction.LiveBench — maintien d'un contexte long 83,3 % — Fiction.live leaderboard
Écriture créative (évaluation de Lech Mazur) 81,1 % budget de réflexion : 16K lechmazur/writing Github repository
GPQA Diamond — questions de niveau doctorat 72,98 % budget de réflexion : 64K · avec un harnais ajusté Epoch evaluations
GeoBench — localisation d'un lieu à partir d'une photo 68 % budget de réflexion : 15K GeoBench leaderboard
Aider Polyglot — modifications de code dans six langages 64,9 % · avec un harnais ajusté Aider LLM Leaderboards
SWE-bench Verified — correction de bugs dans des dépôts 60,95 % · avec un harnais ajusté Epoch evaluations
Mock AIME 2024–2025 — problèmes d'olympiade 57,74 % budget de réflexion : 64K · avec un harnais ajusté Epoch evaluations
CadEval — construction de modèles CAO par le code 54 % — CadEval Dashboard
DeepResearch Bench — recherche approfondie 43,6 % budget de réflexion : 2K DeepResearchBench Leaderboard
OSWorld — travail dans un système d'exploitation, première version 35,8 % · avec un harnais ajusté OS World Website
SimpleBench — questions pièges 35,68 % budget de réflexion : 12K SimpleBench Leaderboard
The Agent Company — tâches de travail en environnement de bureau 30,9 % — TheAgentCompany leaderboard
ARC-AGI — généralisation à des motifs inédits 28,6 % budget de réflexion : 16K · avec un harnais ajusté ARC Prize Leaderboard
Cybench — tâches de cybersécurité 20 % · avec un harnais ajusté Cybench leaderboard
GSO-Bench — optimisation de code 3,8 % — GSO Leaderboard
Humanity’s Last Exam — questions d'expert 3,4 % — —
ARC-AGI-2 0,9 % budget de réflexion : 8K —