AccueilModelesClaude Opus 4.8
AnthropicPower Niveau Vision Batch 50% Off

Claude Opus 4.8

Anthropic · Released May 2026

Prix Entree

$5.00

par 1M tokens

Prix Sortie

$25.00

par 1M tokens

Fenetre de Contexte

1.0M

tokens

Score Vitesse

62

sur 100

Benchmarks

Moy. 95/100
Coding97/100
Reasoning96/100
Extraction95/100
Creative95/100
Vision94/100

Tarification

Entree

Tokens de prompt

$5.00/ 1M

Sortie

Tokens generes

$25.00/ 1M

API par Lots

Remise traitement asynchrone

$2.50 / $12.50

50% remise prix standard

Ideal Pour

codingreasoninganalysis

Claude Opus 4.8 en contexte

Sur un mélange typique de 70 % d'entrée et 30 % de sortie, Claude Opus 4.8 revient à 11.00 $ le million de tokens. Cela le place au-dessus de 81 % des 32 modèles suivis ici, et 2 autres modèles du même palier fleuron passent en dessous. Le palier est une étiquette de capacité, pas une tranche de prix : l'écart à l'intérieur d'un palier est souvent plus large qu'entre paliers, et c'est pourquoi choisir au palier seul fait généralement dépenser trop.

L'entrée coûte 5.00 $ le million et la sortie 25.00 $, soit un rapport de 5.0x. Ce rapport compte plus que chacun des deux chiffres pris isolément : une charge de résumé ou de classification lit bien plus qu'elle n'écrit et suivra le prix d'entrée, tandis que la génération de code ou la rédaction longue inverse la chose et suivra celui de sortie. Comparez les modèles sur le rapport qu'a réellement votre trafic, pas sur le seul prix d'entrée.

Le profil de benchmarks est étonnamment plat : programmation mène à 97/100, mais seuls 3 points séparent la catégorie la plus forte de la plus faible. Cela fait de Claude Opus 4.8 un choix par défaut sûr pour des charges mixtes où l'on ne peut pas prévoir quelle capacité chaque requête sollicitera, et un mauvais choix s'il vous faut un spécialiste.

La fenêtre de contexte est de 1M tokens et le score de débit de 62/100. Le contexte ne se justifie que si vous le remplissez, et le remplir est précisément ce qui rend une requête coûteuse : une grande fenêtre est une option, pas une remise. Pour un modèle de palier fleuron, jugez la vitesse selon votre usage : elle décide de tout en chat interactif et de presque rien en traitement par lots nocturne.

Rien de moins cher dans le tableau n'égale Claude Opus 4.8 en programmation et raisonnement combinés : son prix mélangé de 11.00 $ achète donc une capacité qu'on ne peut pas obtenir pour moins à l'heure actuelle. C'est l'argument pour la payer — et cela mérite d'être revérifié, car c'est exactement la position qu'une nouvelle sortie fait disparaître.

La comparaison la plus proche est GPT-5.6 Sol, de OpenAI, à 12.50 $ le million contre 11.00 $. 4 modèles de ce palier obtiennent un meilleur score en programmation et raisonnement combinés, et c'est le bon cadrage : la question est rarement de savoir si un modèle est bon, mais s'il est le moins cher parmi ceux qui sont assez bons pour le travail précis que vous lui envoyez.

Ce que cela coûte en production

À 10M + 2M tokens par mois — une charge de production moyenne réaliste — Claude Opus 4.8 revient à environ 100.00 $. Router par l'API par lots, à 50 % de remise, la part tolérante à la latence ramènerait cela à environ 50.00 $, soit généralement une économie supérieure à un changement de modèle.

Historique Prix

No price changes since launch

Points Forts

  • State-of-the-art long-horizon agentic execution for its generation
  • Clearer, warmer prose than the 4.7 baseline
  • Strong file-based memory usage across sessions

A Eviter

  • New builds — Opus 5 is the same price with higher capability
  • Cost-sensitive high-volume work