GPT-4o
OpenAI · Released May 2024
Prix Entree
$2.50
par 1M tokens
Prix Sortie
$10.00
par 1M tokens
Fenetre de Contexte
128K
tokens
Score Vitesse
90
sur 100
Benchmarks
Moy. 91/100Tarification
Entree
Tokens de prompt
$2.50/ 1M
Sortie
Tokens generes
$10.00/ 1M
API par Lots
Remise traitement asynchrone
$1.25 / $5.00
50% remise prix standard
Ideal Pour
GPT-4o en contexte
Sur un mélange typique de 70 % d'entrée et 30 % de sortie, GPT-4o revient à 4.75 $ le million de tokens. Cela le place au-dessus de 59 % des 32 modèles suivis ici, et 6 autres modèles du même palier milieu de gamme passent en dessous. Le palier est une étiquette de capacité, pas une tranche de prix : l'écart à l'intérieur d'un palier est souvent plus large qu'entre paliers, et c'est pourquoi choisir au palier seul fait généralement dépenser trop.
L'entrée coûte 2.50 $ le million et la sortie 10.00 $, soit un rapport de 4.0x. Ce rapport compte plus que chacun des deux chiffres pris isolément : une charge de résumé ou de classification lit bien plus qu'elle n'écrit et suivra le prix d'entrée, tandis que la génération de code ou la rédaction longue inverse la chose et suivra celui de sortie. Comparez les modèles sur le rapport qu'a réellement votre trafic, pas sur le seul prix d'entrée.
Le profil de benchmarks est étonnamment plat : vision mène à 95/100, mais seuls 8 points séparent la catégorie la plus forte de la plus faible. Cela fait de GPT-4o un choix par défaut sûr pour des charges mixtes où l'on ne peut pas prévoir quelle capacité chaque requête sollicitera, et un mauvais choix s'il vous faut un spécialiste.
La fenêtre de contexte est de 128K tokens et le score de débit de 90/100. Le contexte ne se justifie que si vous le remplissez, et le remplir est précisément ce qui rend une requête coûteuse : une grande fenêtre est une option, pas une remise. Pour un modèle de palier milieu de gamme, jugez la vitesse selon votre usage : elle décide de tout en chat interactif et de presque rien en traitement par lots nocturne.
À vérifier avant de vous engager : DeepSeek V3 obtient au moins aussi bien en programmation et raisonnement combinés et revient à 0.32 $ le million contre 4.75 $ pour GPT-4o. Cela ne fait pas de GPT-4o un mauvais choix — fenêtre de contexte, latence, dépendance au fournisseur et capacités spécifiques échappent à un score de benchmark — mais cela signifie que l'écart de prix doit avoir une raison derrière lui.
La comparaison la plus proche est Gemini 3.1 Pro, de Google, à 5.00 $ le million contre 4.75 $. 8 modèles de ce palier obtiennent un meilleur score en programmation et raisonnement combinés, et c'est le bon cadrage : la question est rarement de savoir si un modèle est bon, mais s'il est le moins cher parmi ceux qui sont assez bons pour le travail précis que vous lui envoyez.
Ce que cela coûte en production
À 10M + 2M tokens par mois — une charge de production moyenne réaliste — GPT-4o revient à environ 45.00 $. Router par l'API par lots, à 50 % de remise, la part tolérante à la latence ramènerait cela à environ 22.50 $, soit généralement une économie supérieure à un changement de modèle.
Historique Prix
| Date | Input / 1M | Output / 1M | Change |
|---|---|---|---|
| May 2024 | $5.00 | $15.00 | Launch |
| Nov 2024Current | $2.50 | $10.00 | 50% cut |
Points Forts
- Best multimodal model at this price point
- Fast response times, high throughput
- Excellent for API integrations and function calling
- Strong structured output (JSON mode)
A Eviter
- Ultra-low budget projects
- Text-only tasks where GPT-4o Mini suffices