DeepSeek R1
DeepSeek · Released January 2025
Prix Entree
$0.55
par 1M tokens
Prix Sortie
$2.19
par 1M tokens
Fenetre de Contexte
128K
tokens
Score Vitesse
60
sur 100
Benchmarks
Moy. 89/100Tarification
Entree
Tokens de prompt
$0.55/ 1M
Sortie
Tokens generes
$2.19/ 1M
Ideal Pour
DeepSeek R1 en contexte
Sur un mélange typique de 70 % d'entrée et 30 % de sortie, DeepSeek R1 revient à 1.04 $ le million de tokens. Cela le place au-dessus de 25 % des 32 modèles suivis ici, et 0 autres modèles du même palier fleuron passent en dessous. Le palier est une étiquette de capacité, pas une tranche de prix : l'écart à l'intérieur d'un palier est souvent plus large qu'entre paliers, et c'est pourquoi choisir au palier seul fait généralement dépenser trop.
L'entrée coûte 0.55 $ le million et la sortie 2.19 $, soit un rapport de 4.0x. Ce rapport compte plus que chacun des deux chiffres pris isolément : une charge de résumé ou de classification lit bien plus qu'elle n'écrit et suivra le prix d'entrée, tandis que la génération de code ou la rédaction longue inverse la chose et suivra celui de sortie. Comparez les modèles sur le rapport qu'a réellement votre trafic, pas sur le seul prix d'entrée.
Le profil de benchmarks est irrégulier plutôt que plat : raisonnement à 97/100 contre travail créatif à 82/100, soit 15 points d'écart. Une moyenne masque cela. Si votre charge se situe du côté fort, ce modèle rend plus que son prix ; si elle se situe du côté faible, un modèle moins cher au profil plus plat vous servira mieux.
La fenêtre de contexte est de 128K tokens et le score de débit de 60/100. Le contexte ne se justifie que si vous le remplissez, et le remplir est précisément ce qui rend une requête coûteuse : une grande fenêtre est une option, pas une remise. Pour un modèle de palier fleuron, jugez la vitesse selon votre usage : elle décide de tout en chat interactif et de presque rien en traitement par lots nocturne.
Rien de moins cher dans le tableau n'égale DeepSeek R1 en programmation et raisonnement combinés : son prix mélangé de 1.04 $ achète donc une capacité qu'on ne peut pas obtenir pour moins à l'heure actuelle. C'est l'argument pour la payer — et cela mérite d'être revérifié, car c'est exactement la position qu'une nouvelle sortie fait disparaître.
La comparaison la plus proche est Claude Opus 4.8, de Anthropic, à 11.00 $ le million contre 1.04 $. 5 modèles de ce palier obtiennent un meilleur score en programmation et raisonnement combinés, et c'est le bon cadrage : la question est rarement de savoir si un modèle est bon, mais s'il est le moins cher parmi ceux qui sont assez bons pour le travail précis que vous lui envoyez.
Ce que cela coûte en production
À 10M + 2M tokens par mois — une charge de production moyenne réaliste — DeepSeek R1 revient à environ 9.88 $. Ce modèle n'a pas de remise par lots : ce chiffre est donc un plancher — le levier habituel consistant à basculer le travail de fond vers un palier asynchrone moins cher n'existe pas ici.
Historique Prix
No price changes since launch
Points Forts
- Chain-of-thought reasoning competitive with o3-mini
- Strong math, science, and logic tasks
- Open weights — self-hostable
- Much cheaper than comparable OpenAI reasoning models
A Eviter
- Vision tasks
- Creative writing
- Real-time chat (slow due to reasoning steps)