Claude 3.5 Sonnet
Anthropic · Released June 2024
Eingabepreis
$3.00
pro 1M Token
Ausgabepreis
$15.00
pro 1M Token
Kontextfenster
200K
tokens
Geschwindigkeits-Score
95
von 100
Benchmarks
Durchschn. 92/100Preise
Eingabe
Prompt-Token
$3.00/ 1M
Ausgabe
Generierte Token
$15.00/ 1M
Batch-API
Rabatt asynchrone Verarbeitung
$1.50 / $7.50
50% Rabatt auf Standardpreis
Am besten fuer
Claude 3.5 Sonnet im Vergleich
Bei typischem Mix aus 70 % Eingabe und 30 % Ausgabe kommt Claude 3.5 Sonnet auf $6.60 pro Million Token. Damit liegt es über 72 % der 32 hier erfassten Modelle, und 10 weitere Modelle derselben Mittelklasse-Stufe unterbieten es. Die Stufe ist ein Leistungsetikett, kein Preisband — die Spanne innerhalb einer Stufe ist oft größer als der Abstand zwischen Stufen, weshalb eine Auswahl allein nach Stufe meist zu teuer wird.
Die Eingabe kostet $3.00 pro Million, die Ausgabe $15.00 — ein Verhältnis von 5.0x. Dieses Verhältnis zählt mehr als jede der beiden Zahlen für sich: Eine Zusammenfassungs- oder Klassifizierungslast liest weit mehr, als sie schreibt, und folgt dem Eingabepreis; Codegenerierung oder lange Texte drehen das um und folgen dem Ausgabepreis. Vergleichen Sie Modelle nach dem Verhältnis, das Ihr Traffic tatsächlich hat, nicht nach dem Eingabepreis allein.
Das Benchmark-Profil ist ungewöhnlich flach — Programmierung führt mit 96/100, doch nur 6 Punkte trennen die stärkste von der schwächsten Kategorie. Das macht Claude 3.5 Sonnet zur sicheren Standardwahl für gemischte Lasten, bei denen sich nicht vorhersagen lässt, welche Fähigkeit eine Anfrage beansprucht — und zur schlechten Wahl, wenn Sie einen Spezialisten brauchen.
Das Kontextfenster umfasst 200K Token, der Durchsatzwert liegt bei 95/100. Kontext rechnet sich nur, wenn Sie ihn füllen — und genau das Füllen macht eine Anfrage teuer: Ein großes Fenster ist eine Option, kein Rabatt. Beurteilen Sie den Geschwindigkeitswert eines Mittelklasse-Modells nach Ihrem Einsatz: Im interaktiven Chat entscheidet er alles, bei nächtlicher Batch-Arbeit fast nichts.
Vor der Festlegung prüfenswert: DeepSeek R1 schneidet bei Programmierung und Reasoning zusammen mindestens ebenso gut ab und kommt auf $1.04 pro Million gegenüber $6.60 bei Claude 3.5 Sonnet. Das macht Claude 3.5 Sonnet nicht zur falschen Wahl — Kontextfenster, Latenz, Anbieterbindung und bestimmte Fähigkeiten liegen außerhalb eines Benchmark-Werts — aber es heißt, dass der Preisunterschied einen Grund braucht.
Der nächstliegende Vergleich ist GPT-5.2 Chat von OpenAI mit $5.43 pro Million gegenüber $6.60. 2 Modelle dieser Stufe erzielen bei Programmierung und Reasoning zusammen höhere Werte — und das ist die nützliche Perspektive: Die Frage ist selten, ob ein Modell gut ist, sondern ob es das Günstigste ist, das für die konkrete Arbeit gut genug ist, die Sie ihm schicken.
Was es in der Produktion kostet
Bei 10M + 2M Token pro Monat — eine realistische mittelgroße Produktionslast — kostet Claude 3.5 Sonnet rund $60.00. Den latenztoleranten Anteil über die Batch-API mit 50 % Rabatt zu leiten, brächte das auf etwa $30.00 — meist eine größere Ersparnis als ein Modellwechsel.
Preisverlauf
No price changes since launch
Staerken
- #1 on SWE-bench Verified coding benchmark
- Excellent long document handling and summarization
- 200K context window
- 50% batch discount for async workloads
Vermeiden fuer
- Vision-heavy workflows (limited vision capability)
- Real-time customer chat (use Haiku instead)