StartseiteModelleClaude 3.5 Haiku
AnthropicFast Stufe Vision Batch 50% Off

Claude 3.5 Haiku

Anthropic · Released November 2024

Eingabepreis

$0.80

pro 1M Token

Ausgabepreis

$4.00

pro 1M Token

Kontextfenster

200K

tokens

Geschwindigkeits-Score

97

von 100

Benchmarks

Durchschn. 81/100
Coding82/100
Reasoning80/100
Extraction90/100
Creative78/100
Vision74/100

Preise

Eingabe

Prompt-Token

$0.80/ 1M

Ausgabe

Generierte Token

$4.00/ 1M

Batch-API

Rabatt asynchrone Verarbeitung

$0.40 / $2.00

50% Rabatt auf Standardpreis

Am besten fuer

chatbotextractioncodinganalysis

Claude 3.5 Haiku im Vergleich

Bei typischem Mix aus 70 % Eingabe und 30 % Ausgabe kommt Claude 3.5 Haiku auf $1.76 pro Million Token. Damit liegt es über 31 % der 32 hier erfassten Modelle, und 9 weitere Modelle derselben Budget-Stufe unterbieten es. Die Stufe ist ein Leistungsetikett, kein Preisband — die Spanne innerhalb einer Stufe ist oft größer als der Abstand zwischen Stufen, weshalb eine Auswahl allein nach Stufe meist zu teuer wird.

Die Eingabe kostet $0.80 pro Million, die Ausgabe $4.00 — ein Verhältnis von 5.0x. Dieses Verhältnis zählt mehr als jede der beiden Zahlen für sich: Eine Zusammenfassungs- oder Klassifizierungslast liest weit mehr, als sie schreibt, und folgt dem Eingabepreis; Codegenerierung oder lange Texte drehen das um und folgen dem Ausgabepreis. Vergleichen Sie Modelle nach dem Verhältnis, das Ihr Traffic tatsächlich hat, nicht nach dem Eingabepreis allein.

Das Benchmark-Profil ist uneben statt flach: Datenextraktion mit 90/100 gegenüber Bildverstehen mit 74/100 — 16 Punkte Spanne. Ein Durchschnitt verdeckt das. Liegt Ihre Last am starken Ende, leistet dieses Modell mehr, als sein Preis vermuten lässt; liegt sie am schwachen Ende, dient Ihnen ein günstigeres Modell mit flacherem Profil besser.

Das Kontextfenster umfasst 200K Token, der Durchsatzwert liegt bei 97/100. Kontext rechnet sich nur, wenn Sie ihn füllen — und genau das Füllen macht eine Anfrage teuer: Ein großes Fenster ist eine Option, kein Rabatt. Beurteilen Sie den Geschwindigkeitswert eines Budget-Modells nach Ihrem Einsatz: Im interaktiven Chat entscheidet er alles, bei nächtlicher Batch-Arbeit fast nichts.

Vor der Festlegung prüfenswert: DeepSeek V3.2 schneidet bei Programmierung und Reasoning zusammen mindestens ebenso gut ab und kommt auf $0.30 pro Million gegenüber $1.76 bei Claude 3.5 Haiku. Das macht Claude 3.5 Haiku nicht zur falschen Wahl — Kontextfenster, Latenz, Anbieterbindung und bestimmte Fähigkeiten liegen außerhalb eines Benchmark-Werts — aber es heißt, dass der Preisunterschied einen Grund braucht.

Der nächstliegende Vergleich ist Claude Haiku 4.5 von Anthropic mit $2.20 pro Million gegenüber $1.76. 4 Modelle dieser Stufe erzielen bei Programmierung und Reasoning zusammen höhere Werte — und das ist die nützliche Perspektive: Die Frage ist selten, ob ein Modell gut ist, sondern ob es das Günstigste ist, das für die konkrete Arbeit gut genug ist, die Sie ihm schicken.

Was es in der Produktion kostet

Bei 10M + 2M Token pro Monat — eine realistische mittelgroße Produktionslast — kostet Claude 3.5 Haiku rund $16.00. Den latenztoleranten Anteil über die Batch-API mit 50 % Rabatt zu leiten, brächte das auf etwa $8.00 — meist eine größere Ersparnis als ein Modellwechsel.

Preisverlauf

No price changes since launch

Staerken

  • Best fast model from Anthropic
  • Surprisingly strong coding for a fast-tier model
  • 50% batch discount available
  • 200K context window

Vermeiden fuer

  • Vision-heavy workflows
  • Mission-critical complex reasoning