OpenAIFast Seviye Görüntü Batch 50% Off

GPT-4o Mini

OpenAI · Released July 2024

Giriş Fiyatı

$0.15

1M token başına

Çıkış Fiyatı

$0.60

1M token başına

Bağlam Penceresi

128K

tokens

Hız Skoru

97

100 üzerinden

Benchmarklar

Ort. 82/100
Coding74/100
Reasoning78/100
Extraction95/100
Creative83/100
Vision80/100

Fiyatlandırma

Giriş

Prompt / bağlam tokenları

$0.15/ 1M

Çıkış

Üretilen tokenlar

$0.60/ 1M

Toplu API

Asenkron işleme indirimi

$0.07 / $0.30

50% standart fiyattan indirim

En İyi Kullanım Alanları

chatbotextractionanalysis

Bağlam içinde GPT-4o Mini

Tipik %70 giriş / %30 çıkış karışımında GPT-4o Mini, milyon token başına $0.29 harmanlanmış fiyata geliyor. Bu, burada takip edilen 32 modelin %9'inin üzerinde bir konum ve aynı bütçe katmanındaki 3 model onun altında kalıyor. Katman bir yetenek etiketidir, fiyat bandı değil — tek bir katmanın içindeki fiyat aralığı çoğu zaman katmanlar arasındaki farktan geniştir; sadece katmana bakarak seçmek bu yüzden fazla harcatır.

Giriş milyon başına $0.15, çıkış $0.60 — yani 4.0 kat. Bu oran, iki rakamın tek başına olduğundan daha önemli: özetleme veya sınıflandırma yükü yazdığından çok daha fazlasını okur ve giriş fiyatını takip eder; kod üretimi veya uzun metin yazımı bunu tersine çevirir ve çıkış fiyatını takip eder. Modelleri sadece giriş fiyatına göre değil, kendi trafiğinizin gerçek oranına göre karşılaştırın.

Benchmark profili düz değil, dalgalı: veri çıkarımı 100 üzerinden 95 iken kodlama 74 — 21 puanlık bir açıklık. Ortalama bunu gizler. İş yükünüz güçlü uçta duruyorsa bu model fiyatının üstünde performans verir; zayıf uçta duruyorsa daha düz profilli ve daha ucuz bir model sizi daha iyi taşır.

Bağlam penceresi 128K token, verim puanı 100 üzerinden 97. Bağlam ancak doldurursanız hakkını verir ve zaten bir isteği pahalı yapan şey de onu doldurmaktır — geniş pencere bir seçenektir, indirim değil. bütçe katmanındaki bir model için hız puanını yaptığınız işe göre değerlendirin: etkileşimli sohbette her şeyi belirler, gecelik toplu işlerde neredeyse hiçbir şeyi.

Karar vermeden kontrol etmeye değer: Gemini 2.0 Flash, kodlama ve akıl yürütme toplamında en az bunun kadar iyi ve milyon başına $0.19'a geliyor — GPT-4o Mini'in $0.29'ına karşı. Bu, GPT-4o Mini'i yanlış seçim yapmaz; bağlam penceresi, gecikme, tedarikçi bağımlılığı ve spesifik yetenekler benchmark puanının dışında kalır — ama fiyat farkının arkasında bir gerekçe olması gerektiği anlamına gelir.

En yakın karşılaştırma Meta tarafından Llama 3 70B: milyon başına $1.28'a karşı $0.29. Bu katmanda 7 model kodlama ve akıl yürütme toplamında daha yüksek puan alıyor; asıl faydalı çerçeve de bu: soru nadiren bir modelin iyi olup olmadığıdır, gönderdiğiniz spesifik iş için yeterince iyi olan en ucuz şey olup olmadığıdır.

Üretimde maliyeti

Ayda 10M + 2M token — gerçekçi bir orta ölçek üretim yükü — GPT-4o Mini yaklaşık $2.70 tutuyor. Gecikmeye toleranslı kısmı %50 indirimli batch API üzerinden geçirmek bunu kabaca $1.35'a indirir ki bu genelde model değiştirmekten daha büyük bir tasarruftur.

Fiyat Geçmişi

No price changes since launch

Güçlü Yönler

  • Best value for simple-to-medium tasks
  • Very fast with high reliability
  • Excellent structured output and JSON mode
  • 50% batch discount available

Kaçınılması Gereken

  • Complex reasoning chains
  • Advanced software engineering tasks