Concepts Fondamentaux
Fenêtre de Contexte
Le nombre maximum de jetons qu'un modèle peut traiter en une seule requête.
La fenêtre de contexte définit la limite de texte qu'un modèle peut analyser en une seule fois.
Termes Associés
Jeton (Token)
L'unité de base de texte que les modèles de langage traitent et facturent.
Input Price
The per-million-token cost charged for tokens in your prompt.
Streaming
Delivering model output token-by-token as it is generated rather than waiting for the full response.
RAG (Geri Getirmeyle Güçlendirilmiş Üretim)
Modeli harici bir bilgi bankasından gelen gerçek zamanlı verilerle besleme tekniği.