ROUTEUR DE
MODÈLES IA
Collez un prompt. Voyez le modèle le moins cher qui fait encore le travail.
Questions fréquentes
Comment le routeur de modèles IA décide-t-il ?
Il note le prompt sur des caractéristiques mesurables : le type de tâche, la demande éventuelle d'un raisonnement étape par étape, les règles strictes, les exigences énumérées, la présence de code, la longueur et la langue. Leur somme donne une note de difficulté de 0 à 100, qui fixe la note minimale qu'un modèle doit atteindre dans la catégorie correspondante. Le modèle le moins cher atteignant ce niveau est recommandé — de préférence avec une marge confortable plutôt que de justesse. Chaque signal et les points qu'il a ajoutés sont affichés avec le résultat.
Les économies annoncées sont-elles réelles ?
Le calcul du coût est exact : le nombre de tokens de votre prompt est mesuré avec le tokenizer GPT-4, ajusté au tokenizer propre à chaque modèle, puis multiplié par son prix publié. La seule hypothèse est la longueur de sortie, que vous fixez vous-même dans le formulaire. Savoir quel modèle suffira reste une estimation : c'est pourquoi chaque résultat porte un niveau de confiance.
Envoyez-vous mon prompt quelque part ?
Non. La tokenisation et le routage s'exécutent entièrement dans votre navigateur. Le prompt n'est jamais téléversé, stocké ni journalisé, et aucun compte n'est requis.
Pourquoi propose-t-il parfois un modèle plus cher que l'option la moins chère ?
Parce que choisir un modèle qui atteint tout juste le niveau requis est l'option la plus risquée : si l'estimation de difficulté est ne serait-ce qu'un peu faussée, il vous reste un modèle incapable de faire le travail. Nous préférons donc un modèle disposant d'une marge. Quand cette marge coûte bien plus cher — parfois trente fois plus — nous recommandons le modèle le moins cher et disons clairement qu'il est limite. Les options bon marché qui sont limites figurent toujours à part, sous “moins cher, mais plus risqué”.