Les chiffres · L'index d'intelligence (0 à 100) agrège 10 évaluations indépendantes. Le coût par tâche est la dépense moyenne d'une tâche du benchmark, tout compris. « 1er token » = temps avant que la réponse ne commence : les modes max/xhigh réfléchissent longtemps avant de parler (262 s pour Fable max, 317 s pour Astra max).
Pour se repérer · Une page de texte ≈ 500 tokens. Un million de tokens ≈ un roman de 500 pages. Exemple : 100 échanges de 2 pages coûtent environ 0,04 $ sur GLM 5.3 Flash, contre environ 6 $ sur Claude Fable 5.1.
À retenir · Au quotidien, les meilleurs modèles se valent à quelques points près. Ce qui change vraiment entre deux modèles : le prix, la vitesse et la confidentialité. Pour la confidentialité, c'est le fournisseur et le type d'offre qui comptent, pas seulement le modèle : une offre développeurs avec engagement de non-conservation n'a rien à voir avec un abonnement grand public.
Sources vérifiées le 17 septembre 2026 · artificialanalysis.ai (Intelligence Index v4.3, vitesse, coût par tâche) · openrouter.ai (prix au token, contextes, alias). Sélection pédagogique, pas un palmarès absolu. Les prix varient selon le fournisseur et peuvent changer après cette date.
Calcul au token : 70 % du volume en entrée, 30 % en sortie, environ 500 tokens par page. Chez un fournisseur au forfait, ce coût ne se facture pas au token. Données du 17 septembre 2026, à revérifier avant décision.
Top 3 calculé depuis les données du 17 septembre 2026 (index Artificial Analysis v4.3, prix OpenRouter). Les modèles marqués « exclu de ton usage » ne sont jamais recommandés. Touche un résultat pour ouvrir sa fiche. Pour une décision importante, revérifie avant de choisir.