Guide

Statut éditorial : En attente de relecture

Prix des API LLM en 2026 : comparer sans se tromper

Comparer les tarifs officiels des API LLM en tenant compte des versions, du cache, des outils et du coût par tâche réussie.

Classification du contenu

Types

  • Modèles et API
Niveau
Intermédiaire
Publié le
24 août 2026
Dernière relecture
Relecture en attente
Prochaine vérification
24 octobre 2026

Dernière vérification : 25 août 2026. Les tarifs et catalogues évoluent rapidement. Utilisez cet article comme méthode et ouvrez les pages officielles avant toute décision : OpenAI, Anthropic, Google Gemini et Mistral.

Ce qu’un tableau doit préciser

Un tarif utile indique modèle exact, statut stable ou preview, prix d’entrée, entrée en cache, écriture de cache éventuelle, sortie, seuil de contexte long et mode standard, batch ou prioritaire. Ne mélangez pas abonnements grand public et API. Les outils — recherche Web, fichiers, sandbox ou audio — peuvent ajouter leur propre facturation.

Exemple de lecture chez OpenAI

La page officielle affiche actuellement plusieurs niveaux GPT-5.6 et GPT-5.4, avec des colonnes distinctes pour entrée, cache, écriture de cache et sortie, ainsi qu’un tarif différent pour le contexte long. Cela montre pourquoi recopier un seul couple « entrée/sortie » devient trompeur. Google facture également entrée, sortie et cache, et distingue certains outils ou modes d’inférence.

Calculer une conversation

Utilisez : coût entrée = tokens entrée / 1 000 000 × tarif entrée ; coût sortie = tokens sortie / 1 000 000 × tarif sortie. Ajoutez historique répété, contexte RAG, raisonnement facturé selon le fournisseur, retries, appels d’outils et évaluations. Appliquez le taux de cache réellement observé, pas un scénario idéal.

Comparer par tâche réussie

Exécutez les modèles candidats sur le même dataset. Mesurez réussite, latence et coût total. Un modèle moins cher peut nécessiter davantage de contexte ou une seconde tentative ; un modèle plus cher peut être rentable s’il réduit les escalades humaines. Calculez donc coût par réponse acceptée ou processus terminé.

Maintenir le comparatif

Stockez les tarifs dans une source structurée avec URL officielle et date de vérification. Automatisez une alerte de changement, mais exigez une revue humaine avant publication : noms, unités et paliers ne se normalisent pas toujours correctement. Ne recopiez jamais une liste Mistral sans lien vers son catalogue actif.

FAQ

Quel est le LLM le moins cher ?

Cela dépend de la variante, du volume, du cache, de la longueur de sortie et du taux de réussite.

Le batch est-il toujours préférable ?

Seulement pour les tâches asynchrones compatibles avec son délai et ses limites.

Pourquoi les prix de deux comparatifs diffèrent-ils ?

Ils peuvent dater de jours différents ou comparer modes, régions et contextes distincts.

Sources utilisées