Coût par tâche

Le coût par tâche est la dépense totale nécessaire pour terminer un travail, avec toutes les requêtes, reprises et délégations, plutôt que le prix d'un token ou d'un seul appel.

Les grilles tarifaires parlent de tokens, mais ce qui compte est le travail terminé. Un agent explore, modifie, lance des tests et se corrige à travers plusieurs requêtes. Leur nombre varie selon le modèle et l'effort choisi. Le moins cher par token n'est donc pas forcément le moins cher par tâche. En septembre 2026, Anthropic conseille de comparer les modèles au coût du travail achevé : un modèle plus capable peut finir en moins de tours, de recherches et de retours en arrière.

Les échecs font partie du calcul. Une tentative ratée dépense ses tokens, puis la reprise en dépense d'autres. Un modèle peu coûteux à l'appel mais qui échoue plus souvent peut ainsi revenir plus cher. Les corrections ultérieures comptent aussi : une réponse à refaire dans une autre session n'était pas réellement bon marché.

Les comptes de tokens ne sont pas non plus comparables entre tokeniseurs. Selon Anthropic, en septembre 2026, le même texte représente environ 30 % de tokens de plus sur ses modèles 4.7 et suivants que sur les anciens. Comparer les tokens par tâche pénalise donc mécaniquement les nouveaux modèles, tandis que comparer les prix par token ignore la quantité de texte qu'ils représentent. Les dollars par tâche terminée traversent ce changement.

Mesurer exige une tâche définie, un contrôle de réussite et l'ensemble des coûts : session principale, sous-agents, réflexion et nouvelles tentatives. Sur un abonnement sans facture au token, on exprime généralement le total en coût équivalent API.

← Tous les termes