Dans la cuisine d'un restaurant, on parle toujours du chef. Rarement de ceux qui épluchent, découpent et préparent en coulisses : les commis. Sans eux, pourtant, aucune assiette ne sort.
Dans l'IA, les petits modèles sont les commis. Ils trient, résument, classent, par millions, pendant que les grands modèles font le travail de chef. On en parle peu. Ils font pourtant tourner une bonne partie des services que vous utilisez.
Mercredi, Anthropic a sorti le sien : Claude Haiku 5.5.
Le prix, d'abord
C'est le troisième modèle de la nouvelle famille Claude 5.5 en un mois, après Opus 5.5 le 22 septembre et Sonnet 5.5 le 28. Et c'est son prix qui frappe le plus.
Pour une demande de moins de 100 000 tokens, Haiku 5.5 coûte 0,10 dollar par million de tokens en entrée et 0,50 en sortie. Son prédécesseur, Haiku 4.5, coûtait 1 et 5 dollars. Dix fois moins cher, donc.
Au-delà de 100 000 tokens, le tarif passe à 0,50 et 2,50 dollars, soit deux fois moins cher qu'avant. La raison de ce seuil est simple : une très longue demande demande beaucoup plus de calcul, comme lire un livre entier plutôt qu'une page. Selon Anthropic, environ 90 % des demandes envoyées à Haiku 4.5 restaient sous ce seuil, et l'entreprise estime qu'une charge de travail typique coûtera environ 75 % de moins.
Ce qu'il vaut
Anthropic le présente comme son petit modèle le plus rapide et le plus capable à ce jour. Selon l'entreprise, il fait mieux que Haiku 4.5 et que GPT-6 Luna, son concurrent direct chez OpenAI, sur les tests qu'elle a sélectionnés. Sonnet 5.5, le modèle de gamme moyenne, reste devant.
Des entreprises qui l'ont testé avant sa sortie rapportent des gains nets. L'une d'elles indique un score supérieur de 11 points à celui de Haiku 4.5, avec des réponses deux fois plus rapides. Comme toujours, ces chiffres viennent de l'éditeur et de ses partenaires : il faudra attendre des tests indépendants pour les confirmer.
Nouveauté pour un modèle de cette taille : on peut régler son niveau d'effort, c'est-à-dire le temps qu'il prend pour réfléchir avant de répondre. Plus d'effort pour une tâche délicate, moins pour une question simple.
Comparez les grilles. Claude Haiku 5.5 et GPT-6 Luna, les petits modèles d'Anthropic et d'OpenAI : 0,10 dollar en entrée et 0,50 en sortie, chacun. Claude Sonnet 5.5 et GPT-6 Sol, leurs modèles de gamme moyenne : 2 dollars et 10 dollars, chacun. Les deux grands rivaux de l'IA affichent désormais exactement les mêmes prix, gamme par gamme. Une concurrence féroce qui finit par se ressembler, comme deux stations-service face à face sur la même route.
À quoi il sert
Haiku 5.5 vise le travail répétitif et en grand volume : résumer des documents, classer des informations, interroger des bases de données. Et surtout, servir de « sous-agent » : un grand modèle confie une petite tâche à un petit, plus rapide et moins cher.
Un client d'Anthropic en donne un exemple parlant : pendant qu'un grand modèle construit une présentation, un sous-agent Haiku va chercher dans le rapport annuel d'une entreprise le chiffre précis dont la présentation a besoin. Le chef cuisine, le commis va chercher les ingrédients.
Le modèle est disponible pour les développeurs, et dans l'application Claude pour tous les utilisateurs, y compris ceux de la version gratuite.
Ce qu'on retient
Pour la plupart des gens, ce changement sera invisible. Mais il compte. Quand le commis devient dix fois moins cher, ce sont tous les services construits dessus qui peuvent devenir plus rapides et moins chers.
Il confirme aussi une tendance que nous suivons depuis septembre : les prix s'effondrent et les versions s'enchaînent. Avec un paradoxe que nous évoquions ce matin : jamais les petits modèles n'ont été aussi bons et aussi bon marché, et pourtant Google réduit sa version gratuite à son plus petit modèle.