Claude Haiku 5.5 est 90% moins cher, jusqu’à ce que la note de bas de page d’Anthropic compte les jetons

L’article ne peut pas être activé avec JavaScript. Vous pouvez également activer JavaScript dans votre navigateur et sur la nouvelle page.

Anthropic a publié Claude Haiku 5.5 le 7 octobre à 0,10 $ par million de jetons d’entrée et 0,50 $ par million de jetons de sortie pour des invites allant jusqu’à 100 000 jetons, contre 1 $ et 5 $ sur Claude Haiku 4.5. Le message de lancement d’Anthropic situe la réduction à « 90 % de moins que Claude Haiku 4,5 pour les requêtes allant jusqu’à 100 000 jetons », et sur la même page donne un chiffre plus petit pour ce que coûte réellement le modèle à exécuter : « En moyenne, son exécution coûte désormais environ 75 % de moins. »

La note de bas de page d’Anthropic sur ces 75 % donne la répartition. Les prix sont 90 % inférieurs jusqu’à 100 000 tokens et 50 % inférieurs au-dessus, et « Sur Haiku 4.5, 90 % des demandes tombaient dans la première catégorie ». Le reste est le tokenizer. Haiku 5.5, écrit Anthropic, « dispose d’un tokenizer mis à jour (similaire à celui de Sonnet 5.5 et de l’Opus 5.5), ce qui signifie qu’il utilise un peu plus de tokens par tâche ».

La propre documentation d’Anthropic évalue « un peu plus » à 30 %

Légèrement, c’est le mot du message de lancement. La documentation du développeur y met un numéro. La page des nouveautés d’Anthropic pour Haiku 5.5 indique que « le même texte d’entrée produit environ 30 % de jetons en plus sur Claude Haiku 5.5 que sur Claude Haiku 4.5 », le guide de migration dit la même chose, et la page de tarification indique que le nouveau tokenizer « produit environ 30 % de jetons en plus pour le même texte ». Tous les trois ont été lus à 22h02 UTC le 7 octobre.

Rien dans les deux déclarations n’est caché, et toutes deux proviennent d’Anthropic le jour du lancement. Il ne s’agit tout simplement pas de la même description du même changement, et celui contre lequel un développeur budgétise est les 30 %. « L’augmentation exacte dépend du contenu », ajoute la documentation, et ses instructions sont de raconter les invites et de revisiter max_tokens valeurs et estimations de coûts.

Haiku 5.5 obtient une fenêtre de 1 M et un cadran d’effort

Le 90% et le 50% sont deux tarifs publiés. Jusqu’à 100 000 jetons, Haiku 5.5 facture 0,10 USD par million de jetons d’entrée, 0,50 USD par million de jetons de sortie et 0,01 USD pour une lecture du cache. Sur cette longueur, ceux-ci deviennent 0,50 $, 2,50 $ et 0,05 $. Haiku 4.5 facturait un montant forfaitaire de 1 $ et 5 $, avec des lectures de cache à 0,10 $.

L’identifiant du modèle est claude-haïku-5-5sans suffixe de date ni alias distinct. Il comporte une fenêtre contextuelle de 1 million de jetons et jusqu’à 128 000 jetons de sortie, contre 200 000 et 64 000 sur Haiku 4.5, une limite de connaissances en juin 2026 et un paramètre d’effort par défaut de moyen. Il s’agit du premier modèle de classe Haiku doté d’un réglage d’effort réglable, le cadran qu’Anthropic propose désormais à la place d’un budget de réflexion manuelle. Anthropic s’engage à le maintenir disponible jusqu’au « au plus tôt le 7 octobre 2027 ».

Il est en ligne sur l’API Claude, Amazon Bedrock, Claude Platform sur AWS, Google Cloud et Microsoft Foundry, selon les notes de version de la plateforme. À titre de comparaison, Claude Opus 5.5 se situe à 4 $ et 20 $ par million de jetons, et Claude Sonnet 5.5 à 2 $ et 10 $. Anthropic a également réduit de moitié les lectures du cache de Sonnet 5.5 à 0,10 $ par million de jetons le 7 octobre, ce qui, selon lui, représente une réduction d’environ 20 % sur la plupart des travaux d’agent.

Le conseil d’Anthropic est de ne pas traiter le modèle bon marché comme un échange général. Sonnet 5.5 et Opus 5.5 « restent de meilleurs choix pour les tâches de codage agent complexes », indique le message de lancement, tandis que Haiku 5.5 est « le mieux adapté aux tâches plus restreintes » telles que « le compactage, la synthèse ou le travail de sous-agents ».