Anthropic facture désormais les requêtes API Claude refusées, dans trois catégories sur cinq

L’article ne peut pas être activé avec JavaScript. Vous pouvez également activer JavaScript dans votre navigateur et sur la nouvelle page.

Anthropic a commencé à facturer à Claude API les demandes de refus de ses classificateurs de sécurité avant que Claude n’écrive quoi que ce soit, dans trois des cinq catégories de refus. Les notes de publication de l’API Claude d’Anthropic, datées du 24 septembre, indiquent qu’elle « reprise de la facturation pour les refus qui arrivent avant toute sortie » lorsque la stop_details.category de la réponse est « bio », « frontier_llm » ou « reasoning_extraction ».

Ces refus sont « facturés comme toute autre demande, aux tarifs du modèle qui l’a gérée ». Un refus n’est pas une erreur : il revient comme une réponse normale avec un stop_reason de « refusal », un tableau de contenu vide et un nombre de jetons en cours d’utilisation, de sorte que les frais couvrent un appel qui n’a renvoyé aucun texte.

Deux des cinq catégories sont toujours gratuites

La documentation d’Anthropic sur les refus et les replis nomme cinq catégories, décrit chacune d’entre elles et indique celles qui sont facturées avant toute sortie :

  • « bio », demande qui « pourrait provoquer des dommages biologiques, tels que des méthodes de laboratoire dangereuses ». Facturé.
  • « frontier_llm », demande que « pourrait aider au développement de modèles d’IA concurrents ». Facturé.
  • « reasoning_extraction », requêtes qui demandent « au modèle de reproduire son raisonnement interne dans le texte de réponse ». Facturé.
  • « cyber », demandes qui « pourraient permettre des cyber-dommages, tels que le développement de logiciels malveillants ou d’exploits ». Non facturé.
  • « general_harms », demandes qui relèvent d' »un domaine de politique d’utilisation en dehors des quatre catégories nommées ». Non facturé.

Un refus de catégorie nulle n’est pas non plus facturé. Anthropic affirme que les trois catégories qu’elle facture sont les catégories « dans lesquelles Anthropic mesure de faibles volumes de faux positifs, à compter de septembre 2026 », et que la liste facturée « peut changer à mesure qu’Anthropic continue de mesurer et d’affiner les taux de faux positifs de ses garanties ».

Les faux positifs sont la partie à surveiller, car Anthropic affirme qu’un travail inoffensif peut déclencher ces classificateurs. Les travaux bénéfiques en sciences de la vie peuvent également déclencher le « bio », selon leur propre description, et les travaux bénins d’apprentissage automatique peuvent également déclencher « frontier_llm ». Les deux portent désormais une charge.

Anthropic affirme que l’objectif est de rendre les sondages coûteux

Anthropic affirme qu’un refus avant toute sortie est facturé « pour perturber les tentatives visant à contourner les garanties d’Anthropic à grande échelle ». Facturée ou non, la demande est toujours prise en compte dans vos limites tarifaires.

Les refus à mi-stream, qui surviennent après que Claude a commencé à écrire, étaient facturés avant ce changement, aux tarifs normaux pour les tokens d’entrée et de sortie déjà streamés. Lorsqu’un refus déclenche un repli vers un autre modèle, Anthropic précise que le refus est facturé en plus de la demande de repli lorsqu’il arrive à mi-parcours ou entre dans l’une des catégories facturées, et que le crédit de repli reste inchangé.

Cela s’applique à l’API, pas aux applications Claude

Les classificateurs fonctionnent sur Claude Fable 5.1, Claude Fable 5, Claude Opus 5.5 et Claude Opus 5, et Anthropic affirme que les règles de facturation s’appliquent sur chaque plateforme qu’il nomme : l’API Claude, Amazon Bedrock, Claude Platform sur AWS, Google Cloud et Microsoft Foundry. Ce sont toutes des surfaces de développement. Claude.ai et les applications Claude n’en font pas partie.

Anthropic a changé de direction plus tôt en septembre, lorsqu’il a cessé de facturer aux utilisateurs de l’API Claude Code les contrôles de sécurité du mode automatique.

Il n’existe aucun chiffre sur la fréquence des refus, aucun taux de faux positifs et aucune estimation de ce que cela ajoute à une facture mensuelle, de sorte qu’un développeur ne peut pas fixer le prix du changement à l’avance. Anthropic appelle cela la reprise de la facturation plutôt que son introduction.