Anthropic lance Claude Haiku 5.5, son modèle le plus rapide pour les tâches à fort volume
Anthropic lance Claude Haiku 5.5, dernier modèle de sa famille 5.5. La firme le présente comme son modèle le plus rapide à ce jour, pour un coût d’usage inférieur d’environ 75 % à celui de Haiku 4.5.
La génération 5.5 de Claude est désormais au complet. Neuf jours après Sonnet 5.5, lui-même sorti moins d’une semaine après Opus 5.5, Anthropic ajoute à la gamme son modèle le plus léger, Haiku.
Introducing Claude Haiku 5.5: the cheapest, fastest, and most capable small model we’ve ever released.
On average, it costs around 75% less to run than Claude Haiku 4.5. https://t.co/jm06cZJfkV
— Claude (@claudeai) October 7, 2026
Pour afficher ce contenu issu des réseaux sociaux, vous devez accepter les cookies et traceurs publicitaires.
Ces cookies et traceurs permettent à nos partenaires de vous proposer des publicités et des contenus personnalisés en fonction de votre navigation, de votre profil et de vos centres d’intérêt.Plus d’infos.
Haiku 5.5, un modèle taillé pour les tâches courtes et les sous-agents
Anthropic présente Claude Haiku 5.5 comme un modèle adapté aux traitements à fort volume, qui supposent des appels nombreux et peu coûteux, tels que :
- Les résumés et la compaction de contexte,
- Les requêtes en base de données,
- La classification,
- Le travail de sous-agent sur les projets de code, en appui d’Opus 5.5 ou de Sonnet 5.5.
Anthropic prête à son nouveau modèle un record interne de vitesse, faisant de Claude Haiku 5.5 le plus rapide de la firme. Cette notion ne vaut toutefois qu’à vitesse standard, les modèles Opus restant devant en mode Fast.
Autre nouveauté, il s’agit du premier modèle Haiku doté d’un réglage du niveau d’effort, qui permet d’arbitrer entre coût et niveau d’intelligence, comme sur le reste de la gamme. Dans son billet, Anthropic reconnaît toutefois que Sonnet 5.5 et Opus 5.5 restent « de meilleurs choix pour les tâches complexes de codage agentique ». La firme cantonne Haiku 5.5 aux tâches au périmètre plus restreint, « qui auraient autrement pu s’avérer trop coûteuses avec les versions précédentes de Claude ».
Une tarification à deux paliers et des crédits API pour les abonnés
Claude Haiku 5.5 est disponible dès maintenant sur l’ensemble des plateformes, dont Amazon Web Services, Google Cloud et Microsoft Azure. Sur la Claude Platform, il répond à l’identifiant claude-haiku-5-5.
Son prix dépend de la taille du prompt, avec un seuil fixé à 100 000 tokens :
- Sous ce seuil de 100 000 tokens, le modèle coûte 90 % de moins que Haiku 4.5,
- Au-delà du seuil, l’écart tombe à 50 %.
Selon Anthropic, 90 % des requêtes adressées à Haiku 4.5 restaient sous ce seuil. La baisse moyenne du coût, estimée par la firme à environ 75 %, tient aussi compte d’un nouveau tokenizer, qui consomme un peu plus de tokens par tâche.
Les tarifs de Claude Haiku 5.5 sur l'API
Pour un million de tokens, sur un prompt de moins/de plus de 100 000 tokens :
- Entrée : 0,10 $/0,50 $
- Sortie : 0,50 $/2,50 $
- Lecture de cache : 0,01 $/0,05 $
- Écriture de cache : 0,125 $/0,625 $
Sous le seuil, les tarifs en entrée et en sortie sont identiques à ceux de GPT-6 Luna, le modèle léger dévoilé par OpenAI le même jour qu’Opus 5.5.
Anthropic profite de ce lancement pour diviser par deux le prix de la lecture de cache sur Sonnet 5.5, qui passe de 0,20 $ à 0,10 $ par million de tokens. La firme chiffre l’économie à environ 20 % sur la plupart des travaux agentiques. Les abonnés Max et Team recevront par ailleurs, dans le courant de la semaine, un crédit API mensuel utilisable sur tous les modèles :
- 100 $ pour Max 5x,
- 200 $ pour Max 20x,
- Jusqu’à 500 $ pour Team, mutualisés entre les membres de l’équipe.
Côté développeurs, les SDK Python et TypeScript de Claude prennent désormais en charge, en bêta, le computer use et le browser use.