Décryptage · Modèles
Claude Haiku 4.5 : Anthropic rend la performance de pointe trois fois moins chère
Anthropic lance Claude Haiku 4.5, un petit modèle qui égale Claude Sonnet 4 en code à un tiers du prix et plus de deux fois la vitesse.

Anthropic a mis en ligne le 7 octobre Claude Haiku 4.5, la dernière déclinaison « small » de sa famille Claude, disponible immédiatement pour tous les utilisateurs et via l'API sous l'identifiant `claude-haiku-4-5`. L'argument central de l'entreprise tient en une phrase : ce qui était à la pointe il y a cinq mois coûte aujourd'hui trois fois moins cher. Claude Sonnet 4, modèle phare d'Anthropic au printemps, servait de référence en code et en usage d'ordinateur ; Haiku 4.5 atteint un niveau comparable, voire supérieur sur certaines tâches d'utilisation d'interface, pour un tarif de 1 $ en entrée et 5 $ en sortie par million de tokens, et plus de deux fois la vitesse d'exécution.
Un tiers du coût, deux fois la vitesse
Le positionnement n'est pas anodin pour les équipes qui opèrent des assistants IA en production. Les usages à faible latence — support client, programmation en binôme avec une IA, agents conversationnels temps réel — tirent directement parti d'un modèle qui répond plus vite sans sacrifier la qualité. Anthropic cite les retours de plusieurs partenaires techniques : l'éditeur Augment rapporte que Haiku 4.5 atteint 90 % de la performance de Sonnet 4.5 sur son évaluation de code agentique, un résultat qui le rapproche de modèles nettement plus volumineux. Warp, éditeur d'un terminal assisté par IA, évoque de son côté une réactivité qui rend le développement « instantané ».
L'un des usages mis en avant par Anthropic est l'orchestration multi-agents : Claude Sonnet 4.5, le modèle frontière de l'entreprise sorti deux semaines plus tôt, peut désormais découper un problème complexe en sous-tâches et les confier à une équipe de plusieurs instances de Haiku 4.5 travaillant en parallèle. Cette logique répond à une préoccupation très concrète des équipes techniques : un modèle frontière reste nécessaire pour planifier, mais faire exécuter chaque sous-tâche par un modèle coûteux devient vite prohibitif à l'échelle d'une entreprise.
Un profil de sécurité plus favorable
Anthropic a également publié les résultats de ses évaluations de sécurité internes. Selon l'entreprise, Haiku 4.5 affiche un taux de comportements problématiques statistiquement plus bas que ses propres modèles Sonnet 4.5 et Opus 4.1 lors de son évaluation d'alignement automatisée — un résultat présenté comme une amélioration notable par rapport à son prédécesseur, Claude Haiku 3.5. Sur les risques de contribution à la fabrication d'armes chimiques, biologiques, radiologiques ou nucléaires, le modèle a été jugé suffisamment limité pour être classé au niveau de sécurité ASL-2, moins restrictif que le niveau ASL-3 appliqué à Sonnet 4.5 et Opus 4.1. Le détail de cette classification figure dans la fiche système du modèle.
Le modèle est disponible dès maintenant sur Claude Code, les applications Claude, ainsi que via Amazon Bedrock et Google Cloud Vertex AI, où il se positionne comme un remplacement direct de Haiku 3.5 et de Sonnet 4 au tarif le plus économique de la gamme. Pour les entreprises qui multiplient les déploiements d'agents IA — un sujet que la rédaction a déjà traité à propos de l'essor des agents de pentest autonomes — la bascule vers des modèles plus légers et moins coûteux par tâche devient un axe d'optimisation aussi important que la course à la puissance brute.
Ce que ça change pour les éditeurs d'outils IA
Plusieurs éditeurs d'outils de développement ont partagé leurs premiers retours à Anthropic. GitHub Copilot évoque une qualité de génération de code comparable à celle de Claude Sonnet 4, mais à une vitesse supérieure, ce qui en ferait un choix pertinent pour les utilisateurs cherchant avant tout de la réactivité. Un autre partenaire, actif sur la génération automatisée de présentations, rapporte que Haiku 4.5 dépasse ses modèles haut de gamme actuels sur le respect des consignes d'instruction pour la génération de texte de diapositives — 65 % de précision contre 44 % pour son modèle premium — un écart qu'il qualifie de déterminant pour l'équilibre économique de son produit.
Ce type de retour illustre un phénomène plus large dans l'industrie : la frontière entre modèles « petits » et modèles « frontière » devient de moins en moins nette pour une large part des tâches réellement exécutées en production. Un modèle quatre à cinq fois plus rapide que Sonnet 4.5, à une fraction de son coût, ouvre des usages qui n'étaient tout simplement pas viables économiquement il y a encore quelques mois — notamment les architectures à plusieurs agents, où chaque sous-tâche multiplie le nombre d'appels au modèle et où le coût unitaire devient rapidement le facteur limitant.
La bascule progressive vers les petits modèles
Cette dynamique de rattrapage rapide des petits modèles sur les grands n'est pas propre à Anthropic : elle traverse l'ensemble du secteur, de Mistral avec ses gammes Small à Google avec ses modèles Gemini Flash. Mais le cas de Haiku 4.5 est notable par l'ampleur du rattrapage revendiqué sur un intervalle aussi court — cinq mois seulement séparent la sortie de Sonnet 4, alors état de l'art, de ce petit modèle qui en égale les performances sur plusieurs benchmarks. Pour les entreprises qui bâtissent des produits sur ces modèles, la question n'est plus seulement « quel est le modèle le plus capable », mais « quel est le modèle le plus capable pour le budget et la latence que mon produit peut réellement se permettre » — un calcul qui, de plus en plus souvent, penche vers les petits modèles à chaque nouvelle génération.