Anthropic lance Claude Haiku 5.5, un petit modèle pensé pour les tâches répétitives. Il peut aussi seconder Opus 5.5 ou Sonnet 5.5 sur les projets de code.

Haiku 5.5 est le troisième modèle de la famille Claude 5.5 en un mois, après Opus 5.5 et Sonnet 5.5. Il est disponible depuis hier soir sur toutes les plateformes, dont Amazon Web Services, Google Cloud et Azure, sous l'identifiant claude-haiku-5-5.
Un modèle pour les petites tâches, pas pour le code complexe
Haiku 5.5 vise le travail court et répétitif comme les résumés, les requêtes dans une base de données, la classification, ou encore le support client en direct. Il sait aussi faire de la compaction, c'est-à-dire condenser une longue conversation pour qu'elle tienne dans la mémoire d'un modèle. Surtout, Il peut servir de sous-agent. Opus 5.5 ou Sonnet 5.5 peuvent alors piloter un projet de code et lui confier les tâches simples. Les chantiers complexes restent aux grands modèles. Sur Terminal-Bench 4.0, un test de programmation en ligne de commande, Haiku 5.5 atteint le score de 39,2% contre 70,6% pour Sonnet 5.5.
Anthropic annonce une baisse de prix d'environ 75% en moyenne. Jusqu'à 100 000 tokens, le million de jetons coûte 0,10 dollar en entrée et 0,50 dollar en sortie. Le coût est alors 90% plus bas que celui de Haiku 4.5. Il concerne environ neuf requêtes sur dix adressées à ce modèle. Au-delà de 100 000 tokens, le prix passe à 0,50 et 2,50 dollars, soit 50% moins cher. Le tarifs des lectures de cache de Sonnet 5.5 (la relecture d'un contexte déjà envoyé) est aussi divisé par deux. Cela représente environ 20% d'économie sur la plupart des tâches d'agents. Les abonnés Claude Max et Team recevront enfin un crédit API mensuel, de 100 à 500 dollars selon l'offre.
Sur OSWorld 2.1 qui permet de tester le pilotage d'un ordinateur par un agent, Haiku 5.5 obtient le score de 72,4% contre 15,7% pour Haiku 4.5 et 48,9% pour GPT-6 Luna. Haiku 5.5 est aussi le premier Haiku avec un réglage d'effort, sur medium par défaut. Il permet de choisir la quantité de réflexion dépensée par tâche.
Côté sécurité, les protections sont plus strictes que sur Haiku 4.5, mais un peu moins que sur les autres modèles récents. Elles acceptent plus de tâches défensives que celles de Sonnet 5.5. Les tests d'intrusion restent quand même bloqués, tout comme les techniques plus souvent utilisées par des attaquants.

- Excellente compréhension des consignes complexes
- Très bon niveau en rédaction
- Analyse de longs documents efficace