Claude Haiku 5.5 : l’IA qui pourrait faire de l’ombre à ChatGPT sans coûter un bras

Anthropic vient de sortir Claude Haiku 5.5, et derrière ce nom qui ressemble davantage à un mini poème japonais qu’à une nouvelle arme dans la guerre de l’IA, il se cache un modèle qui pourrait faire quelques misères à OpenAI. Parce que Haiku 5.5 n’a pas été conçu pour être le modèle le plus intelligent de la planète. Son idée est beaucoup plus simple : faire énormément de choses, très vite, pour pas cher.

Pour les nuls : c’est quoi Haiku 5.5 ?

Anthropic propose plusieurs tailles de modèles Claude. Opus représente le gros cerveau, Sonnet se situe au milieu et Haiku est le petit modèle rapide et économique. Le canif suisse qui ne va pas vous coûter le prix d’un couteau japonais de maître sushi.

Le questionnement derrière tout ça, c’est qu’un grand modèle n’est pas forcément nécessaire pour toutes les tâches. Si une entreprise reçoit 500 000 demandes de clients et veut simplement classer les messages entre “problème de facturation”, “demande de remboursement” ou “merci, tout est nickel !”, utiliser le modèle le plus puissant disponible revient un peu à employer un ingénieur en aéronautique pour décider si une enveloppe doit aller dans la boîte A ou dans la boîte B. Haiku 5.5 est justement conçu pour ce genre de boulot.

Résumer des documents, classer des informations, extraire des données, interroger une base de données, traiter des milliers de requêtes ou encore servir de petit sous-agent à un modèle plus puissant : c’est là qu’il veut jouer. Et il joue avec un argument particulièrement casse-bonbon pour ses concurrents : le prix.

Oui, le prix est devenu une arme

Anthropic facture Haiku 5.5 seulement 0,10 dollar pour un million de tokens en entrée et 0,50 dollar pour un million de tokens en sortie, pour les requêtes de moins de 100 000 tokens.

Pour comprendre l’ordre de grandeur, un token correspond grosso modo à un morceau de texte. Ce n’est donc pas “une question coûte 0,10 dollar”. La facturation dépend de la quantité de texte envoyée et produite. C’est un peu comme au restaurant : le prix ne dépend pas du nombre de fois où vous dites “Encore une bière”, mais de la quantité réellement consommée. Avec l’IA, même principe : plus vous lui envoyez de texte et plus elle vous en recrache, plus l’addition grimpe. Mais la baisse par rapport à Haiku 4.5 est spectaculaire : le prix par token est divisé par dix. Oui, par dix.

Attention toutefois au joli chiffre marketing qui emballe la mariée. À cause notamment du nouveau système de découpage du texte utilisé par Haiku 5.5, Anthropic estime que le coût réel par tâche est plutôt environ 75 % inférieur à celui de Haiku 4.5. Ce qui reste quand même une sacrée baisse. Et surtout, le prix de Haiku 5.5 est exactement le même que celui de GPT-6 Luna sur les tarifs de base.

Donc non, Anthropic ne met pas OpenAI KO avec une IA dix fois moins chère que Luna. Par contre, il lui met clairement la pression avec une IA qui promet davantage de performances pour le même prix sur certains usages.

Et là, Haiku 5.5 devient intéressant

Anthropic affirme que Haiku 5.5 est son modèle le plus rapide à ce jour. Et ce n’est pas simplement une histoire de répondre rapidement à “Quelle est la capitale de la Belgique ?”. Imaginez un service client avec 100 000 conversations par jour.

Chaque demande doit être analysée, classée, résumée et éventuellement transmise au bon service. Si chaque opération prend quelques secondes et coûte quelques fractions de centime, la facture finale peut devenir importante. Une IA plus rapide et moins chère peut alors faire une différence énorme.

Même chose pour une application qui doit analyser automatiquement des milliers de contrats, extraire certaines informations de chaque document ou surveiller en permanence une énorme quantité de données. Dans ce genre de situation, le meilleur modèle n’est pas forcément celui qui réussit le mieux un examen de mathématiques. C’est celui qui fait correctement le travail 100 000 fois sans faire exploser la facture.

Exemple tout bête : votre service client

Prenons une entreprise qui reçoit 50 000 messages par jour. Pensons “workflow”. Une première IA lit chaque message et répond directement lorsque le problème est simple. Lorsqu’elle rencontre quelque chose de compliqué (encore faut-il le mesurer), elle transmet la conversation à une IA plus puissante ou à un humain.

Haiku 5.5 peut alors jouer le rôle du premier filtre. Il n’a pas besoin de résoudre les problèmes les plus compliqués. Il doit simplement comprendre rapidement la demande, récupérer éventuellement les informations pertinentes et décider de la suite.

Si cette petite IA coûte quatre fois moins cher à la tâche et répond plus rapidement, l’entreprise peut tout simplement traiter beaucoup plus de demandes pour le même budget. Et c’est là que l’approche d’Anthropic devient assez intelligente.

L’IA n’a plus forcément besoin d’être seule

Autre changement intéressant : Haiku 5.5 est pensé pour fonctionner comme sous-agent. Imaginez que vous demandiez à une IA de modifier un gros programme informatique. Le modèle principal peut avoir besoin de faire des dizaines de petites opérations : chercher un fichier, vérifier une fonction, analyser une erreur, lire une documentation, lancer une commande, résumer un résultat…

Plutôt que de demander au gros modèle, qui coûte un bras, de tout faire lui-même, il peut envoyer certaines petites tâches à Haiku 5.5. C’est un peu comme un patron qui dit à son équipe : ‘Tu peux vérifier ça pendant que je m’occupe du reste ?” Sauf que l’employé ne demande pas de pause-café, n’est jamais malade, et travaille 24 heures sur 24.

Anthropic présente donc Haiku 5.5 comme un modèle pouvant servir de sous-agent aux modèles Sonnet et Opus. Judicieux, je trouve.

Et face à GPT-6 Luna ?

Sur le papier, Haiku 5.5 et GPT-6 Luna jouent dans la même catégorie tarifaire. Mais Anthropic affirme que Haiku 5.5 fait mieux que Luna sur plusieurs benchmarks importants, notamment ceux qui mesurent l’utilisation d’un ordinateur ou l’exécution de tâches dans un terminal.

Sur OSWorld, un test dans lequel l’IA doit réellement utiliser un ordinateur pour effectuer des tâches en plusieurs étapes, Anthropic annonce 72,4 % pour Haiku 5.5 contre 48,9 % pour GPT-6 Luna. Aussi, sur Terminal-Bench, qui mesure notamment la capacité à effectuer des tâches dans une interface en ligne de commande, Anthropic annonce 39,2 % contre 16,4 % pour Luna.

Pour le dire clairement, si ces chiffres se confirment dans des tests indépendants, Anthropic aurait réussi à proposer une petite IA qui coûte autant que Luna mais qui se débrouille mieux sur certains travaux pratiques. Mais il faut évidemment garder une petite casserole de prudence sur le coin du feu :  Ces résultats viennent d’Anthropic. C’est moins vendeurs, je sais. C’est un peu normal, les entreprises aiment généralement présenter les benchmarks qui les arrangent, ce qui est assez humain. Des évaluations indépendantes seront donc beaucoup plus intéressantes.

Ce qui pourrait vraiment faire de l’ombre à ChatGPT

Le danger pour OpenAI n’est donc pas forcément que tout le monde abandonne ChatGPT demain matin pour Claude. Le vrai danger est beaucoup plus discret. Les entreprises pourraient commencer à utiliser Claude partout où elles n’ont pas besoin d’un modèle gigantesque.

Une IA dans chaque application. Un agent dans chaque logiciel. Des millions de petites requêtes automatiques. Des assistants qui travaillent en arrière-plan. Des systèmes qui analysent des documents en permanence. Et dans ce monde-là, quelques centièmes d’Euro multipliés par des millions de requêtes finissent par représenter énormément d’argent.

C’est probablement l’un des grands enjeux de la prochaine bataille entre les modèles d’IA. Pendant quelques années, la question était : “Quelle IA est la plus intelligente ?”. La question commence doucement à devenir : “Quelle IA est suffisamment intelligente pour faire le boulot sans me ruiner ?”. Nous parlions d’ailleurs des gigantesques investissements dans un article précédent. 

ChatGPT peut-il vraiment se faire dépasser ?

Pas nécessairement. Haiku 5.5 n’est pas présenté comme le meilleur modèle d’Anthropic pour les tâches complexes. Son propre constructeur reconnaît que Sonnet 5.5 et Opus 5.5 restent plus adaptés aux travaux de programmation complexes et aux tâches nécessitant davantage de raisonnement. Haiku ne cherche donc pas à remplacer Opus. Il cherche plutôt à rendre rentable tout ce qui ne nécessite pas Opus.

Et c’est peut-être encore plus dangereux. Pourquoi ? Parce qu’une IA légèrement moins brillante mais beaucoup moins chère peut être utilisée partout. C’est exactement ce qui s’est produit dans énormément de domaines technologiques : le produit qui gagne n’est pas toujours celui qui possède la meilleure fiche technique. C’est souvent celui qui est suffisamment bon, suffisamment rapide et suffisamment abordable pour être utilisé à grande échelle.

C’est un peu comme un smartphone : le téléphone le plus puissant du marché n’est pas forcément celui qui se vend le mieux. Si un modèle deux fois moins cher fait parfaitement tourner WhatsApp, prendre de belles photos et regarder Netflix, il devient beaucoup plus intéressant pour le grand public.

Pour conclure : La vraie bataille commence peut-être maintenant

Au fond, Haiku 5.5 ne cherche pas forcément à battre les plus gros cerveaux de l’IA. Il cherche quelque chose de beaucoup plus pragmatique : devenir le modèle qu’on peut utiliser partout, tout le temps, sans regarder la facture avec inquiétude.

Et c’est peut-être justement là que se joue la vraie bataille. Une IA n’a pas besoin d’être exceptionnelle pour devenir incontournable. Elle doit être suffisamment bonne, rapide et bon marché pour que les entreprises aient envie de lui confier des millions de petites tâches.

C’est un peu comme notre four vapeur à 2 000 euros pour cuire un hachis parmentier et deux cakes par mois : impressionnant pour faire le malin devant les amis, mais pas forcément indispensable. Non, je ne parlerai pas de Thermomix ici, sinon je vais encore me faire cramer.

Si Haiku 5.5 tient ses promesses, Anthropic ne vient donc pas forcément chercher la place de ChatGPT sur le podium. Il vient plutôt lui rappeler qu’en technologie, celui qui gagne n’est pas toujours celui qui sait faire le plus. C’est parfois simplement celui qui coûte assez peu pour qu’on puisse l’utiliser partout.

Sources

 


Les bons plans du jour
-33%
Philips OneBlade 360 hybride Visage

Philips OneBlade 360 hybride Visage

49 € 32.99 €
Voir l'offre

Ajouté le 04/10/2026

-33%
DJI Osmo Pocket 3 - Vidéo 4K/120 IPS

DJI Osmo Pocket 3 - Vidéo 4K/120 IPS

429 € 288 €
Voir l'offre

Ajouté le 04/10/2026

-33%
Ninja Foodi FlexDrawer Air Fryer

Ninja Foodi FlexDrawer Air Fryer

269 € 179 €
Voir l'offre

Ajouté le 04/10/2026

-45%
Amazon Kindle Colorsoft 16 Go

Amazon Kindle Colorsoft 16 Go

299 € 164.99 €
Voir l'offre

Ajouté le 04/10/2026

Ajouter un bon plan

Bertrand

Bertrand

Explorateur d'Internet depuis 1995 et toujours à la recherche de la prochaine terre promise connectée. Mangeur de chocolat, fan de cuisine, de rando et de Kindle.