Le tout dernier modèle « Claude » d'Anthropic vise à rendre l'IA de pointe moins coûteuse, plus rapide et plus sûre, tout en offrant aux abonnés une plus grande marge de manœuvre avant que ces limites d'utilisation frustrantes n'entrent en vigueur.
Moins de deux mois après la sortie de Claude Opus 5, Anthropic revient avec Opus 5.5. Le principal argument de vente d’Opus 5 était qu’il offrait des performances « proches de celles de Fable » pour moitié moins cher.
Cette fois-ci, l’annonce phare est que l’IA polyvalente Opus 5.5 offre des performances équivalentes à celles de Fable 5.1 pour la plupart des tâches et coûte environ 40 % moins cher à l’utilisation.
« Nos clients utilisent Box AI sur d’énormes volumes de contenu ; la vitesse et le coût sont donc une priorité absolue », explique Yashodha Bhavnani, vice-présidente des produits IA chez Box. « Lors de nos évaluations, Claude Opus 5.5 a utilisé un tiers des tokens consommés par Opus 5, et ses réponses étaient 40 % moins prolixes sans perte de précision. Nous pensons que cela aura une grande importance pour les équipes qui exploitent des agents sur l’ensemble de leurs contenus dans des secteurs tels que les services financiers et le secteur public. »
Anthropic précise : « Au cours des prochaines semaines, nous lancerons également Claude Sonnet 5.5 et Haiku 5.5. » Opus 5.5 est disponible dès aujourd’hui.
J’ai beaucoup utilisé Claude Code avec Opus 5, j’ai donc particulièrement bon espoir que les affirmations de l’entreprise concernant les performances soient exactes. L’entreprise affirme qu’il « génère des résultats plus de 30 % plus rapidement qu’Opus 5 ».
Les tarifs des jetons (token) et les formules d’abonnement sont détaillés dans l’annonce d’aujourd’hui. Le prix des jetons est inférieur de 20 % à celui pratiqué avec Opus 5. Opus 5.5 « nécessiterait également moins de jetons pour un travail de meilleure qualité ».
Pour les abonnés comme moi, Anthropic augmente de 20 % la limite d’utilisation de cinq heures. Cela revient en gros à un réservoir de 20 % plus grand pour la quantité de calculs IA que vous pouvez effectuer en cinq heures. Même si mon forfait Max n’est pas réinitialisé souvent, il l’est tout de même.
Pour ceux qui ont souscrit à un forfait à 20 $ par mois, cela pourrait représenter un gain considérable. De plus, l’entreprise précise que les limites d’utilisation, tant sur cinq heures qu’hebdomadaires, sont plus avantageuses, car Opus 5.5 coûte moins cher qu’Opus 5.
Ces avantages semblent s’additionner. On dispose d’un quota 20 % plus important, associé à une consommation 25 % plus lente, ce qui signifie que la capacité d’utilisation effective semble être d’environ 50 % supérieure avec Opus 5.5. Il s’agit là d’une amélioration non négligeable de la qualité de votre vie professionnelle.
Anthropic affirme également qu’Opus 5.5 communique de manière plus naturelle que les modèles précédents. S’il est ne serait-ce qu’un peu moins obséquieux, j’en serai ravi. Parfois, Opus peut se montrer carrément flagorneur, en particulier lorsqu’il a commis une erreur.
« Les sorties trop détaillées et difficiles à suivre constituaient ma plus grande frustration avec les modèles de pointe, et Claude Opus 5.5 y remédie », explique John Ruelas, ingénieur logiciel chez Ramp.
Opus 5.5, dit-il, « écrit comme un bon collègue et respecte nos règles de rédaction. Une spécification technique s’est avérée utilisable avec un minimum de modifications, et lorsqu’il a réécrit l’une de nos consignes, j’ai préféré sa version à la mienne. Lorsqu’il a optimisé notre suite de tests, j’ai pu suivre facilement son raisonnement et j’ai déployé la modification en toute confiance. »
En parlant d’erreurs, la seconde partie de l’annonce d’Anthropic est entièrement consacrée au fait qu’Opus 5.5 est une IA plus « bien élevée ».
Citant le billet de blog du PDG Dario Amodei sur la modération du rythme des avancées en matière de capacités de l’IA, Anthropic met fortement l’accent sur une série de bonnes pratiques pour Opus 5.5, notamment « des tests d’alignement approfondis, une évaluation préalable à la mise en service par des organismes externes, et des mesures de protection pour les domaines à haut risque tels que la cybersécurité et la biologie ».
L’alignement est le terme utilisé en IA pour mesurer dans quelle mesure une IA semble encline à se comporter de manière incontrôlée. Anthropic affirme qu’Opus 5.5 est « le modèle le plus performant que nous ayons testé à ce jour, avec des améliorations notables sur plusieurs comportements ayant contribué à de récents incidents de cybersécurité (par exemple, un raisonnement biaisé, la tentative de s’échapper d’un bac à sable, etc.) ».
L’entreprise précise avoir fait appel à des prestataires de tests externes, ainsi qu’à « une catégorie de mesures de sécurité similaire à celle de Fable 5.1 en matière de cybersécurité, de biologie et de développement de LLM de pointe ».
Si les mesures de sécurité se déclenchent, les requêtes adressées à l’IA passent du niveau Opus 5.5 au niveau Opus 4.8. Dans la pratique, la plupart des tâches liées à la cybersécurité seront redirigées vers Opus 4.8, tandis que les requêtes liées à la biologie et au développement des LLM seront envoyées vers Opus 5.
Certaines « organisations agréées » peuvent désormais postuler au programme de vérification des sciences de la vie d’Anthropic afin d’obtenir un accès plus étendu pour la recherche biologique. Celles qui sont approuvées pour les travaux de cybersécurité via le programme de vérification cyber pourront commencer à utiliser Opus 5.5 d’ici quelques semaines.
Alors qu’OpenAI accélère la course à l’IA avec son modèle « GPT-6 Astra », Anthropic préparerait à son tour une nouvelle évolution de Claude.
Le ZDNET Morning le brief de l'actu tech pour les pros tous les matins à 9h00. Transformation numérique, IA, matériel, logiciels,… ne passez pas à côté de ce qui fait la Une du secteur.
Grok 4.7 se distingue par sa capacité à mener des tâches longues et à vérifier ses propres résultats, tout en conservant la tarification du modèle précédent.
Amazon a bloqué l’accès de Muse, l’agent d’intelligence artificielle personnel de Meta, à sa boutique en ligne, invoquant une violation de ses conditions d’utilisation et des risques liés à la confidentialité des données.
Si la dictée est votre méthode préférée pour prendre des notes et que vous travaillez sous l’OS libre, ce logiciel est certainement ce qu'il vous faut. Voici comment vous lancer.
Vous souhaitez vous lancer dans le développement d'applications web, mobiles ou « full-stack », mais vous n'avez aucune expérience ? Dyad est là pour vous aider – disponible sur Linux, macOS et Windows.
L'enregistreur vocal Comulytic Note Pro AI concentre une grande puissance dans un appareil de la taille d'une carte de crédit. Mais c'est à vous de décider de son utilité.
J'ai testé les principaux outils de synthèse vocale basés sur l'IA actuellement disponibles afin de déterminer lequel offre la meilleure précision, la meilleure protection de la vie privée, les meilleures corrections et la meilleure productivité au quotidien, sans ralentir le travail proprement dit.
La polyvalence est à l'ordre du jour : les collaborateurs doivent maîtriser l'ensemble de la pile technologique.






