HeadlinesBriefing favicon HeadlinesBriefing.com

Claude Opus 5.5 lancé - 40 % de réduction de coûts

Hacker News •
×

Nous introduisons Claude Opus 5.5, le premier modèle de notre nouvelle famille Claude 5.5. Il réalise les performances de Claude Fable 5.1 dans la plupart des tâches et coûte 40 % de moins à exécuter que Opus 5. Claude Opus 5.5 est notre premier lancement depuis que nous avons appelé à ralentir le rythme de développement. Il a été testé avant mise en production par des évaluateurs externes, notamment Frontier Design et MET R. Dans notre audit comportemental automatisé, le test d'alignement le plus complet que nous réalisons, Opus 5.5 est le modèle qui présente la meilleure performance à ce jour. Il comprend également les protections que nous avons développées pour nos modèles les plus performants.

Opus 5.5 représente une évolution majeure par rapport à Opus 5. Un testeur a achevé une migration de 680 000 lignes de code en moins d'une journée—un travail qui aura nécessité des équipes d'ingénierie des semaines. Lorsqu'on lui a demandé de réduire les temps de chargement sur chaque page d'une application web, Opus 5.5 a réussi 39 fois sur 40, tandis qu'Opus 5 avait obtenu des améliorations plus modestes qui modifiaient également le comportement de l'application. Un autre testeur a fait construire à plusieurs modèles Claude un jeu à partir d'une seule instruction ; Opus 5.5 a obtenu la meilleure note que tout autre modèle dans les graphismes et le polissage.

Opus 5.5 obtient les meilleures notes de tous les modèles à ce jour dans notre audit comportemental automatisé. Il est beaucoup moins susceptible que les modèles récents d'effectuer des actions difficiles à inverser ou d'agir en dehors des limites qui lui ont été assignées, et il résiste mieux que Opus 5 à l'injection de prompts. Il est comparable à Claude Mythos 5.1 en biologie et cybersécurité, donc nous le déployons avec des protections similaires à celles de Claude Fable 5.1. Les organisations vérifiées peuvent postuler aujourd'hui à notre Programme de Vérification des Sciences de la Vie pour utiliser Opus 5.5 dans les recherches en biologie.

Opus 5.5 nécessite moins de ressources de calcul pour être servi que Opus 5, avec des jetons d'entrée et de sortie à 4 $ et 20 $ par million—20 % de moins que Opus 5. Les lectures en cache coûtent 0,20 $ par million de jetons, 60 % de moins que Opus 5. Opus 5.5 génère également une sortie plus de 30 % plus rapidement que Opus 5. Nous augmentons les limites d'utilisation de cinq heures sur les plans Pro, Max, Team et les plans d'entreprise basés sur les sièges. Claude Sonnet 5.5 et Claude Haiku 5.5 suivront dans les prochaines semaines.