La société américaine Anthropic a élargi son offre de modèles d'intelligence artificielle avec Claude Opus 5. La nouveauté est censée combiner de hautes performances en programmation, en traitement de documents et en gestion d'agents autonomes, avec des coûts nettement inférieurs à ceux du modèle phare actuel, Claude Fable 5.

Anthropic décrit Claude Opus 5 comme un saut générationnel significatif dans la gamme Opus, destiné principalement aux tâches longues et complexes, au raisonnement approfondi et au travail professionnel. Bien que Fable 5 demeure le modèle le plus performant et le plus largement disponible de la société, Opus 5 s'en approche ou le surpasse dans de nombreux tests, à moitié prix.

Le nouveau modèle est capable de traiter simultanément du texte et des supports visuels. Il offre une fenêtre contextuelle d'un million de tokens et peut générer une réponse allant jusqu'à 128 000 tokens. Cela permet d'analyser de vastes documentations, des projets logiciels entiers, des bases de données textuelles ou un grand nombre d'images dans le cadre d'une seule requête.

Les développeurs peuvent choisir entre cinq niveaux d'intensité de raisonnement : low, medium, high, xhigh et max. Le paramètre par défaut utilise un raisonnement adaptatif, dans lequel le modèle ajuste lui-même la quantité de puissance de calcul à la difficulté de la tâche. Des outils sont également inclus pour la gestion de fichiers, la programmation, la recherche sur Internet, la mémoire, le contrôle de l'ordinateur et l'interconnexion via le protocole MCP.

Au sommet des tests d'intelligence artificielle

Claude Opus 5 s'est hissé à la première place du classement Intelligence Index de la société Artificial Analysis dès son lancement. Au niveau de raisonnement maximum, il a obtenu 61 points, devançant de justesse Claude Fable 5. Il s'est particulièrement distingué dans les tests de travail agentique, de raisonnement multimodal et de résolution de tâches complexes à forte composante de connaissances.

Le résultat obtenu au benchmark ARC-AGI-3 a également attiré l'attention ; ce test mesure la rapidité avec laquelle un modèle est capable d'apprendre les règles d'un environnement interactif jusqu'alors inconnu. Selon les résultats publiés, Claude Opus 5 a atteint un score de 30,2 %, soit près de quatre fois plus que le meilleur modèle précédent. ARC-AGI-3 se distingue des tests de connaissances classiques en ce qu'il ne fournit pas d'instructions claires aux modèles et évalue principalement leur capacité à découvrir des règles, à planifier et à réagir efficacement à de nouvelles situations.

Le modèle a également enregistré de solides résultats en programmation, en automatisation des flux de travail et dans la résolution de tâches à long terme. Selon Anthropic, il est plus efficace pour répartir le travail entre agents auxiliaires, contrôler sa propre progression et détecter les erreurs dès la phase de planification, et non seulement après la génération de la réponse finale.

Un prix plus bas, mais toujours un modèle premium

Claude Opus 5 est proposé via l'API à cinq dollars par million de tokens en entrée et à 25 dollars par million de tokens en sortie. La mise en cache des parties déjà traitées d'une requête coûte 50 centimes par million de tokens. Le prix est identique à celui du précédent Claude Opus 4.8, mais deux fois moins élevé que celui du modèle Fable 5.

Anthropic propose également un mode rapide, censé fournir des réponses nettement plus rapides. Celui-ci n'est disponible que via l'API Claude et coûte dix dollars par million de tokens en entrée et 50 dollars par million de tokens en sortie. La rapidité de traitement se paie donc au double du tarif standard.

Claude Opus 5 est disponible via l'API Claude ainsi que par l'intermédiaire des services cloud Amazon Bedrock, Google Cloud et Microsoft Foundry. Pour les abonnés Claude Max, il est devenu le modèle par défaut, tandis que les utilisateurs du forfait moins cher Claude Pro y ont un accès limité.

La nouveauté répond à certaines réserves que les utilisateurs émettaient à l'égard du modèle Fable 5, plus onéreux. Opus 5 devrait moins souvent refuser les questions scientifiques ou de sécurité courantes et offrir un meilleur rapport qualité-prix. Fable 5 conserve toutefois un avantage pour certaines tâches nécessitant une restitution précise de faits ou le niveau de capacités le plus élevé disponible.

Anthropic poursuit ainsi sa stratégie axée sur des modèles performants et relativement coûteux destinés au déploiement professionnel. Claude Opus 5 vise principalement les développeurs, les entreprises et les utilisateurs qui ont besoin de traiter de vastes documents, de créer des logiciels ou de faire fonctionner des agents autonomes sur une longue durée.

deeplearning.ai/gnews.cz - GH