La società americana Anthropic ha ampliato la propria offerta di modelli di intelligenza artificiale con Claude Opus 5. La novità dovrebbe unire elevate prestazioni nella programmazione, nell'elaborazione di documenti e nella gestione di agenti autonomi a costi significativamente inferiori rispetto all'attuale modello di punta Claude Fable 5.
Anthropic descrive Claude Opus 5 come un netto salto generazionale nella linea Opus, destinato principalmente a compiti a lungo termine e complessi, a un ragionamento più approfondito e al lavoro professionale. Sebbene Fable 5 rimanga il modello più performante e ampiamente disponibile dell'azienda, Opus 5 si avvicina o lo supera in numerosi test a metà prezzo.
Il nuovo modello è in grado di elaborare simultaneamente testo e contenuti visivi. Offre una finestra contestuale di un milione di token e può generare una risposta lunga fino a 128.000 token. Ciò consente di analizzare documentazioni estese, interi progetti software, database di testi o un gran numero di immagini nell'ambito di un singolo prompt.
Gli sviluppatori possono scegliere tra cinque livelli di intensità del ragionamento: low, medium, high, xhigh e max. L'impostazione predefinita utilizza un ragionamento adattivo, in cui il modello adatta autonomamente la quantità di potenza di calcolo alla difficoltà del compito. Sono inclusi anche strumenti per la gestione dei file, la programmazione, la ricerca su internet, la memoria, il controllo del computer e l'integrazione tramite il protocollo MCP.
Al vertice dei test di intelligenza artificiale
Claude Opus 5 ha raggiunto il primo posto nella classifica Intelligence Index della società Artificial Analysis subito dopo il suo lancio. Al livello massimo di ragionamento ha ottenuto 61 punti, superando di misura Claude Fable 5. Ha ottenuto risultati particolarmente brillanti nei test di lavoro agentivo, ragionamento multimodale e risoluzione di compiti complessi basati sulla conoscenza.
Ha attirato l'attenzione anche il risultato nel benchmark ARC-AGI-3, che misura la velocità con cui il modello è in grado di apprendere le regole di un ambiente interattivo precedentemente sconosciuto. Claude Opus 5 ha raggiunto un punteggio del 30,2 percento secondo i risultati pubblicati, quasi quattro volte superiore rispetto al precedente miglior modello. ARC-AGI-3 si differenzia dai comuni test di conoscenza perché non fornisce istruzioni esplicite ai modelli e valuta principalmente la loro capacità di scoprire regole, pianificare e rispondere efficacemente a nuove situazioni.
Il modello ha registrato risultati solidi anche nella programmazione, nell'automazione dei flussi di lavoro e nella gestione di compiti a lungo termine. Secondo Anthropic, è in grado di distribuire meglio il lavoro tra agenti ausiliari, verificare il proprio avanzamento e individuare gli errori già nella fase di pianificazione, anziché solo dopo aver prodotto la risposta finale.
Prezzo inferiore, ma pur sempre un modello premium
Claude Opus 5 costa tramite API cinque dollari per milione di token in input e 25 dollari per milione di token in output. La memorizzazione nella cache delle parti già elaborate del prompt costa 50 centesimi per milione di token. Il prezzo è lo stesso del precedente Claude Opus 4.8, ma è la metà rispetto al modello Fable 5.
Anthropic offre anche una modalità rapida, pensata per fornire risposte significativamente più veloci. È disponibile esclusivamente tramite Claude API e costa dieci dollari per milione di token in input e 50 dollari per milione di token in output. La maggiore velocità di elaborazione ha quindi come contropartita un prezzo doppio.
Claude Opus 5 è disponibile tramite Claude API e attraverso i servizi cloud Amazon Bedrock, Google Cloud e Microsoft Foundry. Per gli abbonati Claude Max è diventato il modello predefinito, mentre gli utenti del piano Claude Pro più economico vi hanno accesso limitato.
La novità risponde ad alcune critiche che gli utenti avevano mosso nei confronti del più costoso modello Fable 5. Opus 5 dovrebbe rifiutare meno frequentemente le comuni domande scientifiche o di sicurezza e offrire un rapporto più equilibrato tra prezzo e prestazioni. Fable 5 mantiene tuttavia un vantaggio in alcuni compiti che richiedono un recupero preciso di informazioni fattuali o il massimo livello di capacità disponibile.
Anthropic prosegue così nella sua strategia incentrata su modelli potenti e relativamente costosi per l'impiego professionale. Claude Opus 5 si rivolge principalmente a sviluppatori, aziende e utenti che necessitano di elaborare documenti estesi, sviluppare software o gestire agenti autonomi per periodi prolungati.
deeplearning.ai/gnews.cz - GH