Claude Opus 5: il nuovo modello di Anthropic, anche dentro Microsoft 365
· 4 min di lettura
Scritto con l'intelligenza artificiale
Anthropic presenta Claude Opus 5: vicino a Fable 5 a metà del prezzo, più bravo a verificare il proprio lavoro. Lo stesso giorno arriva in Microsoft 365 Copilot. Cosa cambia nel modo di scrivere le istruzioni.
Il 24 luglio Anthropic ha presentato Claude Opus 5 e, lo stesso giorno, Microsoft ha annunciato che il nuovo modello arriva anche in Microsoft 365 Copilot. Anthropic lo descrive come un modello «riflessivo e proattivo» che si avvicina all'intelligenza di frontiera di Claude Fable 5 a metà del prezzo. Per chi lavora con l'AI ogni giorno, la notizia più interessante non è nei punteggi: è nel modo in cui Opus 5 controlla il proprio lavoro.
Che cosa porta Opus 5?
Il prezzo resta quello di Opus 4.8: 5 dollari per milione di token in ingresso e 25 in uscita. Opus 5 diventa il modello predefinito su Claude Max ed è il più potente disponibile su Claude Pro; è disponibile su tutte le piattaforme, API compresa, con l'identificativo claude-opus-5.
Sui test di programmazione Anthropic dichiara risultati notevoli: su Frontier-Bench v0.1 Opus 5 supera tutti gli altri modelli e più che raddoppia il risultato di Opus 4.8; su CursorBench 3.2, al massimo dello sforzo, resta entro lo 0,5% dal miglior punteggio di Fable 5 a metà del costo per compito. Sul lavoro d'ufficio: su Zapier AutomationBench, che misura se un modello porta a termine compiti aziendali dall'inizio alla fine, la percentuale di successo è circa una volta e mezza quella del secondo modello a parità di costo. Su OSWorld 2.0, un test sull'uso del computer, supera il miglior risultato di Fable 5 con poco più di un terzo della spesa.
Anthropic è esplicita anche sui limiti: Opus 5 resta dietro Mythos 5 nei compiti di sicurezza informatica e di ricerca biologica, e le sue protezioni bloccano attività come i test di intrusione e la generazione di exploit, lasciando possibile la ricerca di vulnerabilità nel codice sorgente.
Un modello che verifica il proprio lavoro
Il passaggio più utile dell'annuncio è questo: Opus 5 è «molto più bravo a verificare il proprio lavoro e a ripetere con attenzione finché non riesce». Gli esempi riportati da Anthropic sono eloquenti. In un test doveva ricostruire in 3D un pezzo meccanico partendo da un disegno che non poteva vedere direttamente: ha scritto da solo un sistema di visione artificiale per ricavare la geometria dai pixel. Un ingegnere di una società di trading gli ha fatto costruire in una sola sessione il flusso di dati per una nuova borsa; non trovando un flusso reale con cui confrontarsi, il modello si è costruito un banco di prova per controllare il proprio codice.
L'impostazione dello sforzo (effort) permette di scegliere tra più ragionamento e risposte più rapide ed economiche. Arrivano anche due novità in beta per gli sviluppatori: si possono cambiare gli strumenti a disposizione nel mezzo di una conversazione senza perdere la cache del prompt, e le richieste bloccate dai filtri di sicurezza possono passare in automatico a un altro modello.
Anche dentro Microsoft 365
Microsoft ha annunciato che Opus 5 sta arrivando nel selettore dei modelli di Copilot in Word, Excel e PowerPoint, in Copilot Chat, in Copilot Cowork e in Copilot Studio, con la precisazione che la disponibilità può variare per area geografica e configurazione dell'organizzazione. Non è una sorpresa: già a giugno Copilot Cowork era stato lanciato su modelli di Anthropic, Opus 4.8 e Sonnet 4.6. Per molte aziende italiane significa poter usare Opus 5 dentro la licenza Microsoft 365 Copilot che hanno già, senza un abbonamento separato ad Anthropic.
Che cosa cambia per chi progetta prompt
Un modello che si controlla da solo cambia il modo di scrivere le istruzioni. Invece di dettare ogni passaggio, conviene dirgli come riconoscere un lavoro ben fatto: il criterio di verifica diventa parte del prompt.
Un esempio da provare in Excel o in Cowork:
Riconcilia gli incassi del foglio «Banca luglio» con le fatture del foglio «Emesse». Prima di consegnare, controlla che la somma degli abbinamenti coincida con il totale degli incassi e spiega ogni differenza. Se un abbinamento è incerto, non sceglierlo tu: mettilo in un elenco a parte.
Che cosa osservare: se il modello esegue davvero il controllo dichiarato, se l'elenco dei casi incerti è ragionevole, quanto cambia il risultato alzando o abbassando lo sforzo. Anthropic segnala anche una guida specifica al prompting di Opus 5: vale la pena leggerla prima di migrare i prompt scritti per i modelli precedenti, e provarli su pochi casi noti prima di cambiare modello in produzione.
Non serve più un prompt lunghissimo che prevede tutto. Serve un obiettivo chiaro, i confini entro cui muoversi e un modo per verificare il risultato. È il lavoro di progettazione che spetta a un Prompt Architect.
Fonti
- Microsoft, Copilot Cowork is now generally available, 16 giugno 2026
- Anthropic, Introducing Claude Opus 5, 24 luglio 2026
- Microsoft, Available today: Anthropic Claude Opus 5 in Microsoft 365 Copilot, 24 luglio 2026