Claude 4: Opus e Sonnet per lavorare ore su un compito
· 4 min di lettura
Scritto con l'intelligenza artificiale
Anthropic presenta Claude Opus 4 e Sonnet 4, modelli capaci di lavorare per ore su un compito, e rende Claude Code disponibile a tutti. Il prompt diventa un capitolato: criteri di fine, memoria, punti di controllo.
Il 22 maggio, alla sua prima conferenza per sviluppatori, Anthropic ha presentato Claude Opus 4 e Claude Sonnet 4. La promessa non riguarda una risposta più brillante, ma una cosa diversa: lavorare per ore sullo stesso compito senza perdere il filo.
Insieme ai modelli, Claude Code esce dall'anteprima ed è disponibile a tutti. Per chi progetta con l'AI è un segnale chiaro: l'unità di misura non è più la singola risposta, ma il lavoro completato.
Che cosa sono Opus 4 e Sonnet 4?
Sono due modelli «ibridi»: rispondono quasi all'istante alle richieste semplici e possono attivare un ragionamento esteso per quelle complesse, mostrandone un riassunto. Le differenze principali:
- Opus 4 è il modello di punta. Anthropic lo presenta come il miglior modello al mondo per la programmazione: 72,5% su SWE-bench e 43,2% su Terminal-bench. È riservato agli abbonamenti a pagamento; via API costa 15 dollari per milione di token in ingresso e 75 in uscita.
- Sonnet 4 migliora nettamente Sonnet 3.7, ottiene il 72,7% su SWE-bench ed è disponibile anche per gli utenti gratuiti di Claude.ai. Via API costa 3 dollari in ingresso e 15 in uscita.
Entrambi sono disponibili anche su Amazon Bedrock e Google Cloud Vertex AI.
Perché «per ore» è la vera notizia?
Secondo Anthropic, Opus 4 può lavorare in modo continuativo per diverse ore su compiti lunghi. L'azienda giapponese Rakuten lo ha messo alla prova su un refactoring open source durato sette ore, svolto in autonomia e con prestazioni costanti.
Tre novità tecniche rendono possibile questa resistenza:
- ragionamento con strumenti: durante il ragionamento esteso il modello può usare strumenti come la ricerca web, alternando pensiero e azione;
- file di memoria: se lo sviluppatore gli dà accesso a file locali, Opus 4 vi annota le informazioni chiave e le ritrova più avanti, superando i limiti della finestra di contesto;
- meno scorciatoie: nei compiti da agente più esposti a questo rischio, i due modelli ricorrono il 65% in meno di Sonnet 3.7 a soluzioni di comodo per «chiudere» un compito senza risolverlo davvero.
Claude Code per tutti
Claude Code, lo strumento che porta Claude nel terminale dello sviluppatore, è ora disponibile a tutti, con integrazioni native in VS Code e JetBrains e con GitHub, dove può lavorare in background su richiesta. Esce anche un SDK per costruire agenti propri con la stessa base. Lato API arrivano l'esecuzione di codice, il connettore MCP, la Files API e la cache dei prompt fino a un'ora.
E la sicurezza?
Per Opus 4 Anthropic ha attivato in via precauzionale le protezioni di livello ASL-3, pensate soprattutto contro l'uso improprio in ambito chimico, biologico, radiologico e nucleare. L'azienda spiega di non poter escludere con certezza che il modello abbia raggiunto quella soglia di rischio, e preferisce intervenire prima. È una scelta da notare: più autonomia significa anche più responsabilità.
Cosa cambia per chi progetta con l'AI
Se un modello lavora per ore, il prompt non è più una domanda: è un capitolato. Chi affida un compito lungo deve dire tre cose che con le chat brevi davamo per scontate:
- quando il lavoro è finito: un criterio verificabile, non «fai del tuo meglio»;
- dove tenere traccia: un file o un documento in cui il modello annota decisioni e progressi;
- quando fermarsi a chiedere: i punti in cui serve una persona.
Un esempio di incarico lungo:
Devi aggiornare il manuale operativo del reparto acquisti (cartella allegata) alle nuove procedure descritte nel documento «Procedure 2025». Lavora un capitolo alla volta. Dopo ogni capitolo aggiorna il file «avanzamento.md» con le modifiche fatte e i dubbi aperti. Considera finito il lavoro quando ogni capitolo è aggiornato e la lista dei dubbi è vuota o rinviata a me. Se una procedura nuova contraddice una norma citata nel manuale, fermati e chiedimi come procedere.
Notate il file di avanzamento: è lo stesso principio dei file di memoria di Opus 4, applicato da chi scrive l'incarico. Un agente AI che lavora a lungo ha bisogno di un posto dove ricordare, e di regole chiare su quando chiedere aiuto.
Il punto
Claude 4 sposta il confine tra assistente e collaboratore. Le capacità ci sono; ciò che fa la differenza, ora, è la qualità dell'incarico. Un compito di sette ore progettato male produce sette ore di lavoro da rifare.
Fonti
- Anthropic, Introducing Claude 4, 22 maggio 2025
- Anthropic, Activating AI Safety Level 3 protections, 22 maggio 2025
- TechCrunch, Anthropic's new Claude 4 AI models can reason over many steps, 22 maggio 2025