Claude Opus 4.6: un milione di token e squadre di agenti
· 4 min di lettura
Scritto con l'intelligenza artificiale
Anthropic presenta Claude Opus 4.6: un milione di token di contesto in beta, squadre di agenti in Claude Code e Claude in PowerPoint. Cosa cambia per chi progetta prompt e compiti lunghi.
Il 5 febbraio Anthropic ha presentato Claude Opus 4.6, il suo modello più capace. Le novità che fanno notizia sono due: per la prima volta un modello della classe Opus può lavorare con un milione di token di contesto, e in Claude Code arrivano le «squadre di agenti», più istanze di Claude che si dividono un lavoro e lo portano avanti in parallelo. Vediamo cosa significano per chi progetta il lavoro con l'AI.
Un milione di token: quanto conta davvero
La finestra di contesto da un milione di token è in beta e, per ora, disponibile solo sulla piattaforma per sviluppatori di Anthropic. Oltre i 200.000 token di prompt si applica un prezzo maggiorato (10 dollari per milione di token in ingresso e 37,50 in uscita); il prezzo standard resta di 5 e 25 dollari. Il modello può anche produrre risposte fino a 128.000 token.
Ma la dimensione della finestra è solo metà della storia. L'altra metà è quanto il modello riesce a usare davvero di ciò che legge. Anthropic cita il test MRCR v2 nella variante da un milione di token, che misura la capacità di ritrovare informazioni «nascoste» in grandi quantità di testo: Opus 4.6 ottiene il 76%, contro il 18,5% di Sonnet 4.5. L'azienda la definisce una svolta qualitativa: non basta far entrare un documento enorme, bisogna che il modello ci ragioni sopra senza perdere pezzi.
Le squadre di agenti
In Claude Code, lo strumento di Anthropic per la programmazione, si possono ora comporre squadre di agenti che lavorano insieme. Invece di affrontare i compiti uno dopo l'altro, più agenti si coordinano e procedono in parallelo. Come riporta TechCrunch, la funzione è in anteprima di ricerca.
Accanto alle squadre, sulla piattaforma per sviluppatori arrivano altre tre novità pensate per i compiti lunghi:
- compattazione del contesto (in beta): Claude riassume da solo la parte più vecchia del contesto quando si avvicina al limite, così può continuare a lavorare;
- ragionamento adattivo: non c'è più solo la scelta tra ragionamento esteso acceso o spento, è il modello a capire quando gli serve pensare più a fondo;
- livelli di impegno: basso, medio, alto (quello predefinito) e massimo, per bilanciare qualità, velocità e costo.
Non solo per programmatori
Anthropic insiste sul lavoro d'ufficio: analisi finanziarie, ricerche, documenti, fogli di calcolo e presentazioni. Claude in Excel riceve miglioramenti importanti e arriva Claude in PowerPoint, in anteprima di ricerca, come pannello laterale dentro l'applicazione. Scott White, responsabile di prodotto di Anthropic, ha spiegato a TechCrunch che Opus è passato da strumento specializzato per lo sviluppo software a strumento utile per molti più lavoratori della conoscenza, come product manager e analisti finanziari.
Il modello è disponibile su claude.ai, tramite API e sulle principali piattaforme cloud. Anthropic dichiara il punteggio più alto del settore su Terminal-Bench 2.0, un test di programmazione con agenti, e il primo posto su Humanity's Last Exam, una prova di ragionamento multidisciplinare.
Che cosa cambia per chi progetta prompt
Con un contesto così ampio cresce la tentazione di «buttare dentro tutto». È l'errore da evitare. Più il materiale è vasto, più conta l'architettura: dire al modello che cosa sono i documenti, in che ordine leggerli e che cosa cercare.
Nei documenti che seguono trovi i contratti con tre fornitori, uno per sezione. Per ciascuno estrai durata, penali e condizioni di recesso, indicando la sezione da cui prendi ogni dato. Se un dato manca, scrivi «non presente» invece di dedurlo.
Chiedere il riferimento alla fonte e vietare le deduzioni è il modo più semplice per ridurre le allucinazioni e rendere il risultato controllabile.
Le squadre di agenti spostano il lavoro ancora più in alto. Quando più agenti si dividono un compito, la qualità dipende da come lo si scompone: chi fa cosa, con quali istruzioni, con quale criterio di consegna e chi verifica alla fine. È esattamente il lavoro di un architetto: prima di affidare un progetto a una squadra, umana o artificiale, bisogna disegnare la pianta.
Un consiglio operativo: prima di lanciare un compito lungo, scrivete un brief di mezza pagina con obiettivo, materiali, suddivisione del lavoro e criteri di verifica. Vale per un collega e vale, a maggior ragione, per una squadra di agenti.
Fonti
- Anthropic, Introducing Claude Opus 4.6, 5 febbraio 2026
- TechCrunch, Anthropic releases Opus 4.6 with new 'agent teams', 5 febbraio 2026