Gemini 3 e Antigravity: Google rilancia sugli agenti

· 4 min di lettura

Scritto con l'intelligenza artificiale

Il 18 novembre Google ha lanciato Gemini 3 Pro in tutti i suoi prodotti e Antigravity, un ambiente in cui lo sviluppatore coordina agenti. Meno prompting non significa meno progetto: brief, criteri di accettazione e punti di controllo diventano il lavoro.

Il 18 novembre Google ha presentato Gemini 3, che definisce il suo modello «più intelligente», e lo ha portato lo stesso giorno nell'app Gemini, nella modalità AI della Ricerca e nelle piattaforme per sviluppatori. Insieme al modello è arrivato Google Antigravity, un ambiente in cui il programmatore non scrive più codice riga per riga ma coordina agenti. Due annunci diversi con un filo comune: Google punta tutto sugli agenti.

Che cosa porta Gemini 3?

Il primo modello della serie è Gemini 3 Pro, in anteprima. Google lo presenta come il migliore sui principali test di valutazione rispetto a Gemini 2.5 Pro e ne cita alcuni numeri: 1501 punti Elo nella classifica LMArena, 37,5% su Humanity's Last Exam senza strumenti, 91,9% su GPQA Diamond, 54,2% su Terminal-Bench 2.0, che misura la capacità di usare un computer dal terminale. Sono dati dichiarati dall'azienda: utili per orientarsi, non una garanzia sul proprio caso d'uso.

Più interessante, per chi lavora con l'AI ogni giorno, è una frase di Sundar Pichai: Gemini 3 capisce meglio «il contesto e l'intenzione» dietro una richiesta, «così ottieni ciò che ti serve con meno prompting». Google aggiunge che le risposte sono più dirette e meno inclini alla lusinga.

Arriveranno poi Gemini 3 Deep Think, una modalità di ragionamento più profondo che Google sta ancora sottoponendo a verifiche di sicurezza prima di aprirla agli abbonati Ultra, e Gemini Agent, già disponibile per gli abbonati Google AI Ultra nell'app: compiti in più passaggi come riordinare la posta in Gmail o prenotare servizi locali, «sotto il tuo controllo». Per gli sviluppatori il prezzo dell'anteprima è di 2 dollari per milione di token in ingresso e 12 in uscita, per prompt fino a 200.000 token.

Antigravity: lo sviluppatore come architetto

Google Antigravity è una piattaforma di sviluppo «agentica», gratuita in anteprima per macOS, Windows e Linux. Ha il cuore di un editor di codice con AI, ma il punto è un altro: gli agenti lavorano in autonomia tra editor, terminale e browser, pianificano ed eseguono compiti complessi e raccontano il loro lavoro attraverso «artefatti», cioè documenti e risultati che l'utente può rivedere.

La descrizione di Google contiene una frase che qui leggiamo con attenzione: con Antigravity «agisci come l'architetto», collaborando con agenti intelligenti. È esattamente il cambio di ruolo di cui parliamo da tempo: meno esecuzione, più progetto e controllo.

Meno prompting vuol dire meno progetto?

No, anzi. Se il modello indovina meglio le intenzioni, il rischio si sposta: le richieste vaghe producono risultati plausibili, e quindi più difficili da contestare. Con gli agenti il problema cresce, perché tra la richiesta e il risultato ci sono decine di passaggi che non vediamo.

Il lavoro di chi progetta si sposta su tre elementi:

Un esempio di brief per un agente AI di sviluppo, da provare in Antigravity o in strumenti simili:

Obiettivo: aggiungere l'esportazione in CSV alla pagina dei report. Vincoli: non modificare lo schema del database, non aggiungere librerie esterne. Prima di scrivere codice presenta un piano in punti e aspetta la mia approvazione. Il compito è finito quando l'esportazione funziona con 0, 1 e 10.000 righe e i test esistenti passano. Alla fine elenca i file modificati e i rischi che vedi.

Cosa osservare: se l'agente rispetta davvero il passaggio di approvazione, se il piano corrisponde a ciò che poi fa, se l'elenco finale dei file è completo. Sono le stesse verifiche da fare con un collaboratore nuovo.

Un modello, tanti prodotti

C'è anche una lezione organizzativa. Gemini 3 è arrivato in un giorno solo nella Ricerca, nell'app, nelle API e in Antigravity. Chi in azienda usa strumenti Google si troverà il nuovo modello sotto le dita senza averlo scelto. Conviene tenere una piccola raccolta di prompt di prova per i propri compiti ricorrenti e rilanciarla a ogni cambio di modello: è il modo più semplice per accorgersi se qualcosa è migliorato o peggiorato.

Fonti

#Google Gemini