Modello di ragionamento

Detto anche: Reasoning model, Modello che ragiona

Un modello linguistico addestrato a produrre una catena di ragionamento interna prima della risposta finale: impiega più tempo e più token per affrontare problemi complessi a più passaggi, come matematica, codice e pianificazione.

In breve

Che cos'è un modello di ragionamento?

È un LLM addestrato a «pensare» prima di rispondere: genera una sequenza di passaggi interni in cui scompone il problema, prova strade diverse e corregge gli errori, e solo dopo scrive la risposta. Il primo esempio diffuso è o1 di OpenAI, presentato il 12 settembre 2024 nelle versioni o1-preview e o1-mini.

In che cosa è diverso da un LLM tradizionale?

Un modello tradizionale comincia subito a scrivere la risposta. Per farlo ragionare meglio si usa da tempo il ragionamento passo passo: si chiede nel prompt di procedere per gradi. In un modello di ragionamento questo comportamento è il risultato dell'addestramento. Il ragionamento consuma «token di ragionamento»: in o1 non sono visibili nella risposta dell'API, ma si pagano come token in uscita. Per questo il modello è più lento e più caro, e conviene usarlo dove il ragionamento serve davvero.

Come si scrive un prompt per un modello di ragionamento?

In modo più semplice. Le indicazioni di OpenAI per o1 sono quattro: prompt chiari e diretti, niente istruzioni su come ragionare, delimitatori per separare le parti del prompt, solo il contesto davvero rilevante. L'impegno si sposta dal metodo al risultato: obiettivo, vincoli, criteri di successo. Poiché il ragionamento resta nascosto, è utile chiedere nella risposta le ipotesi su cui si basa la conclusione.

Esempio pratico

Invece di scrivere «Ragiona passo passo: prima calcola i costi, poi aggiungi le penali, poi confronta», con un modello di ragionamento si scrive: «Scegli tra le tre offerte (tra ###) quella con il costo totale più basso su tre anni, con consegna entro 30 giorni. Restituisci la scelta, il calcolo in sintesi e i rischi principali.»

Differenze con Ragionamento passo passo

Confronto tra Modello di ragionamento e Ragionamento passo passo
AspettoModello di ragionamentoRagionamento passo passo
Dove nasce il ragionamentoNell'addestramento del modelloIn un'istruzione scritta nel prompt
VisibilitàNascosto o mostrato in sintesiVisibile nel testo della risposta
Costo e tempiPiù token e risposte più lentePochi token in più rispetto a una risposta normale

Domande frequenti

Con un modello di ragionamento devo ancora chiedere di ragionare passo passo?

No. OpenAI sconsiglia di inserire una catena di ragionamento nel prompt di o1: il modello ragiona già per conto suo e istruzioni di questo tipo possono peggiorare il risultato.

Conviene usarlo per ogni compito?

No. È più lento e più costoso: rende sui problemi a più passaggi, mentre per testi brevi, riassunti o email un modello tradizionale è più adatto.

Fonti

  1. OpenAI unveils o1, a model that can fact-check itself (2024)
  2. Notes on OpenAI's new o1 chain-of-thought models (2024)
  3. Large Language Models are Zero-Shot Reasoners (2022)

Vedi anche

Articoli che ne parlano