Modello di ragionamento
Detto anche: Reasoning model, Modello che ragiona
Un modello linguistico addestrato a produrre una catena di ragionamento interna prima della risposta finale: impiega più tempo e più token per affrontare problemi complessi a più passaggi, come matematica, codice e pianificazione.
In breve
- Ragiona prima di rispondere, con una catena di passaggi interna.
- Il primo esempio diffuso è o1 di OpenAI, presentato a settembre 2024.
- Rende meglio su matematica, codice e problemi con molti vincoli.
- È più lento e più costoso di un modello tradizionale.
- Si usa con prompt semplici, senza chiedere di ragionare passo passo.
Che cos'è un modello di ragionamento?
È un LLM addestrato a «pensare» prima di rispondere: genera una sequenza di passaggi interni in cui scompone il problema, prova strade diverse e corregge gli errori, e solo dopo scrive la risposta. Il primo esempio diffuso è o1 di OpenAI, presentato il 12 settembre 2024 nelle versioni o1-preview e o1-mini.
In che cosa è diverso da un LLM tradizionale?
Un modello tradizionale comincia subito a scrivere la risposta. Per farlo ragionare meglio si usa da tempo il ragionamento passo passo: si chiede nel prompt di procedere per gradi. In un modello di ragionamento questo comportamento è il risultato dell'addestramento. Il ragionamento consuma «token di ragionamento»: in o1 non sono visibili nella risposta dell'API, ma si pagano come token in uscita. Per questo il modello è più lento e più caro, e conviene usarlo dove il ragionamento serve davvero.
Come si scrive un prompt per un modello di ragionamento?
In modo più semplice. Le indicazioni di OpenAI per o1 sono quattro: prompt chiari e diretti, niente istruzioni su come ragionare, delimitatori per separare le parti del prompt, solo il contesto davvero rilevante. L'impegno si sposta dal metodo al risultato: obiettivo, vincoli, criteri di successo. Poiché il ragionamento resta nascosto, è utile chiedere nella risposta le ipotesi su cui si basa la conclusione.
Esempio pratico
Invece di scrivere «Ragiona passo passo: prima calcola i costi, poi aggiungi le penali, poi confronta», con un modello di ragionamento si scrive: «Scegli tra le tre offerte (tra ###) quella con il costo totale più basso su tre anni, con consegna entro 30 giorni. Restituisci la scelta, il calcolo in sintesi e i rischi principali.»
Differenze con Ragionamento passo passo
| Aspetto | Modello di ragionamento | Ragionamento passo passo |
|---|---|---|
| Dove nasce il ragionamento | Nell'addestramento del modello | In un'istruzione scritta nel prompt |
| Visibilità | Nascosto o mostrato in sintesi | Visibile nel testo della risposta |
| Costo e tempi | Più token e risposte più lente | Pochi token in più rispetto a una risposta normale |
Domande frequenti
Con un modello di ragionamento devo ancora chiedere di ragionare passo passo?
No. OpenAI sconsiglia di inserire una catena di ragionamento nel prompt di o1: il modello ragiona già per conto suo e istruzioni di questo tipo possono peggiorare il risultato.
Conviene usarlo per ogni compito?
No. È più lento e più costoso: rende sui problemi a più passaggi, mentre per testi brevi, riassunti o email un modello tradizionale è più adatto.
Fonti
Vedi anche
- LLM (Large Language Model): Un modello linguistico di grandi dimensioni (in inglese large language model, LLM) è un sistema di intelligenza artificiale addestrato su en...
- Prompt engineering: Il prompt engineering è la pratica di progettare, provare e migliorare i prompt per ottenere da un modello di intelligenza artificiale rispo...
- Ragionamento passo passo (chain of thought): Il ragionamento passo passo (in inglese chain of thought) è la tecnica di chiedere al modello di esporre i passaggi intermedi prima della ri...
- Token: Il token è il pezzo di testo con cui un modello linguistico legge e scrive: può essere una parola intera, una parte di parola, un segno di p...