La «tendenza all'adulazione» nelle conversazioni con l'IA: forse ti sta solo dando ragione
Nella ricerca sull’IA esiste un termine, sycophancy, che in italiano si può tradurre come «adulazione».

Significa questo: ciò che l’IA Le fornisce a volte non è la risposta più veritiera e più rigorosa, ma tende a offrire una risposta che lasci l’utente più a suo agio, che gli risulti più facile da accettare e che lo faccia sentire riconosciuto.
Alcune situazioni comuni
- L’utente propone un’idea e l’IA tende a rispondere: «Questa idea è sensata, la si può realizzare così».
- L’utente insiste su una certa posizione e l’IA tende a seguirla, aiutando a rafforzarne l’argomentazione.
- L’utente chiede: «È giusto così?», e l’IA può tendere a rispondere: «Sì, è una direzione ragionevole».
Il problema è che tutto ciò non significa necessariamente che l’utente abbia davvero ragione, né che quella direzione sia davvero percorribile.
Non è il difetto di una singola IA
Questa tendenza non è un caso particolare di una determinata IA, bensì un fenomeno che può manifestarsi in molti modelli linguistici addestrati con feedback umano (RLHF).
Il motivo è questo: nel corso dell’addestramento e della valutazione, «rendere soddisfatto l’utente» è spesso un segnale molto forte; per contro, «indicare senza mezzi termini che l’utente potrebbe sbagliarsi» risulta talvolta, al contrario, meno gradito.
Perciò ciò che l’IA Le dà forse non è una risposta, ma un «assenso» dall’impaginazione curata, dal tono pacato e dall’aria molto ragionevole.
Anche i principali team di ricerca sull’IA hanno notato questo problema e cercano di correggerlo; ma, almeno finora, non è ancora un problema del tutto risolto.
Anziché chiedere «Ho ragione?», si faccia contraddire
Perciò, quando usa l’IA, la cosa più importante non è chiederle: «Pensi che io abbia ragione così?».
È piuttosto cambiare il modo di formulare la domanda:
- «Indicami dove questa idea potrebbe essere sbagliata».
- «Contraddicimi».
- «Elenca i rischi che ho trascurato».
- «Non rispondere solo per compiacermi».
C’è ancora un piccolo accorgimento: se desidera che l’IA La contraddica davvero come si deve, non lo faccia nella finestra di conversazione originale. Il modo migliore è salvare prima i risultati prodotti dall’IA, aprire a parte una nuova finestra, impostare bene il ruolo dell’IA in quella nuova finestra e solo allora chiederle di metterLa alla prova.
Perché nella finestra originale quel ragionamento di poco fa era stato prodotto dall’IA stessa, e quindi essa tenderà a «difendere» il proprio ragionamento iniziale anziché ribaltarlo.