Ricerca: i racconti di ChatGPT hanno ottenuto punteggi più alti dai lettori rispetto a quelli scritti da esseri umani

Secondo una ricerca della Villanova University, i partecipanti non sono stati in grado di distinguere in modo affidabile tra i racconti scritti da ChatGPT e quelli scritti da autori umani nella maggior parte dei casi.

12punto

È emerso che i racconti scritti da ChatGPT sono stati considerati dai lettori, in media, più coinvolgenti e di qualità superiore rispetto a quelli scritti da autori umani. Secondo una sintesi di Euronews Türkçe, lo studio dei ricercatori della Villanova University negli Stati Uniti è stato pubblicato sulla rivista accademica *Judgment and Decision Making*.

Uno dei risultati principali della ricerca è stata la difficoltà dei partecipanti nel distinguere l'origine dei testi. Negli esperimenti, molti partecipanti non sono stati in grado di determinare in modo affidabile quale racconto fosse stato scritto dall'intelligenza artificiale.

Archivio - © AP Photo

COSA È STATO ESAMINATO NEGLI ESPERIMENTI?

Nel primo esperimento, a 1682 volontari adulti è stato fatto leggere uno di sei racconti in totale. Tre di questi racconti sono stati scritti da esseri umani e tre da ChatGPT. Ogni testo prodotto dall'intelligenza artificiale trattava lo stesso tema di uno dei racconti degli autori umani.

I ricercatori hanno comunicato ai partecipanti se il racconto letto fosse stato scritto da un essere umano o da un'intelligenza artificiale; tuttavia, questa informazione non era sempre corretta. Ad alcuni partecipanti sono state fornite intenzionalmente informazioni errate. Successivamente, è stato chiesto ai lettori di valutare il testo in termini di coinvolgimento, interesse e qualità.

Secondo i risultati, i racconti scritti da ChatGPT hanno superato quelli degli autori umani nei punteggi medi. È stato inoltre notato che i partecipanti tendevano ad assegnare un punteggio più alto a un testo quando veniva detto loro che era stato scritto da un essere umano.

Lo studio ha anche indicato che gli atteggiamenti personali verso l'intelligenza artificiale possono influenzare la valutazione. I partecipanti con opinioni più positive sull'intelligenza artificiale hanno mostrato la tendenza ad assegnare punteggi più alti ai racconti che si diceva fossero stati scritti da ChatGPT.

I ricercatori hanno poi condotto due esperimenti aggiuntivi con 905 persone. In questa fase, ai partecipanti sono stati presentati due racconti sullo stesso tema: uno scritto da un essere umano e l'altro da ChatGPT. È stato chiesto ai partecipanti di indovinare quale dei testi appartenesse all'intelligenza artificiale.

Nel primo esperimento aggiuntivo, il tasso di previsione corretta è rimasto al 40%. Nel secondo esperimento, questo tasso è stato misurato al 52%. I ricercatori hanno affermato che questi risultati dimostrano che le persone, in generale, non sono in grado di distinguere in modo affidabile tra i racconti scritti dall'intelligenza artificiale e quelli scritti da esseri umani.

Lo studio ha inoltre affermato che le autovalutazioni dei partecipanti sulla letteratura di narrativa non erano collegate al successo della previsione, mentre coloro che dichiaravano di avere maggiori conoscenze sui sistemi di intelligenza artificiale erano in grado di distinguere i testi di ChatGPT con maggiore precisione.