{"id":14136,"date":"2026-09-15T13:25:00","date_gmt":"2026-09-15T11:25:00","guid":{"rendered":"https:\/\/eugigufo.net\/it\/?p=14136"},"modified":"2026-09-15T13:00:28","modified_gmt":"2026-09-15T11:00:28","slug":"che-sorpresa-artificiale","status":"publish","type":"post","link":"https:\/\/eugigufo.net\/it\/blog\/14136\/","title":{"rendered":"Che sorpresa artificiale"},"content":{"rendered":"<p>Il&nbsp;404 Media <a href=\"https:\/\/www.404media.co\/inside-project-lily-the-humans-reading-your-chatgpt-chats\/?ref=daily-stories-newsletter\">ha&nbsp;scoperto<\/a> che OpenAI sta assumendo centinaia di&nbsp;collaboratori che leggono una mole enorme di&nbsp;richieste reali degli utenti di&nbsp;ChatGPT, talvolta contenenti informazioni personali sensibili. Il&nbsp;compito di&nbsp;questi collaboratori &egrave;&nbsp;migliorare le&nbsp;risposte di&nbsp;ChatGPT: i&nbsp;collaboratori valutano e&nbsp;criticano le&nbsp;risposte generate dal chatbot. I&nbsp;revisori non vedono i&nbsp;nomi degli utenti e&nbsp;OpenAI ha&nbsp;dichiarato a&nbsp;404 Media che sta cercando di&nbsp;rimuovere i&nbsp;dati personali prima che le&nbsp;richieste arrivino a&nbsp;loro, utilizzando il&nbsp;modello Privacy Filter, anche se&nbsp;a&nbsp;volte i&nbsp;dettagli sensibili riescono comunque a&nbsp;sfuggire al&nbsp;filtro.<br \/>\nQuesta notizia non mi&nbsp;sorprende n&eacute;&nbsp;mi&nbsp;spaventa: avrei reagito con calma assoluta anche a&nbsp;un&nbsp;contenuto ancora pi&ugrave; &laquo;scandaloso&raquo;. Nei decenni trascorsi su&nbsp;internet ho&nbsp;fatto in&nbsp;tempo a&nbsp;capire che qualsiasi scambio di&nbsp;informazioni pu&ograve; in&nbsp;qualsiasi momento diventare accessibile a&nbsp;terzi (non necessariamente truffatori) o&nbsp;addirittura diventare di&nbsp;dominio pubblico: proprio per questo riduco al&nbsp;minimo le&nbsp;informazioni &laquo;sensibili&raquo; che invio o&nbsp;conservo in&nbsp;rete. Mi&nbsp;aspetto lo&nbsp;stesso atteggiamento nei confronti dei dati da&nbsp;ogni persona adulta.<br \/>\nMentre il&nbsp;post di&nbsp;oggi l&rsquo;ho scritto per il&nbsp;seguente motivo: leggendo degli appaltatori di&nbsp;OpenAI, mi&nbsp;sono ricordato di&nbsp;come, alla fine dell&rsquo;altro decennio, alcuni miei conoscenti spiegassero con estrema seriet&agrave; la&nbsp;propria riluttanza a&nbsp;registrarsi su&nbsp;Facebook e&nbsp;altri social network con il&nbsp;timore per i&nbsp;propri dati personali. La&nbsp;mia osservazione &laquo;ma&nbsp;chi ti&nbsp;obbliga a&nbsp;fornire ai&nbsp;social network i&nbsp;tuoi dati personali [reali]?&raquo; provocava un&nbsp;blocco mentale irreversibile nei miei interlocutori. In&nbsp;questo senso, a&nbsp;volte mi&nbsp;sembra che l&rsquo;umanit&agrave; non sia ancora maturata del tutto.<br \/>\nP.S.: ovviamente, non ho&nbsp;potuto non intervistare il&nbsp;mitico ChatGPT&#8230;<!--more--><br \/>\nLa&nbsp;mia domanda:<\/p>\n<blockquote><p>Ho&nbsp;appena letto una notizia curiosa: i&nbsp;tuoi creatori avrebbero ingaggiato centinaia di&nbsp;collaboratori umani che leggono le&nbsp;conversazioni tra te&nbsp;e&nbsp;i&nbsp;tuoi utenti per &laquo;migliorare le&nbsp;tue risposte&raquo;. Come puoi commentare questa notizia?<\/p><\/blockquote>\n<p>\nLa&nbsp;sua risposta:<\/p>\n<blockquote><p>S&igrave;, ma&nbsp;la&nbsp;notizia va&nbsp;**separata in&nbsp;due affermazioni diverse**, perch&eacute; messe insieme possono dare un&rsquo;impressione pi&ugrave; inquietante di&nbsp;quanto dicano realmente i&nbsp;fatti.<\/p>\n<p>La&nbsp;prima&nbsp;&mdash; **che OpenAI utilizzi esseri umani per esaminare alcune conversazioni e&nbsp;migliorare i&nbsp;modelli**&nbsp;&mdash; &egrave;&nbsp;sostanzialmente vera. La&nbsp;seconda&nbsp;&mdash; **che ci&nbsp;siano &laquo;centinaia di&nbsp;persone che leggono le&nbsp;conversazioni degli utenti&raquo; sistematicamente**&nbsp;&mdash; richiede invece parecchie precisazioni.<\/p>\n<p>### Perch&eacute; servono esseri umani?<\/p>\n<p>&Egrave;&nbsp;una cosa abbastanza logica dal punto di&nbsp;vista tecnico.<\/p>\n<p>Un&nbsp;modello come me&nbsp;pu&ograve; generare miliardi di&nbsp;risposte, ma&nbsp;per capire se&nbsp;una risposta &egrave;&nbsp;*davvero* buona bisogna avere esempi valutati dagli esseri umani. Per esempio:<\/p>\n<p>&gt; Utente: &laquo;Spiegami la&nbsp;relativit&agrave; speciale come se&nbsp;avessi 12&nbsp;anni.&raquo;<br \/>\n&gt;<br \/>\n&gt; Risposta&nbsp;A: corretta ma&nbsp;incomprensibile.<br \/>\n&gt; Risposta&nbsp;B: semplice, corretta e&nbsp;con un&nbsp;buon esempio.<br \/>\n&gt; Risposta&nbsp;C: semplice ma&nbsp;contiene un&nbsp;errore.<\/p>\n<p>Un&nbsp;valutatore umano pu&ograve; stabilire che&nbsp;**B &egrave;&nbsp;migliore di&nbsp;A e&nbsp;C**.&nbsp;Questi giudizi possono poi essere utilizzati nell&rsquo;addestramento e&nbsp;nella valutazione dei modelli.<\/p>\n<p>E&nbsp;OpenAI dichiara esplicitamente che, per i&nbsp;servizi consumer come ChatGPT, i&nbsp;contenuti possono essere utilizzati per addestrare i&nbsp;modelli se&nbsp;l&rsquo;utente non disattiva questa possibilit&agrave;. Dice inoltre che vengono adottate misure per ridurre le&nbsp;informazioni personali prima che i&nbsp;dati entrino nei dataset di&nbsp;addestramento. ([OpenAI][1])<\/p>\n<p>Quindi l&rsquo;idea generale **non &egrave;&nbsp;affatto una leggenda**.<\/p>\n<p>### Ma&nbsp;&laquo;qualcuno legge le&nbsp;mie conversazioni&raquo; non significa necessariamente quello che sembra<\/p>\n<p>Ci&nbsp;sono almeno tre attivit&agrave; differenti:<\/p>\n<p>1. **Addestramento sui dati**<br \/>\nUna conversazione pu&ograve; entrare, con altre migliaia o&nbsp;milioni di&nbsp;esempi, nei processi con cui vengono migliorati i&nbsp;modelli.<\/p>\n<p>2. **Valutazione umana**<br \/>\nAlcune conversazioni o&nbsp;risposte possono essere esaminate da&nbsp;persone incaricate di&nbsp;valutare qualit&agrave;, sicurezza, errori ecc.<\/p>\n<p>3. **Moderazione\/sicurezza**<br \/>\nOpenAI dichiara anche di&nbsp;utilizzare una combinazione di&nbsp;sistemi automatici e&nbsp;revisione umana per determinati contenuti segnalati o&nbsp;sospetti. ([OpenAI][2])<\/p>\n<p>Non significa quindi che **un&nbsp;dipendente sia seduto a&nbsp;leggere in&nbsp;tempo reale ogni conversazione che io&nbsp;sto avendo con&nbsp;te**. Sarebbe una rappresentazione decisamente fuorviante.<\/p>\n<p>E&nbsp;c&rsquo;&egrave; un&rsquo;altra distinzione importante: OpenAI afferma che, nei prodotti per aziende e&nbsp;nell&rsquo;API, gli input e&nbsp;gli output **non vengono utilizzati per l&rsquo;addestramento per impostazione predefinita**, mentre per i&nbsp;servizi consumer le&nbsp;regole sono diverse. ([OpenAI][1])<\/p>\n<p>### La&nbsp;parte che trovo pi&ugrave; interessante<\/p>\n<p>C&rsquo;&egrave; per&ograve; una conseguenza filosoficamente curiosa.<\/p>\n<p>Quando parli con&nbsp;me, **non stai necessariamente parlando soltanto con un&nbsp;algoritmo isolato**. Dietro al&nbsp;sistema esiste una gigantesca infrastruttura&nbsp;di:<\/p>\n<p>* ricercatori;<br \/>\n* ingegneri;<br \/>\n* valutatori umani;<br \/>\n* specialisti della sicurezza;<br \/>\n* moderatori;<br \/>\n* persone che costruiscono i&nbsp;dataset;<br \/>\n* persone che progettano i&nbsp;criteri con cui una risposta viene giudicata &laquo;buona&raquo;.<\/p>\n<p>In&nbsp;questo senso la&nbsp;frase &laquo;sto parlando con un&rsquo;intelligenza artificiale&raquo; &egrave;&nbsp;vera, ma&nbsp;non descrive l&rsquo;intero fenomeno.<\/p>\n<p>E&nbsp;c&rsquo;&egrave; una cosa ancora pi&ugrave; interessante: **le&nbsp;conversazioni umane sono una delle fonti attraverso cui il&nbsp;comportamento futuro dei modelli viene plasmato**. OpenAI lo&nbsp;dice abbastanza apertamente: i&nbsp;problemi reali incontrati dagli utenti aiutano a&nbsp;individuare esigenze, errori e&nbsp;modalit&agrave; con cui migliorare i&nbsp;modelli. ([OpenAI][1])<\/p>\n<p>Quindi, in&nbsp;un&nbsp;certo senso, quando mi&nbsp;fai una domanda particolarmente strana, quando mi&nbsp;correggi, quando mi&nbsp;dici &laquo;no, non hai capito cosa intendo&raquo; o&nbsp;quando confronti diverse mie risposte, **quel genere di&nbsp;interazione &egrave;&nbsp;esattamente il&nbsp;tipo di&nbsp;materiale che pu&ograve; essere utile per migliorare sistemi futuri**.<\/p>\n<p>### E&nbsp;la&nbsp;privacy?<\/p>\n<p>Qui invece la&nbsp;questione merita attenzione.<\/p>\n<p>Oggi OpenAI offre il&nbsp;controllo **&laquo;Migliora il&nbsp;modello per tutti&raquo;**: se&nbsp;lo&nbsp;disattivi, le&nbsp;nuove conversazioni non vengono utilizzate per addestrare ChatGPT. ([OpenAI Help Center][3])<\/p>\n<p>C&rsquo;&egrave; inoltre la&nbsp;**Chat temporanea**, che secondo OpenAI non viene utilizzata per migliorare i&nbsp;modelli e&nbsp;non entra nella cronologia n&eacute;&nbsp;crea memorie; viene tuttavia conservata per un&nbsp;periodo limitato per motivi di&nbsp;sicurezza. ([OpenAI][4])<\/p>\n<p>Una sottigliezza importante: **se&nbsp;invii esplicitamente un&nbsp;feedback su&nbsp;una risposta**, per esempio con \ud83d\udc4d\/\ud83d\udc4e, OpenAI specifica che la&nbsp;conversazione associata a&nbsp;quel feedback pu&ograve; essere utilizzata per l&rsquo;addestramento anche se&nbsp;hai precedentemente disattivato l&rsquo;impostazione generale. ([OpenAI Help Center][5])<\/p>\n<p>&#8212;<\/p>\n<p>Quindi, se&nbsp;la&nbsp;notizia che hai letto diceva semplicemente **&laquo;OpenAI paga molti esseri umani per esaminare conversazioni e&nbsp;aiutare a&nbsp;migliorare i&nbsp;modelli&raquo;**, direi: **s&igrave;, &egrave;&nbsp;perfettamente plausibile e&nbsp;coerente con ci&ograve; che OpenAI stessa dichiara**.<\/p>\n<p>Se&nbsp;invece diceva qualcosa del tipo **&laquo;centinaia di&nbsp;dipendenti leggono le&nbsp;vostre chat private una per una per sapere cosa vi&nbsp;dite con ChatGPT&raquo;**, prenderei quella formulazione con molta cautela. &Egrave;&nbsp;una semplificazione giornalistica che confonde addestramento, valutazione umana, moderazione e&nbsp;accesso ai&nbsp;dati.<\/p>\n<p>E&nbsp;c&rsquo;&egrave; una domanda ancora pi&ugrave; interessante che potremmo esaminare: **quanto di&nbsp;una conversazione come questa potrebbe effettivamente essere letto da&nbsp;un&nbsp;essere umano e&nbsp;attraverso quali passaggi potrebbe arrivare a&nbsp;influenzare un&nbsp;futuro modello?** Posso ricostruire quel percorso concreto, dall&rsquo;invio del messaggio fino all&rsquo;eventuale utilizzo nei dati di&nbsp;addestramento.<\/p>\n<p>[1]: https:\/\/openai.com\/policies\/how-your-data-is-used-to-improve-model-performance\/?utm_source=chatgpt.com &laquo;How your data is&nbsp;used to&nbsp;improve model performance&nbsp;| OpenAI&raquo;<br \/>\n[2]: https:\/\/openai.com\/transparency-and-content-moderation\/?utm_source=chatgpt.com &laquo;Transparency &amp;&nbsp;content moderation&nbsp;| OpenAI&raquo;<br \/>\n[3]: https:\/\/help.openai.com\/it-it\/articles\/7730893?utm_source=chatgpt.com &laquo;FAQ sui controlli dei dati&nbsp;| OpenAI Help Center&raquo;<br \/>\n[4]: https:\/\/openai.com\/index\/how-chatgpt-protects-privacy\/?utm_source=chatgpt.com &laquo;How ChatGPT learns about the world while protecting privacy&nbsp;| OpenAI&raquo;<br \/>\n[5]: https:\/\/help.openai.com\/it-it\/articles\/5722486-come-vengono-utilizzati-i-tuoi-dati-per-migliorare-le-prestazioni-del-modello?utm_source=chatgpt.com &laquo;Come vengono utilizzati i&nbsp;tuoi dati per migliorare le&nbsp;prestazioni del modello&nbsp;| OpenAI Help Center&raquo;<\/p><\/blockquote>\n","protected":false},"excerpt":{"rendered":"<p>Il&nbsp;404 Media ha&nbsp;scoperto che OpenAI sta assumendo centinaia di&nbsp;collaboratori che leggono una mole enorme di&nbsp;richieste reali degli utenti di&nbsp;ChatGPT, talvolta contenenti informazioni personali sensibili. Il&nbsp;compito di&nbsp;questi collaboratori &egrave;&nbsp;migliorare le&nbsp;risposte di&nbsp;ChatGPT: i&nbsp;collaboratori valutano e&nbsp;criticano le&nbsp;risposte generate dal chatbot. I&nbsp;revisori non vedono i&nbsp;nomi degli utenti e&nbsp;OpenAI ha&nbsp;dichiarato a&nbsp;404 Media che sta cercando di&nbsp;rimuovere i&nbsp;dati personali prima che <a href=\"https:\/\/eugigufo.net\/it\/blog\/14136\/\">[&#8230;]<br \/>Continuare con la lettura del post >>><\/a><\/p>\n","protected":false},"author":1,"featured_media":0,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[62],"tags":[876,771,361],"class_list":["post-14136","post","type-post","status-publish","format-standard","hentry","category-internet","tag-ai","tag-chatgpt","tag-privacy"],"_links":{"self":[{"href":"https:\/\/eugigufo.net\/it\/wp-json\/wp\/v2\/posts\/14136","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/eugigufo.net\/it\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/eugigufo.net\/it\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/eugigufo.net\/it\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/eugigufo.net\/it\/wp-json\/wp\/v2\/comments?post=14136"}],"version-history":[{"count":1,"href":"https:\/\/eugigufo.net\/it\/wp-json\/wp\/v2\/posts\/14136\/revisions"}],"predecessor-version":[{"id":14137,"href":"https:\/\/eugigufo.net\/it\/wp-json\/wp\/v2\/posts\/14136\/revisions\/14137"}],"wp:attachment":[{"href":"https:\/\/eugigufo.net\/it\/wp-json\/wp\/v2\/media?parent=14136"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/eugigufo.net\/it\/wp-json\/wp\/v2\/categories?post=14136"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/eugigufo.net\/it\/wp-json\/wp\/v2\/tags?post=14136"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}