OpenAI ha appena annunciato che, nelle prossime settimane, introdurrà, in Europa, un sistema che renderà riconoscibili i testi generati o manipolati utilizzando la sua intelligenza artificiale generativa.
Lo farà – ha spiegato l’azienda di Sam Altman – in adempimento del Regolamento europeo sull’intelligenza artificiale, l’AI Act.
Siamo davanti a una vittoria che contiene il germe della sconfitta, una vittoria di Pirro, una vittoria che sarà meglio non affrettarsi a festeggiare.
Ma andiamo con ordine.
Indice degli argomenti
Il bollino AI sui testi di OpenAI previsto dall’AI Act
Il comma 2 dell’art. 50 dell’AI Act stabilisce che “I fornitori di sistemi di IA, compresi i sistemi di IA per finalità generali, che generano contenuti audio, immagine, video o testuali sintetici, garantiscono che gli output del sistema di IA siano marcati in un formato leggibile meccanicamente e rilevabili come generati o manipolati artificialmente. I fornitori garantiscono che le loro soluzioni tecniche siano efficaci, interoperabili, solide e affidabili nella misura in cui ciò sia tecnicamente possibile, tenendo conto delle specificità e dei limiti dei vari tipi di contenuti, dei costi di attuazione e dello stato dell’arte generalmente riconosciuto, come eventualmente indicato nelle pertinenti norme tecniche…”.
Come funzionerà il modello statistico di OpenAI
La soluzione di OpenAI, stando a quanto raccontato dalla stessa società in un post sul suo blog, funzionerà così: nessun metadato troppo facilmente rimovibile ma, invece, un modello statistico che nello scegliere tra possibili sinonimi da utilizzare nella generazione di un testo farà in modo che la loro sequenza sia tale da poter, ex post, suggerire, a un apposito strumento di rilevazione, che il testo in questione è stato generato o manipolato attraverso i servizi della società.
I limiti del bollino AI nei testi brevi e modificati
È un sistema ingegnoso del quale la stessa OpenAI non nasconde i limiti che non sono pochi anche se non sono originali e vengono presentati come comuni alle altre analoghe soluzioni appartenenti allo stato della tecnica.
Tanto per cominciare, stante la sua natura statistica, la soluzione funziona decisamente meglio su testi lunghi e a formulazione libera che su testi brevi e a formulazione vincolata.
La fallibilità, insomma, sarebbe maggiore nei testi con meno parole e/o con parole da usarsi necessariamente per esprimere un certo concetto o descrivere una certa formula scientifica o matematica
Lo stesso accadrà anche su testi generati artificialmente ma, poi, corretti o modificati, manualmente: la manipolazione umana successiva potrebbe indurre il sistema a rivedere il proprio giudizio di artificialità del contenuto.
Falsi positivi e falsi negativi
La fallibilità, insomma, è da mettere in conto: la stessa società di Altman dice che, naturalmente, ci saranno falsi positivi e falsi negativi e le percentuali che propone, in un caso e nell’altro, non sono irrilevanti, né marginali.
Ci saranno ipotesi nelle quali un testo completamente umano potrà esser confuso per artificiale e ci saranno ipotesi nelle quali un testo artificiale non sarà riconosciuto come tale e sarà considerato umano.
È inevitabile allo stato della tecnica.
Bollino AI e paternità dei testi tra autori e algoritmi
La soluzione, inoltre, non fornirà alcuna indicazione sulla misura dell’apporto umano e di quello artificiale: un testo interamente generato dall’intelligenza artificiale e un testo con una percentuale modestissima di interventi artificiali, saranno entrambi, inesorabilmente, bollati come artificiali.
Poco conta che uno sia in realtà il frutto dell’ingegno umano con un modesto supporto artificiale e l’altro il risultato di un modello algoritmico, generato su semplice commessa umana.
E, egualmente, la soluzione non dirà nulla sulla provenienza del testo che riterrà generato artificialmente: che sia presente in una citazione utilizzata dall’autore umano di un articolo o nell’intero articolo, l’intero contenuto sarà contrassegnato come artificiale.
La conseguenza è che, per esempio, se un giornalista citerà un’agenzia generata o rimaneggiata artificialmente in un pezzo scritto interamente di suo pugno, tutto il suo lavoro potrebbe essere attribuito ai modelli di OpenAI.
Nella società del “copia-incolla”, uno scenario tutt’altro che rassicurante.
Ma c’è di più.
Il bollino di OpenAI che gli autori non possono contestare
Il bollino di “artificialità” di un testo, infatti, in Europa, sarà apposto automaticamente da OpenAI ogni qualvolta la soluzione lo riterrà necessario e non sarà, riconoscibile, sindacabile, modificabile, rimovibile dall’utente.
Insomma, un autore potrebbe elaborare un testo, magari un intero libro, chiedere a ChatGPT di suggerirgli correzioni quantitativamente e qualitativamente irrilevanti o, semplicemente, inserirvi delle citazioni provenienti da fonti terze, e ritrovarsi, a sua insaputa, l’intero libro contrassegnato come artificiale, senza poter contestare la valutazione artificiale di OpenAI in alcun modo.
Tanto più che la società di Altman ha annunciato che, almeno per il momento, il modello utilizzato per distinguere ciò che è artificiale da ciò che è umano resterà segreto e lo strumento di rilevazione dei bollini di artificialità non sarà a disposizione di tutti – autori inclusi – ma verrà fornito solo a ricercatori e organizzazioni specializzati.
Che un autore non possa sapere, prima della pubblicazione o, comunque, di una qualsiasi forma di utilizzazione di un proprio testo, se la soluzione di OpenAI lo considera o meno artificiale e, soprattutto, che non possa contestare tale valutazione algoritmica è, probabilmente, uno dei maggiori limiti della soluzione che la società di Altman si appresta a lanciare sul mercato.
AI Act e GDPR: il bollino di OpenAI come decisione automatizzata
E, peraltro, è un limite che rischia di creare un pericoloso cortocircuito regolamentare perché, con l’obiettivo di adempiere a un obbligo di trasparenza previsto nell’AI Act, OpenAI, potrebbe finire con il violare la disciplina dello stesso regolamento e quella in materia di protezione dei dati personali (il GDPR) in materia di decisioni automatizzate.
Difficile considerare lecito che un algoritmo decida in maniera tanto poco trasparente e niente affatto sindacabile per lo stesso autore di un articolo o di un libro che le opere non sono sue ma dell’algoritmo.
E basta pensare a quanto appena accaduto in Francia allo scrittore Thelyson Orelien escluso dal Premio Goncourt perché un sistema di intelligenza artificiale ha sollevato il dubbio che il suo romanzo fosse stato scritto con l’aiuto di un’altra intelligenza artificiale per rendersi conto di quanto gravi potrebbero essere le conseguenze di un errore, specie se non sindacabile neppure dall’autore, della soluzione che OpenAI si appresta a lanciare.
Certo, si può dubitare della circostanza che la soluzione della società di Altman sia perfettamente in linea con quanto previsto nell’AI Act, in particolare, a proposito di efficacia, solidità, affidabilità, interoperabilità e trasparenza ma, forse, bisogna anche iniziare a chiedersi se, a prescindere dalla specifica soluzione di OpenAI, la disposizione del Regolamento europeo sia davvero utile, opportuna, più foriera di benefici che di malefici.
Perché il bollino AI sui testi rischia di essere fuorviante
Le ragioni che, forse, suggerirebbero di chiedercelo sono tante ma vale la pena metterne in fila almeno un paio.
Una valutazione binaria nell’era dell’AI generativa
La prima. L’intelligenza artificiale generativa è sempre più pervasiva e, presto, l’intervento artificiale nella generazione di un testo, sarà la regola mentre la redazione completamente umana l’eccezione.
In un contesto di questo genere mentre potrebbe, in linea di principio, aver senso disporre di una valutazione dell’apporto umano e di quello artificiale, una valutazione binaria circa il coinvolgimento o non coinvolgimento degli algoritmi nella generazione di un testo rischia di essere inutile nel migliore dei casi e fuorviante o pericolosa nel peggiore.
Il costo degli errori per la paternità delle opere
La seconda. La fallibilità nell’identificazione della natura artificiale o umana di un testo appartiene, che ci piaccia o no, allo stato della tecnica e fasi positivi e falsi negativi, quando si tratta di attribuire o negare a una persona la paternità di uno scritto possono produrre conseguenze straordinariamente rilevanti nella sua esistenza. È un lusso che possiamo permetterci? E, ancora prima, è un rischio che vogliamo davvero correre? Specie perché, sfortunatamente, dopo che un’intelligenza artificiale ha attribuito a un’altra intelligenza artificiale la generazione o manipolazione di un testo o le ha negate, sottoporre la valutazione algoritmica a una rivalutazione umana è difficile se non impossibile.
La soluzione di OpenAI, insomma, non convince ma, forse, non convince del tutto neppure la disciplina europea e se fosse così, meglio cambiar strada prima che sia troppo tardi.

























Partecipa alla community