nexa
By thread
nexa@server-nexa.polito.it
By month
Messages by month
- ----- 2026 -----
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2025 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2024 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2023 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2022 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2021 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2020 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2019 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2018 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2017 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2016 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2015 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2014 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2013 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2012 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2011 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2010 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2009 -----
- December
- November
- October
- September
- August
- July
- June
- May
- 5 participants
- 30636 messages
Re: [nexa] ChatGPT disabled for users in Italy
by Giacomo Tesio
Ciao Guido,
trovo veramente affascinante (quanto inquietante) questo passaggio
della tua email:
On Tue, 4 Apr 2023 06:52:24 +0200 Guido Vetere wrote:
> Tutto questo è corretto, tranne il riferimento alle "stronzate"
> (*bullshit*) di Frankfurt: queste infatti sono affermazioni capziose
> pronunciate con intento manipolatorio, insomma dietro una "stronzata"
> c'è sempre uno "stronzo", cioè un soggetto dotato di intenzionalità,
> cosa di cui ChatGPT dichiara onestamente di essere privo.
Come diversi informatici in lista ti possono confermare, lo "stronzo"
dietro un software è sempre chi lo programma e ne controlla
l'esecuzione.
Un software infatti applica all'ambiente SEMPRE e ANZITUTTO la volontà
di chi l'ha programmato (e nel caso di un SaaS, eseguito),
riproducendola ed imponendola a tutti coloro che sono parte, volenti o
nolenti, della organizzazione cibernetica in cui tale software opera.
Nel caso di ChatGPT, lo "stronzo" (nel senso di Frankfurt) è Open AI.
Nel caso di GitHub Copilot, lo "stronzo" è GitHub.
Entrambi si leggono "Microsoft".
Nel caso di Google Assistant, lo "stronzo" è Google/Alphabet.
Nel caso dei risultati di ricerca o delle news "personalizzate" fornite
dai servizi di Google, lo "stronzo" è Google/Alphabet.
Nel caso della timeline Instagram o Facebook, lo "stronzo" è Facebook.
Nel caso della timeline TikTok, lo "stronzo" è TikTok.
Nel caso dell'amica virtuale "Replika", lo "stronzo" è Luka, Inc.
Nel caso dell'osservatorio di Monitora PA, lo "stronzo" sono io.
(e con me i molti che contribuiscono al suo sviluppo...)
Il punto è: che si tratti di bug (come può essere un falso positivo
prodotto dall'osservatorio di Monitora PA) o di scelte progettuali
c'è sempre almeno un essere umano di cui il software riproduce
pedissequamente la volontà.
Questa volontà può essere impressa nel software in modo relativamente
trasparente tramite la programmazione linguistica (ad esempio in Python
o in C) oppure essere impressa nel software in modo opaco, attraverso
la selezione dei dati da utilizzare per la programmazione statistica
e la progettazione della topologia della vector reducing machine che
verrà programmata statisticamente.
Ora, tutti gli "stronzi" qui presenti che abbiano mai realizzato un
software in prima persona, potranno confermarti di esistere.
Alcuni saranno ben lieti di non dover rispondere delle proprie
creazioni, mentre altri si sentiranno oltraggiati dall'idea che
qualcuno possa ignorare la propria esistenza come autori di quelle
creazioni.
Ma tutti saranno consapevoli di aver LAVORATO per realizzare la
sequenza di bit che le macchine elaborano automaticamente per produrre
gli effetti che loro desiderano.
Il contributo dell'utente alla produzione dell'output di un software
è completamente determinato dal programmatore e può variare moltissimo
a seconda del software.
Nel caso di ChatGPT, è oggettivamente trascurabile.
Per questa ragione, la responsabilità dell'output NON PUO' essere
scaricata sull'utente con un banale disclaimer!
Quando leggo che "ChatGPT dichiara ONESTAMENTE di essere privo" di
intenzionalità mi chiedo sinceramente se ci sia una qualche forza
all'opera dietro questa allucinazione collettiva, dietro questa
cancellazione delle persone che realizzano la macchina dalla
tua coscienza, a cui gli sviluppatori siano talmente immuni
da non percepirla.
No: chi ha scritto quel disclaimer NON è onesto.
E non è stato Chat GPT a scrivere quel disclaimer.
Noti come Open AI sta manipolando la tua percezione della realtà?
Forse il semplice fatto di essere capaci a programmare
statisticamente un software (e magari averlo programmato),
rende naturalmente immuni a questa allucinazione.
Eppure si deve trattare di un'allucinazione molto forte se, come
osservo qui, persone intelligenti ed in buona fede continuano a
sostenerla NONOSTANTE altre persone, autorevoli, intelligenti ed
altrettanto in buona fede, ma con una maggiore consapevolezza tecnica
della questione, continuano a ripetere che il software è sempre
realizzato da esseri umani e ne riproduce valori e interessi.
Ti prego di riflettere sulla questione: io esisto, Open AI esiste,
Microsoft esiste, Google esiste etc... cosa ti costringe a cancellare
la nostra esistenza dalla tua coscienza quando guardi un artefatto che
realizza pedissequamente la nostra volontà?
Certo, una volta realizzato, un software diventa un agente cibernetico
automatico, che "si muove da sé". Ma non è mai autonomo.
Anche quando varia il proprio stato interno in funzione dell'input,
tale variazione è sempre meccanicamente determinata dalla sua
programmazione (per quanto complessa e opaca sia essa sia).
Anche quando tale stato interno viene utilizzato insieme ad ogni
nuovo input per calcolare nuovi output e nuove variazioni dello stato
interno, ogni output e ogni variazione dello stato interno è
meccanicamente determinato da chi ha programmato il software.
Dunque l'agente cibernetico automatico non è MAI autonomo.
On Mon, 3 Apr 2023 20:18:55 +0200 Guido Vetere wrote:
> La difficoltà qui risiede nel fatto di aver a che fare con oggetti
> privi di intenzionalità che tuttavia producono locuzioni a cui,
> antropologicamente, attribuiamo in effetti intenzionalità. Se gli
> sviluppatori o gli esercenti di questi oggetti dovessero rispondere
> di questa intenzionalità fittizia, farebbero bene a dedicarsi ad
> altro.
In assenza di tale autonomia, l'assenza di intenzionalità è
irrilevante: il software riproduce le intenzioni di chi l'ha
realizzato e ha deciso come deve essere usato.
On Mon, 3 Apr 2023 20:18:55 +0200 Guido Vetere wrote:
> Ma se passasse questa linea dovremmo spegnere tutti i generatori
> basati (solo) su LLM: anche se addestrati sui dati più puri del
> mondo, la probabilità che generino 'utterances' censurabili non
> sarebbe mai nulla.
Beh non è detto: è sufficiente che ciascuno usi i LLM che realizza.
In tal modo, l'intenzionalità (e la responsabilità legale) è tutta
perfettamente determinata.
Giacomo
April 4, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Marco A. Calamari
On mar, 2023-04-04 at 06:52 +0200, Guido Vetere wrote:
> > Questo e altro sull'articolo di oggi di Walter Vannini apparso su:
> > https://www.agendadigitale.eu/sicurezza/privacy/stop-a-chatgpt-per-fortuna-
> il-garante-e-vivo-e-lotta-insieme-a-noi/
>
> Grazie per aver segnalato questo intervento di Walter Vannini, che dopo aver
> perorato la causa del Garante sembra suggerire che basterebbe un buon
> disclaimer per mettere a posto le cose, e ne fornisce un esempio:
>
> chatGPT genera testo che, a livello sintattico, è inerente alla tua richiesta.
> Questo testo può essere o non essere, in modo del tutto casuale,
> corrispondente al senso che tu attribuisci alle parole che hai usato. Allo
> stesso modo, il testo prodotto da chatGPT può corrispondere o non
> corrispondere a fatti o eventi reali, pur essendo sempre grammaticalmente
> impeccabile e formulato in modo da sembrare autorevole. ChatGPT non possiede,
> per scelta dei suo sviluppatori, alcun concetto di “verità” o alcun modello di
> conoscenza ed è quindi strutturalmente incapace di distinguere il vero dal
> falso. Per questo motivo possiamo dire che chatGPT non mente, perché nel suo
> codice verità e falsità sono indistinguibili, ma si limita a dire stronzate,
> nella definizione del professor Frankfurt, cioè a fare affermazioni del tutto
> plausibili senza alcun vincolo di realtà.
>
> Tutto questo è corretto, tranne il riferimento alle "stronzate" (bullshit) di
> Frankfurt: queste infatti sono affermazioni capziose pronunciate con intento
> manipolatorio, insomma dietro una "stronzata" c'è sempre uno "stronzo", cioè
> un soggetto dotato di intenzionalità, cosa di cui ChatGPT dichiara onestamente
> di essere privo.
Salve a tutti,
se è gradito (e ne sono lieto) citare qui DataKnightmare, allora, per chi fosse
interessato, anche Cassandra avrebbe da dire la sua ...
https://medium.com/@calamarim/cassandra-crossing-ia-fabbriche-di-informazio…
>
> Ma se è vero che basterebbe presentare sotto la giusta luce il comportamento
> del sistema, non sarà che la "stronzata" diventa allora il provvedimento del
> Garante? E' per il fatto che la società OpenAI è ambigua (e sì, forse anche
> "stronza") nel presentare ChatGPT come potenziale "oracolo" (mi riferisco in
> particolare al lancio di GPT-4) che oggi chi si trova in Italia anche di
> passaggio deve pagare una VPN per farsi generare uno snippet html o farsi dare
> una ricetta di cucina?
>
> Buona giornata e grazie a tutti per la discussione.
>
> Guido
>
>
>
> On Tue, 4 Apr 2023 at 00:53, Giacomo Tesio <giacomo(a)tesio.it> wrote:
> > Salve Carlo,
> >
> > ciò che non è legale per un essere umano, non deve esserlo nemmeno per
> > un automatismo creato o amministrato da un essere umano.
> > Pena la fine dello stato di diritto.
> >
> >
> > Ma prima di provare a spiegare cosa non regge della tua analisi, vorrei
> > porti una domanda: perché senti questa urgenza di difendere un software?
> >
> > Davvero, ti prego di rifletterci e rispondere perché sono sinceramente
> > curioso sui tuoi moventi profondi. E' probabile che mi aiutino a
> > comprendere i miei.
> >
> >
> > On Mon, 3 Apr 2023 17:56:41 +0200 Carlo Blengino wrote:
> >
> > > I dati generati da ChatGPT ed in generale dalle attuali forme di AI
> > > Generativa, anche per immagini come Dall-e, anche quando
> > > apparentemente riferibili ad una persona fisica identificata o
> > > identificabile, *non dovrebbero mai esser considerati dati
> > > personali*, e ciò a prescindere dalla loro verità/falsità o dalla
> > > loro più o meno marcata aderenza alla realtà.
> > >
> > > Sono dati sintetici che non rappresentano altro se non loro stessi.
> >
> > Per efficienza, proviamo a partire da due semplici definizioni:
> >
> > - informazione: esperienza soggettiva di pensiero comunicabile
> > - dato: rappresentazione (su un supporto trasferibile) interpretabile
> > come informazione da una mente umana
> >
> > L'informazione esiste solo nelle nostre menti e non esce mai dai nostri
> > crani, ma grazie al linguaggio abbiamo inventato un protocollo che ci
> > permette di sincronizzare le nostre menti, ricreando nella mente del
> > destinatario un informazione analoga (ma mai identica) a quella
> > condivisa da un mittente.
> >
> > Il dato è una rappresentazione, ovvero (per semplificare) un insieme di
> > simboli che imprimiamo o facciamo imprimere su un supporto trasferibile
> > nello spazio o nel tempo, affinché siano interpretati come informazione
> > da una o più altre menti umane, lontane nello spazio o nel tempo.
> >
> > Questa definizione, prettamente informatica, di "dato" coincide con la
> > definizione che hai condiviso da un punto di vista giuridico:
> >
> > > Per comprendere l’affermazione, forse azzardata, è bene definire cosa
> > > è un dato per il diritto: il dato è *una rappresentazione di fatti,
> > > informazioni o concetti*. Il dato informatico è sin dalla Convenzione
> > > di Budapest del 2001 definito come una “presentazione di fatti,
> > > informazioni o concetti in forma suscettibile di essere utilizzata in
> > > un sistema computerizzato…”
> >
> > Presentazione e rappresentazione sono produzioni umane.
> >
> > La forma suscettibile di essere utilizzata in un sistema computerizzato
> > è ormai del tutto irrilevante: in qualsiasi forma un'informazione
> > (fatti, informazioni o concetti) venga presentata, è possibile
> > costruire un software in grado di utilizzarla.
> >
> > Omessa questa specificazione ormai irrilevante, le due definizioni
> > coincidono.
> >
> >
> > > Le creazioni di questi sistemi, da quel che ho capito, anche quando
> > > appaiono “dati” personali, rappresentano unicamente loro stessi,
> > > ovvero una sequenza di parole o numeri o di pixels, e null’altro.
> >
> > L'output di un software è sempre un dato.
> >
> > Anche una sequenza casuale di simboli è un dato (peraltro estremamente
> > prezioso, se realmente casuale).
> >
> > Non solo perché rappresenta sempre qualcosa di interpretabile, come
> > minimo, come l'applicazione di un certo numero di trasformazioni ad un
> > certo input.
> >
> > E' un dato perché è interpretabile dall'uomo secondo il significato che
> > chi ha progettato, realizzato e documentato il software che lo ha
> > prodotto, vuole che gli sia attribuito.
> >
> >
> > Nel caso di ChatGPT, tale significato è letteralmente il significato
> > che la tua mente vi attribuisce leggendolo.
> >
> > Quel software è stato realizzato da qualcuno con la precisa intenzione
> > di far produrre un output che la tua mente interpreti come informazione.
> >
> > Dunque non solo la tua mente interpreta i dati di quell'output come
> > informazione, ma chi ha realizzato e mantiene in esecuzione quel
> > software è il mittente di quel messaggio, dell'informazione veicolata
> > da quell'output.
> >
> >
> > Questo rimane vero qualunque disclaimer Open AI possa mettere
> > all'ingresso dell'applicazione.
> >
> >
> > Quello che leggi è e rimane un dato prodotto per conto di qualcuno
> > (Open AI, Microsoft etc...) affinché la tua mente lo riesca ad
> > interpretare come informazione.
> >
> > Il fatto che nessuno, dentro Open AI, abbia materialmente espresso la
> > sequenza di parole che leggi è irrilevante: hanno espresso il software
> > che lo ha prodotto al loro posto e per loro volontà.
> >
> >
> > Sono loro gli autori dell'output di GPT4.
> >
> >
> > Se io scrivessi un software che, quando eseguito, produce in output una
> > poesia come combinazione di una serie di versi che io ho scritto, tu
> > non avresti problemi (credo) a riconoscere in me sia l'autore del
> > software che l'autore dell'opera prodotta dal software stesso.
> >
> > E questo rimarrebbe vero se anche la sequenza prodotta non
> > corrispondesse (magari a causa di un bug) a quella che io avevo in
> > mente durante la scrittura del software.
> >
> > E se le sequenze possibili fossero N, tutte previste dal mio codice,
> > non avresti comunque problema a riconoscere me sia come autore del
> > software sia come autore delle opere da esso prodotte in output.
> >
> > Il software, di fatto, sarebbe una forma compressa di quelle
> > N opere in output.
> >
> >
> > Con ChatGPT è esattamente la stessa cosa.
> > L'unica differenza è che nessuno si vuole assumere la responsabilità di
> > quell'output perché chi l'ha programmato non si è preoccupato delle
> > conseguenze e degli errori.
> >
> >
> > Ora, appurato che l'output di ChatGPT è un dato (in quanto
> > rappresentazione INTERPRETABILE come informazione) dobbiamo chiarire se
> > possa essere un dato personale.
> >
> > In questo caso, come già chiarito da Benedetto Ponti, se il dato fa
> > riferimento (ovvero può essere interpretato da una mente umana come
> > facente riferimento) ad una persona fisica identifica o identificabile,
> > allora è un dato personale.
> >
> > Che sia vero, falso o NULL (con un valore di verità ignoto al lettore)
> > è irrilevante: quel dato produce nella mente di chi lo legge
> > un'informazione riferita ad una persona.
> >
> >
> > Tale persona, va protetta.
> >
> > Il fatto che ChatGPT non abbia intenzionalità è irrilevante: è uno
> > strumento creato da persone con intenzioni precise, e attua
> > costantemente tali intenzioni.
> >
> >
> > Dunque, non dobbiamo proteggere le persone da ChatGPT, ma da chi lo ha
> > creato e lo controlla.
> >
> > In un mondo in cui un software sufficientemente opaco può violare i
> > diritti delle persone, chi li può produrre e controllare sarebbe
> > sempre al di sopra della legge.
> >
> >
> > Scaricare la responsabilità delle violazioni del diritto d'autore o del
> > diritto alla protezione dei dati personali sugli utilizzatori del
> > software è veramente ridicolo.
> >
> > Il loro contributo alla produzione dell'output è quasi irrilevante se
> > confrontato con l'enorme lavoro di programmazione statistica e l'enorme
> > quantità di dati e di energia utilizzati per la produzione del software
> > e del suo output. Output che, non dimentichiamolo, riproduce
> > token/lemmi/parole presenti nel proprio enorme "binario matriciale".
> >
> >
> > > Trovo invece un po’ folle pensare di attenzionare le risposte
> > > sbagliate, attribuendo a quei non-dati uno status di tutela che, a
> > > mio giudizio, allo stato dell’arte, non dovrebbero avere.
> >
> > No attenzione: gli output contenenti dati personali (veri o falsi che
> > siano) sono solo uno dei problemi.
> >
> > C'è l'utilizzo di dati personali durante la programmazione statistica
> > senza un esplicito permesso degli interessati nonché la pretesa
> > impossibilità di esercitare il diritto ad eliminare quei dati dal
> > modello (impossibilità che non esiste: basta rifare la programmazione
> > statistica senza, per quanto costoso possa essere) o l'impossibilità di
> > emendare dati errati.
> >
> > Un software che non possa strutturalmente rispettare i diritti umani
> > semplicemente non va eseguito.
> >
> >
> > > Ultima annotazione: l’uso di dati falsi, inesatti o le lesioni ad
> > > onore e reputazione legati all’uso di informazioni comunque ottenute
> > > da quegli artefatti sono tutte condotte adeguatamente presidiate
> > > dall’ordinamento. Assai più preoccupante e poco presidiata la folle
> > > corsa alle API ed all’utilizzo di quei sistemi per automatizzare
> > > processi diversi come search...vedremo.
> >
> >
> > Una volta che l'output è prodotto, l'uso che chi lo riceve ne fa è
> > presidiato, siamo d'accordo. Mal presidiato, ma presidiato.
> >
> > Ma qui non stiamo parlando di questo: stiamo parlando di ciò che
> > ChatGPT fa per conto di chi lo ha realizzato e lo amministra.
> >
> > ChatGPT (e GPT4) è un software che qualcuno esegue.
> >
> >
> > Se bastasse introdurre un software per non rispondere di un reato,
> > allora non dovremmo rispondere di qualsiasi violazione del diritto
> > d'autore perché la rimozione delle ridicole restrizioni imposte dal DRM
> > viene sempre fatto da un software.
> >
> > O ancora, la pubblicazione di dati personali sottratti ad un individuo
> > su un sito web non dovrebbe costituire un reato perché il server web
> > che li distribuisce è un software che li produce in output per mio conto
> > esattamente come ChatGPT produce output le sue risposte per conto di
> > Open AI.
> >
> >
> > Per questo la tua argomentazione non regge Carlo.
> >
> >
> > Ciò che non è legale per un essere umano, non deve esserlo nemmeno per
> > un automatismo creato o amministrato da un essere umano.
> >
> > Pena la fine dello stato di diritto.
> >
> >
> >
> > Giacomo
> > _______________________________________________
> > nexa mailing list
> > nexa(a)server-nexa.polito.it
> > https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
April 4, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Guido Vetere
>>trova in Italia anche di passaggio deve pagare una VPN per farsi generare
>uno snippet html o farsi dare una ricetta di cucina?
> attento alle intossicazioni alimentari...
> ;-)
sono sopravvisuto a quelle che generava IBM Watson :-)))
Il Mar 4 Apr 2023, 07:33 Stefano Quintarelli <stefano(a)quintarelli.it> ha
scritto:
>
>
>
> >trova in Italia anche di passaggio deve pagare una VPN per farsi generare
> >uno snippet html o farsi dare una ricetta di cucina?
>
>
> attento alle intossicazioni alimentari...
> ;-)
>
April 4, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Stefano Quintarelli
>trova in Italia anche di passaggio deve pagare una VPN per farsi generare
>uno snippet html o farsi dare una ricetta di cucina?
attento alle intossicazioni alimentari...
;-)
April 4, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by M. Fioretti
On Tue, Apr 04, 2023 06:52:24 AM +0200, Guido Vetere wrote:
> Tutto questo è corretto, tranne il riferimento alle "stronzate"
> (bullshit) di Frankfurt: queste infatti sono affermazioni capziose
> pronunciate con intento manipolatorio, insomma dietro una
> "stronzata" c'è sempre uno "stronzo", cioè un soggetto dotato di
> intenzionalità, cosa di cui ChatGPT dichiara onestamente di essere
> privo.
embeh? Mi scuso se ho perso qualcosa nella discussione, e'
probabilissimo che qualcuno piu' preparato abbia gia' detto la stessa
cosa meglio di me ma.. che importanza ha quel che "dichiara" ChatGPT?
Dietro a una str***ta come ChatGPT, ci sono soggetti dotati di
intenzionalita' eccome, ed e' solo di quelli che dovremmo parlare, o
no?
Altrimenti abbiamo gia' perso, accettando l'idea che ChatGPT e simili
siano davvero "soggetti". Cioe' "esseri" distinti, con LORO agency,
diritti, giustificazioni, volonta', eccetera...
Un martello e' un oggetto, mica un soggetto. Idem per chatGPT e
compagnia. Se quelli sono soggetti, non siamo umani noi.
Marco
--
Vi aspetto nella mia nuova newsletter: https://mfioretti.substack.com
April 4, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Guido Vetere
> Questo e altro sull'articolo di oggi di Walter Vannini apparso su:
>
https://www.agendadigitale.eu/sicurezza/privacy/stop-a-chatgpt-per-fortuna-…
<https://www.agendadigitale.eu/sicurezza/privacy/stop-a-chatgpt-per-fortuna-…>
Grazie per aver segnalato questo intervento di Walter Vannini, che dopo
aver perorato la causa del Garante sembra suggerire che basterebbe un buon
disclaimer per mettere a posto le cose, e ne fornisce un esempio:
*chatGPT genera testo che, a livello sintattico, è inerente alla tua
richiesta. Questo testo può essere o non essere, in modo del tutto casuale,
corrispondente al senso che tu attribuisci alle parole che hai usato. Allo
stesso modo, il testo prodotto da chatGPT può corrispondere o non
corrispondere a fatti o eventi reali, pur essendo sempre grammaticalmente
impeccabile e formulato in modo da sembrare autorevole. ChatGPT non
possiede, per scelta dei suo sviluppatori, alcun concetto di “verità” o
alcun modello di conoscenza ed è quindi strutturalmente incapace di
distinguere il vero dal falso. Per questo motivo possiamo dire che chatGPT
non mente, perché nel suo codice verità e falsità sono indistinguibili, ma
si limita a dire stronzate, nella definizione del professor Frankfurt, cioè
a fare affermazioni del tutto plausibili senza alcun vincolo di realtà.*
Tutto questo è corretto, tranne il riferimento alle "stronzate" (*bullshit*)
di Frankfurt: queste infatti sono affermazioni capziose pronunciate con
intento manipolatorio, insomma dietro una "stronzata" c'è sempre uno
"stronzo", cioè un soggetto dotato di intenzionalità, cosa di cui ChatGPT
dichiara onestamente di essere privo.
Ma se è vero che basterebbe presentare sotto la giusta luce il
comportamento del sistema, non sarà che la "stronzata" diventa allora il
provvedimento del Garante? E' per il fatto che la società OpenAI è ambigua
(e sì, forse anche "stronza") nel presentare ChatGPT come potenziale
"oracolo" (mi riferisco in particolare al lancio di GPT-4) che oggi chi si
trova in Italia anche di passaggio deve pagare una VPN per farsi generare
uno snippet html o farsi dare una ricetta di cucina?
Buona giornata e grazie a tutti per la discussione.
Guido
On Tue, 4 Apr 2023 at 00:53, Giacomo Tesio <giacomo(a)tesio.it> wrote:
> Salve Carlo,
>
> ciò che non è legale per un essere umano, non deve esserlo nemmeno per
> un automatismo creato o amministrato da un essere umano.
> Pena la fine dello stato di diritto.
>
>
> Ma prima di provare a spiegare cosa non regge della tua analisi, vorrei
> porti una domanda: perché senti questa urgenza di difendere un software?
>
> Davvero, ti prego di rifletterci e rispondere perché sono sinceramente
> curioso sui tuoi moventi profondi. E' probabile che mi aiutino a
> comprendere i miei.
>
>
> On Mon, 3 Apr 2023 17:56:41 +0200 Carlo Blengino wrote:
>
> > I dati generati da ChatGPT ed in generale dalle attuali forme di AI
> > Generativa, anche per immagini come Dall-e, anche quando
> > apparentemente riferibili ad una persona fisica identificata o
> > identificabile, *non dovrebbero mai esser considerati dati
> > personali*, e ciò a prescindere dalla loro verità/falsità o dalla
> > loro più o meno marcata aderenza alla realtà.
> >
> > Sono dati sintetici che non rappresentano altro se non loro stessi.
>
> Per efficienza, proviamo a partire da due semplici definizioni:
>
> - informazione: esperienza soggettiva di pensiero comunicabile
> - dato: rappresentazione (su un supporto trasferibile) interpretabile
> come informazione da una mente umana
>
> L'informazione esiste solo nelle nostre menti e non esce mai dai nostri
> crani, ma grazie al linguaggio abbiamo inventato un protocollo che ci
> permette di sincronizzare le nostre menti, ricreando nella mente del
> destinatario un informazione analoga (ma mai identica) a quella
> condivisa da un mittente.
>
> Il dato è una rappresentazione, ovvero (per semplificare) un insieme di
> simboli che imprimiamo o facciamo imprimere su un supporto trasferibile
> nello spazio o nel tempo, affinché siano interpretati come informazione
> da una o più altre menti umane, lontane nello spazio o nel tempo.
>
> Questa definizione, prettamente informatica, di "dato" coincide con la
> definizione che hai condiviso da un punto di vista giuridico:
>
> > Per comprendere l’affermazione, forse azzardata, è bene definire cosa
> > è un dato per il diritto: il dato è *una rappresentazione di fatti,
> > informazioni o concetti*. Il dato informatico è sin dalla Convenzione
> > di Budapest del 2001 definito come una “presentazione di fatti,
> > informazioni o concetti in forma suscettibile di essere utilizzata in
> > un sistema computerizzato…”
>
> Presentazione e rappresentazione sono produzioni umane.
>
> La forma suscettibile di essere utilizzata in un sistema computerizzato
> è ormai del tutto irrilevante: in qualsiasi forma un'informazione
> (fatti, informazioni o concetti) venga presentata, è possibile
> costruire un software in grado di utilizzarla.
>
> Omessa questa specificazione ormai irrilevante, le due definizioni
> coincidono.
>
>
> > Le creazioni di questi sistemi, da quel che ho capito, anche quando
> > appaiono “dati” personali, rappresentano unicamente loro stessi,
> > ovvero una sequenza di parole o numeri o di pixels, e null’altro.
>
> L'output di un software è sempre un dato.
>
> Anche una sequenza casuale di simboli è un dato (peraltro estremamente
> prezioso, se realmente casuale).
>
> Non solo perché rappresenta sempre qualcosa di interpretabile, come
> minimo, come l'applicazione di un certo numero di trasformazioni ad un
> certo input.
>
> E' un dato perché è interpretabile dall'uomo secondo il significato che
> chi ha progettato, realizzato e documentato il software che lo ha
> prodotto, vuole che gli sia attribuito.
>
>
> Nel caso di ChatGPT, tale significato è letteralmente il significato
> che la tua mente vi attribuisce leggendolo.
>
> Quel software è stato realizzato da qualcuno con la precisa intenzione
> di far produrre un output che la tua mente interpreti come informazione.
>
> Dunque non solo la tua mente interpreta i dati di quell'output come
> informazione, ma chi ha realizzato e mantiene in esecuzione quel
> software è il mittente di quel messaggio, dell'informazione veicolata
> da quell'output.
>
>
> Questo rimane vero qualunque disclaimer Open AI possa mettere
> all'ingresso dell'applicazione.
>
>
> Quello che leggi è e rimane un dato prodotto per conto di qualcuno
> (Open AI, Microsoft etc...) affinché la tua mente lo riesca ad
> interpretare come informazione.
>
> Il fatto che nessuno, dentro Open AI, abbia materialmente espresso la
> sequenza di parole che leggi è irrilevante: hanno espresso il software
> che lo ha prodotto al loro posto e per loro volontà.
>
>
> Sono loro gli autori dell'output di GPT4.
>
>
> Se io scrivessi un software che, quando eseguito, produce in output una
> poesia come combinazione di una serie di versi che io ho scritto, tu
> non avresti problemi (credo) a riconoscere in me sia l'autore del
> software che l'autore dell'opera prodotta dal software stesso.
>
> E questo rimarrebbe vero se anche la sequenza prodotta non
> corrispondesse (magari a causa di un bug) a quella che io avevo in
> mente durante la scrittura del software.
>
> E se le sequenze possibili fossero N, tutte previste dal mio codice,
> non avresti comunque problema a riconoscere me sia come autore del
> software sia come autore delle opere da esso prodotte in output.
>
> Il software, di fatto, sarebbe una forma compressa di quelle
> N opere in output.
>
>
> Con ChatGPT è esattamente la stessa cosa.
> L'unica differenza è che nessuno si vuole assumere la responsabilità di
> quell'output perché chi l'ha programmato non si è preoccupato delle
> conseguenze e degli errori.
>
>
> Ora, appurato che l'output di ChatGPT è un dato (in quanto
> rappresentazione INTERPRETABILE come informazione) dobbiamo chiarire se
> possa essere un dato personale.
>
> In questo caso, come già chiarito da Benedetto Ponti, se il dato fa
> riferimento (ovvero può essere interpretato da una mente umana come
> facente riferimento) ad una persona fisica identifica o identificabile,
> allora è un dato personale.
>
> Che sia vero, falso o NULL (con un valore di verità ignoto al lettore)
> è irrilevante: quel dato produce nella mente di chi lo legge
> un'informazione riferita ad una persona.
>
>
> Tale persona, va protetta.
>
> Il fatto che ChatGPT non abbia intenzionalità è irrilevante: è uno
> strumento creato da persone con intenzioni precise, e attua
> costantemente tali intenzioni.
>
>
> Dunque, non dobbiamo proteggere le persone da ChatGPT, ma da chi lo ha
> creato e lo controlla.
>
> In un mondo in cui un software sufficientemente opaco può violare i
> diritti delle persone, chi li può produrre e controllare sarebbe
> sempre al di sopra della legge.
>
>
> Scaricare la responsabilità delle violazioni del diritto d'autore o del
> diritto alla protezione dei dati personali sugli utilizzatori del
> software è veramente ridicolo.
>
> Il loro contributo alla produzione dell'output è quasi irrilevante se
> confrontato con l'enorme lavoro di programmazione statistica e l'enorme
> quantità di dati e di energia utilizzati per la produzione del software
> e del suo output. Output che, non dimentichiamolo, riproduce
> token/lemmi/parole presenti nel proprio enorme "binario matriciale".
>
>
> > Trovo invece un po’ folle pensare di attenzionare le risposte
> > sbagliate, attribuendo a quei non-dati uno status di tutela che, a
> > mio giudizio, allo stato dell’arte, non dovrebbero avere.
>
> No attenzione: gli output contenenti dati personali (veri o falsi che
> siano) sono solo uno dei problemi.
>
> C'è l'utilizzo di dati personali durante la programmazione statistica
> senza un esplicito permesso degli interessati nonché la pretesa
> impossibilità di esercitare il diritto ad eliminare quei dati dal
> modello (impossibilità che non esiste: basta rifare la programmazione
> statistica senza, per quanto costoso possa essere) o l'impossibilità di
> emendare dati errati.
>
> Un software che non possa strutturalmente rispettare i diritti umani
> semplicemente non va eseguito.
>
>
> > Ultima annotazione: l’uso di dati falsi, inesatti o le lesioni ad
> > onore e reputazione legati all’uso di informazioni comunque ottenute
> > da quegli artefatti sono tutte condotte adeguatamente presidiate
> > dall’ordinamento. Assai più preoccupante e poco presidiata la folle
> > corsa alle API ed all’utilizzo di quei sistemi per automatizzare
> > processi diversi come search...vedremo.
>
>
> Una volta che l'output è prodotto, l'uso che chi lo riceve ne fa è
> presidiato, siamo d'accordo. Mal presidiato, ma presidiato.
>
> Ma qui non stiamo parlando di questo: stiamo parlando di ciò che
> ChatGPT fa per conto di chi lo ha realizzato e lo amministra.
>
> ChatGPT (e GPT4) è un software che qualcuno esegue.
>
>
> Se bastasse introdurre un software per non rispondere di un reato,
> allora non dovremmo rispondere di qualsiasi violazione del diritto
> d'autore perché la rimozione delle ridicole restrizioni imposte dal DRM
> viene sempre fatto da un software.
>
> O ancora, la pubblicazione di dati personali sottratti ad un individuo
> su un sito web non dovrebbe costituire un reato perché il server web
> che li distribuisce è un software che li produce in output per mio conto
> esattamente come ChatGPT produce output le sue risposte per conto di
> Open AI.
>
>
> Per questo la tua argomentazione non regge Carlo.
>
>
> Ciò che non è legale per un essere umano, non deve esserlo nemmeno per
> un automatismo creato o amministrato da un essere umano.
>
> Pena la fine dello stato di diritto.
>
>
>
> Giacomo
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
>
April 4, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Giacomo Tesio
Salve Carlo,
ciò che non è legale per un essere umano, non deve esserlo nemmeno per
un automatismo creato o amministrato da un essere umano.
Pena la fine dello stato di diritto.
Ma prima di provare a spiegare cosa non regge della tua analisi, vorrei
porti una domanda: perché senti questa urgenza di difendere un software?
Davvero, ti prego di rifletterci e rispondere perché sono sinceramente
curioso sui tuoi moventi profondi. E' probabile che mi aiutino a
comprendere i miei.
On Mon, 3 Apr 2023 17:56:41 +0200 Carlo Blengino wrote:
> I dati generati da ChatGPT ed in generale dalle attuali forme di AI
> Generativa, anche per immagini come Dall-e, anche quando
> apparentemente riferibili ad una persona fisica identificata o
> identificabile, *non dovrebbero mai esser considerati dati
> personali*, e ciò a prescindere dalla loro verità/falsità o dalla
> loro più o meno marcata aderenza alla realtà.
>
> Sono dati sintetici che non rappresentano altro se non loro stessi.
Per efficienza, proviamo a partire da due semplici definizioni:
- informazione: esperienza soggettiva di pensiero comunicabile
- dato: rappresentazione (su un supporto trasferibile) interpretabile
come informazione da una mente umana
L'informazione esiste solo nelle nostre menti e non esce mai dai nostri
crani, ma grazie al linguaggio abbiamo inventato un protocollo che ci
permette di sincronizzare le nostre menti, ricreando nella mente del
destinatario un informazione analoga (ma mai identica) a quella
condivisa da un mittente.
Il dato è una rappresentazione, ovvero (per semplificare) un insieme di
simboli che imprimiamo o facciamo imprimere su un supporto trasferibile
nello spazio o nel tempo, affinché siano interpretati come informazione
da una o più altre menti umane, lontane nello spazio o nel tempo.
Questa definizione, prettamente informatica, di "dato" coincide con la
definizione che hai condiviso da un punto di vista giuridico:
> Per comprendere l’affermazione, forse azzardata, è bene definire cosa
> è un dato per il diritto: il dato è *una rappresentazione di fatti,
> informazioni o concetti*. Il dato informatico è sin dalla Convenzione
> di Budapest del 2001 definito come una “presentazione di fatti,
> informazioni o concetti in forma suscettibile di essere utilizzata in
> un sistema computerizzato…”
Presentazione e rappresentazione sono produzioni umane.
La forma suscettibile di essere utilizzata in un sistema computerizzato
è ormai del tutto irrilevante: in qualsiasi forma un'informazione
(fatti, informazioni o concetti) venga presentata, è possibile
costruire un software in grado di utilizzarla.
Omessa questa specificazione ormai irrilevante, le due definizioni
coincidono.
> Le creazioni di questi sistemi, da quel che ho capito, anche quando
> appaiono “dati” personali, rappresentano unicamente loro stessi,
> ovvero una sequenza di parole o numeri o di pixels, e null’altro.
L'output di un software è sempre un dato.
Anche una sequenza casuale di simboli è un dato (peraltro estremamente
prezioso, se realmente casuale).
Non solo perché rappresenta sempre qualcosa di interpretabile, come
minimo, come l'applicazione di un certo numero di trasformazioni ad un
certo input.
E' un dato perché è interpretabile dall'uomo secondo il significato che
chi ha progettato, realizzato e documentato il software che lo ha
prodotto, vuole che gli sia attribuito.
Nel caso di ChatGPT, tale significato è letteralmente il significato
che la tua mente vi attribuisce leggendolo.
Quel software è stato realizzato da qualcuno con la precisa intenzione
di far produrre un output che la tua mente interpreti come informazione.
Dunque non solo la tua mente interpreta i dati di quell'output come
informazione, ma chi ha realizzato e mantiene in esecuzione quel
software è il mittente di quel messaggio, dell'informazione veicolata
da quell'output.
Questo rimane vero qualunque disclaimer Open AI possa mettere
all'ingresso dell'applicazione.
Quello che leggi è e rimane un dato prodotto per conto di qualcuno
(Open AI, Microsoft etc...) affinché la tua mente lo riesca ad
interpretare come informazione.
Il fatto che nessuno, dentro Open AI, abbia materialmente espresso la
sequenza di parole che leggi è irrilevante: hanno espresso il software
che lo ha prodotto al loro posto e per loro volontà.
Sono loro gli autori dell'output di GPT4.
Se io scrivessi un software che, quando eseguito, produce in output una
poesia come combinazione di una serie di versi che io ho scritto, tu
non avresti problemi (credo) a riconoscere in me sia l'autore del
software che l'autore dell'opera prodotta dal software stesso.
E questo rimarrebbe vero se anche la sequenza prodotta non
corrispondesse (magari a causa di un bug) a quella che io avevo in
mente durante la scrittura del software.
E se le sequenze possibili fossero N, tutte previste dal mio codice,
non avresti comunque problema a riconoscere me sia come autore del
software sia come autore delle opere da esso prodotte in output.
Il software, di fatto, sarebbe una forma compressa di quelle
N opere in output.
Con ChatGPT è esattamente la stessa cosa.
L'unica differenza è che nessuno si vuole assumere la responsabilità di
quell'output perché chi l'ha programmato non si è preoccupato delle
conseguenze e degli errori.
Ora, appurato che l'output di ChatGPT è un dato (in quanto
rappresentazione INTERPRETABILE come informazione) dobbiamo chiarire se
possa essere un dato personale.
In questo caso, come già chiarito da Benedetto Ponti, se il dato fa
riferimento (ovvero può essere interpretato da una mente umana come
facente riferimento) ad una persona fisica identifica o identificabile,
allora è un dato personale.
Che sia vero, falso o NULL (con un valore di verità ignoto al lettore)
è irrilevante: quel dato produce nella mente di chi lo legge
un'informazione riferita ad una persona.
Tale persona, va protetta.
Il fatto che ChatGPT non abbia intenzionalità è irrilevante: è uno
strumento creato da persone con intenzioni precise, e attua
costantemente tali intenzioni.
Dunque, non dobbiamo proteggere le persone da ChatGPT, ma da chi lo ha
creato e lo controlla.
In un mondo in cui un software sufficientemente opaco può violare i
diritti delle persone, chi li può produrre e controllare sarebbe
sempre al di sopra della legge.
Scaricare la responsabilità delle violazioni del diritto d'autore o del
diritto alla protezione dei dati personali sugli utilizzatori del
software è veramente ridicolo.
Il loro contributo alla produzione dell'output è quasi irrilevante se
confrontato con l'enorme lavoro di programmazione statistica e l'enorme
quantità di dati e di energia utilizzati per la produzione del software
e del suo output. Output che, non dimentichiamolo, riproduce
token/lemmi/parole presenti nel proprio enorme "binario matriciale".
> Trovo invece un po’ folle pensare di attenzionare le risposte
> sbagliate, attribuendo a quei non-dati uno status di tutela che, a
> mio giudizio, allo stato dell’arte, non dovrebbero avere.
No attenzione: gli output contenenti dati personali (veri o falsi che
siano) sono solo uno dei problemi.
C'è l'utilizzo di dati personali durante la programmazione statistica
senza un esplicito permesso degli interessati nonché la pretesa
impossibilità di esercitare il diritto ad eliminare quei dati dal
modello (impossibilità che non esiste: basta rifare la programmazione
statistica senza, per quanto costoso possa essere) o l'impossibilità di
emendare dati errati.
Un software che non possa strutturalmente rispettare i diritti umani
semplicemente non va eseguito.
> Ultima annotazione: l’uso di dati falsi, inesatti o le lesioni ad
> onore e reputazione legati all’uso di informazioni comunque ottenute
> da quegli artefatti sono tutte condotte adeguatamente presidiate
> dall’ordinamento. Assai più preoccupante e poco presidiata la folle
> corsa alle API ed all’utilizzo di quei sistemi per automatizzare
> processi diversi come search...vedremo.
Una volta che l'output è prodotto, l'uso che chi lo riceve ne fa è
presidiato, siamo d'accordo. Mal presidiato, ma presidiato.
Ma qui non stiamo parlando di questo: stiamo parlando di ciò che
ChatGPT fa per conto di chi lo ha realizzato e lo amministra.
ChatGPT (e GPT4) è un software che qualcuno esegue.
Se bastasse introdurre un software per non rispondere di un reato,
allora non dovremmo rispondere di qualsiasi violazione del diritto
d'autore perché la rimozione delle ridicole restrizioni imposte dal DRM
viene sempre fatto da un software.
O ancora, la pubblicazione di dati personali sottratti ad un individuo
su un sito web non dovrebbe costituire un reato perché il server web
che li distribuisce è un software che li produce in output per mio conto
esattamente come ChatGPT produce output le sue risposte per conto di
Open AI.
Per questo la tua argomentazione non regge Carlo.
Ciò che non è legale per un essere umano, non deve esserlo nemmeno per
un automatismo creato o amministrato da un essere umano.
Pena la fine dello stato di diritto.
Giacomo
April 3, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Marco A. Calamari
On dom, 2023-04-02 at 17:12 +0200, Stefano Quintarelli wrote:
>
>
> On 02/04/23 16:39, Guido Vetere wrote:
> > Per quanto riguarda il problema delle notizie biografiche inventate di cui
> > parla @Stefano
> > Quintarelli <mailto:stefano@quintarelli.it>, potremmo chiederci: un dato
> > personale falso
> > rivelato da qualcuno che avverte di essere occasionalmente mendace si può
> > considerare come
> > una violazione della privacy? Gli esempi per discuterne possono far
> > riferimento ai siti
> > di satira.
>
> carina l'idea che si presenti come un sito di satira...
> ma non era esattamente quello il mio punto.
> il mio punto e': se gli chiedo di correggere i dati personali -errati- che
> propala su di
> me, lo deve fare ?
>
> secondo me si.
Ciao Stefano,
il problema non è se lo deve fare, la risposta per il GDPR è si, basta che
glielo chiedi.
Il problema è che non lo può fare, perché dovrebbe ripetere l'intero training
... e non è detto che funzionerebbe.
JM2C
> (a meno che non si iscriva alla siae come comico... LOL)
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
April 3, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Alberto Cammozzo
Vorrei mettere alla prova il ragionamento di Carlo Blengino (se lo ho
colto) su un punto.
Anticipo anche io la conclusione: ciò che viene generato dall'LLM non è
un dato, ma un documento che rappresenta dati, e il modo in cui lo fa
non è unicamente sintetico, ma favorisce la produzione di dati originali.
Mentre il documento prodotto da un motore di ricerca riporta
prevalentemente dei collegamenti a documenti che /contengono/ i dati
rilevanti, gli LLM producono intenzionalmente un nuovo documento
/riorganizzando/ i dati estratti dai documenti usati in partenza.
Diversamente dal motore di ricerca, che riporta i dati che
effettivamente "rappresentano unicamente loro stessi", l'LLM li estrae e
li introduce in un nuovo contesto secondo le esigenze della discorsività
e dall'intenzione di apparire come un agente autonomo (che produce,
appunto, un documento e non un elenco di puntatori).
Già questo mi parrebbe un trattamento, se riferito a dati personali. Se
poi un documento generato, data l’oscurità ed erraticità del processo
informatico, contiene dati (veri o falsi) non riferibili a documenti
noti relativi alla stessa persona, non può chiamarsi 'sintetico' (lo
chiamerei ironicamente 'poietico') e contribuisce con il proprio
contenuto originale a una rappresentazione ulteriore della persona.
Ad esempio supponiamo che io chieda a un LLM una biografia di Tizio.
Ammettiamo che il LLM attribuisca a Tizio anche un fatto che riguarda
Caio suo omonimo. L'output sintetico/poietico raccoglie in una sola
biografia elementi della vita di Tizio uniti ad altri della vita di
Caio. Che magari sono anche veri, ma non suoi.
In tal modo introduce nel documento che rappresenta la vita di Tizio un
dato che è totalmente nuovo tra i documenti che lo riguardano, e per
questo motivo quella biografia diventa un dato originale su Tizio.
Indipendentemente dal fatto che il dato attribuito sia vero o falso, chi
lo genera e lo diffonde effettua un trattamento.
Altro esempio forse più forte ancora, quello del video deep-fake con la
faccia di Tizio che lo rappresenta mentre fa qualcosa (qualcosa che non
ha fatto o magari ha anche fatto, ma non in quell'occasione). Ammettiamo
che il video (documento, non dato) sia diffuso senza precisare che si
tratta di un elaborato fittizio (o satirico). Questo si aggiungerà ai
dati reperibili su Tizio. Se per realizzare il fake vengono usati dati
che ha conferito pubblicamente, Tizio ha diritto a opporsi a quello
/specifico/ trattamento, anche se non ne riceve un danno immediato? E
alla /possibilità/ che si effettui quel tipo di trattamento?
Non so se ho frainteso il ragionamento di Blengino, ma credo che meriti
attenzione proprio il fatto che se anche il dato -/per se/- non
rappresenta nulla, il documento che si riferisce alla persona può farlo:
/la/ rappresenta. E che caratteristica di questi programmi sia proprio
la generazione di documenti che anche senza esser veri sono presentati
in modo da essere verosimili.
Purtroppo la verosimiglianza è sufficiente perché i più si accontentino:
come è stato detto in questa sede, ci mettiamo noi il resto.
Un saluto,
Alberto
On 03/04/23 17:56, Carlo Blengino wrote:
>
> Provo ad inserirmi sul problema degli out-put falsi e “fantasiosi” con
> alcune considerazioni che non sono affatto sicuro stiano in piedi, ma
> la difficoltà del diritto non tanto a governare, quanto a comprendere
> e a collocare al suo interno, in norme e leggi, le realtà generate
> dalle nuove tecnologie è uno degli aspetti più affascinanti ed al
> contempo più complessi che questo tempo ci offre (Nexa nasce anche per
> questo!).
>
> Parto dalla tesi di fondo, per poi argomentare.
>
> I dati generati da ChatGPT ed in generale dalle attuali forme di AI
> Generativa, anche per immagini come Dall-e, anche quando
> apparentemente riferibili ad una persona fisica identificata o
> identificabile, *non dovrebbero mai esser considerati dati personali*,
> e ciò a prescindere dalla loro verità/falsità o dalla loro più o meno
> marcata aderenza alla realtà.
>
> Sono dati sintetici che non rappresentano altro se non loro stessi.
>
> Per comprendere l’affermazione, forse azzardata, è bene definire cosa
> è un dato per il diritto: il dato è /una rappresentazione di fatti,
> informazioni o concetti/. Il dato informatico è sin dalla Convenzione
> di Budapest del 2001 definito come una “presentazione di fatti,
> informazioni o concetti in forma suscettibile di essere utilizzata in
> un sistema computerizzato…”
>
> Ora, per quanto ho capito io anche leggendo i contributi passati su
> questa lista, le frasi generate da ChatGPT, come le immagini di
> Dall-e, sono sempre “false”, o meglio “contraffatte”, anche quando
> corrispondono per “magia” (i millemila parametri) a fatti, concetti o
> informazioni reali.
>
> Sono artefatti sintetici (come la carne, che in effetti l’abbiamo
> vietata Sic!) generati da una macchina che non ha alcuna contezza di
> ciò che il dato vuole rappresentare (e che è poi ciò che
> ontologicamente caratterizza il "dato"). E se ho ben capito, non ne
> hanno contezza neanche i “padroni” della macchina, che agisce in
> autonomia generando quegli pseudo-dati (pseudo-informazioni) più o
> meno plausibili.
>
> Con le foto è altrettanto evidente: l’immagine generata da Dall-e può
> esser identica alla realtà (una veduta di Mondovì, per dire..) o
> rappresentare realisticamente un “fatto” mai accaduto (le foto
> dell’arresto di Trump) ma in entrambi i casi l’artefatto non è e non
> può esser "vero", o meglio, non ha le caratteristiche informative (i
> dati) che noi attribuiamo alla fotografia come rappresentazione di un
> fatto, in un dato tempo e in un dato posto.
>
> Le creazioni di questi sistemi, da quel che ho capito, anche quando
> appaiono “dati” personali, rappresentano unicamente loro stessi,
> ovvero una sequenza di parole o numeri o di pixels, e null’altro.
>
> Per questo a mio giudizio quei dati non dovrebbero esser oggetto /ex
> sé/ di protezione e di tutela alcuna. Non contengono alcuna
> rappresentazione di fatti concetti o informazioni in qualche modo
> degni di tutela dall’ordinamento (infatti non c'è diritto d'autore,
> che comunque è un diritto intimamente legato nei suoi aspetti morali
> all’identità della persona, esattamente come il diritto alla
> protezione dei dati).
>
> Pensare di tutelare e “proteggere” come dati personali gli out-put di
> questi sistemi significa oggi conferire loro una valenza che non hanno
> ed avallare temo l’allucinazione che stiamo vivendo con l’intelligenza
> artificiale.
>
> Queste considerazioni non vogliono negare le potenzialità lesive di
> quei dati sintetici o la pericolosità delle macchine che li generano,
> ma consentono di spostare il focus e l’attenzione da quel dato che non
> "rappresenta" nulla (se non se stesso), all'uso che di quell’artefatto
> sintetico e delle macchine che lo producono ne facciamo noi umani.
>
> Forse il mio ragionamento non sta in piedi, ma io sotto il profilo
> “protezione dei dati personali” vedo enormi e quasi insormontabili
> problemi in relazione ai data-set di addestramento (e a mio giudizio
> non sono problemi legati agli errori di output quanto meno in
> relazione al GDPR) e vedo problemi possibili ma a me (e temo anche al
> Garante) ignoti in relazione ai dati degli utenti/fruitori ed ai dati
> da questi immessi nel prompt.
>
> Trovo invece un po’ folle pensare di attenzionare le risposte
> sbagliate, attribuendo a quei non-dati uno status di tutela che, a mio
> giudizio, allo stato dell’arte, non dovrebbero avere.
>
> Ultima annotazione: l’uso di dati falsi, inesatti o le lesioni ad
> onore e reputazione legati all’uso di informazioni comunque ottenute
> da quegli artefatti sono tutte condotte adeguatamente presidiate
> dall’ordinamento. Assai più preoccupante e poco presidiata la folle
> corsa alle API ed all’utilizzo di quei sistemi per automatizzare
> processi diversi come search...vedremo.
>
> CB
>
>
> Il giorno lun 3 apr 2023 alle ore 07:19 Stefano Zacchiroli
> <zack(a)upsilon.cc> ha scritto:
>
> Certo. Ma questo è l'altro aspetto: quello del trattamento dei
> dati in *input* a ChatGPT, che esiste ed è potenzialmente
> problematico dal punto di vista della privacy, a prescindere dalla
> veridicità delle risposte date.
>
> La mia domanda era su quale sia l'impatto della falsità
> dell'*output* (che sollevavi come fattore a se stante nella mail
> precedente) sui profili giuridici di violazione della privacy.
>
> Saluti
>
> On April 2, 2023 11:22:03 PM GMT+02:00, Maurizio Borghi
> <maurizio.borghi(a)unito.it> wrote:
> >On Sun, 2 Apr 2023 at 20:19, Stefano Zacchiroli <zack(a)upsilon.cc>
> wrote:
> >
> >>
> >> Che GhatGPT dica panzane a proposito di persone specifiche
> (viventi) è
> >> in effetti evidente a tutti. Ma, da non giurista, faccio veramente
> >> fatica a capire perché questo ponga problemi al Garante per la
> >> protezione dei dati personali. Se pubblico un sito web pieno di
> panzane
> >> su persone viventi, il Garante ha il potere di farmelo
> chiudere? Direi
> >> (sempre da non giurista), che al massimo rischio una querela per
> >> diffamazione
> >
> >
> >Se la produzione di quelle panzane richiede il trattamento dei
> dati di
> >milioni di ignari cittadini, allora sì, attrai le ire del Garante
> (oltre
> >che quelle dei destinatari delle tue panzane).
> >
> >>
> >> --
> >_______________
> >*Maurizio Borghi*
> >Università di Torino
> >https://www.dg.unito.it/persone/maurizio.borghi
> >Co-Director Nexa Center for Internet & Society
> <https://nexa.polito.it/>
> >
> >My Webex room: https://unito.webex.com/meet/maurizio.borghi
>
> --
> Sent from my mobile phone. Please excuse my brevity and top-posting.
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
>
>
>
> --
> *
> *
> *Avv. Carlo Blengino*
> *
> *
> /Via Duchessa Jolanda n. 19,/
> /10138 Torino (TO) - Italy/
> /tel. +39 011 4474035/
> Penalistiassociati.it
>
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
April 3, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Antonio
> servizi alternativi, tipo poe.com (servizio di Quora) che
> permette di interpellare, non solo ChatGPT, ma Sage, GPT-4, Claude+, Claude-instant, Dragonfly.
aggiungo https://www.pizzagpt.it/ (nessuna registrazione)
C'è fermento in rete.
A.
April 3, 2023