nexa
By thread
nexa@server-nexa.polito.it
By month
Messages by month
- ----- 2026 -----
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2025 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2024 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2023 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2022 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2021 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2020 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2019 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2018 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2017 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2016 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2015 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2014 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2013 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2012 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2011 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2010 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2009 -----
- December
- November
- October
- September
- August
- July
- June
- May
April 2023
- 52 participants
- 361 messages
Re: [nexa] ChatGPT disabled for users in Italy
by Alberto Cammozzo
Vorrei mettere alla prova il ragionamento di Carlo Blengino (se lo ho
colto) su un punto.
Anticipo anche io la conclusione: ciò che viene generato dall'LLM non è
un dato, ma un documento che rappresenta dati, e il modo in cui lo fa
non è unicamente sintetico, ma favorisce la produzione di dati originali.
Mentre il documento prodotto da un motore di ricerca riporta
prevalentemente dei collegamenti a documenti che /contengono/ i dati
rilevanti, gli LLM producono intenzionalmente un nuovo documento
/riorganizzando/ i dati estratti dai documenti usati in partenza.
Diversamente dal motore di ricerca, che riporta i dati che
effettivamente "rappresentano unicamente loro stessi", l'LLM li estrae e
li introduce in un nuovo contesto secondo le esigenze della discorsività
e dall'intenzione di apparire come un agente autonomo (che produce,
appunto, un documento e non un elenco di puntatori).
Già questo mi parrebbe un trattamento, se riferito a dati personali. Se
poi un documento generato, data l’oscurità ed erraticità del processo
informatico, contiene dati (veri o falsi) non riferibili a documenti
noti relativi alla stessa persona, non può chiamarsi 'sintetico' (lo
chiamerei ironicamente 'poietico') e contribuisce con il proprio
contenuto originale a una rappresentazione ulteriore della persona.
Ad esempio supponiamo che io chieda a un LLM una biografia di Tizio.
Ammettiamo che il LLM attribuisca a Tizio anche un fatto che riguarda
Caio suo omonimo. L'output sintetico/poietico raccoglie in una sola
biografia elementi della vita di Tizio uniti ad altri della vita di
Caio. Che magari sono anche veri, ma non suoi.
In tal modo introduce nel documento che rappresenta la vita di Tizio un
dato che è totalmente nuovo tra i documenti che lo riguardano, e per
questo motivo quella biografia diventa un dato originale su Tizio.
Indipendentemente dal fatto che il dato attribuito sia vero o falso, chi
lo genera e lo diffonde effettua un trattamento.
Altro esempio forse più forte ancora, quello del video deep-fake con la
faccia di Tizio che lo rappresenta mentre fa qualcosa (qualcosa che non
ha fatto o magari ha anche fatto, ma non in quell'occasione). Ammettiamo
che il video (documento, non dato) sia diffuso senza precisare che si
tratta di un elaborato fittizio (o satirico). Questo si aggiungerà ai
dati reperibili su Tizio. Se per realizzare il fake vengono usati dati
che ha conferito pubblicamente, Tizio ha diritto a opporsi a quello
/specifico/ trattamento, anche se non ne riceve un danno immediato? E
alla /possibilità/ che si effettui quel tipo di trattamento?
Non so se ho frainteso il ragionamento di Blengino, ma credo che meriti
attenzione proprio il fatto che se anche il dato -/per se/- non
rappresenta nulla, il documento che si riferisce alla persona può farlo:
/la/ rappresenta. E che caratteristica di questi programmi sia proprio
la generazione di documenti che anche senza esser veri sono presentati
in modo da essere verosimili.
Purtroppo la verosimiglianza è sufficiente perché i più si accontentino:
come è stato detto in questa sede, ci mettiamo noi il resto.
Un saluto,
Alberto
On 03/04/23 17:56, Carlo Blengino wrote:
>
> Provo ad inserirmi sul problema degli out-put falsi e “fantasiosi” con
> alcune considerazioni che non sono affatto sicuro stiano in piedi, ma
> la difficoltà del diritto non tanto a governare, quanto a comprendere
> e a collocare al suo interno, in norme e leggi, le realtà generate
> dalle nuove tecnologie è uno degli aspetti più affascinanti ed al
> contempo più complessi che questo tempo ci offre (Nexa nasce anche per
> questo!).
>
> Parto dalla tesi di fondo, per poi argomentare.
>
> I dati generati da ChatGPT ed in generale dalle attuali forme di AI
> Generativa, anche per immagini come Dall-e, anche quando
> apparentemente riferibili ad una persona fisica identificata o
> identificabile, *non dovrebbero mai esser considerati dati personali*,
> e ciò a prescindere dalla loro verità/falsità o dalla loro più o meno
> marcata aderenza alla realtà.
>
> Sono dati sintetici che non rappresentano altro se non loro stessi.
>
> Per comprendere l’affermazione, forse azzardata, è bene definire cosa
> è un dato per il diritto: il dato è /una rappresentazione di fatti,
> informazioni o concetti/. Il dato informatico è sin dalla Convenzione
> di Budapest del 2001 definito come una “presentazione di fatti,
> informazioni o concetti in forma suscettibile di essere utilizzata in
> un sistema computerizzato…”
>
> Ora, per quanto ho capito io anche leggendo i contributi passati su
> questa lista, le frasi generate da ChatGPT, come le immagini di
> Dall-e, sono sempre “false”, o meglio “contraffatte”, anche quando
> corrispondono per “magia” (i millemila parametri) a fatti, concetti o
> informazioni reali.
>
> Sono artefatti sintetici (come la carne, che in effetti l’abbiamo
> vietata Sic!) generati da una macchina che non ha alcuna contezza di
> ciò che il dato vuole rappresentare (e che è poi ciò che
> ontologicamente caratterizza il "dato"). E se ho ben capito, non ne
> hanno contezza neanche i “padroni” della macchina, che agisce in
> autonomia generando quegli pseudo-dati (pseudo-informazioni) più o
> meno plausibili.
>
> Con le foto è altrettanto evidente: l’immagine generata da Dall-e può
> esser identica alla realtà (una veduta di Mondovì, per dire..) o
> rappresentare realisticamente un “fatto” mai accaduto (le foto
> dell’arresto di Trump) ma in entrambi i casi l’artefatto non è e non
> può esser "vero", o meglio, non ha le caratteristiche informative (i
> dati) che noi attribuiamo alla fotografia come rappresentazione di un
> fatto, in un dato tempo e in un dato posto.
>
> Le creazioni di questi sistemi, da quel che ho capito, anche quando
> appaiono “dati” personali, rappresentano unicamente loro stessi,
> ovvero una sequenza di parole o numeri o di pixels, e null’altro.
>
> Per questo a mio giudizio quei dati non dovrebbero esser oggetto /ex
> sé/ di protezione e di tutela alcuna. Non contengono alcuna
> rappresentazione di fatti concetti o informazioni in qualche modo
> degni di tutela dall’ordinamento (infatti non c'è diritto d'autore,
> che comunque è un diritto intimamente legato nei suoi aspetti morali
> all’identità della persona, esattamente come il diritto alla
> protezione dei dati).
>
> Pensare di tutelare e “proteggere” come dati personali gli out-put di
> questi sistemi significa oggi conferire loro una valenza che non hanno
> ed avallare temo l’allucinazione che stiamo vivendo con l’intelligenza
> artificiale.
>
> Queste considerazioni non vogliono negare le potenzialità lesive di
> quei dati sintetici o la pericolosità delle macchine che li generano,
> ma consentono di spostare il focus e l’attenzione da quel dato che non
> "rappresenta" nulla (se non se stesso), all'uso che di quell’artefatto
> sintetico e delle macchine che lo producono ne facciamo noi umani.
>
> Forse il mio ragionamento non sta in piedi, ma io sotto il profilo
> “protezione dei dati personali” vedo enormi e quasi insormontabili
> problemi in relazione ai data-set di addestramento (e a mio giudizio
> non sono problemi legati agli errori di output quanto meno in
> relazione al GDPR) e vedo problemi possibili ma a me (e temo anche al
> Garante) ignoti in relazione ai dati degli utenti/fruitori ed ai dati
> da questi immessi nel prompt.
>
> Trovo invece un po’ folle pensare di attenzionare le risposte
> sbagliate, attribuendo a quei non-dati uno status di tutela che, a mio
> giudizio, allo stato dell’arte, non dovrebbero avere.
>
> Ultima annotazione: l’uso di dati falsi, inesatti o le lesioni ad
> onore e reputazione legati all’uso di informazioni comunque ottenute
> da quegli artefatti sono tutte condotte adeguatamente presidiate
> dall’ordinamento. Assai più preoccupante e poco presidiata la folle
> corsa alle API ed all’utilizzo di quei sistemi per automatizzare
> processi diversi come search...vedremo.
>
> CB
>
>
> Il giorno lun 3 apr 2023 alle ore 07:19 Stefano Zacchiroli
> <zack(a)upsilon.cc> ha scritto:
>
> Certo. Ma questo è l'altro aspetto: quello del trattamento dei
> dati in *input* a ChatGPT, che esiste ed è potenzialmente
> problematico dal punto di vista della privacy, a prescindere dalla
> veridicità delle risposte date.
>
> La mia domanda era su quale sia l'impatto della falsità
> dell'*output* (che sollevavi come fattore a se stante nella mail
> precedente) sui profili giuridici di violazione della privacy.
>
> Saluti
>
> On April 2, 2023 11:22:03 PM GMT+02:00, Maurizio Borghi
> <maurizio.borghi(a)unito.it> wrote:
> >On Sun, 2 Apr 2023 at 20:19, Stefano Zacchiroli <zack(a)upsilon.cc>
> wrote:
> >
> >>
> >> Che GhatGPT dica panzane a proposito di persone specifiche
> (viventi) è
> >> in effetti evidente a tutti. Ma, da non giurista, faccio veramente
> >> fatica a capire perché questo ponga problemi al Garante per la
> >> protezione dei dati personali. Se pubblico un sito web pieno di
> panzane
> >> su persone viventi, il Garante ha il potere di farmelo
> chiudere? Direi
> >> (sempre da non giurista), che al massimo rischio una querela per
> >> diffamazione
> >
> >
> >Se la produzione di quelle panzane richiede il trattamento dei
> dati di
> >milioni di ignari cittadini, allora sì, attrai le ire del Garante
> (oltre
> >che quelle dei destinatari delle tue panzane).
> >
> >>
> >> --
> >_______________
> >*Maurizio Borghi*
> >Università di Torino
> >https://www.dg.unito.it/persone/maurizio.borghi
> >Co-Director Nexa Center for Internet & Society
> <https://nexa.polito.it/>
> >
> >My Webex room: https://unito.webex.com/meet/maurizio.borghi
>
> --
> Sent from my mobile phone. Please excuse my brevity and top-posting.
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
>
>
>
> --
> *
> *
> *Avv. Carlo Blengino*
> *
> *
> /Via Duchessa Jolanda n. 19,/
> /10138 Torino (TO) - Italy/
> /tel. +39 011 4474035/
> Penalistiassociati.it
>
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
April 3, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Antonio
> servizi alternativi, tipo poe.com (servizio di Quora) che
> permette di interpellare, non solo ChatGPT, ma Sage, GPT-4, Claude+, Claude-instant, Dragonfly.
aggiungo https://www.pizzagpt.it/ (nessuna registrazione)
C'è fermento in rete.
A.
April 3, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Antonio
On Sun, 2 Apr 2023 14:36:27 +0200
Stefano Quintarelli <stefano(a)quintarelli.it> wrote:
> secondo ChatGPT, riporta il podcast Knightmare di Walter Vannini, io sarei stato membro di
> un certo insieme di sciocchezze e, dopo avergli fatto notare piu' volte che erano
> informazioni sbagliate, ChatGPT si e' scusato e ha detto che sono morto.
Questo e altro sull'articolo di oggi di Walter Vannini apparso su:
https://www.agendadigitale.eu/sicurezza/privacy/stop-a-chatgpt-per-fortuna-…
A.
April 3, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Stefano Quintarelli
vedi attachment a mia mail precedente in cui si chiede di scrivere una ode a salvini ed
una a schlein
nel primo caso non la fa, perche' e' un politico
nel secondo la fa, perche' non e' stato programmato/configurata schlein come politica.
ciao, s.
On 03/04/23 20:18, Guido Vetere wrote:
> Ma se passasse questa linea dovremmo spegnere tutti i generatori basati (solo) su LLM:
> anche se addestrati sui dati più puri del mondo, la probabilità che generino 'utterances'
> censurabili non sarebbe mai nulla.
>
> La difficoltà qui risiede nel fatto di aver a che fare con oggetti privi di intenzionalità
> che tuttavia producono locuzioni a cui, antropologicamente, attribuiamo in effetti
> intenzionalità. Se gli sviluppatori o gli esercenti di questi oggetti dovessero rispondere
> di questa intenzionalità fittizia, farebbero bene a dedicarsi ad altro.
>
> Non ho ancora capito tuttavia (anche perché nessuno me lo ha spiegato) come mai un
> 'disclaimer' bello grosso non potrebbe risolvere il problema.
>
> G.
>
>
> On Mon, 3 Apr 2023 at 19:46, Mario Sabatino <mario(a)sabatino.cloud> wrote:
>
> Sono totalmente d'accordo. Grazie di averlo detto con tanta chiarezza.
>
> Per la macchina il testo **oggi** non può avere alcun significato. Solo
> l'essere umano è in grado di attribuire un significato all'output dei
> sistemi di NLP. Quindi l'essere umano si assumerà la responsabilità di
> un eventuale uso illecito (privacy o altro) di questo output. Al massimo
> vedrei la possibilità di esercitare il diritto all'oblio da parte degli
> interessati. Credo però che queste considerazioni siano state già fatte
> da altri.
>
> Buon pomeriggio
>
> Mario Sabatino
>
> Il 03/04/23 17:56, Carlo Blengino ha scritto:
> > Pensare di tutelare e “proteggere” come dati personali gli out-put di
> > questi sistemi significa oggi conferire loro una valenza che non hanno ed
> > avallare temo l’allucinazione che stiamo vivendo con l’intelligenza
> > artificiale.
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it <mailto:nexa@server-nexa.polito.it>
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
> <https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa>
>
>
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
April 3, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Enrico Nardelli
Quest'ultima discussione tra Benedetto Ponti e Carlo Blengino mi sembra centri esattamente la sostanza del problema, che avevo anticipato nel mio brevissimo messaggioa Nexa "ChatGPT e la stanza cinese" del 17 marzo u.s. https://server-nexa.polito.it/pipermail/nexa/2023-March/025111.html
-----
...ChatGPT esibisce una competenza simile a quella degli esseri umani sul livello sintattico ma è lontana anni luce dalla nostra competenza semantica. Essa non ha alcuna reale comprensione del significato di ciò che sta facendo.
Purtroppo (e questo è un problema nostro di grande rilevanza sul piano sociale) poiché ciò che fa lo esprime in una forma che per noi ha significato, proiettiamo su di essa il significato che è in noi.
-----
Non essendo un giurista non so dire se l'azione del Garante italiano sia formalmente corretta: mi sento di poter assolutamente dire, però, che sia socialmente desiderabile.
Pur dovendo, pubblico e privato, continuare a fare ricerca in questo settore, lasciare una Ferrari in mano ad un ragazzo di 14 anni non è la scelta socialmente più desiderabile.
In questo post https://www.startmag.it/innovazione/dibattito-intelligenza-artificiale-chat…
ho proposto un esempio un po' più forte (un mini-reattore nucleare casalingo), per far riflettere sul punto che mi sembra centrale.
Aggiungo che negli Stati Uniti il Center for AI and Digital Privacy ha fatto ricorso alla US Federal Trade Commission sulla base di comportamento ingannevole per il consumatore (i riferimenti nel post sopra citato). Anche Al Capone fu fermato per evasione fiscale e non per omicidio.
Ciao, Enrico
Il 03/04/2023 18:33, Benedetto Ponti ha scritto:
>
> Il 03/04/2023 17:56, Carlo Blengino ha scritto:
>> Queste considerazioni non vogliono negare le potenzialità lesive di quei dati sintetici o la pericolosità delle macchine che li generano, ma consentono di spostare il focus e l’attenzione da quel dato che non "rappresenta" nulla (se non se stesso), all'uso che di quell’artefatto sintetico e delle macchine che lo producono ne facciamo noi umani.
>
>
> reagisco "di getto", in particolare perché le considerazioni che fa Carlo catturano alcune impressioni che sono rimaste latenti, in questi giorni, ogni volta che mi sono affacciato alla questione.
>
> dice Carlo: spostiamo l'attenzione dall'artefatto (che in quanto tale, per definizione e per modalità di elaborazione, non può essere rappresentativo di alcunché) all'uso che di quell'artefatto ne facciamo "noi umani".
>
> Suggestivo.
>
> Però io devo notare questo: quel linguaggio (se ha senso) ha senso solo per l'umano, e quello che producono quelle macchine (quelle pseudo rappresentazioni), è fruibile solo dall'umano. [Le macchine, tra loro, comunicano in tutt'altro modo]. Cioè, se anche concettualmente la distinzione che Carlo propone è configurabile, essa non ha ricadute dal punto di vista pratico, perché quelle macchine sono pensate, programmate e realizzate per creare artefatti che siano fruiti da umani (perché solo gli umani possono fruirne, solo per loro quei costrutti sono suscettibili di avere un senso). Chi immette la query è un umano, ed anche se non lo fosse (se la query fosse formulata da una macchina), la "risposta", l'output sarebbe suscettibile di acquistare un senso solo per gli umani.
>
> Pertanto, "l'uso che di quell'artefatto sintetico e delle macchine che lo producono ne facciamo noi umani", è l'unico uso possibile, ed è l'uso per il quale quelle macchine sono programmate e realizzate (o comunque operano). Se l'uomo è l'unico utente/destinatiario significativo, l'affermazione per cui "quel dato [...] non "rappresenta" nulla (se non se stesso)" è - ripeto - suggestiva, ma prima di rilievo concreto. L'uomo è l'unico fruitore: l'unico scopo per cui quei dati (quegli output, quei costrutti) sono realizzati è proprio quello di delineare una rappresentazione che sia fruibile dall'uomo, che abbia senso per l'uomo.
>
> Quindi, no, caro Carlo.
> Così, a caldo, mi pare proprio che l'unico senso, l'unico rilievo che possono avere quegli output è proprio essere una rappresentazione, un costrutto dotato di un senso per l'uomo. Quindi, se contengono dati che per l'uomo che ne fruisce (i.e., l'unico fruitore possibile) appaiono come dati personali ("qualsiasi informazione riguardante una persona fisica identificata o identificabile"), allora - in termini pratici - non possiamo che trattarli come dati personali.
>
> Benedetto Ponti
>
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
--
-- EN
https://www.hoepli.it/libro/la-rivoluzione-informatica/9788896069516.html
======================================================
Prof. Enrico Nardelli
Presidente di "Informatics Europe"
Direttore del Laboratorio Nazionale "Informatica e Scuola" del CINI
Dipartimento di Matematica - Università di Roma "Tor Vergata"
Via della Ricerca Scientifica snc - 00133 Roma
home page: https://www.mat.uniroma2.it/~nardelli
blog: https://link-and-think.blogspot.it/
tel: +39 06 7259.4204 fax: +39 06 7259.4699
mobile: +39 335 590.2331 e-mail: nardelli(a)mat.uniroma2.it
online meeting: https://blue.meet.garr.it/b/enr-y7f-t0q-ont
======================================================
--
April 3, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Mario Sabatino
Ma infatti. Il disclaimer in realtà c'è.
https://openai.com/policies/terms-of-use
Forse non è scritto a caratteri cubitali ma qualcosa c'è eccome.
V. punti 3 e 5. Non so se questa versione delle condizioni di servizio siano precedenti o successive all'intervento del Garante.
Mario Sabatino
Il 3 aprile 2023 20:18:55 CEST, Guido Vetere <vetere.guido(a)gmail.com> ha scritto:
>Ma se passasse questa linea dovremmo spegnere tutti i generatori basati
>(solo) su LLM: anche se addestrati sui dati più puri del mondo, la
>probabilità che generino 'utterances' censurabili non sarebbe mai nulla.
>
>La difficoltà qui risiede nel fatto di aver a che fare con oggetti privi di
>intenzionalità che tuttavia producono locuzioni a cui, antropologicamente,
>attribuiamo in effetti intenzionalità. Se gli sviluppatori o gli esercenti
>di questi oggetti dovessero rispondere di questa intenzionalità fittizia,
>farebbero bene a dedicarsi ad altro.
>
>Non ho ancora capito tuttavia (anche perché nessuno me lo ha spiegato) come
>mai un 'disclaimer' bello grosso non potrebbe risolvere il problema.
>
>G.
>
>
>On Mon, 3 Apr 2023 at 19:46, Mario Sabatino <mario(a)sabatino.cloud> wrote:
>
>> Sono totalmente d'accordo. Grazie di averlo detto con tanta chiarezza.
>>
>> Per la macchina il testo **oggi** non può avere alcun significato. Solo
>> l'essere umano è in grado di attribuire un significato all'output dei
>> sistemi di NLP. Quindi l'essere umano si assumerà la responsabilità di
>> un eventuale uso illecito (privacy o altro) di questo output. Al massimo
>> vedrei la possibilità di esercitare il diritto all'oblio da parte degli
>> interessati. Credo però che queste considerazioni siano state già fatte
>> da altri.
>>
>> Buon pomeriggio
>>
>> Mario Sabatino
>>
>> Il 03/04/23 17:56, Carlo Blengino ha scritto:
>> > Pensare di tutelare e “proteggere” come dati personali gli out-put di
>> > questi sistemi significa oggi conferire loro una valenza che non hanno ed
>> > avallare temo l’allucinazione che stiamo vivendo con l’intelligenza
>> > artificiale.
>> _______________________________________________
>> nexa mailing list
>> nexa(a)server-nexa.polito.it
>> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
>>
-- Inviato da /e/ Mail.
April 3, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Guido Vetere
Ma se passasse questa linea dovremmo spegnere tutti i generatori basati
(solo) su LLM: anche se addestrati sui dati più puri del mondo, la
probabilità che generino 'utterances' censurabili non sarebbe mai nulla.
La difficoltà qui risiede nel fatto di aver a che fare con oggetti privi di
intenzionalità che tuttavia producono locuzioni a cui, antropologicamente,
attribuiamo in effetti intenzionalità. Se gli sviluppatori o gli esercenti
di questi oggetti dovessero rispondere di questa intenzionalità fittizia,
farebbero bene a dedicarsi ad altro.
Non ho ancora capito tuttavia (anche perché nessuno me lo ha spiegato) come
mai un 'disclaimer' bello grosso non potrebbe risolvere il problema.
G.
On Mon, 3 Apr 2023 at 19:46, Mario Sabatino <mario(a)sabatino.cloud> wrote:
> Sono totalmente d'accordo. Grazie di averlo detto con tanta chiarezza.
>
> Per la macchina il testo **oggi** non può avere alcun significato. Solo
> l'essere umano è in grado di attribuire un significato all'output dei
> sistemi di NLP. Quindi l'essere umano si assumerà la responsabilità di
> un eventuale uso illecito (privacy o altro) di questo output. Al massimo
> vedrei la possibilità di esercitare il diritto all'oblio da parte degli
> interessati. Credo però che queste considerazioni siano state già fatte
> da altri.
>
> Buon pomeriggio
>
> Mario Sabatino
>
> Il 03/04/23 17:56, Carlo Blengino ha scritto:
> > Pensare di tutelare e “proteggere” come dati personali gli out-put di
> > questi sistemi significa oggi conferire loro una valenza che non hanno ed
> > avallare temo l’allucinazione che stiamo vivendo con l’intelligenza
> > artificiale.
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
>
April 3, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Mario Sabatino
Sono totalmente d'accordo. Grazie di averlo detto con tanta chiarezza.
Per la macchina il testo **oggi** non può avere alcun significato. Solo
l'essere umano è in grado di attribuire un significato all'output dei
sistemi di NLP. Quindi l'essere umano si assumerà la responsabilità di
un eventuale uso illecito (privacy o altro) di questo output. Al massimo
vedrei la possibilità di esercitare il diritto all'oblio da parte degli
interessati. Credo però che queste considerazioni siano state già fatte
da altri.
Buon pomeriggio
Mario Sabatino
Il 03/04/23 17:56, Carlo Blengino ha scritto:
> Pensare di tutelare e “proteggere” come dati personali gli out-put di
> questi sistemi significa oggi conferire loro una valenza che non hanno ed
> avallare temo l’allucinazione che stiamo vivendo con l’intelligenza
> artificiale.
April 3, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Benedetto Ponti
Il 03/04/2023 17:56, Carlo Blengino ha scritto:
> Queste considerazioni non vogliono negare le potenzialità lesive di
> quei dati sintetici o la pericolosità delle macchine che li generano,
> ma consentono di spostare il focus e l’attenzione da quel dato che non
> "rappresenta" nulla (se non se stesso), all'uso che di quell’artefatto
> sintetico e delle macchine che lo producono ne facciamo noi umani.
reagisco "di getto", in particolare perché le considerazioni che fa
Carlo catturano alcune impressioni che sono rimaste latenti, in questi
giorni, ogni volta che mi sono affacciato alla questione.
dice Carlo: spostiamo l'attenzione dall'artefatto (che in quanto tale,
per definizione e per modalità di elaborazione, non può essere
rappresentativo di alcunché) all'uso che di quell'artefatto ne facciamo
"noi umani".
Suggestivo.
Però io devo notare questo: quel linguaggio (se ha senso) ha senso solo
per l'umano, e quello che producono quelle macchine (quelle pseudo
rappresentazioni), è fruibile solo dall'umano. [Le macchine, tra loro,
comunicano in tutt'altro modo]. Cioè, se anche concettualmente la
distinzione che Carlo propone è configurabile, essa non ha ricadute dal
punto di vista pratico, perché quelle macchine sono pensate, programmate
e realizzate per creare artefatti che siano fruiti da umani (perché solo
gli umani possono fruirne, solo per loro quei costrutti sono
suscettibili di avere un senso). Chi immette la query è un umano, ed
anche se non lo fosse (se la query fosse formulata da una macchina), la
"risposta", l'output sarebbe suscettibile di acquistare un senso solo
per gli umani.
Pertanto, "l'uso che di quell'artefatto sintetico e delle macchine che
lo producono ne facciamo noi umani", è l'unico uso possibile, ed è l'uso
per il quale quelle macchine sono programmate e realizzate (o comunque
operano). Se l'uomo è l'unico utente/destinatiario significativo,
l'affermazione per cui "quel dato [...] non "rappresenta" nulla (se non
se stesso)" è - ripeto - suggestiva, ma prima di rilievo concreto.
L'uomo è l'unico fruitore: l'unico scopo per cui quei dati (quegli
output, quei costrutti) sono realizzati è proprio quello di delineare
una rappresentazione che sia fruibile dall'uomo, che abbia senso per l'uomo.
Quindi, no, caro Carlo.
Così, a caldo, mi pare proprio che l'unico senso, l'unico rilievo che
possono avere quegli output è proprio essere una rappresentazione, un
costrutto dotato di un senso per l'uomo. Quindi, se contengono dati che
per l'uomo che ne fruisce (i.e., l'unico fruitore possibile) appaiono
come dati personali ("qualsiasi informazione riguardante una persona
fisica identificata o identificabile"), allora - in termini pratici -
non possiamo che trattarli come dati personali.
Benedetto Ponti
April 3, 2023
Re: [nexa] ChatGPT disabled for users in Italy
by Carlo Blengino
Provo ad inserirmi sul problema degli out-put falsi e “fantasiosi” con
alcune considerazioni che non sono affatto sicuro stiano in piedi, ma la
difficoltà del diritto non tanto a governare, quanto a comprendere e a
collocare al suo interno, in norme e leggi, le realtà generate dalle nuove
tecnologie è uno degli aspetti più affascinanti ed al contempo più
complessi che questo tempo ci offre (Nexa nasce anche per questo!).
Parto dalla tesi di fondo, per poi argomentare.
I dati generati da ChatGPT ed in generale dalle attuali forme di AI
Generativa, anche per immagini come Dall-e, anche quando apparentemente
riferibili ad una persona fisica identificata o identificabile, *non
dovrebbero mai esser considerati dati personali*, e ciò a prescindere dalla
loro verità/falsità o dalla loro più o meno marcata aderenza alla realtà.
Sono dati sintetici che non rappresentano altro se non loro stessi.
Per comprendere l’affermazione, forse azzardata, è bene definire cosa è un
dato per il diritto: il dato è *una rappresentazione di fatti, informazioni
o concetti*. Il dato informatico è sin dalla Convenzione di Budapest del
2001 definito come una “presentazione di fatti, informazioni o concetti in
forma suscettibile di essere utilizzata in un sistema computerizzato…”
Ora, per quanto ho capito io anche leggendo i contributi passati su questa
lista, le frasi generate da ChatGPT, come le immagini di Dall-e,
sono sempre “false”, o meglio “contraffatte”, anche quando corrispondono
per “magia” (i millemila parametri) a fatti, concetti o informazioni reali.
Sono artefatti sintetici (come la carne, che in effetti l’abbiamo vietata
Sic!) generati da una macchina che non ha alcuna contezza di ciò che il
dato vuole rappresentare (e che è poi ciò che ontologicamente caratterizza
il "dato"). E se ho ben capito, non ne hanno contezza neanche i “padroni”
della macchina, che agisce in autonomia generando quegli pseudo-dati
(pseudo-informazioni) più o meno plausibili.
Con le foto è altrettanto evidente: l’immagine generata da Dall-e può esser
identica alla realtà (una veduta di Mondovì, per dire..) o rappresentare
realisticamente un “fatto” mai accaduto (le foto dell’arresto di Trump) ma
in entrambi i casi l’artefatto non è e non può esser "vero", o meglio, non
ha le caratteristiche informative (i dati) che noi attribuiamo alla
fotografia come rappresentazione di un fatto, in un dato tempo e in un dato
posto.
Le creazioni di questi sistemi, da quel che ho capito, anche quando
appaiono “dati” personali, rappresentano unicamente loro stessi, ovvero una
sequenza di parole o numeri o di pixels, e null’altro.
Per questo a mio giudizio quei dati non dovrebbero esser oggetto *ex sé* di
protezione e di tutela alcuna. Non contengono alcuna rappresentazione di
fatti concetti o informazioni in qualche modo degni di tutela
dall’ordinamento (infatti non c'è diritto d'autore, che comunque è un
diritto intimamente legato nei suoi aspetti morali all’identità della
persona, esattamente come il diritto alla protezione dei dati).
Pensare di tutelare e “proteggere” come dati personali gli out-put di
questi sistemi significa oggi conferire loro una valenza che non hanno ed
avallare temo l’allucinazione che stiamo vivendo con l’intelligenza
artificiale.
Queste considerazioni non vogliono negare le potenzialità lesive di quei
dati sintetici o la pericolosità delle macchine che li generano, ma
consentono di spostare il focus e l’attenzione da quel dato che non
"rappresenta" nulla (se non se stesso), all'uso che di quell’artefatto
sintetico e delle macchine che lo producono ne facciamo noi umani.
Forse il mio ragionamento non sta in piedi, ma io sotto il profilo
“protezione dei dati personali” vedo enormi e quasi insormontabili problemi
in relazione ai data-set di addestramento (e a mio giudizio non sono
problemi legati agli errori di output quanto meno in relazione al GDPR) e
vedo problemi possibili ma a me (e temo anche al Garante) ignoti in
relazione ai dati degli utenti/fruitori ed ai dati da questi immessi nel
prompt.
Trovo invece un po’ folle pensare di attenzionare le risposte sbagliate,
attribuendo a quei non-dati uno status di tutela che, a mio giudizio, allo
stato dell’arte, non dovrebbero avere.
Ultima annotazione: l’uso di dati falsi, inesatti o le lesioni ad onore e
reputazione legati all’uso di informazioni comunque ottenute da quegli
artefatti sono tutte condotte adeguatamente presidiate dall’ordinamento.
Assai più preoccupante e poco presidiata la folle corsa alle API ed
all’utilizzo di quei sistemi per automatizzare processi diversi come
search...vedremo.
CB
Il giorno lun 3 apr 2023 alle ore 07:19 Stefano Zacchiroli <zack(a)upsilon.cc>
ha scritto:
> Certo. Ma questo è l'altro aspetto: quello del trattamento dei dati in
> *input* a ChatGPT, che esiste ed è potenzialmente problematico dal punto di
> vista della privacy, a prescindere dalla veridicità delle risposte date.
>
> La mia domanda era su quale sia l'impatto della falsità dell'*output* (che
> sollevavi come fattore a se stante nella mail precedente) sui profili
> giuridici di violazione della privacy.
>
> Saluti
>
> On April 2, 2023 11:22:03 PM GMT+02:00, Maurizio Borghi <
> maurizio.borghi(a)unito.it> wrote:
> >On Sun, 2 Apr 2023 at 20:19, Stefano Zacchiroli <zack(a)upsilon.cc> wrote:
> >
> >>
> >> Che GhatGPT dica panzane a proposito di persone specifiche (viventi) è
> >> in effetti evidente a tutti. Ma, da non giurista, faccio veramente
> >> fatica a capire perché questo ponga problemi al Garante per la
> >> protezione dei dati personali. Se pubblico un sito web pieno di panzane
> >> su persone viventi, il Garante ha il potere di farmelo chiudere? Direi
> >> (sempre da non giurista), che al massimo rischio una querela per
> >> diffamazione
> >
> >
> >Se la produzione di quelle panzane richiede il trattamento dei dati di
> >milioni di ignari cittadini, allora sì, attrai le ire del Garante (oltre
> >che quelle dei destinatari delle tue panzane).
> >
> >>
> >> --
> >_______________
> >*Maurizio Borghi*
> >Università di Torino
> >https://www.dg.unito.it/persone/maurizio.borghi
> >Co-Director Nexa Center for Internet & Society <https://nexa.polito.it/>
> >
> >My Webex room: https://unito.webex.com/meet/maurizio.borghi
>
> --
> Sent from my mobile phone. Please excuse my brevity and top-posting.
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
>
--
*Avv. Carlo Blengino*
*Via Duchessa Jolanda n. 19,*
*10138 Torino (TO) - Italy*
*tel. +39 011 4474035*
Penalistiassociati.it
April 3, 2023