nexa
By thread
nexa@server-nexa.polito.it
By month
Messages by month
- ----- 2026 -----
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2025 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2024 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2023 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2022 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2021 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2020 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2019 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2018 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2017 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2016 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2015 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2014 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2013 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2012 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2011 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2010 -----
- December
- November
- October
- September
- August
- July
- June
- May
- April
- March
- February
- January
- ----- 2009 -----
- December
- November
- October
- September
- August
- July
- June
- May
February 2023
- 45 participants
- 195 messages
Re: [nexa] Surf [Olanda]: concretezza nelle azioni anti-Big-Tech
by Damiano Verzulli
Il 22/02/23 12:19, Maria Chiara Pievatolo ha scritto:
> [....]
> Se DV lo ritiene utile, posso anche cominciare a far pubblicità
> all'istanza su Garrlab.
L'istanza mastodon di GARRLab è nata semplicemente perché io (in primis)
ed alcuni altri (alcuni studenti che animano la community di GARRLab)
abbiamo voluto toccare con mano cosa significasse, _ESATTAMENTE_,
mettere in piedi una istanza self-hosted di mastodon e come questa si
rapporti con il resto della comunita'/federazione.
Cio' ci ha permesso di capire alcune cose... e soprattutto di
identificare alcune criticita': prima fra tutte, la creazione delle
utenze. Non è un caso che sulla nostra istanza, attualmente è attivo
_SOLO_ il mio "account": gli account (da noi) vanno creati _A_MANO_....
e questo è inaccettabile. Non è un caso che SURF si sia attivata per
aggiungere alla propria istanza il supporto SAML, e quindi far si che
gli account vengano auto-creati previa autenticazione alla loro
federazione nazionale (gestita esternamente alla piattaforma mastodon di
cui discutiamo).
Ci sarebbero ancora un sacco di esperimenti da fare (sul "nostro"
mastodon): analizzare i volumi e la tipologia di traffico (di
federazione); analizzare l'uso delle risorse (memoria, cpu, disco,
rete), magari all'incrementare del numero di utenze e di traffico;
capire le dinamiche che si genereranno rispetto alla necessita' di
moderare i contenuti (al crescere della comunita', inevitalmente ci si
trovera' di fronte alla necessita' di "rimuovere" alcuni contenuti).
Per fare tutto cio', pero', serve una volonta' di farlo... E la mia si è
"esaurita" subito dopo averlo messo in piedi e verificato che funzioni
(chi è su mastodon, puoi "cercarmi" in @verzulli@garrlab.it e vedere
che... mi trova [almeno spero!])
Cio' detto, quell'istanza è li per restare (almeno fino a quando
esistera' GARRLab) e al netto di singhiozzi che sicuramente potranno
esserci (l'intero progetto GARRLab è "best-effort & zero-funded", quindi
si fa quel che si puo', su base volontaria) puo' essere certamente
promossa/pubblicizzata.
Tuttavia, l'obiettivo fondamentale non è quello di farla "crescere" (non
mi interessa creare account per utenti esterni a GARRLab), ma piuttosto
di dimostrare che è possibile fare altrettanto, su proprie
infrastrutture. Quindi, se ad AISA interessa.... può _CERTAMENTE_
contare sul mio/nostro supporto per il setup della _VOSTRA_ istanza.
Anzi. A pensarci bene.... è il caso che io scriva un documento che
racconti quello che è stato fatto, da noi, per metterlo in piedi... a
beneficio di tutti.
> Segnalo anche: https://zenodo.org/record/7652771
Grazie per il link. L'ho gia' aperto e... lo leggero' appena fatto
"INVIO" :-)
Saluti,
DV
--
Damiano Verzulli
e-mail: damiano(a)verzulli.it
---
possible?ok:while(!possible){open_mindedness++}
---
"...I realized that free software would not generate the kind of
income that was needed. Maybe in USA or Europe, you may be able
to get a well paying job as a free software developer, but not
here [in Africa]..." -- Guido Sohne - 1973-2008
http://ole.kenic.or.ke/pipermail/skunkworks/2008-April/005989.html
Feb. 22, 2023
Re: [nexa] ChatGPT: sicuri che.... non "sappia" nulla?
by Damiano Verzulli
Grazie per il contributo, Alberto.
Rispetto al tuo ultimo passaggio:
Il 22/02/23 12:06, Alberto Cammozzo via nexa ha scritto:
> [...]
> Per cui la risposta si sposta a questa domanda: chiedendo a GPT di
> elencare i comandi SQL da dare, faresti copia-incolla? La lasceresti
> _fare_?
> Metteresti un tuo database nelle sue "mani"?
chi mi conosce... sa che io "non sono normale" (in senso matematico).
Non è un caso che io non abbia mai chiesto nulla a ChatGPT (e sono molto
poco stimolato a farlo). Men che meno accetterei di copia-incollare
dell'SQL (o un frammento di bash) all'interno delle mie console, se non
prima di averlo "verificato" (mentalmente) e auto-convincermi che il
frammento sia corretto.
Ma, ripeto.... io NON sono normale.
La cruda realta' è che in giro, la fuori, è _PIENISSIMO_ di gente che fa
copia-incolla senza porsi alcun tipo di problema. Anche di pezzi di
shell...
Da parte mia, ciò non è particolarmente dissimile dall'installare APP "a
caso" da un app-store, sul proprio smartphone... oppure accettere che
sulla propria auto giri del software di cui non si ha il controllo.
Sono questioni (tutte quelle da te elencate, + quelle qui sopra), cui
penso spesso. Molto spesso. Ma faccio una fatica bestiale a
raccapezzarmici...
E' talmente complesso (rifletterci) che alla fine... preferisco
rimettere le mani sulla tastiera (o sugli attrezzi necessari a costruire
il carro di carnevale) :-)
Un caro saluto,
DV
--
Damiano Verzulli
e-mail: damiano(a)verzulli.it
---
possible?ok:while(!possible){open_mindedness++}
---
"...I realized that free software would not generate the kind of
income that was needed. Maybe in USA or Europe, you may be able
to get a well paying job as a free software developer, but not
here [in Africa]..." -- Guido Sohne - 1973-2008
http://ole.kenic.or.ke/pipermail/skunkworks/2008-April/005989.html
Feb. 22, 2023
Re: [nexa] Surf [Olanda]: concretezza nelle azioni anti-Big-Tech
by Maria Chiara Pievatolo
On 22/02/23 10:05, Damiano Verzulli wrote:
> SURF [ https://www.surf.nl/en ] è l'equivalente olandese del nostro
> GARR, ossia un elemento di un network di organizzazioni europee (NREN)
> che, nelle varie nazioni, gestisce la locale "Rete della Ricerca" (la
> lista delle Europee è qui [1]).
>
> SURF ha appena lanciato un pilot "ufficiale" di Mastodon, dedicato a
> tutto il mondo accademico e della ricerca olandese:
>
> https://www.surf.nl/en/mastodon-pilot-for-research-and-education
>
L'abbiamo visto in molti, e ci siamo chiesti se sarebbe stato possibile
anche solo immaginare una discussione del genere alla Crui. Ho cercato,
nel mio piccolo, di proporlo "a casa mia" e non ho neppure ricevuto
risposta.
Ho una macchina virtuale sottoutilizzata. Appena troverò un po' di tempo
per un piccolo studio extradisciplinare ci farò un'istanza accademica di
Mastodon per AISA e altri studiosi di buona volontà, accessibile in
scrittura solo a persone per le quali non necessita moderazione. Se DV
lo ritiene utile, posso anche cominciare a far pubblicità all'istanza su
Garrlab.
Segnalo anche: https://zenodo.org/record/7652771
Un saluto.
MCP
Feb. 22, 2023
Re: [nexa] ChatGPT: sicuri che.... non "sappia" nulla?
by Giacomo Tesio
Ciao Damiano,
On Wed, 22 Feb 2023 09:39:06 +0100 Damiano Verzulli wrote:
> Mi aggancio alla discussione in corso su altri thread sulla natura
> statistica/probabilistica di ChatGPT e sulle relative implicazioni
> (non puo' "sapere"; non produce "informazione", quindi non può
> errare; non ha "conoscenza", etc.).
Confermo:
- non produce e non elabora informazione, solo dati.
- non può errare esattamente quanto non può "fare giusto" [1]
> Da tecnico, rilevo che la "qualita'" delle risposte sia fortemente
> determinata dal dominio della domanda. Se chiedi la biografia di
> Pinco Pallino da Pennapiedimonte, è un conto. Se chiedi cos'é un
> "inner join" è un altro conto. Trovo che la cosa sia molto simile al
> mio carattere personale: se alle superiori mi interrogavano su
> Manzoni... facevo una fatica bestiale; se mi chiedevano di disegnare
> una funzione, era un gioco da ragazzi.
Anzitutto Damiano, credo sia doveroso farti notare che paragonarti ad
una macchina (per altro per difenderla) potrebbe evidenziare una
profonda alienazione in corso.
Non sei una macchina.
ChatGPT non ti assomiglia e tu non assomigli a ChatGPT.
Non merita la tua empatia o la tua difesa.
Mi rendo conto che il passaggio
- dato -> informazione
- informazione -> dato
è talmente naturale ed inconsapevole per la nostra mente da confondere
le due entità. Eppure puoi certamente distinguere la rappresentazione
delle parole che stai leggendo dall'informazione che veicolano.
Poi da tecnico dovresti rilevare che in realtà la qualità attribuita
alla risposta dipende anzitutto dalla preparazione di chi la interpreta.
Prediamo il tuo aneddoto come caso di studio:
> =================
>
> Domanda: "I have a database containing two tables "elementi" and
> "proprietari" in elementi i have rows that refers to multiple
> proprietari and vice versa, what can be the best way to use reference
> keys in this scenarios?"
>
> Risposta: "In a scenario where you have a many-to-many relationship
> between the "elementi" and "proprietari" tables, the best way to use
> reference keys is to create a third table that acts as a bridge
> between the two tables. This is commonly referred to as a junction
> table or an associative table.
> The junction table should contain foreign keys that reference the
> primary keys of the "elementi" and "proprietari" tables. This table
> can also contain additional columns that relate to the relationship
> between the two tables, such as the date the relationship was
> established or the nature of the relationship.
> For example, you could create a junction table called
> "elementi_proprietari" with columns "id", "elemento_id", and
> "proprietario_id". The "id" column would be the primary key of the
> junction table, while "elemento_id" and "proprietario_id" would be
> foreign keys that reference the "id" column of the "elementi" and
> "proprietari" tables, respectively.
> In this way, each row in the junction table represents a relationship
> between a single "elemento" and a single "proprietario". To represent
> relationships between multiple "proprietari" and a single "elemento",
> you would simply add additional rows to the junction table with the
> same "elemento_id" but different "proprietario_id" values.
> By using a junction table, you can easily query and update the
> relationships between "elementi" and "proprietari" using standard SQL
> commands"
>
> =================
>
> Ai non-tecnici che potrebbero non percepire la qualita' della
> risposta, segnalo che non solo è _PERFETTA_, ma la trovo anche
> qualitativamente migliore di molte altre spiegazioni che circolano in
> aria all'inizio dei corsi universitari sui database relazionali.
La risposta non è affatto perfetta.
L'esempio che propone è proprio sbagliato, tanto da evidenziare
l'assoluta assenza di comprensione dell'algebra relazionale.
Se metti come chiave primaria nella junction table un id
(assumo, numerico autoincrementale) e non poni alcun vincolo di
univocità sulle altre due chiavi, permetti l'inserimento di una stessa
relazione più volte, costringendo l'applicativo a gestire i duplicati.
Visto che non si sta parlando di un DBMS in particolare e non possiamo
assumere ridicoli limiti implementativi, la risposta corretta sarebbe
stata di impostare come chiave primaria la coppia proprietario_id,
elemento_id.
Una chiave diversa può aver senso in presenza di attributi di relazione
che possano rendere non univoca la coppia (come una data di scadenza, o
altri attributi specifici della relazione in questione).
Ma anche in tale caso, un db relazionale che si curi della consistenza
dei dati, dovrebbe imporre vincoli specifici che esprimano tale
consistenza.
E anche in presenza di limiti del DBMS in questione che impongano una
chiave primaria costituita da una sola colonna (limite che spero ormai
sia una reminiscenza di tempi oscuri) dovresti specificare la necessità
di un vincolo di univocità della coppia di riferimenti.
Al tuo amico, la risposta può sembrare perfetta, ma non lo è.
Se un collega mi proponesse una simile soluzione, gli farei un lungo
pippotto sul fatto che la junction table proposta non rappresenta
una relazione (in termini matematici) né una proprietà del modello
e ci esporrebbe a diversi bug applicativi.
> Ora io non voglio mettere in dubbio il fatto che ChatGPT risponda
> seguendo logiche statistiche o probabilistiche. Voglio solo dire che
> per _MOLTI_ ambiti (quelli strettamente piu' "tecnici") si fa
> veramente fatica a dire che il suo "output" segua esclusivamente tale
> logica o --per tornare ai thread in corso-- che ChatGPT non "sappia"
> come implementare una relazione N a M nei contesti dei database
> relazionali.
Eppure, come dimostra l'output stesso del tuo esempio, non lo sa.
> E comunque --qualora si volesse insistere su questo
> punto [come mi pare alcuni vogliano fare]-- anche se cosi' fosse...
> tendenzialmente al mio amico non gliene frega un granché [perché la
> risposta alla sua domanda _TECNICA_, è _PERFETTA_].
Non lo è.
E se il tuo amico seguirà il consiglio di ChatGPT si ritroverà prima o
poi con un database inconsistente.
I bug in cui può incappare sono innumerevoli.
Banalmente, se erroneamente una relazione venisse inserita due volte
nella junction table e successivamente solo una delle righe che la
rappresentano venisse aggiornata a valle di un cambiamento di
relazione, il database esprimerebbe due relazioni dove ce n'è una sola.
Nella migliore delle ipotesi, ciò comporterebbe un errore applicativo
da cui l'utente non potrebbe uscire.
Nella peggiore, la relazione erronea avrebbe conseguenze dispositive a
valle, come l'esecuzione di ordini short in finanza etc...
Se al tuo amico "non gliene frega un granché" della consistenza del
database di cui è responsabile, fa bene ad affidarsi a ChatGPT.
Ma forse il suo datore di lavoro dovrebbe esserne informato.
> Aggiungo --infine-- che pur avendo conseguito una laurea in Scienze
> dell'Informazione nel lontano 1995, ho scoperto cosa fosse un
> Gerber-File soltanto nel ~2016. Ed è stato soltanto grazie al mio
> amico (quello del carro), che ho scoperto l'esistenza della
> "Saldatura a TIG" un paio di anni fa e che, a dispetto della
> pressione, a temperatura ambiente non è possibile liquefare il metano
> (il propano si, invece). Insomma: a 52 anni riesco ancora facilmente
> ad "apprendere" cose molto tecniche/specifiche.... Allo stesso tempo
> (continuo) a far fatica a metabolizzare la biografia del Manzoni o
> gli scritti di Dante.
Un proverbio che mia mamma mi ripeteva spesso da giovane era:
"La vecchia aveva cent'anni, e aveva ancora qualcosa da imparare"
ammetto che solo diventando genitore ho iniziato a comprenderne la
profondità.
Purtuttavia il tuo parallelo non sembra aggiungere molto.
Sei finito, nello spazio, nel tempo e nell'esperienza.
E questa è una caratteristica che ti accomuna a ChatGPT e ad un ameba.
Ma contrariamente a ChatGPT e all'ameba, tu sei ANCHE intelligente.
Puoi essere convinto che di non esserlo o di esserlo quanto ChatGPT.
Ma rimarrai un essere umano, dotato di intelligenza e autonomia.
> Mi sorge il dubbio, che anche il mio cervello funzioni --da qualche
> parte-- con logiche statistico/probabilistiche.
Stai confondendo il modello con la realtà modellata.
Tu puoi certamente descrivere alcuni comportamenti del tuo cervello
"con logiche statistico/probabilistiche". Lui continuerà ad essere un
cervello che fa un po' quel che gli pare, seguendo istinti primordiali,
riflessioni, esperienze sensoriali o mistiche etc...
Invece ChatGPT è un software programmato statisticamente.
Tu puoi comportarti come ChatGPT, come un gatto o come una ameba.
Rimani un essere umano, dotato di una mente che elabora informazioni.
ChatGPT rimane un software programmato statisticamente.
Un software che elabora meccanicamente dati che non può comprendere.
> Un'ultima nota: ho letto piu' volte, in lista, di organizzare forme
> di "resistenza" a questo fenomeno. [...] nutro fortissimi dubbi che
> da questa lista, per questo ambito specifico, possano uscire cose
> piu' concrete degli Archives della lista stessa.
Beh come da qualsiasi mailing list, suppongo.
Ma le persone che partecipano a questa comunità possono fare molto
per diffondere consapevolezza sulla natura di questi agenti cibernetici.
Possono persino influenzare la loro regolamentazione futura.
Ad esempio, potrebbero spiegare ai politici l'urgenza di vientarne
l'utilizzo in ambito medico, educativo o legale.
O l'importanza di imporre pene severe e responsabilità precise in capo
a chi li esegue per i danni prodotti dall'interpretazione del loro
output, "giusto" o "sbagliato" che appaia ex-post.
Se per esempio un paziente fraintendesse l'output di un LLM medico [2]
e subisse un danno dalla terapia adottata, ne dovrebbe rispondere
civilmente e penalmente chi ha prodotto ed eseguito quel LLM.
> Aldila' del fatto che trovo il termine "resistenza"
> non-brillantissimo
Puoi elaborare? In che senso?
Giacomo
[1]: persino meno di uno studente che abbia studiato a memoria il libro
del professore che lo interroga e lo sappia ripetere a menadito pur
non avendo compreso una parola: lo studente ha la possibilità
teorica, in futuro, di rielaborare le nozioni memorizzate e
comprenderle, ChatGPT no.
[2]: Non è un'ipotesi così astratta, Microsoft conta molto sul NON dover
rispondere dei danni: https://github.com/microsoft/BioGPT
Feb. 22, 2023
Re: [nexa] ChatGPT: sicuri che.... non "sappia" nulla?
by Alberto Cammozzo
Caro Damiano,
sono anche io colpito dalla competenza descrittiva e procedurale della
risposta.
Tuttavia la domanda posta (1) è molto specifica, in (2) un ambito molto
tecnico per la quale (3) la pragmatica (cioè come si _fa_ -a mano- una
relazione tra tabelle etc...) è piuttosto univoca.
Per cui suppongo che la variabilità all'interno dei testi selezionati
dal lessico della domanda sia piuttosto bassa, specie se sono
selezionate fonti con uno score che misura l'affidabilità della risposta
(come stackoverflow). Anche se diversa nella complessità, la risposta
non è più controversa che chiedere "come si sposta un file in Unix".
Mi aspetterei un comportamento diverso in domande come "come curare la
gastrite dell'unicorno", ambito altrettanto specifico e tecnico ma con
risposte che mi aspetto più variabili (magari mi sbaglio, confesso di
essere piuttosto ignorante in materia di unicorni).
Anche la ricetta della pasta alla carbonara rischia di riservare delle
sorprese, specie se formulata in inglese.
Il fatto che la risposta a domande tecniche sia esatta ("vera", cioè si
fa davvero così) significa che vi è poca variabilità nei contenuti dei
documenti che ne descrivono la pragmatica e che la macchina riassume
secondo il percorso più probabile, rispecchiandone la coerenza semantica
e lessicale.
Sarei curioso di vedere se GPT mantiene la risposta corretta anche a
fronte di un riscontro negativo dell'utente.
Resta la sorpresa di veder emulata una competenza, quella verbale
descrittiva, che noi associamo alla conoscenza.
Qui linguisti, epistemologi e filosofi avranno da riflettere appena si
saranno ripresi dallo shock. Cosa significa 'sapere' se uno dei suoi
indicatori (la competenza descrittiva verbale) può essere emulato da una
macchina?
Ribalterei la tua domanda: cosa differenzia il "sapere" umano da quello
emulabile?
Pragmatismo e idealismo si confronteranno diversamente su questa
domanda, sono curioso di vederne lo sviluppo, ma in ambito tecnico credo
ci siano pochi dubbi che 'sapere' vuol dire 'saper fare'. La macchina
che davvero "sa", oltre che saper descrivere, deve saper fare.
Per cui la risposta si sposta a questa domanda: chiedendo a GPT di
elencare i comandi SQL da dare, faresti copia-incolla? La lasceresti
_fare_?
Metteresti un tuo database nelle sue "mani"?
Ciao,
Alberto
On 22/02/2023 09:39, Damiano Verzulli wrote:
> Mi aggancio alla discussione in corso su altri thread sulla natura
> statistica/probabilistica di ChatGPT e sulle relative implicazioni
> (non puo' "sapere"; non produce "informazione", quindi non può errare;
> non ha "conoscenza", etc.).
>
> Da tecnico, rilevo che la "qualita'" delle risposte sia fortemente
> determinata dal dominio della domanda. Se chiedi la biografia di Pinco
> Pallino da Pennapiedimonte, è un conto. Se chiedi cos'é un "inner
> join" è un altro conto. Trovo che la cosa sia molto simile al mio
> carattere personale: se alle superiori mi interrogavano su Manzoni...
> facevo una fatica bestiale; se mi chiedevano di disegnare una
> funzione, era un gioco da ragazzi.
>
> Dico questo, perché ieri parlavo (mentre sfilavamo per il paese, sul
> carro di Carnevale) con un amico che mi chiedeva: "Damia'! Ma se ho
> una relazione N a M fra 2 tabelle SQL, come posso organizzare il
> database?". Ed io gli dicevo: "Nessun problema. Ti serve una terza
> tabella, dove infili la relazione fra le due". E ne abbiamo discusso
> per qualche minuto (attorniati da coriandoli, musica e tanto altro
> "casino").
>
> Stamattina mi ha scritto, copia-incollandomi l'interazione con ChatGPT:
>
> =================
>
> Domanda: "I have a database containing two tables "elementi" and
> "proprietari" in elementi i have rows that refers to multiple
> proprietari and vice versa, what can be the best way to use reference
> keys in this scenarios?"
>
> Risposta: "In a scenario where you have a many-to-many relationship
> between the "elementi" and "proprietari" tables, the best way to use
> reference keys is to create a third table that acts as a bridge
> between the two tables. This is commonly referred to as a junction
> table or an associative table.
> The junction table should contain foreign keys that reference the
> primary keys of the "elementi" and "proprietari" tables. This table
> can also contain additional columns that relate to the relationship
> between the two tables, such as the date the relationship was
> established or the nature of the relationship.
> For example, you could create a junction table called
> "elementi_proprietari" with columns "id", "elemento_id", and
> "proprietario_id". The "id" column would be the primary key of the
> junction table, while "elemento_id" and "proprietario_id" would be
> foreign keys that reference the "id" column of the "elementi" and
> "proprietari" tables, respectively.
> In this way, each row in the junction table represents a relationship
> between a single "elemento" and a single "proprietario". To represent
> relationships between multiple "proprietari" and a single "elemento",
> you would simply add additional rows to the junction table with the
> same "elemento_id" but different "proprietario_id" values.
> By using a junction table, you can easily query and update the
> relationships between "elementi" and "proprietari" using standard SQL
> commands"
>
> =================
>
> Ai non-tecnici che potrebbero non percepire la qualita' della
> risposta, segnalo che non solo è _PERFETTA_, ma la trovo anche
> qualitativamente migliore di molte altre spiegazioni che circolano in
> aria all'inizio dei corsi universitari sui database relazionali.
>
> Ora io non voglio mettere in dubbio il fatto che ChatGPT risponda
> seguendo logiche statistiche o probabilistiche. Voglio solo dire che
> per _MOLTI_ ambiti (quelli strettamente piu' "tecnici") si fa
> veramente fatica a dire che il suo "output" segua esclusivamente tale
> logica o --per tornare ai thread in corso-- che ChatGPT non "sappia"
> come implementare una relazione N a M nei contesti dei database
> relazionali.
> E comunque --qualora si volesse insistere su questo punto [come mi
> pare alcuni vogliano fare]-- anche se cosi' fosse... tendenzialmente
> al mio amico non gliene frega un granché [perché la risposta alla sua
> domanda _TECNICA_, è _PERFETTA_].
>
> Aggiungo --infine-- che pur avendo conseguito una laurea in Scienze
> dell'Informazione nel lontano 1995, ho scoperto cosa fosse un
> Gerber-File soltanto nel ~2016. Ed è stato soltanto grazie al mio
> amico (quello del carro), che ho scoperto l'esistenza della "Saldatura
> a TIG" un paio di anni fa e che, a dispetto della pressione, a
> temperatura ambiente non è possibile liquefare il metano (il propano
> si, invece). Insomma: a 52 anni riesco ancora facilmente ad
> "apprendere" cose molto tecniche/specifiche.... Allo stesso tempo
> (continuo) a far fatica a metabolizzare la biografia del Manzoni o gli
> scritti di Dante.
>
> Mi sorge il dubbio, che anche il mio cervello funzioni --da qualche
> parte-- con logiche statistico/probabilistiche.
>
>
> Un'ultima nota: ho letto piu' volte, in lista, di organizzare forme di
> "resistenza" a questo fenomeno. Aldila' del fatto che trovo il termine
> "resistenza" non-brillantissimo, nutro fortissimi dubbi che
> --perdonatemi la brutalità-- da questa lista, per questo ambito
> specifico, possano uscire cose piu' concrete degli Archives della
> lista stessa.
>
> Bye,
> DV
>
>
> _______________________________________________
> nexa mailing list
> nexa(a)server-nexa.polito.it
> https://server-nexa.polito.it/cgi-bin/mailman/listinfo/nexa
Feb. 22, 2023
Sofisti Artificiali
by 380°
Buongiorno,
grazie Marco per LA frase chiave del discorso :-)
"Marco A. Calamari" <marcoc_maillist(a)marcoc.it> writes:
[...]
> GPT-3 non funziona così. Non immagazzina conoscenza, ma si perfeziona
> nell'abilità di mettere in fila le parole. Solo quello.
Credo che sia all'opera un processo che nel "circolo" di c18e.it
chiamiamo "mascheramento", simile (ma più complesso) rispetto al
mascheramento operato dalle interfacce grafiche (o web)
A ben vedere, sotto la maschera, ChatGPT è un sofista (erista)
cibernetico autonomo, è maestro nel "mettere in fila le parole" e far
/apparire/ che siano vere _solo_ perché sono messe in fila estremamente
bene.
Tecnicamente, /ontologicamente/, in un Large Language Model:
--8<---------------cut here---------------start------------->8---
non interessa se un discorso possa essere vero o falso né le definizioni
delle parole che vengono impiegate; il suo unico fine è quello di
confutare il proprio avversario e di persuaderlo mediante la retorica a
cambiare opinione. Per questo i sofisti della scuola eristica, detti
eristi, si vantavano di poter confutare qualsiasi cosa che si dica esser
vera o esser falsa.
--8<---------------cut here---------------end--------------->8---
(da https://it.wikipedia.org/wiki/Eristica)
Qualche millennio dopo, l'uomo è in grado di "costruire" una magnifica
MES (Macchina Eristica Stocastica) denominata Large Language Model [1],
roba che i sofisti non potevano nemmeno sognarsi di striscio fino a 30
anni fa, erano costretti a ricorrere autonomamente ad altre /tecniche/.
Penso che i /narratori/ e i progettisti dei LLM e dell'AI in generale
non si pongano minimamente un obiettivo filosofico ma si "limitino" ad
applicare _tecniche_ sofistiche:
--8<---------------cut here---------------start------------->8---
[...] in antitesi con la parola «filosofia», intesa come ricerca del
sapere, che presuppone socraticamente il fatto di non possedere alcun
sapere. I sofisti vennero ritenuti falsi sapienti, interessati al
successo e ai soldi, più che alla verità.
[...] I sofisti concepivano la verità come una forma di conoscenza
sempre e comunque relativa al soggetto che la produce e al suo rapporto
con l'esperienza. Non esiste un'unica verità, poiché essa si frantuma in
una miriade di opinioni soggettive, le quali, proprio in quanto
relative, finiscono per essere considerate comunque valide ed
equivalenti: si parla pertanto di relativismo gnoseologico. Questo
relativismo investe tutti gli ambiti della conoscenza, dall'etica alla
politica, dalla religione alle scienze della natura.
[...] La dialettica divenne una disciplina filosofica essenziale e
influenzò profondamente la retorica, ponendo l'accento sull'aspetto
persuasivo dei discorsi, fino a scadere nell'eristica.
--8<---------------cut here---------------end--------------->8---
(da https://it.wikipedia.org/wiki/Sofistica)
...solo che, a volte, ce lo dimentichiamo (perché /sempre/ quando c'è di
mezzo un computer c'è di mezzo una forma più o meno marcata di
mascheramento).
[...]
saluti, 380°
[1] che poi... mi piacerebbe ascoltare il giudizio di qualche linguista
in merito alla "stocastica del linguaggio" :-O
P.S.: dialettica NON in senso hegeliano, insomma
--
380° (Giovanni Biscuolo public alter ego)
«Noi, incompetenti come siamo,
non abbiamo alcun titolo per suggerire alcunché»
Disinformation flourishes because many people care deeply about injustice
but very few check the facts. Ask me about <https://stallmansupport.org>.
Feb. 22, 2023
Re: [nexa] l'output e le fonti [era Triste Annuncio (a proposito di Chat GPT)]
by Andrea Bolioli
I dataset usati nell'apprendimento automatico influenzano fortemente i
comportamenti dei servizi basati sugli LLM, anche se non li definiscono in
modo deterministico.
Un filone di ricerca portato avanti da Andrew Ng e altri ricercatori è
focalizzato proprio sulla Data centric AI: banalmente, se il dataset
contiene solo testi misogini, l'LLM genererà testi misogini. I dataset
utilizzati hanno un ruolo importante.
Si ha a che fare però con dataset enormi, il training richiede enormi
capacità computazionali e di memoria, quindi non è facile lavorare su
questi aspetti, mi risulta che le università stesse abbiano difficoltà a
lavorare su questi temi.
Ricercatori come Giuseppe Attardi possono spiegare molto meglio di me
questi temi.
Come funzionerebbe un LLM che abbia fatto apprendimento anche su intere
banche dati bibliografiche? Non lo so.
Dato un certo LLM (che fa quello che vuole, quello che sa fare, genere
testi di tanti tipi), posso andare a controllare/analizzare i testi che
genera oppure controllare/analizzare i testi che scrivono gli utenti, e
quindi filtrarli, integrali, correggerli. Ad es. Bing sta mettendo
filtri/limiti vari all'interazione con gli utenti in questi giorni per non
rendere visibili troppe fesserie generate automaticamente.
Se il controllo, filtro, integrazione con risorse esterne diventa troppo
costoso, probabilmente ad un certo punto conviene creare un nuovo LLM.
AB
Il giorno mer 22 feb 2023 alle ore 10:51 380° <g380(a)biscuolo.net> ha
scritto:
> Andrea Bolioli via nexa <nexa(a)server-nexa.polito.it> writes:
>
> [...]
>
> > Questo tipo di errore non me l'aspettavo, perché non è molto difficile
> > controllare la correttezza (o perlomeno l'esistenza) dei riferimenti
> > bibliografici. Evidentemente non era tra le priorità di OpenAI finora,
> non
> > avranno ancora integrato banche dati bibliografiche?
>
> ribadisco la mia fiera (sebbene relativa) ignoranza nel funzionamento di
> ChatGPT, ma è tecnicamente possibile "inserire" nel modello generato da
> una rete neurale un sistema di verifica di fonti esterne tipo
> bibliografie, database RDF, ecc.?
>
--
*
*
innovation.h-farm.com <https://innovation.h-farm.com/> / Linkedin
<https://www.linkedin.com/company/h-farm-innovation>
*Roncade*, H-FARM
Campus, Via Olivetti, 1 – 31056 (TV)
*Milano*, Corso di Porta Romana, 15 –
20122
*Torino*, Via San Quintino, 31 – 10121
Our privacy policy
<https://www.jakala.com/wp-content/uploads/2019/11/JAKALA-pivacy-policy-and-…>.
Feb. 22, 2023
Re: [nexa] l'output e le fonti [era Triste Annuncio (a proposito di Chat GPT)]
by 380°
Andrea Bolioli via nexa <nexa(a)server-nexa.polito.it> writes:
[...]
> Questo tipo di errore non me l'aspettavo, perché non è molto difficile
> controllare la correttezza (o perlomeno l'esistenza) dei riferimenti
> bibliografici. Evidentemente non era tra le priorità di OpenAI finora, non
> avranno ancora integrato banche dati bibliografiche?
ribadisco la mia fiera (sebbene relativa) ignoranza nel funzionamento di
ChatGPT, ma è tecnicamente possibile "inserire" nel modello generato da
una rete neurale un sistema di verifica di fonti esterne tipo
bibliografie, database RDF, ecc.?
da quello che ho capito io (soprattutto grazie a https://nooscope.ai/
[1]) non è possibile "incorporare" le fonti /prima/ della generazione
del modello LLM perché le fasi di "compressione delle informazioni"
(inevitabili per poter generare il modello) non prevedono di "salvare"
la fonte (non c'è nemmeno il concetto di fonte in una rete neurale, no?)
l'unica cosa che si potrebbe fare è quella di far controllare la
risposta ad un agente cibernetico autonomo esterno al LLM al quale venga
fornito il "database universale delle fonti" e che sia in grado di
verificare postumamente le fonnti alle quali si riferisce l'output di
ChatGPT... ma siamo punto e a capo: qual'è quell sistema AI in grado di
farlo?
saluti, 380°
[1] "a manifesto of AI dissidents" :-D
[...]
--
380° (Giovanni Biscuolo public alter ego)
«Noi, incompetenti come siamo,
non abbiamo alcun titolo per suggerire alcunché»
Disinformation flourishes because many people care deeply about injustice
but very few check the facts. Ask me about <https://stallmansupport.org>.
Feb. 22, 2023
Surf [Olanda]: concretezza nelle azioni anti-Big-Tech
by Damiano Verzulli
SURF [ https://www.surf.nl/en ] è l'equivalente olandese del nostro
GARR, ossia un elemento di un network di organizzazioni europee (NREN)
che, nelle varie nazioni, gestisce la locale "Rete della Ricerca" (la
lista delle Europee è qui [1]).
SURF ha appena lanciato un pilot "ufficiale" di Mastodon, dedicato a
tutto il mondo accademico e della ricerca olandese:
https://www.surf.nl/en/mastodon-pilot-for-research-and-education
L'istanza mastodon è questa:
https://social.edu.nl/about
Data la natura di SURF e la pre-esistenza di sistemi di federazione
delle identita' fra tutti gli enti afferenti a SURF, questo vuol dire
che con questa (semplice) azione, si è data _ISTANTANEAMENTE_ la
possibilita' a _CENTINAIA_DI_MIGLIAIA_ di studenti e docenti olandesi
[2], di "accedere" a questo pilot (autocreandosi l'account) ed
utilizzarlo...
Ovviamente, in SURF c'e' qualcuno che si è dovuto sciroppare come
installare e configurare Mastodon, tenendo presente che la cosa potrebbe
dover "scalare" rapidamente...
Ma... avendolo fatto io stesso, con le mie mani, su una scala ridotta
[3], posso garantire che... non è nulla di straordinariamente complesso.
Basterebbe solo volerlo fare...
Bye,
DV
[1]
https://en.wikipedia.org/wiki/National_research_and_education_network#Europe
[2] https://dashboard.surfconext.nl/apps/9977/saml20_sp/about?language=en
[3] https://mastodon.garrlab.it/about
--
Damiano Verzulli
e-mail: damiano(a)verzulli.it
---
possible?ok:while(!possible){open_mindedness++}
---
"...I realized that free software would not generate the kind of
income that was needed. Maybe in USA or Europe, you may be able
to get a well paying job as a free software developer, but not
here [in Africa]..." -- Guido Sohne - 1973-2008
http://ole.kenic.or.ke/pipermail/skunkworks/2008-April/005989.html
Feb. 22, 2023
ChatGPT: sicuri che.... non "sappia" nulla?
by Damiano Verzulli
Mi aggancio alla discussione in corso su altri thread sulla natura
statistica/probabilistica di ChatGPT e sulle relative implicazioni (non
puo' "sapere"; non produce "informazione", quindi non può errare; non ha
"conoscenza", etc.).
Da tecnico, rilevo che la "qualita'" delle risposte sia fortemente
determinata dal dominio della domanda. Se chiedi la biografia di Pinco
Pallino da Pennapiedimonte, è un conto. Se chiedi cos'é un "inner join"
è un altro conto. Trovo che la cosa sia molto simile al mio carattere
personale: se alle superiori mi interrogavano su Manzoni... facevo una
fatica bestiale; se mi chiedevano di disegnare una funzione, era un
gioco da ragazzi.
Dico questo, perché ieri parlavo (mentre sfilavamo per il paese, sul
carro di Carnevale) con un amico che mi chiedeva: "Damia'! Ma se ho una
relazione N a M fra 2 tabelle SQL, come posso organizzare il database?".
Ed io gli dicevo: "Nessun problema. Ti serve una terza tabella, dove
infili la relazione fra le due". E ne abbiamo discusso per qualche
minuto (attorniati da coriandoli, musica e tanto altro "casino").
Stamattina mi ha scritto, copia-incollandomi l'interazione con ChatGPT:
=================
Domanda: "I have a database containing two tables "elementi" and
"proprietari" in elementi i have rows that refers to multiple
proprietari and vice versa, what can be the best way to use reference
keys in this scenarios?"
Risposta: "In a scenario where you have a many-to-many relationship
between the "elementi" and "proprietari" tables, the best way to use
reference keys is to create a third table that acts as a bridge between
the two tables. This is commonly referred to as a junction table or an
associative table.
The junction table should contain foreign keys that reference the
primary keys of the "elementi" and "proprietari" tables. This table can
also contain additional columns that relate to the relationship between
the two tables, such as the date the relationship was established or the
nature of the relationship.
For example, you could create a junction table called
"elementi_proprietari" with columns "id", "elemento_id", and
"proprietario_id". The "id" column would be the primary key of the
junction table, while "elemento_id" and "proprietario_id" would be
foreign keys that reference the "id" column of the "elementi" and
"proprietari" tables, respectively.
In this way, each row in the junction table represents a relationship
between a single "elemento" and a single "proprietario". To represent
relationships between multiple "proprietari" and a single "elemento",
you would simply add additional rows to the junction table with the same
"elemento_id" but different "proprietario_id" values.
By using a junction table, you can easily query and update the
relationships between "elementi" and "proprietari" using standard SQL
commands"
=================
Ai non-tecnici che potrebbero non percepire la qualita' della risposta,
segnalo che non solo è _PERFETTA_, ma la trovo anche qualitativamente
migliore di molte altre spiegazioni che circolano in aria all'inizio dei
corsi universitari sui database relazionali.
Ora io non voglio mettere in dubbio il fatto che ChatGPT risponda
seguendo logiche statistiche o probabilistiche. Voglio solo dire che per
_MOLTI_ ambiti (quelli strettamente piu' "tecnici") si fa veramente
fatica a dire che il suo "output" segua esclusivamente tale logica o
--per tornare ai thread in corso-- che ChatGPT non "sappia" come
implementare una relazione N a M nei contesti dei database relazionali.
E comunque --qualora si volesse insistere su questo punto [come mi pare
alcuni vogliano fare]-- anche se cosi' fosse... tendenzialmente al mio
amico non gliene frega un granché [perché la risposta alla sua domanda
_TECNICA_, è _PERFETTA_].
Aggiungo --infine-- che pur avendo conseguito una laurea in Scienze
dell'Informazione nel lontano 1995, ho scoperto cosa fosse un
Gerber-File soltanto nel ~2016. Ed è stato soltanto grazie al mio amico
(quello del carro), che ho scoperto l'esistenza della "Saldatura a TIG"
un paio di anni fa e che, a dispetto della pressione, a temperatura
ambiente non è possibile liquefare il metano (il propano si, invece).
Insomma: a 52 anni riesco ancora facilmente ad "apprendere" cose molto
tecniche/specifiche.... Allo stesso tempo (continuo) a far fatica a
metabolizzare la biografia del Manzoni o gli scritti di Dante.
Mi sorge il dubbio, che anche il mio cervello funzioni --da qualche
parte-- con logiche statistico/probabilistiche.
Un'ultima nota: ho letto piu' volte, in lista, di organizzare forme di
"resistenza" a questo fenomeno. Aldila' del fatto che trovo il termine
"resistenza" non-brillantissimo, nutro fortissimi dubbi che
--perdonatemi la brutalità-- da questa lista, per questo ambito
specifico, possano uscire cose piu' concrete degli Archives della lista
stessa.
Bye,
DV
--
Damiano Verzulli
e-mail: damiano(a)verzulli.it
---
possible?ok:while(!possible){open_mindedness++}
---
"...I realized that free software would not generate the kind of
income that was needed. Maybe in USA or Europe, you may be able
to get a well paying job as a free software developer, but not
here [in Africa]..." -- Guido Sohne - 1973-2008
http://ole.kenic.or.ke/pipermail/skunkworks/2008-April/005989.html
Feb. 22, 2023