L’intelligenza artificiale può comprendere?

L’intelligenza artificiale può comprendere?

Condividi con i tuoi amici...

La questione della comprensione, un concetto tanto fondamentale quanto complesso, ha sempre suscitato dibattito sia tra filosofi che tra scienziati. Con l’avvento delle moderne tecnologie di intelligenza artificiale, l’attribuzione di capacità di comprensione ai modelli di AI è divenuta un tema particolarmente controverso. Da un lato, gli entusiasti del progresso tecnologico vedono nelle reti neurali e negli algoritmi di machine learning la possibilità di riprodurre e persino superare le capacità umane di comprensione. Dall’altro lato, molti ritengono che la vera comprensione sia un fenomeno profondamente umano, irriducibile a mere formalizzazioni matematiche e algoritmiche.

Questa controversia rende necessario un approfondimento critico del significato stesso di comprensione. La comprensione è riducibile a sistemi formali o modelli scientifici? È davvero possibile che reti neurali e algoritmi riescano a replicare l’ampiezza e la profondità della comprensione umana, che non solo associa dati e identifica pattern, ma entra in risonanza con emozioni, contesti culturali e storicità?

Attraverso l’analisi delle prospettive filosofiche, come quelle di Hans-Georg Gadamer, che ha enfatizzato l’importanza delle precomprensioni e della storicità nel processo ermeneutico, si evidenzia come la comprensione umana vada oltre i limiti dell’analisi logica e dei modelli formali. D’altro canto, la straordinaria capacità adattativa e la complessità crescente delle moderne AI invitano a non escludere del tutto la possibilità che forme di “comprensione” possano emergere anche in sistemi non umani, sollevando nuove ed intriganti domande sul significato e sui confini della comprensione stessa.

L’obiettivo di questo articolo è offrire una riflessione sulla complessa intersezione tra comprensione umana e artificiale, promuovendo un dialogo tra filosofia e scienza per esplorare se e come la comprensione, in tutta la sua ricchezza, possa essere modellata, formalizzata e, forse, superata.


“Afferrare completamente”

La parola “comprensione” deriva dal latino “comprehensio, comprehensionis“, che è un sostantivo femminile derivato dal verbo “comprehendere”.

Il verbo “comprehendere” può essere scomposto ulteriormente:

“prehendere”: deriva dalla radice indoeuropea “ghend-” o “ghehd-“ che significa “prendere”, “afferrare”.
com-“: insieme, completamente.

Quindi, il significato letterale di “comprehendere” è “afferrare completamente” o “prendere insieme”.

Nel latino classico, “comprehendere” veniva usato in vari contesti, da quello fisico (afferrare, catturare) a quello intellettuale (comprendere, capire). Da qui, il sostantivo “comprehensio” ha mantenuto questa duplice valenza, indicando sia l’atto di afferrare fisicamente qualcosa sia l’atto di comprendere mentalmente un concetto o un’idea.

In italiano, la parola “comprensione” ha mantenuto principalmente il significato intellettuale e mentale, riferendosi alla capacità di capire, afferrare concetti, idee, emozioni e situazioni.

I molteplici contesti della comprensione

Si possono individuare diversi contesti principali in cui avviene la comprensione ai quali possiamo attribuire convenzionalmente dei nomi:

La comprensione cognitiva riguarda la capacità di processare e assimilare informazioni attraverso il pensiero razionale e logico, utilizzando abilità mentali come l’analisi, la sintesi e il ragionamento.

La comprensione pragmatica consiste nel comprendere il significato e l’uso del linguaggio nel contesto della comunicazione quotidiana, tenendo conto delle intenzioni dell’interlocutore e delle convenzioni sociali.

La comprensione empatica è la capacità di comprendere e condividere i sentimenti e le emozioni di un’altra persona, mettendosi nei suoi panni e percependo il suo stato emotivo.

La comprensione ermeneutica riguarda l’interpretazione dei testi, in particolare quelli complessi o ambigui, e si basa sull’analisi del contesto, del significato e dell’intenzione dell’autore.

La comprensione dei fenomeni si riferisce alla capacità di capire i fenomeni naturali o sociali attraverso l’osservazione, l’analisi delle cause e degli effetti, e la formulazione di modelli esplicativi.

La comprensione morale coinvolge la capacità di discernere tra giusto e sbagliato, e di valutare le azioni o le decisioni in base a principi etici o morali.

La comprensione sensoriale è la capacità di percepire e interpretare informazioni attraverso i sensi, come la vista, l’udito, il tatto, il gusto e l’olfatto.

La comprensione storica consiste nella capacità di interpretare e comprendere eventi passati, analizzandoli nel loro contesto temporale e considerando le loro cause, conseguenze e significati.

La comprensione culturale si riferisce alla capacità di riconoscere, comprendere e apprezzare i valori, le credenze, le pratiche e i simboli di una cultura diversa dalla propria.

La comprensione metacognitiva coinvolge la consapevolezza e il controllo sui propri processi di pensiero e apprendimento, permettendo di riflettere su come si conosce e su come si risolvono i problemi.

Si può dire che la comprensione implica la capacità di stabilire e integrare relazioni tra idee di livello inferiore per formare idee di livello superiore. Questo processo di sintesi è alla base di molte forme di comprensione, che si tratti di concetti intellettuali, emozionali o pratici.

Per esempio nell’ambito della comprensione cognitiva si integrano informazioni e concetti di base per formare una comprensione più complessa. In matematica, si deve comprendere come diverse operazioni aritmetiche si combinano per risolvere equazioni complesse.

Nella comprensione pragmatica si combinano conoscenze e abilità pratiche per sapere come agire in situazioni concrete e articolate. Per esempio un meccanico unisce la conoscenza dei singoli componenti di un motore per riparare un’auto.

La comprensione empatica permette di integrare le proprie esperienze con quelle degli altri per comprendere le loro emozioni e reazioni. Un terapeuta utilizza la sua conoscenza delle emozioni umane per comprendere e aiutare un paziente.

La comprensione ermeneutica implica interpretare segni, simboli e testi combinando elementi culturali e storici per formare un significato più ampio. Un critico letterario analizza simboli e temi in un’opera letteraria per comprendere il messaggio dell’autore.

La comprensione dei fenomeni implica collegare cause ed effetti per ricostruire le dinamiche di un fenomeno. Uno scienziato studia le relazioni tra variabili per comprendere il cambiamento climatico.

Per ottenere la comprensione morale si integrano principi etici e situazioni specifiche per giudicare ciò che è giusto o sbagliato. Un giudice considera le leggi e i precedenti legali per prendere una decisione equa.

Combinando stimoli sensoriali per formare una percezione coerente dell’ambiente si ottiene la comprensione sensoriale. Un sommelier unisce aromi, sapori e consistenze per valutare un vino.

Collegare eventi passati per comprendere il loro impatto sul presente e futuro significa comprendere storicamente qualcosa. Un insegnante di storia spiega come la Rivoluzione Francese ha influenzato la democrazia moderna.

Integrare diverse tradizioni e pratiche culturali per promuovere la tolleranza e la comprensione reciproca significa promuovere la comprensione culturale. Un diplomatico comprende le tradizioni e le norme culturali per negoziare efficacemente con rappresentanti di altri paesi.

Riflettere sulle proprie strategie di apprendimento per migliorarle e adattarle a nuove situazioni vuol dire avviare un processo metacognitivo. Uno studente analizza i propri metodi di studio per ottenere risultati migliori.

In tutti questi casi, la comprensione implica il processo di mettere insieme elementi più semplici per formare un quadro integrato e il più possibile completo, rendendo esplicito il legame coerente tra le idee elementari di livello inferiore e quelle composte di livello superiore. Il procedimento è quello dell’inferenza.

Quando parliamo di elementi da integrare logicamente per dedurre dei risultati a partire da certi dati, ci vengono in mente i sistemi formali che caratterizzano i ragionamenti più rigorosi in assoluto.

In realtà è facile sostenere che la comprensione umana in generale non sia formalizzabile per via della complessità in gioco e della componente soggettiva implicata nel processo stesso. Definire un criterio universale in grado di stabilire se vi è stata o meno vera comprensione di un argomento, diventa pertanto molto arduo. Tuttavia, quando due persone dicono di essersi comprese, è vero? Quando uno studente sostiene di aver compreso la lezione, l’ha compresa davvero? Quando la comunità scientifica dichiara di aver compreso un certo fenomeno fisico, lo ha compreso veramente? Quando un testo viene interpretato, tale interpretazione è corretta?

Vi sono campi del sapere per i quali si possono costruire sistemi formali rigorosi

coerenza e completezza nei sistemi formali

I concetti di coerenza e completezza sono fondamentali nella logica e nei sistemi formali, e sono stati esplorati in profondità nel contesto dei teoremi di incompletezza di Gödel.

Un sistema formale è una struttura teorica utilizzata in logica, matematica e informatica per definire rigorosamente il concetto di dimostrazione e di deduzione. Un sistema formale è costituito da quattro componenti principali:

Alfabeto: Un insieme finito di simboli di base che costituiscono le unità fondamentali del sistema. Questi simboli possono rappresentare vari elementi, come numeri, variabili, operatori logici, e così via.

Regole di formazione: Un insieme di regole che specificano come i simboli dell’alfabeto possono essere combinati per formare espressioni ben formate (EBF), ovvero le stringhe di simboli che sono considerate sintatticamente corrette all’interno del sistema. Le EBF rappresentano le proposizioni o le affermazioni del sistema.

Assiomi: Un insieme di espressioni ben formate che sono accettate come verità fondamentali senza bisogno di dimostrazione. Gli assiomi sono le “regole di partenza” da cui si sviluppano le deduzioni all’interno del sistema.

Regole di inferenza: Regole che determinano come nuove espressioni ben formate possono essere derivate dagli assiomi o da altre espressioni già dimostrate. Le regole di inferenza sono le procedure logiche che permettono di dedurre conclusioni a partire da premesse date.

Un sistema formale funziona nel modo seguente:

Si parte dagli assiomi. Applicando le regole di inferenza, si possono derivare nuove proposizioni, chiamate teoremi. Il processo di deduzione continua finché non si ottiene una proposizione desiderata o si dimostra l’impossibilità di derivarla.

Esempi di Sistemi Formali

Aritmetica di Peano: Un sistema formale che definisce i numeri naturali e le operazioni aritmetiche di base.
Logica proposizionale: Un sistema formale che riguarda proposizioni e connettivi logici come AND, OR, e NOT.
Teoria degli insiemi di Zermelo-Fraenkel: Un sistema formale utilizzato come fondamento della matematica moderna.

I sistemi formali sono utilizzati per formalizzare e analizzare le teorie matematiche, per automatizzare il ragionamento (come nei sistemi di prova automatizzata) e per costruire modelli computazionali. Sono strumenti essenziali per garantire la precisione e la coerenza nei ragionamenti complessi e per esplorare i limiti del sapere matematico e logico, come dimostrato dai teoremi di incompletezza di Gödel.

Possiamo pensare a questi sistemi come a procedimenti rigorosi per giungere alla comprensione mediante il ragionamento formale. Non sono applicabili necessariamente a tutti i casi ma potrebbero essere presi come modello ideale di comprensione.

Coerenza e completezza

Un sistema formale è coerente (o consistente) se non permette di derivare una contraddizione, cioè non è possibile dimostrare sia una proposizione P che la sua negazione ¬P all’interno del sistema. Se un sistema è incoerente (o inconsistente), qualsiasi proposizione può essere dimostrata vera all’interno del sistema, rendendo il sistema inutile per qualsiasi applicazione pratica o teorica.

Un sistema formale è completo se per ogni proposizione ben formata P all’interno del sistema, è possibile dimostrare o P o la sua negazione ¬P. In altre parole, non ci sono proposizioni per le quali non si può decidere la verità o falsità usando le regole del sistema.

Teoremi di Incompletezza di Gödel

Kurt Gödel, nel 1931, dimostrò due teoremi di incompletezza che hanno rivoluzionato la logica matematica:

Primo teorema di incompletezza: In un sistema formale sufficientemente potente (ad esempio, uno che include l’aritmetica di base), se il sistema è coerente, non può essere completo. Ci saranno sempre proposizioni vere che non possono essere dimostrate all’interno del sistema.

Secondo teorema di incompletezza: Un sistema formale non può dimostrare la propria coerenza, a meno che non sia incoerente.

Questi concetti hanno profonde implicazioni filosofiche e matematiche. La coerenza garantisce che un sistema formale non generi contraddizioni, mentre la completezza garantisce che tutte le verità all’interno del sistema siano dimostrabili. Tuttavia, secondo Gödel, un sistema formale non può essere contemporaneamente coerente e completo, il che significa che ci saranno sempre limiti intrinseci nella nostra capacità di formalizzare tutte le verità matematiche.

In sintesi, coerenza e completezza rappresentano due criteri fondamentali nella valutazione di un sistema formale, ma il loro raggiungimento simultaneo è limitato da principi fondamentali della logica stessa.


Abbiamo voluto richiamare questi aspetti fondamentali della logica e dei sistemi formali per chiarire quale potrebbe essere l’ottimo o il fine ideale a cui dovrebbe mirare un processo di comprensione. Nell’integrare elementi semplici per formare un quadro complessivo, il processo di comprensione dovrebbe essere il più possibile coerente e completo. In altre parole, anche se comprendere un testo o il discorso di una persona non è come procedere nell’ambito di un sistema formale, i risultati che si ottengono non dovrebbero contraddirsi e dovrebbero fornire tutte le risposte ritenute importanti al caso in questione.


Hans-Georg Gadamer

Un filosofo che sostenne l’irriducibilità dell’attività prettamente umana della comprensione a puro metodo scientificamente descrivibile fu Hans-Georg Gadamer

Hans-Georg Gadamer è uno dei filosofi più influenti nel campo dell’ermeneutica, e la sua opera principale, “Verità e Metodo” (1960), è fondamentale per comprendere il suo approccio alla comprensione e all’interpretazione.

Gadamer sviluppa la sua ermeneutica come risposta e sviluppo delle idee di filosofi precedenti come Friedrich Schleiermacher e Martin Heidegger. Mentre Schleiermacher vedeva l’ermeneutica come una tecnica per interpretare testi e Heidegger come un modo di esistenza, Gadamer va oltre, considerando l’ermeneutica come una base universale dell’esperienza umana.

Il circolo ermeneutico

Secondo Gadamer, la comprensione non avviene mai in modo lineare, ma circolare.

Questo significa che non si può comprendere il significato di una parte di un testo senza comprendere il tutto, e viceversa. La nostra interpretazione si muove quindi continuamente tra la parte e il tutto, in un processo dinamico e reiterativo.

Ogni atto di comprensione inizia con una precomprensione, cioè con delle aspettative, idee o pregiudizi che abbiamo prima di affrontare il testo o il fenomeno. Gadamer non considera il pregiudizio necessariamente come qualcosa di negativo, ma come un punto di partenza indispensabile per l’interpretazione.

Quando leggiamo un testo o interpretiamo un fenomeno, le nostre precomprensioni vengono messe alla prova. Il testo può confermare o confutare queste aspettative, e attraverso questo dialogo, la nostra comprensione evolve.
Ogni nuova comprensione modifica le nostre precomprensioni, che a loro volta influenzano ulteriori interpretazioni, in un circolo senza fine.

Gadamer introduce il concetto di fusione degli orizzonti. L’“orizzonte” rappresenta il contesto culturale, storico e personale entro cui comprendiamo. Nella comprensione, l’orizzonte del lettore e quello del testo si fondono, permettendo una comprensione più profonda e ricca.

Il filosofo sottolinea che questo processo non è limitato alla lettura dei testi, ma è una caratteristica fondamentale di tutta l’esperienza umana. Ogni volta che cerchiamo di comprendere un’esperienza, un’opera d’arte, una conversazione o un evento storico, siamo coinvolti in questo circolo ermeneutico.

Gadamer critica l’idea che si possa comprendere un testo in modo completamente oggettivo, senza pregiudizi. Per lui, l’interpretazione è sempre influenzata dalla nostra storia e dal nostro contesto. La vera comprensione è un dialogo in cui il lettore è trasformato dall’interazione con il testo.

Fusione degli orizzonti (Horizontverschmelzung)

La comprensione è vista come una fusione degli orizzonti di due diverse prospettive: quella dell’interprete e quella del testo o dell’evento da interpretare. Questo processo è dinamico e interattivo, in cui l’orizzonte dell’interprete si espande e si trasforma attraverso l’incontro con l’altro orizzonte.

Come abbiamo già anticipato, ogni atto di comprensione è influenzato dalle precomprensioni, ossia dalle aspettative, esperienze e bias che l’interprete porta con sé. La precomprensione non è un ostacolo da superare ma una condizione necessaria per ogni comprensione. L’interpretazione è sempre un processo di riformulazione delle proprie precomprensioni.

La comprensione è vista come un dialogo tra l’interprete e il testo. Questo dialogo non è solo un semplice scambio di informazioni, ma un processo di partecipazione attiva e trasformativa. L’interprete deve essere aperto a cambiare la propria prospettiva attraverso il dialogo, riconoscendo la possibilità di apprendere e modificare le proprie precomprensioni.

Gadamer sostiene che la comprensione è sempre influenzata dalla storia e dalla tradizione. Gli interpreti sono immersi in una storia effettuale che modella le loro interpretazioni. Essere consapevoli della storicità della comprensione aiuta gli interpreti a riconoscere l’influenza delle tradizioni e delle situazioni storiche sulla loro interpretazione.

Il filosofo critica l’idea che la verità possa essere raggiunta esclusivamente attraverso metodi scientifici. Sostiene che la verità può emergere anche attraverso l’esperienza estetica e il dialogo ermeneutico. L’arte e l’estetica giocano un ruolo cruciale nella comprensione ermeneutica, offrendo una via di accesso alla verità che non è riducibile a formule metodologiche. L’ermeneutica viene estesa oltre l’interpretazione dei testi, vedendola come una condizione fondamentale dell’esistenza umana che coinvolge ogni forma di comprensione. Gadamer sviluppa una visione ontologica della comprensione, sostenendo che essa è una modalità fondamentale dell’essere umano. Non si tratta solo di una tecnica o metodo ma di un modo di essere nel mondo.

Il positivismo e l’idea che la conoscenza scientifica sia l’unico modo legittimo di comprendere la realtà sono poste sotto accusa dal filosofo che sostiene invece la validità della conoscenza ermeneutica e storica. Gadamer rivaluta la tradizione non come un ostacolo alla comprensione ma come un elemento costitutivo che rende possibile la comprensione stessa.

Il concetto di “orizzonte” è centrale per comprendere la teoria ermeneutica. Gadamer utilizza il termine “orizzonte” in un senso metaforico per descrivere l’ambito di visione e comprensione che una persona possiede in un determinato momento, influenzato dalle proprie esperienze, conoscenze, pregiudizi e contesto storico-culturale.

L’orizzonte rappresenta il campo di visione entro cui una persona può vedere e comprendere. Analogamente, in senso ermeneutico, l’orizzonte denota l’ambito di comprensione e interpretazione che una persona ha rispetto a un fenomeno, testo o evento.

Il linguaggio

Gadamer attribuisce al linguaggio un ruolo fondamentale nella nostra comprensione del mondo, sostenendo che esso funge da “orizzonte” che condiziona e media ogni nostra esperienza e conoscenza.

Il linguaggio non è semplicemente un mezzo per comunicare pensieri già formati, ma è il medium attraverso cui il mondo stesso ci appare e si svela. In altre parole, noi pensiamo, interpretiamo e comprendiamo il mondo attraverso il linguaggio. Questo implica che non esiste un’esperienza o una conoscenza “pura” che precede il linguaggio: il nostro modo di vedere il mondo è sempre già linguistico.

Gadamer parla di “orizzonte” per indicare il campo entro cui qualcosa può essere compreso. Il linguaggio costituisce l’orizzonte più ampio perché delimita ciò che è comprensibile per noi. Ogni esperienza è quindi filtrata e strutturata dal linguaggio: ciò che possiamo conoscere, pensare o immaginare è sempre circoscritto dalle possibilità linguistiche. Questo orizzonte linguistico è storico e culturale, il che significa che varia nel tempo e nello spazio. La nostra comprensione del mondo è radicata nel linguaggio specifico della nostra cultura, della nostra epoca, del nostro contesto sociale.

Il linguaggio non è un insieme statico di parole e regole, ma vive e si evolve nel dialogo, nell’interazione tra le persone. Quando partecipiamo a un dialogo, non stiamo solo scambiando informazioni, ma stiamo anche ampliando e trasformando il nostro orizzonte di comprensione. Il dialogo, dunque, è un processo attraverso il quale il nostro orizzonte linguistico si apre a nuovi significati e interpretazioni, rendendo possibile una comprensione più profonda e condivisa.

Poiché il linguaggio struttura la nostra comprensione del mondo, esso è anche la fonte delle nostre precomprensioni. Le parole e le espressioni che usiamo portano con sé una storia di significati e associazioni che influenzano come vediamo e interpretiamo il mondo. Queste precomprensioni, tuttavia, non sono fisse, ma possono essere riviste e rinegoziate nel dialogo e nell’esperienza.

La comprensione con i modelli di machine learning

Nell’ambito del machine learning, la “comprensione” assume una connotazione specifica che può essere analizzata sotto diversi aspetti. A differenza della comprensione umana, che può coinvolgere l’empatia, la soggettività e l’interpretazione, la comprensione nel machine learning è principalmente di natura funzionale e operativa.

Le macchine comprendono i dati identificando modelli e regolarità. Questo include la capacità di riconoscere schemi in dati non strutturati come immagini, testo e suoni.

Alcuni algoritmi di machine learning, come le decision tree, sono intrinsecamente interpretabili, mentre altri, come le reti neurali profonde, sono spesso considerati black box. La comprensione in questo contesto si riferisce alla capacità di spiegare come e perché un modello prende determinate decisioni.

Per cogliere meglio questa distinzione tra modelli interpretabili e non leggi l’articolo
Interpretabilità delle reti neurali

Comprendere un testo o parole nel contesto del machine learning implica la capacità di processare, interpretare e generare linguaggio naturale. Questo campo di competenza è noto come Elaborazione del Linguaggio Naturale (Natural Language Processing, NLP).

L’Analisi Sintattica e Semantica è una parte cruciale di questo campo e implica i seguenti passaggi:
Tokenizzazione: Suddividere il testo in unità fondamentali (parole, frasi).
Parsing Sintattico: Analizzare la struttura grammaticale del testo.
Analisi Semantica: Comprendere il significato delle parole e delle frasi nel loro contesto.

Approfondisci questo tipo di comprensione leggendo l’articolo
Il processo di information retrieval (IR)

La generazione del linguaggio si sviluppa anche attraverso le sguenti applicazioni:

Named Entity Recognition (NER): Identificare e classificare entità nominate nel testo (persone, luoghi, organizzazioni).
Sentiment analysis: Determinare il tono emotivo del testo (positivo, negativo, neutro).
Machine translation: Tradurre automaticamente il testo da una lingua all’altra.
Text Generation: Generare testo in linguaggio naturale a partire da input strutturati o non strutturati.
Disambiguazione semantica: Risolvere ambiguità nel significato delle parole
Inference e Completamento del Testo: Derivare conclusioni implicite e completare il testo basato su informazioni incomplete.
Question answering: Rispondere a domande poste in linguaggio naturale basandosi su un corpus di conoscenza.
Chatbot e assistenti virtuali: Interagire con gli utenti attraverso conversazioni in linguaggio naturale.
Summarization: Riassumere automaticamente testi lunghi mantenendo le informazioni essenziali.

Tutti questi processi vengono spiegati dettagliatamente su HumAI.it. Per esempio puoi leggere i seguenti articoli:

Algoritmi di disambiguazione (Word Sense Disambiguation)
Addestramento dei modelli di traduzione automatica
Il classificatore di Bayes

Tra rigido determinismo e creatività

Molti studiosi e filosofi del passato non hanno avuto modo di vedere all’opera i moderni modelli di intelligenza artificiale ed in particolar modo, i modelli generativi del linguaggio. Le operazioni svolte dai calcolatori sono sempre state di natura deterministica e rigidamente definite e ciò ha indotto a pensare che fossero in qualche modo limitate rispetto alla creatività e alle facoltà di comprensione umane. Nel compiere queste considerazioni, forse si è trascurata l’ipotesi che da una complessa rete neurale composta da miliardi di parametri (pesi) e da un sistema di autoregolazione dinamico possano emergere proprietà inaspettate molto più simili a quelle umane rispetto a quelle che emergono da un classico algoritmo statico composto da istruzioni statiche del tipo if…then.

Per approfondire le tecniche che permettono ai modelli di AI di generalizzare bene e di mostrare un certo grado di creatività leggi questi articoli:

Il ruolo della casualità nei processi di apprendimento
La regolarizzazione, un modo per gestire l’overfitting
Statistica e intelligenza artificiale

Il potere rappresentativo dei numeri

Potremmo trovarci in un periodo della storia in cui i numeri rivelano tutto il loro potenziale rappresentativo.

Se il linguaggio rappresenta la realtà sino al punto da identificarsi con la realtà stessa, i numeri possono rappresentare il linguaggio?

Grazie alle moderne reti neurali che stanno alla base del NLP (natural language processing), la risposta potrebbe essere affermativa.

Il numero, nell’ambito del deep learning assume il ruolo di parametro regolabile (peso) che una volta regolato incorpora in un certo senso una “parte infinitesimale” di realtà che può essere un elemento del linguaggio naturale o un elemento di una possibile immagine o di un possibile video. Tuttavia, il parametro non rappresenta la realtà indipendentemente da altri fattori, in quanto è l’architettura della rete, la funzione di perdita e il processo di gradient descent a permettere la sua corretta regolazione ed infine, sono i dati in input e l’operazione di etichettatura a fornire materiale per l’addestramento del modello. Cambiando queste cose, anche i parametri della rete cambiano.

I moderni metodi per rendere efficienti le reti neurali si avvalgono di modelli di machine learning in grado di stabilire le migliori architetture di reti neurali. Siamo in presenza di un livello superiore d’azione in cui l’AI valuta l’AI e individua i parametri in grado di rappresentare la migliore architettura utile per rappresentare la realtà.

Per maggiori approfondimenti su questo aspetto leggi l’articolo Modelli di AI più efficienti.

A tutti i livelli di attività si ha a che fare con numeri e funzioni matematiche che vengono regolati e selezionati per offrire una sorta di rappresentazione della realtà che può essere costituita da immagini, video, testi o audio.

Di fronte a queste strutture non banali, potrebbe essere un atteggiamento onesto ed equilibrato quello di non escludere a priori l’irriducibilità di molti aspetti della sfera di attività umane, tra cui quelli che interessano la facoltà del comprendere.

L’avversione nei confronti del riduzionismo

l’avversione di Gadamer e di altri filosofi ermeneutici nei confronti del riduzionismo scientifico deriva dal timore che l’adozione esclusiva di metodi scientifici possa ridurre la ricchezza e la complessità dell’esperienza umana a poche formule semplici. Gadamer difende la necessità di approcci ermeneutici che valorizzino la storicità, la tradizione e la particolarità delle situazioni umane, promuovendo una comprensione più profonda e sfumata della realtà.

I metodi scientifici mutano e si ampliano mostrandoci oggi come possa avvenire una sorta di umanizzazione delle macchine.

L’approccio scientifico non riguarda più solo la materia, la misurazione di entità nello spazio e nel tempo, ma riguarda, come abbiamo anticipato, la comprensione e la generazione del linguaggio ad opera di complesse reti neurali.

Ciò potrebbe implicare la capacità di queste reti di dotarsi di un “orizzonte” formato dalle informazioni e dai contesti culturali presenti nei dati di addestramento. Un modello ben addestrato può simulare una certa sensibilità storica e culturale rispondendo in modo appropriato a vari contesti. Le reti neurali possono essere progettate per interagire con gli utenti in modo dialogico.

Ad esempio, i modelli di linguaggio come GPT possono mantenere un dialogo prolungato con un utente, adattando le risposte in base al contesto del dialogo. Questo può essere visto come una forma rudimentale di “fusione degli orizzonti”, in cui il modello tenta di adattarsi alle precomprensioni e alle esigenze dell’utente. I modelli possono essere ulteriormente affinati o adattati tramite tecniche di fine-tuning per specifiche applicazioni o contesti culturali. Questo permette di personalizzare il “campo di visione” del modello, migliorando la sua capacità di rispondere in modo appropriato a diversi orizzonti interpretativi.

Il riduzionismo scientifico potrebbe non essere più così spaventoso se si affinano i concetti del linguaggio scientifico stesso. Ciò che si teme è l’eccessiva semplificazione dei modelli scientifici rispetto all’articolata e complessa natura umana. Tuttavia, il carattere adattativo e versatile dei modelli di intelligenza artificiale mostra come sia possibile evitare con i metodi matematici l’estrema semplificazione.

Non possiamo escludere a priori che aumentando il numero di parametri di una rete neurale, migliorandone l’ architettura e i dati di addestramento essa non possa cogliere molte sfumature della realtà come avviene nel caso dell’esperienza umana.

In altre parole, se la scienza in passato può averci abituato ad una descrizione oggettiva e generalista della realtà, oggi potrebbe indicarci un modo per ottenere una descrizione più accurata che riflette anche la soggettività, i sentiementi e i contesti particolari del presente e del passato.

Un Esempio di AI nell’Interpretazione di un dipinto

Prendiamo di nuovo “Guernica” di Picasso come esempio

Un modello di deep learning potrebbe essere addestrato su immagini di “Guernica”, insieme a descrizioni storiche del bombardamento di Guernica, critiche d’arte, e interpretazioni di vari esperti. La mole di dati che un modello di AI può incorporare è sicuramente significativa.

Una volta addestrato, il modello potrebbe generare interpretazioni del dipinto. Potrebbe descrivere i simboli nel dipinto (come il toro e il cavallo), discutere il contesto storico e offrire una lettura delle emozioni evocate dall’opera.

Utilizzando tecniche di analisi del sentiment, il modello potrebbe analizzare le reazioni emotive di vari spettatori di “Guernica”, fornendo insight su come diverse persone e culture percepiscono l’opera.

Verso una comprensione integrata

Mentre le capacità delle reti neurali profonde sono impressionanti e possono significativamente arricchire la nostra comprensione delle opere d’arte, c’è ancora valore nell’approccio ermeneutico tradizionale. L’approccio migliore potrebbe essere l’integrazione delle capacità delle AI con l’ermeneutica tradizionale. Le AI possono fornire una base quantitativa e una prima interpretazione, che poi può essere raffinata e approfondita attraverso il dialogo ermeneutico umano.

Alvise Giubelli

HumAI.it