Il consumo energetico nascosto dietro ogni singola interrogazione
Quando un utente invia un input a un modello linguistico di grandi dimensioni, si attiva un processo di calcolo distribuito su migliaia di GPU (Graphics Processing Units) situate all'interno di data center iperscalabili. Questo processo, noto come inferenza, richiede una quantità di energia elettrica decisamente superiore rispetto a una tradizionale ricerca su un motore web classico, poiché il sistema non si limita a reperire un'informazione preesistente, ma deve generare autonomamente una risposta inedita calcolando la probabilità di associazione di ogni singola parola. Questa continua elaborazione statistica rappresenta un costo ecologico degli algoritmi che cresce in modo proporzionale alla complessità del modello e alla lunghezza del testo richiesto. La quantificazione esatta di questo consumo energetico è complessa e varia a seconda dell'efficienza della struttura che ospita i server, ma le stime attuali indicano un divario allarmante tra le vecchie e le nuove tecnologie di ricerca. Per comprendere appieno la portata del fenomeno, è utile analizzare i fattori principali che determinano questo enorme dispendio di energia durante la fase di utilizzo quotidiano dei sistemi:- La complessità dei parametri di calcolo: I modelli di ultima generazione gestiscono centinaia di miliardi di variabili attive simultaneamente per elaborare anche una singola frase di risposta.
- Il carico costante sulla rete di trasmissione: Il trasferimento continuo di pacchetti di dati ad altissima velocità tra i server e i dispositivi degli utenti richiede un supporto infrastrutturale costantemente alimentato.
- L'inefficienza energetica dei data center obsoleti: Molti impianti di elaborazione non utilizzano sistemi di alimentazione ottimizzati, disperdendo una quota significativa di elettricità sotto forma di calore prima ancora che questa raggiunga i processori.
Il fabbisogno idrico per il raffreddamento dei data center
Un aspetto altrettanto critico e spesso ignorato del consumo tecnologico è legato al massiccio utilizzo di acqua dolce necessario per evitare il surriscaldamento dei server che elaborano i nostri comandi. I supercomputer lavorano a temperature elevatissime e richiedono sistemi di raffreddamento evaporativo che consumano milioni di litri d'acqua al giorno, sottraendo risorse preziose ai bacini idrici locali, spesso in aree già colpite da gravi fenomeni di siccità. Questo consumo idrico silenzioso rappresenta una delle esternalità negative più urgenti da affrontare, soprattutto alla luce delle nuove normative ambientali europee come il Decreto MASE 2024, che impongono standard sempre più severi per la tutela delle risorse naturali e l'efficienza dei grandi impianti industriali. Per mitigare questo impatto, molte aziende tecnologiche stanno sperimentando soluzioni di raffreddamento a circuito chiuso o l'installazione di server in regioni geografiche caratterizzate da climi estremamente freddi, sfruttando la ventilazione naturale esterna. Inoltre, la digitalizzazione e la dematerializzazione delle procedure burocratiche, come l'introduzione di sistemi avanzati sul modello di ViViFir per la gestione documentale ecologica, dimostrano come la tecnologia possa anche contribuire a ottimizzare le risorse e a ridurre i consumi, purché i sistemi informatici sottostanti siano progettati e gestiti secondo rigorosi criteri di eco-compatibilità.Il ciclo di vita dei server e i rifiuti elettronici generati
L'impronta ecologica della tecnologia non si esaurisce con il consumo di elettricità e acqua durante il funzionamento dei server, ma comprende l'intero ciclo di vita dell'hardware dedicato all'elaborazione dei dati. Le schede grafiche e i processori utilizzati per addestrare ed eseguire i modelli avanzati hanno un ciclo di obsolescenza incredibilmente rapido, che spesso non supera i tre o quattro anni a causa della continua evoluzione degli algoritmi che richiedono prestazioni sempre più elevate. Questo ricambio frenetico genera montagne di rifiuti elettronici complessi, la cui gestione e il cui smaltimento rappresentano una sfida ambientale senza precedenti per la presenza di metalli pesanti e sostanze chimiche tossiche.
A differenza di altri flussi di rifiuti più facilmente riciclabili, come avviene ad esempio per le frazioni cellulosiche attraverso i sistemi strutturati per lo smaltimento della carta, i circuiti stampati e i chip di silicio richiedono processi chimici e termici estremamente raffinati per il recupero delle materie prime critiche. L'estrazione e la lavorazione di queste terre rare necessarie alla produzione di nuovi chip hanno un costo ambientale devastante nei paesi d'origine, rendendo urgente lo sviluppo di filiere di riciclo dedicate capaci di reimmettere i metalli preziosi nel circuito produttivo. I punti chiave di questa complessa transizione verso una gestione sostenibile dell'hardware includono:
- Il recupero dei metalli preziosi: Oro, argento, rame e palladio presenti nelle schede logiche devono essere estratti in sicurezza per evitare la contaminazione del suolo e delle falde acquifere.
- La rigenerazione dei componenti funzionanti: Implementare pratiche di refitting industriale per estendere la vita utile dei server destinati a compiti di calcolo meno intensivi rispetto all'addestramento dei modelli primari.
- La tracciabilità dei materiali rari: Monitorare la provenienza e la destinazione delle materie prime critiche utilizzate nella componentistica per garantire standard etici e ambientali elevati lungo tutta la catena di fornitura.
La sostenibilità dei sistemi di machine learning nel lungo termine
Per garantire la sostenibilità dei sistemi di machine learning in un futuro dominato dall'automazione, è essenziale che gli ingegneri del software e i ricercatori si concentrino sull'ottimizzazione dell'efficienza degli algoritmi anziché solo sul continuo incremento delle dimensioni dei modelli. Lo sviluppo di tecniche di compressione dei modelli, come la quantizzazione e la distillazione della conoscenza, consente di far girare reti neurali altamente performanti su hardware meno energivoro, riducendo drasticamente il fabbisogno computazionale. Solo attraverso una sinergia tra l'efficienza del codice software e l'utilizzo di infrastrutture fisiche alimentate interamente da fonti rinnovabili sarà possibile arginare l'avanzata dell'inquinamento digitale invisibile.Bibliografia
- Kate Crawford - Atlante dell'intelligenza artificiale. Potere, politica e costi planetari della tecnologia
- Gerry McGovern - World Wide Waste: How digital is killing our planet
- Guillaume Pitron - L'inferno digitale. Perché la tecnologia non è ecologica
- James Bridle - Nuova era oscura. Tecnologia e fine del futuro
- Roberto Cingolani - L'altra specie. Otto domande su intelligenza artificiale e umani
Domande frequenti
Qual è la differenza in termini di emissioni tra la fase di addestramento e quella di utilizzo quotidiano di un'intelligenza artificiale?
La fase di addestramento di un grande modello linguistico rappresenta un picco di consumo energetico massiccio e concentrato nel tempo, durante il quale migliaia di supercomputer lavorano in parallelo per mesi consumando centinaia di megawattora e generando centinaia di tonnellate di anidride carbonica. Al contrario, la fase di utilizzo quotidiano, detta inferenza, consuma una quantità di energia infinitesimale per ogni singolo prompt inviato dall'utente. Tuttavia, poiché questi sistemi vengono interrogati miliardi di volte al giorno da milioni di persone in tutto il mondo, il consumo cumulativo della fase di utilizzo supera rapidamente quello della fase di addestramento nel giro di pochi mesi, rendendo la gestione quotidiana dei server la principale responsabile dell'impatto ecologico globale della tecnologia a lungo termine.
In che modo gli utenti comuni possono ridurre l'impronta di carbonio dei modelli generativi durante l'uso quotidiano?
Gli utenti possono adottare diverse buone pratiche digitali per limitare l'impronta di carbonio dei modelli generativi senza dover rinunciare ai vantaggi di questi strumenti di assistenza. In primo luogo, è consigliabile formulare richieste precise, chiare e dettagliate fin da subito per evitare la necessità di generare ripetutamente risposte correttive, riducendo così il numero complessivo di interrogazioni necessarie. Inoltre, per compiti semplici e ripetitivi, è preferibile utilizzare modelli linguistici di dimensioni ridotte o specializzati, che richiedono molta meno potenza di calcolo rispetto ai modelli generalisti più complessi. Infine, evitare di richiedere la generazione di immagini o video complessi quando non strettamente necessario contribuisce in modo significativo a limitare l'uso intensivo delle GPU dei data center.
Esistono certificazioni ecologiche per i data center che ospitano i sistemi di intelligenza artificiale?
Sì, esistono diversi standard internazionali e certificazioni ambientali volti a valutare e migliorare l'efficienza energetica e l'impronta ecologica delle infrastrutture che ospitano i server di calcolo. La metrica più nota è il PUE (Power Usage Effectiveness), che misura il rapporto tra l'energia totale consumata dal data center e quella effettivamente utilizzata per alimentare i computer, con l'obiettivo di avvicinarsi il più possibile al valore ottimale di 1.0. Inoltre, certificazioni come lo standard ISO 50001 per la gestione dell'energia e la certificazione LEED (Leadership in Energy and Environmental Design) per gli edifici verdi vengono sempre più applicate ai moderni complessi tecnologici per garantire l'uso di energie rinnovabili, la riduzione dei consumi idrici e l'adozione di sistemi di raffreddamento a basso impatto ambientale.
In che modo lo sviluppo del "green coding" può aiutare a mitigare il consumo energetico del software?
Il movimento del "green coding" si concentra sulla scrittura di codice software ottimizzato dal punto di vista energetico, riducendo al minimo i cicli di calcolo ridondanti e l'uso inefficiente della memoria da parte delle applicazioni. Gli sviluppatori possono progettare algoritmi che richiedono meno passaggi logici per giungere allo stesso risultato, riducendo lo stress computazionale sui processori fisici dei server. Questo approccio include anche la scelta di linguaggi di programmazione più efficienti a basso livello e l'implementazione di logiche di caricamento dinamico delle risorse, che attivano la potenza di elaborazione solo quando strettamente necessario, contribuendo in modo determinante a limitare i consumi energetici complessivi dei sistemi informatici su larga scala.
Quali sono i metalli rari maggiormente impiegati nell'hardware per l'intelligenza artificiale e come impattano sull'ambiente?
La produzione dei semiconduttori e delle GPU ad altissime prestazioni impiega una vasta gamma di elementi rari e metalli critici, tra cui il silicio ad altissimo grado di purezza, il gallio, il germanio, il cobalto, il litio e il neodimio, quest'ultimo fondamentale per i magneti dei sistemi di raffreddamento e dei dischi rigidi. L'estrazione di queste materie prime avviene spesso attraverso lavorazioni minerarie ad altissimo impatto ecologico, che comportano la distruzione di interi ecosistemi terrestri, il consumo di imponenti risorse idriche locali e la produzione di scorie chimiche tossiche e radioattive che rischiano di contaminare i terreni e le falde acquifere circostanti se non gestite secondo rigidi protocolli di sicurezza ambientale.


