I data center sono infrastrutture che erogano potenza di calcolo, rete e storage per applicazioni complesse; tra queste, i carichi di AI richiedono risorse concentrate e continuative. Per comprendere perché consumano energia e come ridurla, conviene analizzare l’intero ciclo: dal carico computazionale alla gestione termica, fino all’origine dell’energia e al possibile riutilizzo del calore. In questo quadro, la metrica chiave è il PUE e il nodo tecnico è il raffreddamento mentre le leve gestionali includono workload scheduling e politiche di approvvigionamento energetico.
Ridurre i consumi non significa solo “mettere server efficienti”, ma ottimizzare il sistema: allocare correttamente i carichi, ridurre le perdite, raffreddare al meglio, alimentare con fonti pulite e valorizzare il calore in uscita. Questa panoramica presenta i principi fondamentali, gli indicatori utili e le strategie pratiche che aziende e pubbliche amministrazioni possono applicare per data center più green senza sacrificare prestazioni e affidabilità.
Carichi di calcolo AI e profilo energetico
I carichi di intelligenza artificiale tipicamente concentrano attività su GPU o acceleratori dedicati, con fasi di addestramento e inferenza che differiscono per intensità e durata. L’addestramento genera lunghi periodi di alto utilizzo richiedendo alimentazione stabile e raffreddamento efficiente; l’inferenza, invece, può essere più frammentata ma a bassa latenza. Il consumo deriva non solo dall’elaborazione ma anche da rete ad alta velocità e memoria a larga banda.
Minimizzare energia richiede progettare topologie che riducano colli di bottiglia, scegliere profili di potenza adeguati e dimensionare correttamente i cluster: acceleratori saturi e ben orchestrati consumano meno per unità di lavoro rispetto a risorse sottoutilizzate.
PUE: cosa misura e come migliorarlo
Il PUE (Power Usage Effectiveness) è il rapporto tra energia totale del sito e energia assorbita dall’IT. Valori più vicini a 1 indicano minori overhead di infrastruttura. Migliorare il PUE significa intervenire su cooling distribuzione elettrica e perdite ausiliarie. Passi tipici includono: ottimizzare il controllo delle temperature (setpoint coerenti con gli standard ambientali dei componenti), ridurre i ricircoli d’aria tramite contenimento dei corridoi caldo/freddo, adeguare ventilatori e pompe con variatori di velocità, migliorare l’efficienza dei gruppi di continuità. Un PUE favorevole è la base, ma non l’obiettivo unico: l’energia va anche resa pulita e il calore valorizzato.
Raffreddamento: aria o liquido, e quando conviene
Il raffreddamento a aria resta una soluzione diffusa per densità moderate, con buone pratiche come contenimento, filtri e gestione precisa dei flussi. Al crescere della densità termica dei rack, il raffreddamento a liquido (liquid cooling) diventa competitivo: il liquido ha maggiore capacità di trasporto del calore e riduce il lavoro dei chiller. Opzioni comuni includono scambiatori a porta posteriore, piastre a contatto diretto e immersione. La scelta dipende da densità, vincoli edilizi e costi operativi: quando pochi rack superano soglie elevate, soluzioni ibride permettono di usare aria dove è efficiente e liquido dove è necessario, migliorando il PUE e la stabilità termica.
Workload scheduling e orchestrazione efficiente
Una leva potente è lo workload scheduling allocare carichi AI in modo da massimizzare l’utilizzo degli acceleratori, ridurre code e spegnere risorse inattive. Strumenti di orchestrazione consentono di raggruppare job compatibili, limitare lo stranding di memoria e comunicazione, e bilanciare tra latenza e throughput. Pratiche efficaci includono: prenotazioni a finestra per l’addestramento, profilazione dei job per attribuire clock e voltaggi adeguati, co-locazione di carichi che condividono dataset per ridurre traffico. Dove possibile, la programmazione può seguire la disponibilità di energia rinnovabile o tariffe più favorevoli, spostando carichi flessibili verso slot con energia più pulita.
Energie rinnovabili e gestione del calore
Ridurre l’impronta richiede agire sulla fonte: contratti di energia rinnovabile e, quando praticabile, generazione in sito con fotovoltaico o altre tecnologie. L’abbinamento tra domanda e disponibilità rinnovabile si rafforza con storage e pianificazione dei carichi. Sul lato termico, il riuso del calore trasforma un costo in risorsa: reti di teleriscaldamento, processi industriali a bassa temperatura o servizi locali possono valorizzare il calore di scarto. Il successo dipende da temperatura, continuità del flusso e vicinanza degli utilizzatori; il raffreddamento a liquido semplifica il recupero, offrendo vettori termici più adatti e perdite inferiori rispetto all’aria.
Metriche oltre il PUE: efficienza per lavoro svolto
Per i carichi AI è utile misurare l’energia per unità di lavoro, ad esempio kWh per modello addestrato o per milione di inferenze. Questa metrica sposta l’attenzione dal sito al risultato: ottimizzazioni algoritmiche (quantizzazione, pruning, batch ottimizzati) riducono energia a parità di accuratezza. Anche la scelta dell’hardware conta: acceleratori con migliore performance-per-watt e memorie ad alta efficienza tagliano i consumi sistemici. Valutare periodicamente questi indicatori permette di individuare colli di bottiglia energetici e di calibrare sia le politiche di scheduling sia gli investimenti in infrastrutture di raffreddamento.
Cosa possono fare aziende e pubbliche amministrazioni
Aziende e PA possono impostare una roadmap pratica. Passi chiave: 1) audit energetico e termico del sito con baseline di PUE e metriche per lavoro; 2) interventi a basso impatto (contenimento, setpoint, VFD su ventilatori/pompe); 3) valutazione della densità per decidere se adottare liquid cooling parziale; 4) implementazione di workload scheduling orientato a saturazione, spegnimento automatico e allineamento con finestre di energia rinnovabile; 5) procurement di elettricità verde con criteri di addizionalità e, dove possibile, riuso del calore con partner locali. Queste azioni combinano riduzioni immediate dei consumi con benefici strutturali nel medio periodo.
Eccezioni, vincoli e scelte di compromesso
Non esiste una singola soluzione universale: siti in aree calde o umide possono limitare l’uso di free cooling edifici esistenti possono ostacolare il passaggio al liquido; carichi con SLA rigidi riducono la flessibilità dello scheduling. In questi casi, la strategia più efficace è modulare: intervenire dove il rapporto costo/beneficio è migliore, sperimentare su piccoli domini e scalare progressivamente. Quando il recupero di calore non è praticabile, conviene massimizzare l’efficienza elettrica e ridurre le perdite meccaniche; dove la rinnovabile non è integrabile in sito, contratti di fornitura ben progettati e sistemi di accumulo contribuiscono comunque a un profilo energetico più pulito.
Un data center efficiente per carichi AI nasce da una visione sistemica: misurare, ottimizzare e orchestrare. PUE contenuto, liquid cooling dove serve, scheduling intelligente, energia rinnovabile e valorizzazione del calore formano un insieme coerente. La combinazione di scelte tecniche e gestionali, supportate da metriche chiare, consente a organizzazioni pubbliche e private di ottenere prestazioni elevate con impronte energetiche sensibilmente ridotte.
