Server per intelligenza artificiale con GPU NVIDIA in un data center, simbolo dei controlli sulle esportazioni verso la Cina
AI (Intelligenza Artificiale) Nvidia 8 ottobre 2026 9 min lettura

300 milioni di dollari di GPU NVIDIA verso la Cina: il contrabbando che mette alla prova la guerra dei chip

Greg Lui è accusato di aver aggirato i controlli USA facendo transitare server con GPU NVIDIA da Malaysia e Singapore. Il caso mostra quanto sia fragile il confine tecnologico costruito attorno all'IA.


La guerra dei chip tra Stati Uniti e Cina non si combatte soltanto dentro le fabbriche di semiconduttori. Sempre più spesso passa attraverso fatture, società di spedizione, intermediari e Paesi utilizzati come destinazioni temporanee. Il caso di Greg Lui, 38 anni, proprietario della californiana Earthmade Computer Inc., è probabilmente uno degli esempi più grandi emersi finora.

Il Dipartimento di Giustizia degli Stati Uniti lo ha arrestato il 1° ottobre 2026 dopo un'incriminazione federale che lo accusa di aver fatto arrivare in Cina oltre 300 milioni di dollari di server ad alte prestazioni contenenti GPU sottoposte a controllo sulle esportazioni. Secondo i procuratori, l'hardware sarebbe stato acquistato negli Stati Uniti indicando Malaysia e Singapore come destinazioni finali, per poi essere reindirizzato verso acquirenti cinesi.

È importante precisare che si tratta di accuse e non di una condanna: Lui è presunto innocente fino a prova contraria. Ma la struttura del presunto schema racconta qualcosa di più grande del singolo procedimento penale. Washington può vietare l'esportazione diretta di determinati acceleratori verso la Cina; molto più difficile è controllare ogni passaggio di una catena globale nella quale un server può attraversare più società e più Paesi prima di raggiungere l'utilizzatore finale.

Come avrebbe funzionato il sistema

Secondo l'accusa, tra il 2023 e il 2024 Lui e alcuni complici avrebbero utilizzato Earthmade Computer per acquistare server contenenti GPU avanzate senza richiedere le licenze necessarie per una destinazione cinese. Ai produttori statunitensi sarebbero stati forniti documenti nei quali comparivano clienti e destinazioni apparentemente consentiti.

I server venivano quindi spediti verso Paesi come Malaysia e Singapore, dove quelle esportazioni non richiedevano la stessa autorizzazione prevista per la Cina. Una volta arrivato l'hardware, secondo i procuratori, gli intermediari lo avrebbero nuovamente spedito verso clienti cinesi.

Il dettaglio più concreto contenuto nell'incriminazione riguarda gennaio 2024. Lui avrebbe discusso con un complice l'acquisto di 70 server con GPU sottoposte a restrizioni. Pochi giorni dopo Earthmade avrebbe effettuato un ordine da circa 7,614 milioni di dollari per 27 server, spediti dall'area di Los Angeles a Kuala Lumpur. Nel marzo successivo, secondo il Dipartimento di Giustizia, un complice avrebbe comunicato a un funzionario malese che tutti i 27 server erano stati trasferiti a un acquirente in Cina.

Il Los Angeles Times, citando l'atto d'accusa, identifica in quella spedizione GPU NVIDIA H100 e indica tra l'hardware contestato anche acceleratori A100. Il comunicato pubblico del Dipartimento di Giustizia non nomina invece direttamente NVIDIA o i singoli modelli, parlando più genericamente di GPU statunitensi ad alte prestazioni.

Perché H100 e A100 sono diventate materiale strategico

Il valore di queste GPU non deriva dal normale mercato delle schede grafiche. A100 e H100 sono acceleratori progettati per data center, addestramento di modelli di intelligenza artificiale e calcolo ad alte prestazioni.

La NVIDIA A100, basata sull'architettura Ampere, può essere configurata con 80 GB di memoria HBM2e e oltre 2 TB/s di banda nelle versioni SXM. È stata una delle piattaforme centrali dell'espansione dell'IA su larga scala prima dell'arrivo della generazione Hopper.

La H100 ha fatto un ulteriore salto introducendo Tensor Core di quarta generazione e un Transformer Engine dedicato ai modelli di tipo Transformer. Nella versione SXM dispone di 80 GB di memoria HBM3 e una banda di circa 3,35 TB/s, oltre a NVLink di quarta generazione per collegare molte GPU all'interno dello stesso sistema.

Questi numeri spiegano perché parlare semplicemente di “chip” sia riduttivo. Un server dotato di otto acceleratori di questo tipo non è un computer particolarmente veloce: è uno dei mattoni con cui si costruiscono cluster capaci di addestrare e servire modelli linguistici, sistemi di visione artificiale, simulazioni scientifiche e altri carichi estremamente pesanti.

Il collo di bottiglia dell'IA non è soltanto il modello: è il calcolo

Negli ultimi anni la competizione nell'intelligenza artificiale ha reso evidente una realtà: avere buoni algoritmi non basta. Per addestrare modelli molto grandi servono enormi quantità di capacità di calcolo, memoria ad alta banda, reti veloci e migliaia di acceleratori collegati tra loro.

Limitare l'accesso a GPU di fascia data center significa quindi cercare di rallentare la velocità con cui un Paese può aumentare la propria capacità computazionale. È questa la logica alla base dei controlli statunitensi introdotti nell'ottobre 2022 e successivamente rafforzati.

Il Bureau of Industry and Security del Dipartimento del Commercio spiegò esplicitamente che le nuove regole erano pensate per limitare l'accesso cinese a chip avanzati, capacità di supercalcolo e tecnologie per la produzione di semiconduttori. Nel 2023 e nel 2024 le restrizioni sono state aggiornate per ridurre alcune delle vie utilizzabili per aggirarle.

L'obiettivo dichiarato dagli Stati Uniti è soprattutto impedire che capacità di calcolo avanzato vengano utilizzate per modernizzazione militare, sistemi d'arma, sorveglianza e altre applicazioni considerate sensibili per la sicurezza nazionale.

300 milioni di dollari mostrano il problema delle triangolazioni

Se le accuse verranno provate, la cifra rende il caso Earthmade particolarmente importante. Non si parla di qualche GPU nascosta in un bagaglio, ma di una rete commerciale capace di muovere server per centinaia di milioni di dollari.

Tra gennaio e ottobre 2024, secondo il Dipartimento di Giustizia, Earthmade avrebbe ricevuto oltre 176 milioni di dollari da due società di spedizione con sede in Malaysia coinvolte nello schema contestato. Il meccanismo avrebbe sfruttato proprio la differenza tra il Paese indicato nei documenti di esportazione e quello dell'utilizzatore finale.

È uno dei problemi strutturali dei controlli tecnologici: un semiconduttore non conosce la propria destinazione. Una volta uscito dalla fabbrica, la sua tracciabilità dipende da documenti, distributori, intermediari, spedizionieri e verifiche sui clienti.

Più la differenza di disponibilità e valore tra due mercati diventa grande, maggiore è inoltre l'incentivo economico a creare canali paralleli. Le restrizioni non eliminano necessariamente la domanda di GPU: possono anche aumentare il premio economico associato al loro trasferimento illegale.

Malaysia e Singapore sono diventate nodi delicati della catena

Il caso Lui non è isolato. Nell'agosto 2025 il Dipartimento di Giustizia aveva già annunciato l'arresto di due cittadini cinesi, Chuan Geng e Shiwei Yang, accusati di aver utilizzato la società californiana ALX Solutions per spedire verso la Cina GPU controllate passando ancora una volta attraverso aziende di trasporto in Malaysia e Singapore.

In quel procedimento gli investigatori sostenevano che una serie di spedizioni indicava formalmente destinatari nel Sud-est asiatico, mentre i pagamenti provenivano da società cinesi e di Hong Kong. Le autorità affermarono inoltre di aver trovato comunicazioni relative al passaggio dei chip attraverso la Malaysia per evitare i controlli statunitensi.

Il fatto che schemi differenti utilizzino gli stessi punti di transito suggerisce perché Washington stia dedicando sempre maggiore attenzione alla destinazione finale dell'hardware e non soltanto al Paese indicato sulla prima fattura di esportazione.

Bloccare una GPU è molto più difficile che bloccare una fabbrica

Le restrizioni sui semiconduttori operano su almeno due livelli molto diversi. Il primo riguarda la produzione: macchinari litografici, strumenti di fabbricazione, progettazione dei chip e accesso alle fonderie. Sono infrastrutture grandi, costose e relativamente facili da individuare.

Il secondo riguarda il prodotto finito. Una GPU H100 può invece essere montata dentro un server, venduta a un distributore, trasferita a un'altra società e attraversare più confini. È qui che l'applicazione delle regole diventa molto più complessa.

Gli Stati Uniti possono impedire a un produttore americano di vendere direttamente un determinato acceleratore a un cliente cinese senza licenza. Devono però anche assicurarsi che un cliente apparentemente legittimo in un altro Paese non sia semplicemente un intermediario.

Questo sposta una parte crescente della responsabilità sui produttori e sui rivenditori: non basta più sapere a chi viene emessa la fattura, diventa importante verificare chi utilizzerà realmente il sistema.

Le H100 non sono più il massimo di NVIDIA, ma restano estremamente utili

Nel 2026 NVIDIA dispone ormai di architetture più recenti rispetto ad Ampere e Hopper. Questo non rende inutili A100 e H100. Un data center non sostituisce migliaia di acceleratori semplicemente perché è arrivata una nuova generazione, e molti modelli possono essere addestrati o eseguiti efficacemente su hardware meno recente.

Una H100 rimane un acceleratore progettato espressamente per i Transformer, con enormi quantità di memoria ad alta banda e collegamenti pensati per creare cluster di grandi dimensioni. È quindi perfettamente comprensibile che esista ancora una domanda significativa per sistemi di questo tipo.

Il valore strategico non dipende soltanto dall'avere la GPU più veloce disponibile in assoluto. Dipende dalla quantità complessiva di calcolo che un'organizzazione riesce ad accumulare. Centinaia o migliaia di acceleratori di una generazione precedente possono comunque costituire un'infrastruttura IA molto importante.

Il caso non dimostra che i controlli siano inutili

È facile leggere una vicenda del genere e concludere che le restrizioni statunitensi non funzionino. Sarebbe una conclusione troppo semplice.

Il mercato parallelo stesso può essere interpretato in due modi. Da una parte dimostra che esistono percorsi attraverso cui parte dell'hardware riesce comunque a raggiungere destinazioni vietate. Dall'altra, il fatto che siano necessari intermediari, documenti falsi, triangolazioni e rischi penali indica che ottenere quel calcolo è diventato più costoso e complesso rispetto a un normale acquisto diretto.

La domanda più importante è quindi quantitativa: quanta capacità riesce effettivamente a passare attraverso questi canali rispetto a quella che sarebbe disponibile senza alcuna restrizione? Un singolo procedimento, anche da 300 milioni di dollari, non permette di rispondere.

Dall'hardware alla geopolitica dell'intelligenza artificiale

Il caso Earthmade mostra quanto sia cambiato il significato di una GPU. Un acceleratore nato per moltiplicazioni di matrici, rendering e calcolo parallelo è diventato contemporaneamente prodotto commerciale, infrastruttura strategica e oggetto di politica internazionale.

Washington considera l'accesso al calcolo avanzato una questione di sicurezza nazionale. Pechino sta investendo per ridurre la dipendenza dai fornitori statunitensi. NVIDIA, nel mezzo, vende alcuni dei componenti più desiderati dell'intera economia dell'IA e deve adattare continuamente prodotti e strategie alle regole di esportazione.

Il risultato è una catena di fornitura in cui conoscere la destinazione finale di un server può essere importante quasi quanto conoscere la sua architettura.

Greg Lui rischia decenni di carcere, ma il caso è ancora all'inizio

Lui è accusato di tre reati federali: cospirazione per violare l'Export Control Reform Act e le Export Administration Regulations, contrabbando in uscita e cospirazione per riciclaggio di denaro. Secondo il Dipartimento di Giustizia, in caso di condanna le pene massime previste sono 20 anni per il primo capo, 20 anni per quello relativo al riciclaggio e 10 anni per il contrabbando.

Questi sono massimi teorici e non equivalgono alla pena che verrebbe eventualmente applicata. Soprattutto, l'incriminazione rappresenta l'accusa del governo: Lui non è stato dichiarato colpevole.

Ma indipendentemente dall'esito giudiziario, la vicenda mette in luce il problema che accompagnerà probabilmente tutta la prossima fase della competizione sull'IA. Produrre le GPU più avanzate è difficile. Decidere chi possa comprarle è relativamente semplice sulla carta. Controllare dove finiscano davvero, in una catena logistica globale, è un problema completamente diverso.

Ed è proprio lì che la guerra dei chip rischia di diventare una guerra di fatture, società di comodo, controlli doganali e tracciabilità. Il silicio è sempre lo stesso. È il percorso che compie dopo essere uscito dalla fabbrica a essere diventato geopolitica.

Fonti


Articoli Correlati