+39 06.7914027

Lenovo AI Express: linea di produzione industriale automatizzata con robot di saldatura e scie luminose (immagine Lenovo)

Lenovo AI Express con NVIDIA: infrastruttura IA per aziende con spedizione da 15 giorni

Molte aziende hanno già fatto almeno un progetto pilota con l’intelligenza artificiale. Il passaggio successivo, portare i modelli in produzione su un’infrastruttura IA propria, spesso si blocca su due fronti: tempi di approvvigionamento lunghi e integrazione complessa.

Secondo il CIO Playbook 2026 di Lenovo, le organizzazioni che passano dalla sperimentazione all’uso su larga scala si aspettano in media un ritorno di 2,79 dollari per ogni dollaro investito, e il 93% degli intervistati enterprise prevede un ritorno positivo. Gli stessi dati indicano però che lunghi tempi di consegna e difficoltà di integrazione rallentano il percorso.

Il 30 settembre 2026 Lenovo ha annunciato Lenovo AI Express, un programma sviluppato con NVIDIA che propone tre configurazioni di server IA già validate, con spedizione a partire da 15 giorni lavorativi per le configurazioni idonee. Qui trovi cosa contiene ciascuna configurazione, a chi si rivolge e come leggere i tempi di consegna.

Cos’è Lenovo AI Express

Lenovo AI Express è un percorso di avvio rapido verso la Lenovo Hybrid AI Factory with NVIDIA, l’insieme di hardware, software e servizi con cui Lenovo propone di costruire una AI factory aziendale. Al posto di un progetto su misura si parte da una delle tre configurazioni validate, scelta in base alla dimensione dei modelli, al numero di utenti e al throughput richiesto. Quando aumentano utenti, agenti, dati e richieste di inferenza, l’infrastruttura può crescere.

Nel complesso il programma copre CPU AMD e Intel: SR650a V4 e SR680a V4 usano Intel Xeon 6, SR675 V3 usa AMD EPYC. Sopra l’hardware si può aggiungere il software IA enterprise più adatto alle proprie esigenze, ad esempio NVIDIA AI Enterprise o Red Hat AI Factory with NVIDIA. Per proteggere applicazioni, dati, modelli e pipeline IA è disponibile come opzione Veeam Kasten.

Le tre configurazioni: Small, Medium e Large

Le tre taglie coprono esigenze molto diverse: si va dal primo server dedicato all’inferenza IA per un reparto fino ai server IA enterprise che servono migliaia di utenti. I valori su utenti, token al secondo e dimensione dei modelli sono indicativi. Lenovo precisa che variano in base a modello, carico di lavoro, software e livello di servizio (SLA), e che sono stimati con il suo strumento interno di dimensionamento.

Small: inferenza IA mirata, spedizione da 15 giorni lavorativi

  • Server: Lenovo ThinkSystem SR650a V4
  • GPU: 2 NVIDIA RTX PRO 6000 Blackwell Server Edition (96 GB di memoria GDDR7 ciascuna)
  • Carico tipico: inferenza IA mirata
  • Modelli: dimensione media da 7 a 70 miliardi di parametri (7B–70B)
  • Utenti: decine, a oltre 30 token al secondo
  • Spedizione: da 15 giorni lavorativi

È la configurazione da cui partire per mettere in produzione un primo servizio basato su modelli generativi, per esempio un assistente interno che risponde su documentazione e procedure aziendali, senza dimensionare da subito un’infrastruttura grande.

Medium: più utenti e AI agentica, spedizione da 20 giorni lavorativi

  • Server: Lenovo ThinkSystem SR675 V3
  • GPU: 8 NVIDIA RTX PRO 6000 Blackwell Server Edition
  • Carico tipico: inferenza ad alto throughput e AI agentica
  • Modelli: dimensione media da 70 a 400 miliardi di parametri (70B–400B)
  • Utenti: centinaia, a oltre 30 token al secondo
  • Spedizione: da 20 giorni lavorativi

Ha senso quando l’IA deve servire più reparti o un servizio rivolto ai clienti, oppure quando si vogliono usare agenti che svolgono compiti in più passaggi.

Large: IA generativa su scala enterprise, spedizione da 25 giorni lavorativi

  • Server: Lenovo ThinkSystem SR680a V4
  • GPU: piattaforma NVIDIA HGX B300
  • Carico tipico: modelli di IA generativa su larga scala, con carichi di lavoro e livelli di interattività molto diversi
  • Modelli: fino a mille miliardi di parametri
  • Utenti: migliaia
  • Spedizione: da 25 giorni lavorativi

È pensata per deployment di livello enterprise, in cui un’unica piattaforma deve reggere molte applicazioni e migliaia di persone.

Confronto tra le configurazioni Lenovo AI Express

SmallMediumLarge
ServerThinkSystem SR650a V4ThinkSystem SR675 V3ThinkSystem SR680a V4
GPU NVIDIA2× RTX PRO 6000 Blackwell Server Edition8× RTX PRO 6000 Blackwell Server EditionHGX B300
Carico tipicoInferenza IA mirataInferenza ad alto throughput e AI agenticaIA generativa su larga scala
Dimensione modelli7B–70B70B–400BFino a 1.000 miliardi di parametri
UtentiDecine (30+ token/s)Centinaia (30+ token/s)Migliaia
Spedizione dall’ordineDa 15 giorni lavorativiDa 20 giorni lavorativiDa 25 giorni lavorativi
Valori indicativi dichiarati da Lenovo. Prestazioni e numero di utenti dipendono da modello, carico di lavoro, software e SLA; i tempi valgono per le configurazioni idonee.

Cosa significa “spedizione da 15 giorni”

I 15, 20 e 25 giorni lavorativi indicano il tempo tra ordine e spedizione (order-to-ship). La messa in produzione arriva dopo: una volta consegnati i server, servono installazione, configurazione del software e test sui propri dati.

Lenovo indica anche alcune condizioni. I tempi valgono per le configurazioni AI Express idonee e per componenti selezionati, nei mercati senza restrizioni. Il conteggio parte dopo la validazione dell’ordine, l’approvazione del pagamento o del credito, la certificazione dell’utente finale (End User Certification) e le eventuali verifiche e autorizzazioni all’esportazione. Disponibilità, requisiti e modalità d’ordine variano da paese a paese, quindi per l’Italia i tempi vanno confermati sulla singola configurazione.

Il vantaggio rispetto a un progetto costruito da zero è la prevedibilità. Si sa in anticipo cosa si acquista e in che tempi viene spedito, e si riduce il rischio di sovradimensionare l’infrastruttura o di restare fermi in attesa dei componenti.

Servizi e assistenza Lenovo

Lenovo affianca AI Express con servizi che coprono l’intero ciclo di vita della AI factory: dall’individuazione dei casi d’uso alla verifica del ritorno dell’investimento con un proof of concept, fino all’ottimizzazione degli ambienti GPU per prestazioni, utilizzo e costi. Con l’annuncio è arrivato anche Premier Support Plus, un livello di assistenza con funzioni proattive e predittive pensate per individuare prima i problemi negli ambienti critici.

Per chi vuole partire in fretta con un caso concreto, Lenovo propone anche AI Fast Start, un servizio che punta ad avere un progetto pilota funzionante, costruito sui dati del cliente, in un minimo di 90 giorni.

Esempi di utilizzo in azienda

Qualche progetto che si può realizzare su un’infrastruttura di questo tipo. La configurazione giusta dipende dai modelli scelti, dal numero di utenti e dai tempi di risposta richiesti.

  • Assistente per il supporto clienti: un chatbot o un copilota per gli operatori che lavora su FAQ, manuali e storico dei ticket.
  • Analisi dei log e sicurezza: grandi volumi di log analizzati per far emergere anomalie e aiutare il team di sicurezza a correlare gli eventi.
  • Documentazione e contenuti: bozze di documentazione tecnica, schede prodotto e traduzioni per i reparti tecnici e marketing.
  • Piattaforma IA interna: un ambiente condiviso tra più reparti per sperimentare e poi mettere in produzione modelli proprietari o open source.

Avere i modelli su un’infrastruttura propria permette di usarli sui dati aziendali mantenendo il controllo su dove risiedono e su chi vi accede.

Come ti aiuta VMS’S Group

Per scegliere la configurazione giusta conviene partire dai casi d’uso che vuoi portare in produzione. Con VMS’S Group puoi:

  • analizzare con noi i carichi di lavoro e capire quale taglia, tra Small, Medium e Large, è adeguata oggi e quanto margine serve per crescere;
  • ricevere un preventivo con configurazione, software e tempi di consegna confermati per l’Italia;
  • pianificare installazione, configurazione dello stack software (NVIDIA AI Enterprise o Red Hat AI Factory with NVIDIA) e messa in servizio;
  • definire assistenza e manutenzione dopo l’avvio, anche con i servizi di supporto Lenovo.

Domande frequenti su Lenovo AI Express

Quanto costa Lenovo AI Express?

Il comunicato di Lenovo non indica prezzi. Il costo dipende dalla taglia, dalla CPU, dal software scelto e dai servizi inclusi, quindi per avere una cifra serve un preventivo sulla configurazione che ti interessa.

L’infrastruttura è operativa dopo 15 giorni?

No. I 15 giorni lavorativi (20 per la Medium, 25 per la Large) misurano il tempo dall’ordine alla spedizione per le configurazioni idonee, e il conteggio parte dopo validazione dell’ordine, pagamento e autorizzazioni. Installazione e configurazione vanno pianificate a parte.

Serve un data center?

Si tratta di server rack ThinkSystem, quindi serve uno spazio tecnico con alimentazione, raffreddamento e connettività adeguati. I requisiti cambiano molto da una taglia all’altra: una configurazione Large con NVIDIA HGX B300 chiede molto più di una Small. Conviene verificarli prima dell’ordine.

Si può partire con un progetto pilota?

Sì. La configurazione Small è pensata per carichi di inferenza mirati e permette di partire con un primo caso d’uso per poi crescere. Lenovo offre anche il servizio AI Fast Start, che punta a un pilota funzionante sui dati del cliente in un minimo di 90 giorni.

Lenovo AI Express funziona con processori AMD?

Sì, con la configurazione Medium, basata su ThinkSystem SR675 V3 con processori AMD EPYC. Small e Large usano Intel Xeon 6.

Vuoi valutare un’infrastruttura IA per la tua azienda?

Compila il modulo qui sotto per richiedere una consulenza gratuita: ti aiutiamo a scegliere la configurazione Lenovo AI Express più adatta tra Small, Medium e Large, a stimare costi e tempi e a definire un piano di deployment in settimane invece che in mesi.


Fonte: comunicato stampa Lenovo del 30 settembre 2026, “Lenovo AI Express with NVIDIA Accelerates Path to Hybrid AI Factory in Weeks” (pubblicato anche su Business Wire).

Chiedi informazioni

Hai domande su questo argomento o vuoi capire come applicarlo alla tua azienda? Compila il modulo: ti ricontattiamo a breve.