Con Lenovo AI Express, Lenovo interviene su una parte molto concreta del percorso che separa i progetti pilota dall’AI in produzione: scelta, dimensionamento e approvvigionamento dell’infrastruttura. Il nuovo programma, sviluppato con NVIDIA, definisce tre configurazioni validate di server e acceleratori, associate a differenti dimensioni dei modelli, numero di utenti e carichi di inferenza.
Il punto centrale dell’offerta è un percorso rapido verso la Lenovo Hybrid AI Factory con NVIDIA, basato su sistemi predefiniti e tempi di fornitura più prevedibili. Per le configurazioni idonee Lenovo indica un order-to-ship a partire da 15 giorni lavorativi, riferito quindi all’evasione dell’ordine e alla spedizione dell’infrastruttura; i tempi salgono rispettivamente a 20 e 25 giorni per le configurazioni superiori. L’effettiva messa in produzione dipende poi dalle attività di installazione, integrazione con dati e software, validazione e gestione operativa.
Tre configurazioni per modelli da 7 miliardi a un trilione di parametri
Lenovo AI Express parte da tre configurazioni, denominate Small, Medium e Large, basate su sistemi ThinkSystem e acceleratori NVIDIA.
La configurazione Small è destinata principalmente all’inferenza per alcune decine di utenti e a modelli compresi indicativamente fra 7 e 70 miliardi di parametri. Utilizza un Lenovo ThinkSystem SR650a V4 con due NVIDIA RTX 6000 PRO Blackwell Server Edition e ha un tempo di consegna dichiarato a partire da 15 giorni lavorativi.
Il livello Medium sale a centinaia di utenti e comprende anche workload di AI agentica, con modelli fra 70 e 400 miliardi di parametri. La configurazione prevede un ThinkSystem SR675 V3 con otto NVIDIA RTX 6000 PRO Blackwell Server Edition e tempi a partire da 20 giorni.
La configurazione Large utilizza invece un ThinkSystem SR680a V4 con NVIDIA HGX B300 ed è pensata per installazioni enterprise destinate a migliaia di utenti, con modelli che possono arrivare fino a un trilione di parametri. In questo caso Lenovo indica tempi a partire da 25 giorni lavorativi.
Le soglie non rappresentano limiti rigidi. Dimensione del modello, throughput e numero di utenti effettivamente supportabili dipendono dal modello utilizzato, dal software, dal workload e dagli SLA. Lenovo utilizza questi valori come riferimento per il dimensionamento iniziale delle configurazioni.
Il problema è anche dimensionare l’infrastruttura senza sovradimensionarla
La logica di AI Express affronta uno dei problemi emersi con il passaggio dai proof of concept ai sistemi utilizzati stabilmente in azienda: prevedere quanta capacità GPU sia effettivamente necessaria.
Una configurazione progettata per un prototipo può diventare insufficiente quando aumentano contemporaneamente utenti, agenti, dimensioni del contesto e richieste di inferenza. All’estremo opposto, acquistare fin dall’inizio capacità dimensionata per la crescita futura immobilizza risorse costose che potrebbero restare inutilizzate.
“Lenovo AI Express offre ai nostri clienti un percorso accelerato per implementare infrastrutture AI dimensionate sulle loro specifiche esigenze, riducendo il rischio di sovradimensionamento o di costosi ritardi”, afferma Ashley Gorakhpurwalla, President Infrastructure Solutions Group di Lenovo.
L’approccio prevede quindi di partire dalla configurazione corrispondente al carico iniziale e ampliare successivamente l’infrastruttura al crescere di modelli, agenti AI, utenti, dati e richieste di inferenza.
CPU AMD e Intel e software enterprise sopra l’infrastruttura NVIDIA
Le tre configurazioni supportano le più recenti piattaforme CPU AMD e Intel, mentre sopra l’infrastruttura possono essere installati differenti ambienti software enterprise.
Tra quelli indicati dall’azienda figurano NVIDIA AI Enterprise e Red Hat AI Factory with NVIDIA. È prevista inoltre l’integrazione con Veeam Kasten per la protezione di applicazioni, dati, modelli e pipeline AI.
AI Express assume così la funzione di livello infrastrutturale della strategia Hybrid AI di Lenovo, combinando configurazioni hardware, software enterprise e servizi di implementazione.
Dai server ai servizi per costruire una AI Factory
Alla componente hardware Lenovo affianca un insieme di servizi dedicati alle Hybrid AI Factory, che coprono fasi differenti del progetto: individuazione e validazione dei casi d’uso, proof of concept, verifica del ritorno dell’investimento e ottimizzazione degli ambienti GPU in termini di prestazioni, utilizzo ed efficienza economica.
La società ha inoltre introdotto Premier Support Plus for Servers, servizio che utilizza funzioni di supporto proattivo e predittivo per individuare potenziali criticità prima che producano conseguenze sull’operatività dei sistemi.
“Il mercato sta entrando in una nuova fase dell’adozione dell’intelligenza artificiale: l’attenzione si sta spostando dalla sperimentazione alla capacità di portare l’AI in produzione in modo sicuro, efficiente e sostenibile”, afferma Roberto Massoli, Chief Technology Officer di Lenovo Italia. “Per le aziende è fondamentale poter contare su un’infrastruttura pronta all’uso, ma anche progettata per evolvere nel tempo. Lenovo AI Express nasce proprio con questo obiettivo: semplificare il percorso verso l’AI e consentire alle organizzazioni di scalare i propri progetti con maggiore velocità e prevedibilità”.
Il passaggio dai progetti pilota all’AI in produzione
La scelta di concentrarsi su tempi di approvvigionamento e dimensionamento riflette anche l’evoluzione degli investimenti aziendali nell’AI.
Nel Lenovo CIO Playbook 2026, il 94% dei responsabili IT si attende benefici concreti dai propri progetti AI, mentre le organizzazioni che stanno passando dalla sperimentazione all’implementazione su larga scala prevedono un ritorno medio di 2,78 dollari per ogni dollaro investito.
La crescita dei progetti in produzione modifica anche i requisiti dell’infrastruttura. Aumentano gli utenti, i modelli da gestire, gli agenti e i carichi di inferenza, mentre diventano più rilevanti disponibilità delle GPU, tempi di approvvigionamento, integrazione e capacità di espansione.
AI Express concentra quindi la standardizzazione proprio sulla fase infrastrutturale, associando classi di sistemi già validate a differenti scale di utilizzo.
Lenovo AI Express passa anche dal canale
Il programma sarà distribuito attraverso l’ecosistema di partner Lenovo e il framework Lenovo 360, mettendo le configurazioni validate a disposizione di system integrator, reseller e operatori di canale.
AI Express riprende in questo senso il modello già utilizzato da Lenovo con Top Choice Express, applicandolo alle infrastrutture AI attraverso configurazioni validate, maggiore trasparenza sul dimensionamento e tempi di approvvigionamento definiti.
“Le aziende chiedono oggi percorsi più semplici e prevedibili per portare l’intelligenza artificiale dalla fase di sperimentazione a quella operativa”, afferma Ilenia Lupi, Europe Channel Leader di Lenovo. “Attraverso il nostro ecosistema di partner rendiamo queste soluzioni più accessibili, aiutando le organizzazioni a ridurre la complessità e ad accelerare il time-to-value dei propri investimenti in AI”.
Per il canale, il programma definisce così un catalogo iniziale di infrastrutture già dimensionate per differenti scenari, dal deployment di modelli relativamente compatti per poche decine di utenti fino alle installazioni basate su HGX B300 per workload enterprise su larga scala.








