top of page

Il lancio di GMKtec Evo-X5 Pro porta l'AI locale nel territorio delle workstation

30 set
Tempo di lettura: 13 min

GMKtec ha lanciato Evo-X5 Pro con 192GB di memoria unificata, trasformando un mini-PC AI in una workstation desktop insolitamente costosa. Il lancio di GMKtec Evo-X5 Pro segna inoltre una delle prime apparizioni commerciali del Ryzen AI Max+ Pro 495 di AMD, precedentemente noto come Gorgon Halo.

Il dato decisivo non è la frequenza di clock del processore né la sua valutazione di elaborazione neurale. È la capacità di memoria. GMKtec consente alla grafica Radeon integrata di utilizzare fino a 160GB, offrendo ai modelli locali accesso a molta più memoria rispetto a quella disponibile nella maggior parte dei computer compatti.

Questa progettazione colloca Evo-X5 Pro in competizione con sistemi come Minisforum MS-S1 Max e Acemagic F9A. Tuttavia, il suo vero concorrente è l'AI nel cloud. GMKtec chiede agli acquirenti di assumersi un ingente impegno iniziale per l'inferenza privata offline, anziché pagare continuamente per l'elaborazione remota.

Il lancio di GMKtec Evo-X5 Pro ruota attorno a 192GB di memoria condivisa

GMKtec vende la capacità di memoria come caratteristica AI distintiva di Evo-X5 Pro, non come specifica secondaria.

L'azienda ha rilasciato ufficialmente la macchina il 28 settembre 2026, dopo una precedente presentazione all'IFA di Berlino. Le sue specifiche di lancio abbinano Ryzen AI Max+ Pro 495 di AMD a 192GB di memoria LPDDR5X-8533.

La memoria unificata è un pool condiviso al servizio di CPU e grafica integrata. Evita la separazione fissa tra la RAM di sistema convenzionale e la memoria dedicata collegata a una scheda grafica discreta.

GMKtec afferma che Evo-X5 Pro può assegnare dinamicamente fino a 160GB di questo pool alla grafica. L'azienda indica una larghezza di banda di memoria di picco pari a 273GB al secondo, che determina la velocità con cui i processori possono spostare i pesi dei modelli e altri dati.

Questi dati costituiscono l'argomento centrale del prodotto. I grandi modelli locali spesso raggiungono un limite di capacità prima di esaurire le prestazioni di calcolo teoriche di un processore. Una workstation compatta con più memoria grafica indirizzabile può caricare modelli che semplicemente non entrano in molte GPU consumer.

GMKtec afferma che il sistema finito supporta l'inferenza offline con modelli contenenti fino a 320 miliardi di parametri. Si tratta di un'affermazione aggiornata rispetto all'obiettivo di 300 miliardi di parametri annunciato in occasione dell'IFA.

La precisazione è importante. GMKtec osserva che compatibilità e prestazioni dipendono dal modello, dal software, dalla quantizzazione, dal carico di lavoro e dalla configurazione del sistema. La quantizzazione riduce la precisione dei pesi del modello, abbassando i requisiti di memoria a fronte di un possibile costo in accuratezza o qualità dell'output.

Il numero di parametri, quindi, non descrive l'intera esperienza. Caricare un modello compresso è diverso dal generare risposte rapidamente, mantenere un contesto lungo o coordinare diversi modelli attivi.

Il report originale ha evidenziato il costo insolitamente elevato della macchina. Questo posizionamento la distingue dai mini-PC mainstream prima ancora che entrino in gioco le prestazioni.

GMKtec offre configurazioni con 2TB o 4TB di archiviazione PCIe 4.0. Il sistema supporta unità aggiuntive, portando la capacità di archiviazione totale dichiarata a 24TB.

Lo chassis include inoltre una camera di vapore e tre ventole per carichi di lavoro prolungati. Questo sistema di raffreddamento segnala che Evo-X5 Pro è progettato per eseguire attività di inferenza e sviluppo più lunghe, non funzionalità occasionali di ufficio assistite dall'AI.

Due porte USB4 V2 offrono connessioni valutate fino a 80Gbps. Il sistema include inoltre funzionalità di gestione e sicurezza professionali, tra cui l'amministrazione remota AMD DASH e un componente di sicurezza TPM 2.0 dedicato.

Nel loro insieme, queste scelte rendono la macchina più simile a una piccola workstation che a un comune mini-PC da salotto. L'involucro compatto fa parte del suo fascino, ma è l'architettura della memoria a definire l'identità pratica del prodotto.

Gorgon Halo fa comportare una GPU integrata in modo diverso

La piattaforma Gorgon Halo di AMD è importante perché combina un ampio pool di memoria con una grafica capace, riducendo un vincolo rilevante per l'inferenza locale.

Ryzen AI Max+ Pro 495 utilizza 16 core CPU Zen 5 e supporta 32 thread di elaborazione. AMD indica una frequenza boost fino a 5.2GHz, mentre GMKtec abbina il processore alla grafica integrata Radeon 8065S.

Questa GPU utilizza l'architettura RDNA 3.5 di AMD e contiene 40 unità di calcolo. A differenza di una scheda grafica discreta, attinge allo stesso pool di memoria della CPU.

Le specifiche del processore di AMD identificano Gorgon Halo come il precedente nome in codice del chip. Il processore include inoltre un'unità di elaborazione neurale XDNA 2, o NPU, valutata fino a 55 trilioni di operazioni al secondo.

Una NPU accelera le attività AI supportate utilizzando generalmente meno energia di una CPU. Tuttavia, le prestazioni dei grandi modelli linguistici dipendono fortemente dalla GPU integrata, dalla memoria disponibile, dal supporto software e dal formato del modello.

Sommando l'output di CPU, GPU e NPU si ottiene un valore AI totale più elevato. Questo numero combinato può essere utile per confrontare le piattaforme, ma non rappresenta un unico blocco intercambiabile di capacità computazionale.

Il software deve assegnare il lavoro compatibile a ciascun motore. Un modello che funziona bene tramite la GPU Radeon non utilizza automaticamente la NPU, mentre un'applicazione progettata per la NPU può supportare soltanto tipi di modello specifici.

Il vantaggio più significativo di Evo-X5 Pro è il suo equilibrio tra capacità di memoria e larghezza di banda. Molti sistemi AI locali possono calcolare rapidamente ma non riescono a mantenere interamente il modello desiderato nella memoria veloce.

Quando una parte del modello finisce nell'archiviazione più lenta o passa tra dispositivi, le prestazioni possono diminuire drasticamente. Un pool unificato più grande riduce questo rischio, anche se non elimina l'overhead software né i limiti di larghezza di banda.

Questa architettura evita inoltre di copiare gli stessi dati di lavoro tra la RAM di sistema convenzionale e la memoria video separata. Ciò può semplificare alcuni carichi di lavoro e preservare una maggiore capacità utilizzabile.

Il compromesso è che la memoria LPDDR5X è normalmente saldata alla scheda madre. Gli acquirenti devono scegliere una capacità sufficiente al momento dell'acquisto, poiché non possono trattarla come DIMM desktop sostituibili.

Questa limitazione aumenta l'importanza del firmware di GMKtec, dei controlli di allocazione della memoria e del supporto software a lungo termine. Un ampio pool di memoria offre valore solo quando sistemi operativi e framework AI possono utilizzarlo in modo affidabile.

Il prodotto supporta Windows 11, mentre AMD elenca Ubuntu e Red Hat Enterprise Linux tra i sistemi operativi supportati dalla famiglia di processori. La maturità effettiva dei driver per strumenti specifici richiede comunque test a livello di carico di lavoro.

Gli sviluppatori di AI locale dipendono spesso da combinazioni in rapida evoluzione di runtime, server per modelli, formati di quantizzazione e librerie GPU. Un processore tecnicamente capace può comunque produrre risultati disomogenei quando un componente non dispone di ottimizzazione.

Evo-X5 Pro rappresenta quindi un meccanismo hardware, non un risultato prestazionale garantito. Amplia la gamma di modelli che possono entrare in un unico sistema compatto, ma il software determina l'efficacia con cui vengono eseguiti.

Questa distinzione è importante per gli acquirenti che confrontano la macchina con servizi cloud o workstation basate su Nvidia. Capacità, throughput, compatibilità e impegno operativo restano dimensioni separate.

La privacy dell'AI locale comporta un grande impegno iniziale

Evo-X5 Pro trasforma l'evitare il cloud in un acquisto hardware, trasferendo costi e responsabilità sull'acquirente.

GMKtec descrive il computer come un “agentic PC”, ovvero un sistema progettato per eseguire software che pianifica e completa attività in più passaggi. Tra le applicazioni suggerite figurano modelli linguistici privati, assistenti per la programmazione, basi di conoscenza locali e flussi di lavoro multi-agente.

L'argomento della privacy è semplice. Un modello locale può elaborare documenti senza inviare ogni prompt o file sorgente a un servizio di inferenza remoto.

Questo approccio può interessare sviluppatori che gestiscono codice proprietario, ricercatori che lavorano su materiale non pubblicato e organizzazioni che amministrano record riservati. L'elaborazione locale consente inoltre ai team di continuare a utilizzare un modello quando l'accesso a internet non è disponibile o è limitato.

Mantenere l'inferenza su un computer non rende automaticamente sicuro un flusso di lavoro. Gli amministratori devono comunque predisporre controlli di accesso, crittografia dello storage, aggiornamenti di sistema, verifiche della provenienza dei modelli e backup affidabili.

Il software agentico introduce un ulteriore livello di rischio perché può interagire con file, applicazioni o servizi di rete. Un agente ospitato localmente può comunque esporre informazioni attraverso strumenti non sicuri o autorizzazioni troppo ampie.

Evo-X5 Pro fornisce hardware per l'elaborazione privata, non un sistema di governance completo. Gli acquirenti restano responsabili di decidere quali modelli possano accedere a informazioni sensibili e quali azioni tali modelli possano eseguire.

Una base di conoscenza ricercabile è un possibile carico di lavoro. Gli ingegneri potrebbero indicizzare documenti tecnici interni mantenendo i file originali vicini al loro ambiente esistente.

La capacità di 192GB della macchina crea inoltre spazio per servizi di supporto attorno a un modello. Un'applicazione AI pratica può richiedere un modello di embedding, un database vettoriale, un reranker, un parser di documenti, un servizio di monitoraggio e un'interfaccia utente.

L'esecuzione simultanea di questi componenti può consumare molta memoria anche quando il modello principale entra comodamente. La capacità aggiuntiva può contare più per uno stack applicativo completo che per inseguire il maggior numero di parametri possibile.

I servizi cloud restano più facili da scalare. Un team può richiedere più acceleratori per un progetto temporaneo, utilizzare API gestite o cambiare fornitore di modelli senza sostituire la propria workstation.

L'hardware locale offre invece un pool fisso di risorse. Può garantire una disponibilità più prevedibile, ma richiede anche installazione, manutenzione, alimentazione, raffreddamento e risoluzione dei problemi.

Il confronto finanziario dipende dall'uso. Un'inferenza intensa e continua può rendere l'hardware di proprietà interessante nel tempo, mentre esperimenti intermittenti possono favorire servizi cloud basati sul consumo.

La scelta del modello complica ulteriormente il calcolo. I fornitori di servizi ospitati introducono regolarmente nuovi modelli, acceleratori specializzati e sistemi di inferenza ottimizzati. Una workstation acquistata mantiene le stesse capacità fisiche per tutta la sua vita utile.

L'elevato costo di ingresso della macchina restringe il suo pubblico. Ricercatori indipendenti e piccoli team devono decidere se la memoria aggiuntiva cambi materialmente il loro lavoro o crei soltanto margine inutilizzato.

Per le organizzazioni, l'approvvigionamento è solo il primo ostacolo. I team di sicurezza possono richiedere gestione dei dispositivi, log di audit, fonti di modelli approvate e politiche documentate di trattamento dei dati.

GMKtec include funzionalità di gestione remota e sicurezza hardware rivolte alle implementazioni professionali. Questi strumenti migliorano l'idoneità della piattaforma per ambienti gestiti, ma le organizzazioni dovranno comunque validarli rispetto alle politiche esistenti.

La decisione tra locale e cloud non è quindi un semplice confronto sulla privacy. È una scelta tra controllo operativo e comodità operativa.

Minisforum e Acemagic mostrano il reale divario competitivo

Evo-X5 Pro primeggia per capacità di memoria, mentre i sistemi Ryzen AI Max consolidati competono con un impegno minore e configurazioni collaudate.

Minisforum MS-S1 Max rappresenta un importante punto di riferimento perché ha introdotto una workstation compatta basata sul precedente Ryzen AI Max+ 395 di AMD. Anche quel processore offre 16 core Zen 5 e grafica Radeon 8060S.

Minisforum propone il sistema con fino a 128GB di memoria LPDDR5X. Il suo design MS-S1 Max supporta l'uso da desktop e l'installazione in un rack 2U, rendendolo rilevante per piccoli cluster.

Il sistema punta inoltre su espansione e networking. La combinazione di USB ad alta velocità, doppia Ethernet da 10 gigabit e uno slot PCIe offre agli sviluppatori più opzioni per collegare storage, hardware di rete o altri acceleratori.

F9A di Acemagic segue un approccio simile. La sua configurazione Ryzen AI Max+ 395 abbina 128GB di memoria LPDDR5X alla grafica Radeon 8060S in uno chassis da due litri.

Le specifiche F9A pubblicate includono due slot di archiviazione PCIe 4.0, Wi-Fi 7 e diverse uscite video. Acemagic lo posiziona per sistemi di retrieval privati, agenti locali, ricerca e creazione di contenuti.

Entrambi i concorrenti si fermano sotto il limite di 192GB dell'Evo-X5 Pro. Questo lascia a GMKtec un chiaro vantaggio di capacità per i carichi di lavoro che richiedono realmente più di 128GB.

Il vantaggio diventa meno decisivo quando un modello entra già nel pool più piccolo. In quel caso, maturità del software, potenza sostenuta, raffreddamento, rumore, connettività e supporto possono contare di più.

Un modello più grande non è automaticamente migliore per ogni attività. Modelli specializzati più piccoli possono rispondere più rapidamente, consumare meno energia e offrire buone prestazioni se abbinati a retrieval o strumenti accuratamente strutturati.

I team dispongono anche di alternative a un'unica grande macchina. Diversi sistemi più piccoli possono suddividere i servizi, fornire ridondanza o gestire richieste parallele.

Il clustering introduce overhead di rete e orchestrazione, ma riduce la dipendenza da una singola workstation. Può inoltre consentire alle organizzazioni di espandere la capacità in incrementi più piccoli.

L'Evo-X5 Pro privilegia il consolidamento. Un solo sistema può ospitare un modello consistente e diversi processi di supporto senza coordinare la memoria tra più computer.

Questa semplicità ha valore per sviluppo e dimostrazioni. Un team può riprodurre uno stack locale completo su un dispositivo, spostarlo tra sedi diverse o isolarlo dalle reti esterne.

Tuttavia, il consolidamento crea un singolo punto di guasto. Se la macchina necessita di riparazione, l'intero ambiente può diventare indisponibile, a meno che l'organizzazione non mantenga un altro sistema.

La concorrenza arriva anche da altri fornitori che utilizzano Ryzen AI Max+ Pro 495. Una più ampia ondata hardware include sistemi annunciati da Framework e Acemagic con configurazioni di memoria altrettanto ampie.

Questo conta perché la finestra di vantaggio come primo arrivato di GMKtec potrebbe essere breve. Una volta che più fornitori offriranno macchine da 192GB, gli acquirenti potranno confrontare assistenza, design dello chassis, sistemi operativi ed espandibilità anziché la sola memoria.

Le workstation Nvidia restano un'altra strada competitiva. Le GPU discrete beneficiano di software AI maturo e di un ampio supporto applicativo, sebbene le configurazioni ad alta memoria possano richiedere più acceleratori o schede professionali.

I desktop Apple con memoria unificata offrono un confronto diverso. Possono fornire grandi pool di memoria condivisa e un'inferenza locale efficiente, ma il supporto software e la portabilità dei carichi di lavoro variano tra le piattaforme.

L'Evo-X5 Pro non risolve questi confronti con le sole specifiche. I test indipendenti devono misurare velocità di generazione utilizzabile, consumo energetico, temperature, rumore e stabilità nei formati di modello più comuni.

L'affermazione sui 320B è il test, non il verdetto

L'affermazione di GMKtec sul modello più grande descrive ciò che può entrare in condizioni selezionate, non ciò che gli utenti dovrebbero aspettarsi da ogni carico di lavoro AI locale.

Il conteggio dei parametri è diventato una scorciatoia allettante per l'hardware AI locale. È facile da comprendere e un numero maggiore crea una distinzione visibile tra i prodotti.

Eppure, il conteggio dei parametri dice poco su architettura del modello, livello di quantizzazione, lunghezza del contesto, velocità di output o qualità delle risposte. Due modelli di dimensioni simili possono generare richieste hardware molto diverse.

GMKtec qualifica con attenzione la sua dichiarazione sui 320 miliardi di parametri. L'azienda afferma che i risultati dipendono dal modello selezionato, dal software, dalla quantizzazione, dal carico di lavoro e dalla configurazione.

Questa precisazione dovrebbe orientare qualsiasi decisione d'acquisto. Il benchmark critico non è se la macchina carica un modello selezionato, ma se fornisce prestazioni utili per il lavoro ripetuto.

Per un assistente interattivo, il tempo al primo token influenza la reattività percepita del sistema. La velocità di generazione determina se gli utenti possono mantenere una conversazione produttiva.

Per l'analisi dei documenti, contano capacità di contesto e qualità del retrieval. Per gli agenti, affidabilità degli strumenti e tempo totale di completamento dell'attività possono pesare più della pura dimensione del modello.

L'operatività sostenuta presenta un'altra prova. Una breve dimostrazione potrebbe non rivelare throttling termico, pressione sulla memoria, instabilità dei driver o cambiamenti delle prestazioni durante sessioni prolungate.

Anche il consumo energetico incide sull'equazione locale rispetto al cloud. L'inferenza continua può trasformare elettricità e raffreddamento in costi operativi significativi, soprattutto negli uffici che utilizzano più macchine.

Poi c'è il supporto software. L'ecosistema AI di AMD è migliorato, ma gli acquirenti dovrebbero confermare che il runtime scelto supporti Radeon 8065S e i formati di modello necessari.

Un modello eseguito tramite una soluzione sperimentale potrebbe non essere adatto a un flusso di lavoro produttivo. Gli aggiornamenti di driver o framework possono migliorare le prestazioni, ma possono anche introdurre incompatibilità.

Le recensioni indipendenti dovrebbero testare diversi livelli di quantizzazione anziché pubblicare un unico risultato nel caso migliore. Dovrebbero inoltre riportare uso totale della memoria, velocità di elaborazione del prompt, velocità di generazione e potenza del sistema.

I confronti richiedono modelli e impostazioni coerenti. Testare una macchina con un modello fortemente compresso e un'altra con precisione più elevata nasconderebbe la differenza hardware.

Anche la memoria saldata merita attenzione. Gli acquirenti ottengono elevata larghezza di banda e capacità eccezionale, ma non possono sostituire né espandere la memoria in seguito.

Riparabilità e servizio di garanzia assumono quindi più peso rispetto a un normale desktop aggiornabile. Un guasto legato alla memoria può coinvolgere l'intero assemblaggio della scheda madre.

L'espansione dello storage dell'Evo-X5 Pro compensa in parte questa rigidità. Gli utenti possono aggiungere più dataset locali e file di modello, anche se lo storage non può sostituire la larghezza di banda della memoria di lavoro.

Le dichiarazioni sulla sicurezza richiedono una prudenza analoga. L'inferenza offline può ridurre l'esposizione dei dati a provider esterni, ma non può prevenire file di modello non sicuri, software compromesso o agenti configurati male.

La conclusione utile è più circoscritta del linguaggio di marketing. GMKtec ha creato un sistema compatto con memoria condivisa sufficiente per tentare carichi di lavoro locali che in precedenza richiedevano workstation più grandi.

Che si tratti di una piattaforma efficace dipende da prove indipendenti. L'hardware apre la porta, ma applicazioni, driver e prestazioni sostenute determinano ciò che accade dopo la sua apertura.

Cosa dovrebbero osservare gli acquirenti dopo il lancio di GMKtec Evo-X5 Pro

Tre segnali determineranno se Evo-X5 Pro diventerà una credibile workstation AI locale o resterà una costosa vetrina di capacità.

Il primo segnale è il test indipendente dei modelli. I recensori devono misurare velocità di generazione, elaborazione dei prompt, uso della memoria, rumore e consumo energetico su diverse dimensioni di modello.

I test dovrebbero includere la classe più grande supportata, ma non fermarsi lì. Modelli più piccoli potrebbero rivelare se il sistema può servire gli assistenti quotidiani in modo più efficiente rispetto a una GPU discreta di fascia alta.

Risultati solidi a diversi livelli di quantizzazione sosterrebbero l'argomentazione di GMKtec secondo cui 192GB cambiano ciò che un computer compatto può fare. Un output molto lento indebolirebbe il valore pratico della capacità in evidenza.

Il secondo segnale è il supporto software per Gorgon Halo. AMD, i fornitori di sistemi operativi e gli sviluppatori di framework per l'inferenza devono rendere Radeon 8065S accessibile tramite percorsi software stabili e documentati.

Il supporto per i comuni server locali di modelli conterà più di codice dimostrativo isolato. Gli sviluppatori non dovrebbero dover ricostruire il proprio ambiente a ogni modifica del driver.

Anche l'adozione dell'NPU merita attenzione. Se le applicazioni possono assegnare adeguate attività in background all'unità XDNA 2, la piattaforma potrebbe distribuire il lavoro in modo più efficiente.

Il terzo segnale è la risposta competitiva. Framework, Acemagic, Minisforum e altri produttori sono nella posizione di verificare se 192GB diventeranno una categoria o rimarranno una specifica di nicchia.

Più sistemi spingerebbero i fornitori a competere su raffreddamento, supporto, connettività, riparabilità e prestazioni verificate. Un'adozione limitata suggerirebbe che il mercato indirizzabile è più piccolo di quanto l'attenzione al lancio faccia intendere.

Gli acquirenti dovrebbero inoltre osservare l'affidabilità delle consegne e le prime segnalazioni dei proprietari. I sistemi a fattore di forma ridotto collocano processori esigenti, memoria veloce, storage e componenti di rete in ambienti termici limitati.

La qualità del firmware diventa spesso visibile solo dopo che i clienti testano comportamento in sospensione, compatibilità con le periferiche, carichi sostenuti e aggiornamenti del sistema operativo. Queste segnalazioni possono essere più utili di una dimostrazione di lancio controllata.

Il lancio di GMKtec Evo-X5 Pro verifica infine se gli utenti dell'AI locale attribuiscano alla capacità un valore sufficiente da accettare costi e responsabilità da workstation. Il suo pool di memoria da 192GB è davvero insolito, ma la capacità da sola non garantisce un sistema utile.

Gli sviluppatori che valutano la macchina dovrebbero partire dal proprio carico di lavoro, non dal modello più grande citato da GMKtec. Misurate la memoria effettivamente richiesta dal vostro modello, dal contesto e dai servizi di supporto.

Poi confrontate l'utilizzo previsto con le alternative cloud e con sistemi locali più piccoli. Se i carichi di lavoro sensibili vengono eseguiti continuamente e superano 128GB, Evo-X5 Pro offre un'opzione distintiva.

Se il carico di lavoro è intermittente o rientra comodamente altrove, attendere benchmark indipendenti è la scelta più prudente. I prossimi mesi dovrebbero rivelare se Gorgon Halo offre un nuovo livello per l'AI locale o se semplicemente alza il limite massimo.

 
 

Inizia gratis

Un assistente IA local-first con gestione della conoscenza personale

Per una migliore esperienza con l’IA,

al momento remio supporta solo Windows 10+ (x64) e M-Chip Macs.

Il tuo partner AI al lavoro
Fai di più con remio

Pianifica. Crea. Consegna.
Tutto in un unico posto.

bottom of page