Fujitsu · AI Infrastructure · scheda YoctoIT

PRIMERGY GX

I server GPU della famiglia PRIMERGY: acceleratori NVIDIA, alimentazione e raffreddamento dimensionati per l'AI — la base per training e inferenza che restano in casa.

FOCUS · AI SOVRANAL'AI nel tuo data center: GPU NVIDIA on-premises, modelli e dati sotto il tuo controllo
Materiale YoctoIT per clienti e partner · Fujitsu, PRIMERGY e gli altri prodotti citati sono marchi di Fujitsu Limited o di Fsas Technologies.
01 · Cos'è

PRIMERGY GX, in chiaro.

GX è la linea PRIMERGY pensata per i carichi accelerati: sistemi progettati attorno alle GPU NVIDIA, con alimentazione, raffreddamento e topologia PCIe dimensionati per farle rendere davvero. È il mattone hardware delle soluzioni AI di Fujitsu — Fsas Technologies in Europa — da Private GPT all'AI Test Drive: inferenza, fine-tuning e training senza mandare i dati fuori dal perimetro.

GPU
acceleratori NVIDIA: numero e tipo scelti sul workload
on-prem
i modelli girano da te: dati e costi sotto controllo
kW
alimentazione e raffreddamento dimensionati: le GPU rendono solo se respirano
PRIMERGY GX
VESTE UFFICIALE FUJITSU
02 · Come lo si usa bene

Le cose che fanno la differenza.

Il nodo AI

Dati / modelli / RAG / inferenzaciò che deve girare
GPU
CPU
NVMe
topologia bilanciata · rete veloce · storage che alimenta
Stack NVIDIAdriver, CUDA e container governati
Monitoraggioverso Yocto Vision e il nostro NOC
Le GPU che rendono quanto costano

Workload prima del ferro

Inferenza, RAG o training: numero e tipo di GPU si scelgono dopo aver capito il caso d'uso.

Alimentazione vera

kW, raffreddamento e spazio verificati in assessment: la sorpresa in sala macchine non esiste.

Storage all'altezza

NVMe locale e storage veloce a monte: la GPU non deve mai aspettare i dati.

Stack governato

Driver, CUDA e orchestrazione tenuti allineati: l'ambiente riproducibile, non fragile.

03 · In profondità

GPU, rete e storage: l'anatomia di un nodo AI

Un server GX combina GPU NVIDIA, CPU con abbastanza corsie PCIe, memoria e NVMe locale per alimentare gli acceleratori; la rete ad alta banda collega più nodi quando il modello cresce. Sopra, lo stack: driver, CUDA, container e framework — o direttamente Private GPT per l'AI generativa chiavi in mano. Noi dimensioniamo il nodo sul caso d'uso, lo integriamo in sala e lo teniamo aggiornato.

  • GPU NVIDIA — la scelta su misura: inferenza, fine-tuning o training cambiano la scheda giusta
  • Topologia PCIe — corsie e bilanciamento: le GPU parlano senza colli di bottiglia
  • NVMe locale — i dati vicino al calcolo: il feed che tiene le GPU occupate
  • Rete AI — alta banda tra i nodi: il cluster quando un server non basta
  • Private GPT ready — la base validata per l'AI generativa on-premises di Fujitsu
  • AI Test Drive — prova prima: il tuo caso d'uso su GPU reali, prima dell'investimento
04 · Numeri e ciclo di vita

I numeri che contano.

0
dati fuori dal perimetro: l'AI resta in casa
kW
la variabile dimenticata: alimentazione e cooling verificati prima
1
assessment prima dell'ordine: caso d'uso, ferro e TCO in chiaro
H24
il presidio del nostro NOC su nodo, stack e salute delle GPU
L'AI non è una GPU comprata a caso: è un caso d'uso dimensionato — noi lo misuriamo prima e lo gestiamo dopo.
05 · Use case

Dove rende davvero.

AI generativa interna

Chatbot e assistenti sui documenti aziendali, senza cloud.

Inferenza di produzione

Modelli in esercizio con latenza e costi prevedibili.

Visione e industria

Controllo qualità e analisi video vicino alla linea.

Una GPU ben scelta vale più di mille benchmark: facciamo i conti sul tuo caso d'uso reale.