Potenza alla portata di tutti
Approfitta dell'architettura NVIDIA Hopper senza la complessità di un cluster di supercomputer. Ideale per affinare i modelli ed eseguire operazioni di inferenza ad alta velocità.
Prestazioni affidabili per tutti i carichi di lavoro legati all'intelligenza artificiale.

Approfitta dell'architettura NVIDIA Hopper senza la complessità di un cluster di supercomputer. Ideale per affinare i modelli ed eseguire operazioni di inferenza ad alta velocità.
Implementate nodi con una o due GPU a seconda del vostro carico di lavoro. Le H100 PCIe garantiscono un trasferimento rapido dei dati tra la CPU e la GPU, in particolare per le applicazioni che richiedono molte risorse.
Addestrate i vostri modelli come preferite: ospitati in Europa (a Parigi e a Varsavia), i vostri modelli e i vostri dati rimangono sotto la giurisdizione europea e non sono soggetti a normative extraterritoriali.
Le istanze H100 PCIe integrano la potenza dell’H100 in modo versatile. Progettate per le aziende che necessitano di potenza di calcolo grezza per affinare i modelli di linguaggio (LLM), eseguire simulazioni scientifiche o far funzionare modelli di IA generativa su larga scala, queste istanze combinano prestazioni e flessibilità di implementazione.
Adattate i modelli di base ai vostri dati. Con 80 GB di memoria per scheda, le H100 PCIe sono ideali per affinare modelli da 7B (e fino a 70B con quantizzazione avanzata) molto più rapidamente rispetto alle precedenti generazioni di hardware.
Esegui modelli complessi su larga scala. Sfrutta il Transformer Engine per automatizzare la precisione FP8, ottenendo così prestazioni di inferenza fino a 30 volte più veloci per le applicazioni di IA generativa rispetto all'A100.
Le schede H100 PCIe offrono notevoli miglioramenti in termini di prestazioni in doppia precisione (FP64), accelerando così le simulazioni nei campi della fluidodinamica, della modellizzazione climatica e della dinamica molecolare.

Unità di elaborazione grafica
NVIDIA H100 PCIe5.
Architettura
NVIDIA Hopper 2022.
VRAM
80 GB di HBM2E per GPU (2 TB/s).
Unità centrale di elaborazione
24-48 vCPU AMD EPYC™ 9334.
Frequenza del processore
2,7 GHz.
Memoria ad accesso casuale
240-480 GB.
Digita la RAM
Double Data Rate 5
Larghezza di banda di rete
Fino a 20 Gbps.
Archiviazione
Block Storage e Scratch locale NVMe.
GPU ad alte prestazioni
1513 TFLOPS FP16 Tensor Cores.
Accordo standard sulla lingua
99,5%.

Tempi di esecuzione ridotti del 40% rispetto ad altri fornitori
Gli esperti di IA sovrana Golem.ai hanno condotto un rigoroso studio comparativo tra Replicate.com e l'infrastruttura di Scaleway. Dopo aver effettuato oltre 100 test, la loro approfondita analisi tecnica ha rivelato un aumento della velocità di esecuzione del 40% a favore delle istanze H100 PCIe di Scaleway.
| Option and value | Price |
|---|---|
| ZonePAR-2 | |
| Instance1x | 0€ |
| Volume10GB | 0€ |
| IPv4 flessibileNo | 0€ |
DC5 è uno dei data center più ecologici d’Europa, alimentato interamente da energia eolica e idroelettrica rinnovabile (certificata GO), con un sistema di raffreddamento ultra-efficiente che utilizza la ventilazione diretta e il raffreddamento adiabatico. Con un PUE di 1,16 (rispetto alla media del settore pari a 1,55), riduce il consumo energetico fino al 30% rispetto ai data center tradizionali.

Ad alta velocità, a lungo raggio
Accelerate lo sviluppo di applicazioni di intelligenza artificiale grazie alle istanze GPU H100-SXM.

B300-SXM
Supera i limiti delle prestazioni grazie all'architettura Blackwell di NVIDIA.

Inferenza gestita - Distribuzioni dedicate
Implementate modelli di IA in un’infrastruttura dedicata, con sicurezza su misura e prestazioni prevedibili.
La dipendenza è nemica della resilienza. I vostri clienti desiderano che i loro dati siano ospitati da un fornitore regionale. Acquisite maggiore autonomia grazie ai nostri strumenti e alla nostra infrastruttura multi-cloud.
Ricicliamo le nostre apparecchiature, utilizziamo esclusivamente energie rinnovabili e riduciamo al minimo il nostro consumo idrico. Inoltre, il nostro indice di efficienza energetica (PUE) è disponibile online e in tempo reale, così potrete verificarlo voi stessi.
Ogni ecosistema cloud completo deve essere assolutamente affidabile. Ecco perché offriamo 10 zone di disponibilità in quattro diverse regioni.
Si tratta di due formati della stessa istanza dotata di una GPU NVIDIA H100 PCIe Tensor Core.
La tecnologia Multi-Instance GPU (MIG) è una tecnologia sviluppata da NVIDIA per migliorare l'utilizzo e la flessibilità delle proprie GPU; è progettata specificamente per ambienti di virtualizzazione e ambienti multi-tenant. Consente di suddividere una singola GPU fisica in un massimo di sette istanze distinte, ciascuna delle quali funziona come una partizione MIG indipendente dotata di risorse dedicate, quali memoria, core di calcolo e uscite video.
Consulta la nostra documentazione dedicata per utilizzare MIG sulla tua istanza GPU.
Ci sono numerosi criteri da considerare nella scelta dell'istanza GPU più adatta:
Per ulteriori informazioni, consulta la documentazione dedicata.
NVLink è una tecnologia di interconnessione ad alta velocità sviluppata da NVIDIA che consente di accelerare il trasferimento dei dati tra le GPU, nonché tra GPU e CPU.
È progettata per aumentare notevolmente la larghezza di banda e ridurre la latenza dei trasferimenti di dati rispetto alle tradizionali connessioni PCIe (Peripheral Component Interconnect Express). È particolarmente utile negli ambienti di calcolo ad alte prestazioni (HPC) e nei data center, dove vengono utilizzate più GPU in parallelo per accelerare i calcoli.
Per saperne di più, clicca qui.
È possibile implementare le risorse in pochi minuti: crea un account Scaleway, configura le autorizzazioni IAM, quindi segui le istruzioni nella console per implementare la tua GPU cloud H100 PCIe.