Prestazioni versatili
Gestisci carichi di lavoro diversificati su un'unica architettura, che spaziano dall'inferenza dei modelli di linguaggio di grandi dimensioni (LLM) e dall'IA generativa al rendering 3D e alla codifica video.
L'inferenza a un prezzo accessibile.

Gestisci carichi di lavoro diversificati su un'unica architettura, che spaziano dall'inferenza dei modelli di linguaggio di grandi dimensioni (LLM) e dall'IA generativa al rendering 3D e alla codifica video.
Iniziate a implementare la vostra infrastruttura di IA a partire da 0,79 € per GPU all’ora: L4 è la soluzione ideale per le start-up che desiderano realizzare prototipi senza costi iniziali.
Goditi un'elaborazione e un rendering più veloci grazie all'architettura Ada Lovelace e ai suoi 24 GB di memoria GDDR6.
Che utilizziate modelli di IA, elaboriate flussi video o eseguiate il rendering di scene 3D, l'istanza GPU L4 offre una soluzione equilibrata ed economica. Vi evita di pagare per una capacità GPU superflua per le vostre attività meno impegnative, garantendovi al contempo le prestazioni di cui avete bisogno.
Implementate su larga scala i più recenti modelli di linguaggio (LLM) e modelli di diffusione, evitando al contempo l'eccessivo consumo energetico delle GPU di addestramento di fascia alta.
Elaborate video su larga scala grazie a codificatori dedicati. Con il supporto nativo della codifica AV1 e prestazioni fino a tre volte superiori a quelle del T4 per l'H264, l'L4 è ottimizzato per la transcodifica, lo streaming live e le applicazioni di visione artificiale in tempo reale.
Accelerate lo sviluppo dei gemelli digitali industriali e del cloud gaming. I core RT di terza generazione offrono funzionalità di ray tracing in tempo reale, consentendo ai team di ingegneri di visualizzare più rapidamente modelli 3D e simulazioni complesse.

Unità di elaborazione grafica
NVIDIA L4 Tensor Core.
Architettura
NVIDIA Lovelace 2022.
VRAM
24 GB di GDDR6 per GPU (300 GB/s).
Unità centrale di elaborazione
8-64 vCPU AMD EPYC™ 7413
Frequenza del processore
2,65 GHz.
Memoria ad accesso casuale
48-384 GB.
Digita la RAM
Double Data Rate 4
Larghezza di banda di rete
Fino a 20 Gbps.
Archiviazione
Archiviazione a blocchi.
GPU ad alte prestazioni
Tensor Core di quarta generazione, RT Core di terza generazione.
Acquisizione del linguaggio grave
99,5%.
| Option and value | Price |
|---|---|
| ZonePAR-2 | |
| Instance1x | 0€ |
| Volume10GB | 0€ |
| IPv4 flessibileNo | 0€ |
DC5 è uno dei data center più ecologici d’Europa, alimentato interamente da energia eolica e idroelettrica rinnovabile (certificata GO), con un sistema di raffreddamento ultra-efficiente che utilizza la ventilazione diretta e il raffreddamento adiabatico. Con un PUE di 1,16 (rispetto alla media del settore pari a 1,55), riduce il consumo energetico fino al 30% rispetto ai data center tradizionali.

Inferenza gestita - Distribuzioni dedicate
Implementate modelli di IA in un'infrastruttura dedicata, con sicurezza su misura e prestazioni prevedibili.

L40S
Accelerate lo sviluppo della prossima generazione di applicazioni basate sull'intelligenza artificiale grazie all'istanza GPU universale L40S.

H100 PCIe
Accelera le tue applicazioni di IA grazie alle GPU H100.
La dipendenza è nemica della resilienza. I vostri clienti desiderano che i loro dati siano ospitati da un fornitore regionale. Acquisite maggiore autonomia grazie ai nostri strumenti e alla nostra infrastruttura multi-cloud.
Ricicliamo le nostre apparecchiature, utilizziamo esclusivamente energie rinnovabili e riduciamo al minimo il nostro consumo idrico. Inoltre, il nostro indice di efficienza energetica (PUE) è disponibile online e in tempo reale, così potrete verificarlo voi stessi.
Ogni ecosistema cloud completo deve essere assolutamente affidabile. Ecco perché offriamo 10 zone di disponibilità in quattro diverse regioni.
Le tariffe delle nostre istanze GPU includono le vCPU e la memoria RAM necessarie per garantire prestazioni ottimali.
Per avviare l'istanza GPU L4, dovrete procurarvi almeno uno spazio di archiviazione Block Storage e un indirizzo IP flessibile, a vostre spese.
Se avete dubbi sul prezzo, utilizzate il calcolatore: è fatto proprio per questo!
Prima di noleggiare un'infrastruttura GPU, è necessario abbinare le proprie esigenze tecniche al tipo di istanza più adatto, al fine di evitare un sovradimensionamento. Si prega di tenere conto dei seguenti fattori:
Caso d’uso principale: si tratta di codifica video in tempo reale, inferenza IA di livello base o elaborazione grafica di base che non richiede una potenza di calcolo estrema?
Costo vs prestazioni: valutate se la vostra applicazione richiede effettivamente hardware di fascia alta o se un'architettura ottimizzata in termini di costi offrirà la stessa latenza per l'utente finale.
Vincoli di memoria: verificate le dimensioni dei modelli che intendete supportare. Per i modelli più piccoli o i flussi video, 24 GB di VRAM sono spesso sufficienti.
Equilibrio tra CPU e RAM: assicuratevi che le risorse di sistema associate siano in grado di gestire il vostro traffico web o la pre-elaborazione dei dati senza causare rallentamenti sulla vostra GPU cloud.
Per aiutarvi a prendere la giusta decisione tecnica, consultate la nostra guida completa sulla valutazione delle istanze GPU qui