L40S · Servere GPU NVIDIA

Servere dedicate NVIDIA L40S

Implementați servere GPU NVIDIA L40S de înaltă performanță, optimizate pentru antrenarea AI, inferență LLM, randare 3D și producție video. Ada Lovelace cu 48 GB ECC GDDR6 și trei encodere NVENC cu AV1, montate pe mașina pe care o configurați.

SLA de disponibilitate 48 GB ECC GDDR6 Locații globale

Specificații GPU NVIDIA L40S

NVIDIA L40S excelează în antrenarea AI, randare grafică, transcodare video și virtualizare, cu performanța revoluționară a arhitecturii Ada Lovelace.

NVIDIA L40S

GPU-ul L40S atinge metrici de performanță remarcabile: 1466 TFLOPS în operații Tensor, 212 TFLOPS în capacități RT core și 91,6 TFLOPS în putere de calcul de precizie simplă.

Arhitectură

Ada Lovelace

Memorie video

48GB GDDR6 cu ECC

Nuclee CUDA

18.176 buc.

Lățime de bandă maximă

864 GB/s

Putere maximă

350 W

Metrici de performanță

Nucleele Tensor de a patra generație cu suport FP8 oferă performanțe computaționale remarcabile pentru sarcinile de antrenare și inferență AI.

FP32

91,6 teraFLOPS

FP16 Tensor Core

733 teraFLOPS

FP8 Tensor Core

1.466 teraFLOPS

RT Core

212 teraFLOPS

Servere GPU proiectate pentru sarcini de lucru solicitante

Servere bare metal cu GPU NVIDIA L40S, bazate pe arhitectura Ada Lovelace, optimizate pentru antrenarea AI, calcul științific și vizualizare de înaltă performanță.

Performanță pentru antrenarea AI

GPU-ul L40S crește performanța sarcinilor AI de 5 ori față de predecesorul său, permițând generarea rapidă de imagini de înaltă calitate și conținut imersiv cu procesare avansată a tensorilor.

LLM și AI generativă

L40S utilizează nucleele Tensor de a patra generație cu suport FP8, oferind performanțe computaționale remarcabile pentru accelerarea antrenării modelelor AI și de știința datelor.

Accelerare ray tracing

GPU-urile L40S cresc vitezele de randare în sarcinile de design și inginerie prin capacități avansate de ray tracing, perfecte pentru vizualizare arhitecturală și design de produs.

Vizualizare 3D

NVIDIA L40S îmbunătățește vizualizarea 3D, permițând randare mai rapidă și gestionarea în timp real a designurilor complexe pentru productivitate sporită și rezultate de înaltă fidelitate.

Producție video

NVIDIA L40S îmbunătățește sarcinile de streaming și conținut video cu trei motoare de codare și decodare video, inclusiv codare AV1 pentru performanță sporită și TCO redus.

Securitate enterprise

GPU-ul L40S respectă standardele centrelor de date, inclusiv pregătirea pentru NEBS Nivel 3, și oferă pornire securizată cu tehnologie root of trust pentru securitate sporită.

A100 vs L40S vs H100

Cele trei plăci de centru de date pe care le montăm, comparate ca plăci adiționale PCIe care intră în serverele noastre.

L40S A100 80 GB H100 80 GB
Arhitectură Ada Lovelace NVIDIA Ampere Hopper
Memorie 48GB GDDR6 cu ECC 80GB HBM2e 80GB HBM2e
Lățime de bandă memorie 864 GB/s 1.935 GB/s 2.039 GB/s
Putere Până la 350W Până la 300W Până la 350W
Interfață bus PCIe Gen 4 x16 PCIe Gen 4 x16 PCIe Gen 5 x16
Codare video 3 NVENC cu AV1 Niciuna Niciuna
NVLink Nu Conector, punte la cerere Conector, punte la cerere
Doar placa, pe lună Se încarcă... Se încarcă... Se încarcă...

Întrebări frecvente despre serverele bare metal cu GPU NVIDIA L40S

Întrebări frecvente despre implementarea și gestionarea serverelor dedicate accelerate cu GPU NVIDIA L40S pentru sarcini de lucru AI, randare și vizualizare profesională.

Ce face NVIDIA L40S ideal pentru sarcini mixte de AI și grafică?

NVIDIA L40S este construit pe arhitectura Ada Lovelace, combinând unic accelerarea AI cu capacități grafice profesionale. Având 18.176 nuclee CUDA, 48GB memorie GDDR6 și nuclee Tensor de a patra generație cu suport FP8, excelează în antrenarea modelelor AI, inferență LLM, randare 3D și producție video. L40S oferă 1.466 teraFLOPS de performanță FP8, menținând în același timp suport avansat pentru ray tracing și DLSS 3 pentru fluxuri de lucru de vizualizare.

Cât de repede pot implementa un server GPU L40S?

O mașină deja montată în rack cu un L40S este livrată în aproximativ 30 minute de la verificarea plății. Când montăm o placă pe care o avem în stoc, durează între 4 și 24 de ore; o placă pe care trebuie să o achiziționăm durează cinci până la zece zile lucrătoare, iar dumneavoastră sunteți informat înainte de a plăti. Fiecare server L40S include reinstalarea instantanee a sistemului de operare, astfel încât să puteți itera fără a deschide un tichet de suport.

Care sunt avantajele de performanță ale L40S pentru fluxurile de lucru AI?

L40S oferă accelerare FP8 Tensor Core optimizată special pentru antrenarea și inferența eficientă a modelelor de limbaj mari. Memoria de 48GB GDDR6 suportă dimensiuni mari ale modelelor, în timp ce operațiile avansate pe tensori oferă o îmbunătățire a performanței de 5 ori față de GPU-urile din generația anterioară. Combinat cu trei motoare de codare/decodare video cu suport AV1, L40S gestionează sarcini de lucru AI multimodale care combină procesarea de text, imagine și video.

Ce sarcini de lucru beneficiază cel mai mult de serverele GPU L40S?

Serverele GPU L40S excelează în medii care necesită atât calcul AI, cât și accelerare grafică. Cazurile de utilizare optime includ: antrenarea și inferența modelelor de limbaj mari, generarea de imagini și video bazată pe AI, randare 3D profesională și fluxuri de lucru CAD, transcodare video cu codare AV1, implementări de stații de lucru virtuale (VDI) și sarcini de lucru hibride care combină învățarea automată cu vizualizarea în timp real.