Vai al contenuto
GPU.it
Archivio in revisione
Tutte le GPU

NVIDIA · Scheda tecnica

NVIDIA L40S

NVIDIA L40S: architettura Ada Lovelace, 48 GB di memoria GDDR6, TDP dichiarato di 300 W, CUDA Compute Capability 8.9. Nella coorte Blender 4.1.0 / OPTIX / Linux (6e45362455da75f5), 12 test compatibili hanno una mediana di 9514,3 samples/minuto. Alcuni valori presentano divergenze: consultare le fonti.

Confronta questa GPU

2 divergenze tra le fonti. I valori visualizzati seguono la priorità dell’importer, non una verifica manuale. Vedi i dettagli.

VRAM / memoria

48 GB

TDP dichiarato

300 W

FP32 teorici

91,61 TFLOPS

Banda memoria

864 GB/s

Identità e architettura

Architettura
Ada Lovelace
Generazione
Server Ada(Lxx)
Data riportata dalla fonte
2022-10-13
Chip
AD102
Fonderia
TSMC
Processo produttivo
5 nm
Transistor
76,3 miliardi
Superficie chip
609 mm²

Memoria

Capacità memoria
48 GB
Tipo memoria
GDDR6
Memoria unificata
No
Banda memoria
864 GB/s
Bus memoria
384 bit
Clock memoria
2.250 MHz

Calcolo e potenza

Unità shader
18.176
Tensor Core NVIDIA
568
Unità ray tracing (vendor-specific)
142 · NVIDIA
Clock base
1.110 MHz
Clock boost
2.520 MHz
FP16 teorici
91,61 TFLOPS
FP32 teorici
91,61 TFLOPS
FP64 teorici
1,43 TFLOPS
TDP dichiarato
300 W
Interfaccia
PCIe 4.0 x16

API e compatibilità

CUDA Compute Capability
8.9
DirectX
12.2
Vulkan
1.4
OpenGL
4.6
OpenCL
3.0
Shader model
6.8

FP32 e FP16 sono capacità teoriche, non prestazioni nei giochi. «—» indica un dato assente. «N.A.» indica terminologia non applicabile, non assenza di accelerazione AI. I Tensor Core sono NVIDIA; le unità ray tracing hanno definizioni specifiche del produttore e non sono equivalenti automaticamente.

Benchmark Blender

Samples/minuto · più alto significa più rendering, non più FPS.

NVIDIA L40S

7.848,1mediana
P25
7.750,8
P75
7.951,3
Campione
4 test

Campione 1–4: disponibile in scheda, escluso dalle classifiche.

Dettagli del protocollo ac0a03966ec7a3c8
Blender 4.5.0 · OPTIX · Windows · schema v4
Scene e impronta del test: classroom,junkshop,monster|protocol:78ceccdd92716249feb0aeee41ed5c12608875248aa10d30751e9dfa05b6f164

P25–P75 descrive la metà centrale dei risultati, non un intervallo di confidenza. Mediane separate per versione, backend, OS, scene e protocollo. Driver, temperature e configurazione possono influire. Fonte: Blender Open Data (CC0).

CUDA · fonte NVIDIA

La Compute Capability descrive l’hardware: non è la versione del toolkit CUDA e non garantisce che qualsiasi software sia compatibile.

CUDA Compute Capability
8.9
Famiglia architetturale
Ada
Hardware presente nella tabella CUDA

Video · matrice ufficiale NVIDIA

Supporto hardware nei formati indicati, non una certificazione per Plex, Premiere o altri programmi. I profili dettagliati di decodifica saranno aggiunti dopo verifica delle intestazioni multilivello della matrice.

Generazione NVENC
8th Gen
Motori NVENC totali
3
Generazione NVDEC
5th Gen
Motori NVDEC totali
3
H.264 4:2:0 encode
H.264 4:2:2 encode
No
HEVC 4K 4:2:0 encode
HEVC 10-bit encode
AV1 4:2:0 encode

MLPerf · benchmark AI per configurazione

Configurazioni MLPerf contenenti NVIDIA L40S

Risultati dell’intero sistema, mai divisi per il numero di GPU. Modello, scenario, precisione, categoria, versione e software devono essere compatibili per un confronto: questa non è una classifica della GPU. Risultati inferiti e conteggi incoerenti restano fuori da questa tabella.

10 risultati di configurazione

Sistema e acceleratoriWorkload e protocolloRisultato del sistemaSoftware e fonte

IBM Cloud gx3-48x240x2l40s instance,2xL40S-PCIE-48GB,vLLM 0.15.1

NVIDIA L40S

2 acceleratori/nodo · 1 nodi

Totale dichiarato: 2

Intel Xeon Processor (SapphireRapids)

whisper

Offline · bfloat16

v6.0 · closed · datacenter

Accuratezza riportata

ACCURACY: 98.1099574597676

3.646,91

Samples/s

Red Hat Enterprise Linux 9.6

Software stack

vLLM 0.15.1, RHEL 9.6

MLCommons · 6.0-0090

IBM Cloud gx3 instance 1xL40S-PCIE-48GB ,vLLM

NVIDIA L40S

1 acceleratori/nodo · 1 nodi

Intel Xeon Processor (SapphireRapids)

llama3.1-8b

Offline · fp8

v5.1 · closed · datacenter

Accuratezza riportata

ROUGE1: 38.6335 ROUGE2: 15.7685 ROUGEL: 24.4179 ROUGELSUM: 35.6537 GEN_LEN: 8184498

1.642,22

Tokens/s

Red Hat Enterprise Linux 9.6

Software stack

vLLM 0.10.0, RHEL 9.6

MLCommons · 5.1-0082

IBM Cloud gx3 instance 1xL40S-PCIE-48GB ,vLLM

NVIDIA L40S

1 acceleratori/nodo · 1 nodi

Intel Xeon Processor (SapphireRapids)

llama3.1-8b

Server · fp8

v5.1 · closed · datacenter

Accuratezza riportata

ROUGE1: 38.7564 ROUGE2: 15.7913 ROUGEL: 24.4559 ROUGELSUM: 35.7753 GEN_LEN: 8109406

1.207,14

Tokens/s

Red Hat Enterprise Linux 9.6

Software stack

vLLM 0.10.0, RHEL 9.6

MLCommons · 5.1-0082

Cisco UCS C845A M8 (8x L40S-48GB, TensorRT)

NVIDIA L40S

8 acceleratori/nodo · 1 nodi

AMD EPYC 9575F 64-Core Processor

retinanet

Offline · int8

v5.1 · closed · datacenter

Accuratezza riportata

mAP: 37.319

6.518,39

Samples/s

Ubuntu 24.04

Software stack

TensorRT 10.11, CUDA 12.9

MLCommons · 5.1-0012

Dell PowerEdge XE7740 (8x L40S, TensorRT)

NVIDIA L40S

8 acceleratori/nodo · 1 nodi

Intel Xeon 6787P 86-Core Processor

retinanet

Offline · int8

v5.1 · closed · datacenter

Accuratezza riportata

mAP: 37.354

6.509,66

Samples/s

Ubuntu 24.04.02

Software stack

TensorRT 10.11, CUDA 12.9

MLCommons · 5.1-0022

Cisco UCS C845A M8 (8x L40S-48GB, TensorRT)

NVIDIA L40S

8 acceleratori/nodo · 1 nodi

AMD EPYC 9575F 64-Core Processor

retinanet

Server · int8

v5.1 · closed · datacenter

Accuratezza riportata

mAP: 37.333

6.101,41

Queries/s

Ubuntu 24.04

Software stack

TensorRT 10.11, CUDA 12.9

MLCommons · 5.1-0012

Dell PowerEdge XE7740 (8x L40S, TensorRT)

NVIDIA L40S

8 acceleratori/nodo · 1 nodi

Intel Xeon 6787P 86-Core Processor

retinanet

Server · int8

v5.1 · closed · datacenter

Accuratezza riportata

mAP: 37.358

6.101,31

Queries/s

Ubuntu 24.04.02

Software stack

TensorRT 10.11, CUDA 12.9

MLCommons · 5.1-0022

Dell PowerEdge XE7740 (8x L40S, TensorRT)

NVIDIA L40S

8 acceleratori/nodo · 1 nodi

Intel Xeon 6787P 86-Core Processor

stable-diffusion-xl

Offline · {'clip1': 'fp16', 'clip2': 'fp16', 'unet': 'fp8', 'vae': 'int8'}

v5.1 · closed · datacenter

Accuratezza riportata

CLIP_SCORE: 31.796962655186654 FID_SCORE: 23.479670120187848

5,52

Samples/s

Ubuntu 24.04.02

Software stack

TensorRT 10.11, CUDA 12.9

MLCommons · 5.1-0022

Dell PowerEdge XE7740 (8x L40S, TensorRT)

NVIDIA L40S

8 acceleratori/nodo · 1 nodi

Intel Xeon 6787P 86-Core Processor

stable-diffusion-xl

Server · {'clip1': 'fp16', 'clip2': 'fp16', 'unet': 'fp8', 'vae': 'int8'}

v5.1 · closed · datacenter

Accuratezza riportata

CLIP_SCORE: 31.79556788921356 FID_SCORE: 23.645534055988833

5,9

Queries/s

Ubuntu 24.04.02

Software stack

TensorRT 10.11, CUDA 12.9

MLCommons · 5.1-0022

Dell PowerEdge XE7740 (8x L40S, TensorRT)

NVIDIA L40S

8 acceleratori/nodo · 1 nodi

Intel Xeon 6787P 86-Core Processor

whisper

Offline · fp16

v5.1 · closed · datacenter

Accuratezza riportata

ACCURACY: 97.85109966976599

9.272

Samples/s

Ubuntu 24.04.02

Software stack

TensorRT 10.11, CUDA 12.9

MLCommons · 5.1-0022
1 / 1

Fonti e divergenze

Ogni specifica conserva fonte, data di acquisizione e confidenza del matching. La confidenza non è una certificazione della correttezza del valore.

Clock base

1.110 (Open GPU DB, selezionato)

1.065 (GPU Ark specifications, alternativa)

TDP dichiarato

300 (Open GPU DB, selezionato)

350 (GPU Ark specifications, alternativa)

Open GPU DB34 attributi selezionati

NVIDIA CUDA architecture matrix1 attributi selezionati

NVIDIA Compute Capability2 attributi selezionati

NVIDIA video encode/decode support matrix9 attributi selezionati

Mostra provenance campo per campo
SpecificaFonteAcquisizioneMatching
ArchitetturaOpen GPU DB17/09/202690%
device_typeOpen GPU DB17/09/202690%
GenerazioneOpen GPU DB17/09/202690%
Banda memoriaOpen GPU DB17/09/202690%
Capacità memoriaOpen GPU DB17/09/202690%
Tipo memoriaOpen GPU DB17/09/202690%
Memoria unificataOpen GPU DB17/09/202690%
nameOpen GPU DB17/09/202690%
Data riportata dalla fonteOpen GPU DB17/09/202690%
CUDA Compute CapabilityOpen GPU DB17/09/202690%
DirectXOpen GPU DB17/09/202690%
OpenCLOpen GPU DB17/09/202690%
OpenGLOpen GPU DB17/09/202690%
Shader modelOpen GPU DB17/09/202690%
VulkanOpen GPU DB17/09/202690%
Clock baseOpen GPU DB17/09/202690%
Clock boostOpen GPU DB17/09/202690%
InterfacciaOpen GPU DB17/09/202690%
ChipOpen GPU DB17/09/202690%
Superficie chipOpen GPU DB17/09/202690%
FonderiaOpen GPU DB17/09/202690%
FP16 teoriciOpen GPU DB17/09/202690%
FP32 teoriciOpen GPU DB17/09/202690%
FP64 teoriciOpen GPU DB17/09/202690%
Bus memoriaOpen GPU DB17/09/202690%
Clock memoriaOpen GPU DB17/09/202690%
Processo produttivoOpen GPU DB17/09/202690%
Unità ray tracing (vendor-specific)Open GPU DB17/09/202690%
Unità shaderOpen GPU DB17/09/202690%
TDP dichiaratoOpen GPU DB17/09/202690%
Tensor Core NVIDIAOpen GPU DB17/09/202690%
TransistorOpen GPU DB17/09/202690%
statusOpen GPU DB17/09/202690%
vendorOpen GPU DB17/09/202690%
cuda.arch_familyNVIDIA CUDA architecture matrix17/09/202698%
cuda.compute_capabilityNVIDIA Compute Capability17/09/202698%
cuda.supportedNVIDIA Compute Capability17/09/202698%
video.av1_encodeNVIDIA video encode/decode support matrix17/09/202698%
video.h264_422_encodeNVIDIA video encode/decode support matrix17/09/202698%
video.h264_encodeNVIDIA video encode/decode support matrix17/09/202698%
video.h265_encodeNVIDIA video encode/decode support matrix17/09/202698%
video.hevc_10bit_encodeNVIDIA video encode/decode support matrix17/09/202698%
video.nvdec_countNVIDIA video encode/decode support matrix17/09/202698%
video.nvdec_generationNVIDIA video encode/decode support matrix17/09/202698%
video.nvenc_countNVIDIA video encode/decode support matrix17/09/202698%
video.nvenc_generationNVIDIA video encode/decode support matrix17/09/202698%
Metodo di riconciliazione e licenze

Altre GPU della stessa architettura

Esplora NVIDIAEsplora Ada Lovelace