NVIDIA · Scheda tecnica
NVIDIA L40S
NVIDIA L40S: architettura Ada Lovelace, 48 GB di memoria GDDR6, TDP dichiarato di 300 W, CUDA Compute Capability 8.9. Nella coorte Blender 4.1.0 / OPTIX / Linux (6e45362455da75f5), 12 test compatibili hanno una mediana di 9514,3 samples/minuto. Alcuni valori presentano divergenze: consultare le fonti.
2 divergenze tra le fonti. I valori visualizzati seguono la priorità dell’importer, non una verifica manuale. Vedi i dettagli.
VRAM / memoria
48 GB
TDP dichiarato
300 W
FP32 teorici
91,61 TFLOPS
Banda memoria
864 GB/s
Identità e architettura
- Architettura
- Ada Lovelace
- Generazione
- Server Ada(Lxx)
- Data riportata dalla fonte
- 2022-10-13
- Chip
- AD102
- Fonderia
- TSMC
- Processo produttivo
- 5 nm
- Transistor
- 76,3 miliardi
- Superficie chip
- 609 mm²
Memoria
- Capacità memoria
- 48 GB
- Tipo memoria
- GDDR6
- Memoria unificata
- No
- Banda memoria
- 864 GB/s
- Bus memoria
- 384 bit
- Clock memoria
- 2.250 MHz
Calcolo e potenza
- Unità shader
- 18.176
- Tensor Core NVIDIA
- 568
- Unità ray tracing (vendor-specific)
- 142 · NVIDIA
- Clock boost
- 2.520 MHz
- FP16 teorici
- 91,61 TFLOPS
- FP32 teorici
- 91,61 TFLOPS
- FP64 teorici
- 1,43 TFLOPS
- Interfaccia
- PCIe 4.0 x16
API e compatibilità
- CUDA Compute Capability
- 8.9
- DirectX
- 12.2
- Vulkan
- 1.4
- OpenGL
- 4.6
- OpenCL
- 3.0
- Shader model
- 6.8
FP32 e FP16 sono capacità teoriche, non prestazioni nei giochi. «—» indica un dato assente. «N.A.» indica terminologia non applicabile, non assenza di accelerazione AI. I Tensor Core sono NVIDIA; le unità ray tracing hanno definizioni specifiche del produttore e non sono equivalenti automaticamente.
Benchmark Blender
Samples/minuto · più alto significa più rendering, non più FPS.
NVIDIA L40S
- P25
- 7.750,8
- P75
- 7.951,3
- Campione
- 4 test
Campione 1–4: disponibile in scheda, escluso dalle classifiche.
Dettagli del protocollo ac0a03966ec7a3c8
P25–P75 descrive la metà centrale dei risultati, non un intervallo di confidenza. Mediane separate per versione, backend, OS, scene e protocollo. Driver, temperature e configurazione possono influire. Fonte: Blender Open Data (CC0).
CUDA · fonte NVIDIA
La Compute Capability descrive l’hardware: non è la versione del toolkit CUDA e non garantisce che qualsiasi software sia compatibile.
Video · matrice ufficiale NVIDIA
Supporto hardware nei formati indicati, non una certificazione per Plex, Premiere o altri programmi. I profili dettagliati di decodifica saranno aggiunti dopo verifica delle intestazioni multilivello della matrice.
MLPerf · benchmark AI per configurazione
Configurazioni MLPerf contenenti NVIDIA L40S
Risultati dell’intero sistema, mai divisi per il numero di GPU. Modello, scenario, precisione, categoria, versione e software devono essere compatibili per un confronto: questa non è una classifica della GPU. Risultati inferiti e conteggi incoerenti restano fuori da questa tabella.
10 risultati di configurazione
| Sistema e acceleratori | Workload e protocollo | Risultato del sistema | Software e fonte |
|---|---|---|---|
IBM Cloud gx3-48x240x2l40s instance,2xL40S-PCIE-48GB,vLLM 0.15.1 NVIDIA L40S 2 acceleratori/nodo · 1 nodi Totale dichiarato: 2 Intel Xeon Processor (SapphireRapids) | whisper Offline · bfloat16 v6.0 · closed · datacenter Accuratezza riportataACCURACY: 98.1099574597676 | 3.646,91 Samples/s | Red Hat Enterprise Linux 9.6 Software stackvLLM 0.15.1, RHEL 9.6 |
IBM Cloud gx3 instance 1xL40S-PCIE-48GB ,vLLM NVIDIA L40S 1 acceleratori/nodo · 1 nodi Intel Xeon Processor (SapphireRapids) | llama3.1-8b Offline · fp8 v5.1 · closed · datacenter Accuratezza riportataROUGE1: 38.6335 ROUGE2: 15.7685 ROUGEL: 24.4179 ROUGELSUM: 35.6537 GEN_LEN: 8184498 | 1.642,22 Tokens/s | Red Hat Enterprise Linux 9.6 Software stackvLLM 0.10.0, RHEL 9.6 |
IBM Cloud gx3 instance 1xL40S-PCIE-48GB ,vLLM NVIDIA L40S 1 acceleratori/nodo · 1 nodi Intel Xeon Processor (SapphireRapids) | llama3.1-8b Server · fp8 v5.1 · closed · datacenter Accuratezza riportataROUGE1: 38.7564 ROUGE2: 15.7913 ROUGEL: 24.4559 ROUGELSUM: 35.7753 GEN_LEN: 8109406 | 1.207,14 Tokens/s | Red Hat Enterprise Linux 9.6 Software stackvLLM 0.10.0, RHEL 9.6 |
Cisco UCS C845A M8 (8x L40S-48GB, TensorRT) NVIDIA L40S 8 acceleratori/nodo · 1 nodi AMD EPYC 9575F 64-Core Processor | retinanet Offline · int8 v5.1 · closed · datacenter Accuratezza riportatamAP: 37.319 | 6.518,39 Samples/s | Ubuntu 24.04 Software stackTensorRT 10.11, CUDA 12.9 |
Dell PowerEdge XE7740 (8x L40S, TensorRT) NVIDIA L40S 8 acceleratori/nodo · 1 nodi Intel Xeon 6787P 86-Core Processor | retinanet Offline · int8 v5.1 · closed · datacenter Accuratezza riportatamAP: 37.354 | 6.509,66 Samples/s | Ubuntu 24.04.02 Software stackTensorRT 10.11, CUDA 12.9 |
Cisco UCS C845A M8 (8x L40S-48GB, TensorRT) NVIDIA L40S 8 acceleratori/nodo · 1 nodi AMD EPYC 9575F 64-Core Processor | retinanet Server · int8 v5.1 · closed · datacenter Accuratezza riportatamAP: 37.333 | 6.101,41 Queries/s | Ubuntu 24.04 Software stackTensorRT 10.11, CUDA 12.9 |
Dell PowerEdge XE7740 (8x L40S, TensorRT) NVIDIA L40S 8 acceleratori/nodo · 1 nodi Intel Xeon 6787P 86-Core Processor | retinanet Server · int8 v5.1 · closed · datacenter Accuratezza riportatamAP: 37.358 | 6.101,31 Queries/s | Ubuntu 24.04.02 Software stackTensorRT 10.11, CUDA 12.9 |
Dell PowerEdge XE7740 (8x L40S, TensorRT) NVIDIA L40S 8 acceleratori/nodo · 1 nodi Intel Xeon 6787P 86-Core Processor | stable-diffusion-xl Offline · {'clip1': 'fp16', 'clip2': 'fp16', 'unet': 'fp8', 'vae': 'int8'} v5.1 · closed · datacenter Accuratezza riportataCLIP_SCORE: 31.796962655186654 FID_SCORE: 23.479670120187848 | 5,52 Samples/s | Ubuntu 24.04.02 Software stackTensorRT 10.11, CUDA 12.9 |
Dell PowerEdge XE7740 (8x L40S, TensorRT) NVIDIA L40S 8 acceleratori/nodo · 1 nodi Intel Xeon 6787P 86-Core Processor | stable-diffusion-xl Server · {'clip1': 'fp16', 'clip2': 'fp16', 'unet': 'fp8', 'vae': 'int8'} v5.1 · closed · datacenter Accuratezza riportataCLIP_SCORE: 31.79556788921356 FID_SCORE: 23.645534055988833 | 5,9 Queries/s | Ubuntu 24.04.02 Software stackTensorRT 10.11, CUDA 12.9 |
Dell PowerEdge XE7740 (8x L40S, TensorRT) NVIDIA L40S 8 acceleratori/nodo · 1 nodi Intel Xeon 6787P 86-Core Processor | whisper Offline · fp16 v5.1 · closed · datacenter Accuratezza riportataACCURACY: 97.85109966976599 | 9.272 Samples/s | Ubuntu 24.04.02 Software stackTensorRT 10.11, CUDA 12.9 |
Fonti e divergenze
Ogni specifica conserva fonte, data di acquisizione e confidenza del matching. La confidenza non è una certificazione della correttezza del valore.
Clock base
1.110 (Open GPU DB, selezionato)
1.065 (GPU Ark specifications, alternativa)
TDP dichiarato
300 (Open GPU DB, selezionato)
350 (GPU Ark specifications, alternativa)
Open GPU DB — 34 attributi selezionati
NVIDIA CUDA architecture matrix — 1 attributi selezionati
NVIDIA Compute Capability — 2 attributi selezionati
NVIDIA video encode/decode support matrix — 9 attributi selezionati
Mostra provenance campo per campo
| Specifica | Fonte | Acquisizione | Matching |
|---|---|---|---|
| Architettura | Open GPU DB | 17/09/2026 | 90% |
| device_type | Open GPU DB | 17/09/2026 | 90% |
| Generazione | Open GPU DB | 17/09/2026 | 90% |
| Banda memoria | Open GPU DB | 17/09/2026 | 90% |
| Capacità memoria | Open GPU DB | 17/09/2026 | 90% |
| Tipo memoria | Open GPU DB | 17/09/2026 | 90% |
| Memoria unificata | Open GPU DB | 17/09/2026 | 90% |
| name | Open GPU DB | 17/09/2026 | 90% |
| Data riportata dalla fonte | Open GPU DB | 17/09/2026 | 90% |
| CUDA Compute Capability | Open GPU DB | 17/09/2026 | 90% |
| DirectX | Open GPU DB | 17/09/2026 | 90% |
| OpenCL | Open GPU DB | 17/09/2026 | 90% |
| OpenGL | Open GPU DB | 17/09/2026 | 90% |
| Shader model | Open GPU DB | 17/09/2026 | 90% |
| Vulkan | Open GPU DB | 17/09/2026 | 90% |
| Clock base | Open GPU DB | 17/09/2026 | 90% |
| Clock boost | Open GPU DB | 17/09/2026 | 90% |
| Interfaccia | Open GPU DB | 17/09/2026 | 90% |
| Chip | Open GPU DB | 17/09/2026 | 90% |
| Superficie chip | Open GPU DB | 17/09/2026 | 90% |
| Fonderia | Open GPU DB | 17/09/2026 | 90% |
| FP16 teorici | Open GPU DB | 17/09/2026 | 90% |
| FP32 teorici | Open GPU DB | 17/09/2026 | 90% |
| FP64 teorici | Open GPU DB | 17/09/2026 | 90% |
| Bus memoria | Open GPU DB | 17/09/2026 | 90% |
| Clock memoria | Open GPU DB | 17/09/2026 | 90% |
| Processo produttivo | Open GPU DB | 17/09/2026 | 90% |
| Unità ray tracing (vendor-specific) | Open GPU DB | 17/09/2026 | 90% |
| Unità shader | Open GPU DB | 17/09/2026 | 90% |
| TDP dichiarato | Open GPU DB | 17/09/2026 | 90% |
| Tensor Core NVIDIA | Open GPU DB | 17/09/2026 | 90% |
| Transistor | Open GPU DB | 17/09/2026 | 90% |
| status | Open GPU DB | 17/09/2026 | 90% |
| vendor | Open GPU DB | 17/09/2026 | 90% |
| cuda.arch_family | NVIDIA CUDA architecture matrix | 17/09/2026 | 98% |
| cuda.compute_capability | NVIDIA Compute Capability | 17/09/2026 | 98% |
| cuda.supported | NVIDIA Compute Capability | 17/09/2026 | 98% |
| video.av1_encode | NVIDIA video encode/decode support matrix | 17/09/2026 | 98% |
| video.h264_422_encode | NVIDIA video encode/decode support matrix | 17/09/2026 | 98% |
| video.h264_encode | NVIDIA video encode/decode support matrix | 17/09/2026 | 98% |
| video.h265_encode | NVIDIA video encode/decode support matrix | 17/09/2026 | 98% |
| video.hevc_10bit_encode | NVIDIA video encode/decode support matrix | 17/09/2026 | 98% |
| video.nvdec_count | NVIDIA video encode/decode support matrix | 17/09/2026 | 98% |
| video.nvdec_generation | NVIDIA video encode/decode support matrix | 17/09/2026 | 98% |
| video.nvenc_count | NVIDIA video encode/decode support matrix | 17/09/2026 | 98% |
| video.nvenc_generation | NVIDIA video encode/decode support matrix | 17/09/2026 | 98% |
Altre GPU della stessa architettura
NVIDIA · desktop
NVIDIA GeForce RTX 4060
Ada Lovelace
NVIDIA · desktop
NVIDIA GeForce RTX 4060 AD106
Ada Lovelace
NVIDIA · desktop
NVIDIA GeForce RTX 4060 Ti 16 GB
Ada Lovelace
NVIDIA · desktop
NVIDIA GeForce RTX 4060 Ti 8 GB
Ada Lovelace