Vai al contenuto
GPU.it
Archivio in revisione
Tutte le GPU

Confronta NVIDIA GeForce RTX 4090 con altre GPU

NVIDIA · Scheda tecnica

NVIDIA GeForce RTX 4090

NVIDIA GeForce RTX 4090: architettura Ada Lovelace, 24 GB di memoria GDDR6X, TDP dichiarato di 450 W, CUDA Compute Capability 8.9. Nella coorte Blender 4.5.0 / OPTIX / Windows (ac0a03966ec7a3c8), 449 test compatibili hanno una mediana di 11.001,5 samples/minuto.

Confronta questa GPU

VRAM / memoria

24 GB

TDP dichiarato

450 W

FP32 teorici

82,58 TFLOPS

Banda memoria

1.010 GB/s

Identità e architettura

Architettura
Ada Lovelace
Generazione
GeForce 40
Data riportata dalla fonte
2022-09-20
Chip
AD102
Fonderia
TSMC
Processo produttivo
5 nm
Transistor
76,3 miliardi
Superficie chip
609 mm²

Memoria

Capacità memoria
24 GB
Tipo memoria
GDDR6X
Memoria unificata
No
Banda memoria
1.010 GB/s
Bus memoria
384 bit
Clock memoria
1.313 MHz

Calcolo e potenza

Unità shader
16.384
Tensor Core NVIDIA
512
Unità ray tracing (vendor-specific)
128 · NVIDIA
Clock base
2.235 MHz
Clock boost
2.520 MHz
FP16 teorici
82,58 TFLOPS
FP32 teorici
82,58 TFLOPS
FP64 teorici
1,29 TFLOPS
TDP dichiarato
450 W
Interfaccia
PCIe 4.0 x16

API e compatibilità

CUDA Compute Capability
8.9
DirectX
12.2
Vulkan
1.4
OpenGL
4.6
OpenCL
3.0
Shader model
6.8

FP32 e FP16 sono capacità teoriche, non prestazioni nei giochi. «—» indica un dato assente. «N.A.» indica terminologia non applicabile, non assenza di accelerazione AI. I Tensor Core sono NVIDIA; le unità ray tracing hanno definizioni specifiche del produttore e non sono equivalenti automaticamente.

Benchmark Blender

Samples/minuto · più alto significa più rendering, non più FPS.

NVIDIA GeForce RTX 4090

11.001,5mediana
P25
10.472,8
P75
11.268,8
Campione
449 test
Dettagli del protocollo ac0a03966ec7a3c8
Blender 4.5.0 · OPTIX · Windows · schema v4
Scene e impronta del test: classroom,junkshop,monster|protocol:78ceccdd92716249feb0aeee41ed5c12608875248aa10d30751e9dfa05b6f164

P25–P75 descrive la metà centrale dei risultati, non un intervallo di confidenza. Mediane separate per versione, backend, OS, scene e protocollo. Driver, temperature e configurazione possono influire. Fonte: Blender Open Data (CC0).

CUDA · fonte NVIDIA

La Compute Capability descrive l’hardware: non è la versione del toolkit CUDA e non garantisce che qualsiasi software sia compatibile.

CUDA Compute Capability
8.9
Famiglia architetturale
Ada
Hardware presente nella tabella CUDA

Video · matrice ufficiale NVIDIA

Supporto hardware nei formati indicati, non una certificazione per Plex, Premiere o altri programmi. I profili dettagliati di decodifica saranno aggiunti dopo verifica delle intestazioni multilivello della matrice.

Generazione NVENC
8th Gen
Motori NVENC totali
2
Generazione NVDEC
5th Gen
Motori NVDEC totali
1
H.264 4:2:0 encode
H.264 4:2:2 encode
No
HEVC 4K 4:2:0 encode
HEVC 10-bit encode
AV1 4:2:0 encode

MLPerf · benchmark AI per configurazione

Configurazioni MLPerf contenenti NVIDIA GeForce RTX 4090

Risultati dell’intero sistema, mai divisi per il numero di GPU. Modello, scenario, precisione, categoria, versione e software devono essere compatibili per un confronto: questa non è una classifica della GPU. Risultati inferiti e conteggi incoerenti restano fuori da questa tabella.

26 risultati di configurazione

Sistema e acceleratoriWorkload e protocolloRisultato del sistemaSoftware e fonte

GATE Overflow Intel Sapphire Rapids (2x RTX 4090)

NVIDIA GeForce RTX 4090

2 acceleratori/nodo · 1 nodi

Intel(R) Xeon(R) w7-2495X

3d-unet-99

Offline · int8

v5.1 · closed · edge

Accuratezza riportata

DICE: 0.86112

8,35

Samples/s

Ubuntu 24.04 (linux-6.11.0-25-generic-glibc2.39)

Software stack

TensorRT

MLCommons · 5.1-0044

GATE Overflow Intel Sapphire Rapids (2x RTX 4090)

NVIDIA GeForce RTX 4090

2 acceleratori/nodo · 1 nodi

Intel(R) Xeon(R) w7-2495X

3d-unet-99

SingleStream · int8

v5.1 · closed · edge

Accuratezza riportata

DICE: 0.86018

428,84

Latency (ms)

Ubuntu 24.04 (linux-6.11.0-25-generic-glibc2.39)

Software stack

TensorRT

MLCommons · 5.1-0044

GATE Overflow Intel Sapphire Rapids (2x RTX 4090)

NVIDIA GeForce RTX 4090

2 acceleratori/nodo · 1 nodi

Intel(R) Xeon(R) w7-2495X

3d-unet-99.9

Offline · int8

v5.1 · open · edge

Accuratezza riportata

DICE: 0.86112

8,32

Samples/s

Ubuntu 24.04 (linux-6.11.0-25-generic-glibc2.39)

Software stack

TensorRT

MLCommons · 5.1-0374

GATE Overflow Intel Sapphire Rapids (2x RTX 4090)

NVIDIA GeForce RTX 4090

2 acceleratori/nodo · 1 nodi

Intel(R) Xeon(R) w7-2495X

3d-unet-99.9

SingleStream · int8

v5.1 · open · edge

Accuratezza riportata

DICE: 0.86018

429,99

Latency (ms)

Ubuntu 24.04 (linux-6.11.0-25-generic-glibc2.39)

Software stack

TensorRT

MLCommons · 5.1-0374

GATE Overflow Intel Sapphire Rapids (2x RTX 4090)

NVIDIA GeForce RTX 4090

2 acceleratori/nodo · 1 nodi

Intel(R) Xeon(R) w7-2495X

llama3.1-8b-edge

Offline · fp32

v5.1 · open · edge

Accuratezza riportata

ROUGE1: 38.8041 ROUGE2: 15.9281 ROUGEL: 24.4964 ROUGELSUM: 35.8406 GEN_LEN: 2918432

89,34

Tokens/s

Ubuntu 22.04 (linux-6.14.0-24-generic-glibc2.35)

Software stack

vllm

MLCommons · 5.1-0369

GATE Overflow Intel SPR i9 (1x RTX 4090)

NVIDIA GeForce RTX 4090

1 acceleratori/nodo · 1 nodi

13th Gen Intel(R) Core(TM) i9-13900K

pointpainting

SingleStream · fp32

v5.1 · open · edge

Accuratezza riportata

mAP: 54.256218124416954

564,02

Latency (ms)

Ubuntu 22.04 (linux-6.8.0-64-generic-glibc2.35)

Software stack

pytorch v2.2.2

MLCommons · 5.1-0228

GATE Overflow Intel SPR i9 (1x RTX 4090)

NVIDIA GeForce RTX 4090

1 acceleratori/nodo · 1 nodi

13th Gen Intel(R) Core(TM) i9-13900K

pointpainting

SingleStream · fp32

v5.1 · open · edge

Accuratezza riportata

mAP: 54.256218124416954

564,02

Latency (ms)

Ubuntu 22.04 (linux-6.8.0-64-generic-glibc2.35)

Software stack

pytorch v2.2.2

MLCommons · 5.1-0368

GATE Overflow Intel Sapphire Rapids (2x RTX 4090)

NVIDIA GeForce RTX 4090

2 acceleratori/nodo · 1 nodi

Intel(R) Xeon(R) w7-2495X

resnet

MultiStream · int8

v5.1 · closed · edge

Accuratezza riportata

acc: 76.062

0,5

Latency (ms)

Ubuntu 24.04 (linux-6.11.0-25-generic-glibc2.39)

Software stack

TensorRT

MLCommons · 5.1-0044

PCSPECIALIST AMD AM5 PC (1x RTX 4090)

NVIDIA GeForce RTX 4090

1 acceleratori/nodo · 1 nodi

AMD Ryzen 9 7950X 16-Core Processor

resnet

MultiStream · fp32

v5.1 · open · edge

Accuratezza riportata

acc: 76.454

2,56

Latency (ms)

Ubuntu 22.04 (linux-6.14.0-27-generic-glibc2.35)

Software stack

onnxruntime

MLCommons · 5.1-0245

GATE Overflow Intel Sapphire Rapids (2x RTX 4090)

NVIDIA GeForce RTX 4090

2 acceleratori/nodo · 1 nodi

Intel(R) Xeon(R) w7-2495X

resnet

Offline · int8

v5.1 · closed · edge

Accuratezza riportata

acc: 76.078

88.476,4

Samples/s

Ubuntu 24.04 (linux-6.11.0-25-generic-glibc2.39)

Software stack

TensorRT

MLCommons · 5.1-0044
1 / 3

Fonti e divergenze

Ogni specifica conserva fonte, data di acquisizione e confidenza del matching. La confidenza non è una certificazione della correttezza del valore.

Open GPU DB34 attributi selezionati

NVIDIA CUDA architecture matrix1 attributi selezionati

NVIDIA Compute Capability2 attributi selezionati

NVIDIA video encode/decode support matrix9 attributi selezionati

Mostra provenance campo per campo
SpecificaFonteAcquisizioneMatching
ArchitetturaOpen GPU DB17/09/202690%
device_typeOpen GPU DB17/09/202690%
GenerazioneOpen GPU DB17/09/202690%
Banda memoriaOpen GPU DB17/09/202690%
Capacità memoriaOpen GPU DB17/09/202690%
Tipo memoriaOpen GPU DB17/09/202690%
Memoria unificataOpen GPU DB17/09/202690%
nameOpen GPU DB17/09/202690%
Data riportata dalla fonteOpen GPU DB17/09/202690%
CUDA Compute CapabilityOpen GPU DB17/09/202690%
DirectXOpen GPU DB17/09/202690%
OpenCLOpen GPU DB17/09/202690%
OpenGLOpen GPU DB17/09/202690%
Shader modelOpen GPU DB17/09/202690%
VulkanOpen GPU DB17/09/202690%
Clock baseOpen GPU DB17/09/202690%
Clock boostOpen GPU DB17/09/202690%
InterfacciaOpen GPU DB17/09/202690%
ChipOpen GPU DB17/09/202690%
Superficie chipOpen GPU DB17/09/202690%
FonderiaOpen GPU DB17/09/202690%
FP16 teoriciOpen GPU DB17/09/202690%
FP32 teoriciOpen GPU DB17/09/202690%
FP64 teoriciOpen GPU DB17/09/202690%
Bus memoriaOpen GPU DB17/09/202690%
Clock memoriaOpen GPU DB17/09/202690%
Processo produttivoOpen GPU DB17/09/202690%
Unità ray tracing (vendor-specific)Open GPU DB17/09/202690%
Unità shaderOpen GPU DB17/09/202690%
TDP dichiaratoOpen GPU DB17/09/202690%
Tensor Core NVIDIAOpen GPU DB17/09/202690%
TransistorOpen GPU DB17/09/202690%
statusOpen GPU DB17/09/202690%
vendorOpen GPU DB17/09/202690%
cuda.arch_familyNVIDIA CUDA architecture matrix17/09/202698%
cuda.compute_capabilityNVIDIA Compute Capability17/09/202698%
cuda.supportedNVIDIA Compute Capability17/09/202698%
video.av1_encodeNVIDIA video encode/decode support matrix17/09/202698%
video.h264_422_encodeNVIDIA video encode/decode support matrix17/09/202698%
video.h264_encodeNVIDIA video encode/decode support matrix17/09/202698%
video.h265_encodeNVIDIA video encode/decode support matrix17/09/202698%
video.hevc_10bit_encodeNVIDIA video encode/decode support matrix17/09/202698%
video.nvdec_countNVIDIA video encode/decode support matrix17/09/202698%
video.nvdec_generationNVIDIA video encode/decode support matrix17/09/202698%
video.nvenc_countNVIDIA video encode/decode support matrix17/09/202698%
video.nvenc_generationNVIDIA video encode/decode support matrix17/09/202698%
Metodo di riconciliazione e licenze

Altre GPU della stessa architettura

Esplora NVIDIAEsplora GeForce RTX 40Esplora Ada Lovelace