NVIDIA RTX A4000

NVIDIA RTX A4000

NVIDIA RTX A4000 ist ein Professional-Videobeschleuniger von NVIDIA. Die Veröffentlichung begann in April 2021. Die GPU hat eine Boost-Frequenz von 1560MHz. Es hat auch eine Speicherfrequenz von 1750MHz. Seine Eigenschaften sowie Benchmark-Ergebnisse werden im Folgenden detaillierter vorgestellt.

Basic

Markenname
NVIDIA
Plattform
Professional
Erscheinungsdatum
April 2021
Modellname
RTX A4000
Generation
Quadro
Basis-Takt
735MHz
Boost-Takt
1560MHz
Shading-Einheiten
?
Die grundlegendste Verarbeitungseinheit ist der Streaming-Prozessor (SP), in dem spezifische Anweisungen und Aufgaben ausgeführt werden. GPUs führen paralleles Rechnen durch, was bedeutet, dass mehrere SPs gleichzeitig arbeiten, um Aufgaben zu verarbeiten.
6144
SM-Anzahl
?
Mehrere Streaming-Prozessoren (SPs) bilden zusammen mit anderen Ressourcen einen Streaming-Multiprozessor (SM), der auch als Hauptkern einer GPU bezeichnet wird. Zu diesen zusätzlichen Ressourcen gehören Komponenten wie Warp-Scheduler, Register und gemeinsamer Speicher. Der SM kann als Herz der GPU betrachtet werden, ähnlich wie ein CPU-Kern, wobei Register und gemeinsamer Speicher knappe Ressourcen innerhalb des SM sind.
48
Transistoren
17,400 million
RT-Kerne
48
Tensor-Kerne
?
Tensor-Kerne sind spezialisierte Verarbeitungseinheiten, die speziell für das Deep Learning entwickelt wurden und im Vergleich zum FP32-Training eine höhere Trainings- und Inferenzleistung bieten. Sie ermöglichen schnelle Berechnungen in Bereichen wie Computer Vision, Natural Language Processing, Spracherkennung, Text-zu-Sprache-Konvertierung und personalisierteEmpfehlungen. Die beiden bekanntesten Anwendungen von Tensor-Kernen sind DLSS (Deep Learning Super Sampling) und AI Denoiser zur Rauschreduzierung.
192
TMUs
?
Textur-Mapping-Einheiten (TMUs) sind Komponenten der GPU, die in der Lage sind, Binärbilder zu drehen, zu skalieren und zu verzerren und sie dann als Texturen auf jede Ebene eines gegebenen 3D-Modells zu platzieren. Dieser Prozess wird als Textur-Mapping bezeichnet.
192
L1-Cache
128 KB (per SM)
L2-Cache
4MB
Bus-Schnittstelle
PCIe 4.0 x16
Foundry
Samsung
Prozessgröße
8 nm
Architektur
Ampere
TDP (Thermal Design Power)
140W

Speicherspezifikationen

Speichergröße
16GB
Speichertyp
GDDR6
Speicherbus
?
Der Speicherbus bezieht sich auf die Anzahl der Bits, die das Videomemory innerhalb eines einzelnen Taktzyklus übertragen kann. Je größer die Busbreite, desto mehr Daten können gleichzeitig übertragen werden, was sie zu einem der entscheidenden Parameter des Videomemory macht. Die Speicherbandbreite wird wie folgt berechnet: Speicherbandbreite = Speicherfrequenz x Speicherbusbreite / 8. Wenn also die Speicherfrequenzen ähnlich sind, bestimmt die Speicherbusbreite die Größe der Speicherbandbreite.
256bit
Speichertakt
1750MHz
Bandbreite
?
Die Speicherbandbreite bezieht sich auf die Datenübertragungsrate zwischen dem Grafikchip und dem Videomemory. Sie wird in Bytes pro Sekunde gemessen, und die Formel zur Berechnung lautet: Speicherbandbreite = Arbeitsfrequenz × Speicherbusbreite / 8 Bit.
448.0 GB/s

Theoretische Leistung

Pixeltakt
?
Die Pixel-Füllrate bezieht sich auf die Anzahl der Pixel, die eine Grafikverarbeitungseinheit (GPU) pro Sekunde rendern kann, gemessen in MPixel/s (Millionen Pixel pro Sekunde) oder GPixel/s (Milliarden Pixel pro Sekunde). Es handelt sich dabei um die am häufigsten verwendete Kennzahl zur Bewertung der Pixelverarbeitungsleistung einer Grafikkarte.
149.8 GPixel/s
Texture-Takt
?
Die Textur-Füllrate bezieht sich auf die Anzahl der Textur-Map-Elemente (Texel), die eine GPU in einer Sekunde auf Pixel abbilden kann.
299.5 GTexel/s
FP16 (halbe Genauigkeit)
?
Eine wichtige Kennzahl zur Messung der GPU-Leistung ist die Gleitkomma-Rechenleistung. Halbgenaue Gleitkommazahlen (16 Bit) werden für Anwendungen wie maschinelles Lernen verwendet, bei denen eine geringere Genauigkeit akzeptabel ist. Einfach genaue Gleitkommazahlen (32 Bit) werden für übliche Multimedia- und Grafikverarbeitungsaufgaben verwendet, während doppelt genaue Gleitkommazahlen (64 Bit) für wissenschaftliches Rechnen erforderlich sind, das einen großen Zahlenbereich und hohe Genauigkeit erfordert.
19.17 TFLOPS
FP64 (Doppelte Gleitkommazahl)
?
Eine wichtige Kennzahl zur Messung der GPU-Leistung ist die Gleitkomma-Rechenleistung. Doppelt genaue Gleitkommazahlen (64 Bit) sind für wissenschaftliches Rechnen erforderlich, das einen großen Zahlenbereich und hohe Genauigkeit erfordert, während einfach genaue Gleitkommazahlen (32 Bit) für übliche Multimedia- und Grafikverarbeitungsaufgaben verwendet werden. Halbgenaue Gleitkommazahlen (16 Bit) werden für Anwendungen wie maschinelles Lernen verwendet, bei denen eine geringere Genauigkeit akzeptabel ist.
599.0 GFLOPS
FP32 (float)
?
Eine wichtige Kennzahl zur Messung der GPU-Leistung ist die Gleitkomma-Rechenfähigkeit. Gleitkommazahlen mit einfacher Genauigkeit (32 Bit) werden für allgemeine Multimedia- und Grafikverarbeitungsaufgaben verwendet, während Gleitkommazahlen mit doppelter Genauigkeit (64 Bit) für wissenschaftliche Berechnungen erforderlich sind, die einen großen Zahlenbereich und hohe Genauigkeit erfordern. Gleitkommazahlen mit halber Genauigkeit (16 Bit) werden für Anwendungen wie maschinelles Lernen verwendet, bei denen eine geringere Genauigkeit akzeptabel ist.
19.551 TFlops

Verschiedenes

Vulkan-Version
?
Vulkan ist eine plattformübergreifende Grafik- und Rechen-API der Khronos Group, die hohe Leistung und geringen CPU-Overhead bietet. Es ermöglicht Entwicklern die direkte Steuerung der GPU, reduziert den Rendering-Overhead und unterstützt Multi-Threading und Multi-Core-Prozessoren.
1.3
OpenCL-Version
3.0
OpenGL
4.6
DirectX
12 Ultimate (12_2)
CUDA
8.6
Stromanschlüsse
1x 6-pin
ROPs
?
Die Raster-Operations-Pipeline (ROPs) ist hauptsächlich für die Handhabung von Licht- und Reflexionsberechnungen in Spielen verantwortlich, sowie für die Verwaltung von Effekten wie Kantenglättung (AA), hoher Auflösung, Rauch und Feuer. Je anspruchsvoller die Kantenglättung und Lichteffekte in einem Spiel sind, desto höher sind die Leistungsanforderungen für die ROPs. Andernfalls kann es zu einem starken Einbruch der Bildrate kommen.
96
Shader-Modell
6.6
Empfohlene PSU (Stromversorgung)
300W

Shadow of the Tomb Raider 2160p

49 Fps

Shadow of the Tomb Raider 1440p

101 Fps

Shadow of the Tomb Raider 1080p

147 Fps

FP32 (float)

19.551 TFlops

3DMark Time Spy

10734

Blender

3547

OctaneBench

350

Vulkan

108871

OpenCL

122331

Im Vergleich zu anderen GPUs

SiliconCat Rangliste

139
Platz 139 unter allen GPU auf unserer Website
Shadow of the Tomb Raider 2160p
GeForce RTX 4090
NVIDIA, September 2022
195 Fps
TITAN RTX
NVIDIA, December 2018
69 Fps
RTX A4000
NVIDIA, April 2021
49 Fps
Radeon RX 6700M
AMD, May 2021
34 Fps
GeForce RTX 2060
NVIDIA, January 2019
24 Fps
Shadow of the Tomb Raider 1440p
GeForce RTX 4090
NVIDIA, September 2022
289 Fps
GeForce RTX 3070 Ti
NVIDIA, May 2021
126 Fps
RTX A4000
NVIDIA, April 2021
101 Fps
GeForce RTX 2070
NVIDIA, October 2018
69 Fps
GeForce GTX 1070
NVIDIA, June 2016
49 Fps
Shadow of the Tomb Raider 1080p
GeForce RTX 4090
NVIDIA, September 2022
307 Fps
RTX A5000
NVIDIA, April 2021
190 Fps
RTX A4000
NVIDIA, April 2021
147 Fps
GeForce GTX 1070 Ti
NVIDIA, November 2017
102 Fps
GeForce GTX 1660
NVIDIA, March 2019
74 Fps
FP32 (float)
Radeon Pro W6900X
AMD, August 2021
22.014 TFlops
Radeon RX 7600
AMD, May 2023
20.891 TFlops
RTX A4000
NVIDIA, April 2021
19.551 TFlops
A100 PCIe
NVIDIA, June 2020
18.72 TFlops
Quadro GV100
NVIDIA, March 2018
16.991 TFlops
3DMark Time Spy
GeForce RTX 4080 16 GB
NVIDIA, September 2022
28190
GeForce RTX 2080 Ti
NVIDIA, September 2018
15266
RTX A4000
NVIDIA, April 2021
10734
GeForce RTX 3060
NVIDIA, January 2021
8881
6798
Blender
GeForce RTX 4090
NVIDIA, September 2022
12577
RTX A4000
NVIDIA, April 2021
3547
Radeon RX 6800M
AMD, May 2021
1424
Tesla M40 24 GB
NVIDIA, November 2015
589
Tesla K80
NVIDIA, November 2014
258
OctaneBench
GeForce RTX 4090
NVIDIA, September 2022
1341
RTX A4000
NVIDIA, April 2021
350
Tesla P40
NVIDIA, September 2016
167
GeForce GTX 780
NVIDIA, May 2013
88
T550 Mobile
NVIDIA, May 2022
47
Vulkan
GeForce RTX 4090
NVIDIA, September 2022
254749
L4
NVIDIA, March 2023
120950
RTX A4000
NVIDIA, April 2021
108871
Radeon RX 6550M
AMD, January 2023
54373
GeForce GTX 780 Ti
NVIDIA, November 2013
30994
OpenCL
L40S
NVIDIA, October 2022
362331
Radeon PRO W7800
AMD, April 2023
147444
RTX A4000
NVIDIA, April 2021
122331
Radeon RX 6600S
AMD, January 2022
66774
Radeon RX 6550M
AMD, January 2023
46389