NVIDIA RTX A5000

NVIDIA RTX A5000

NVIDIA RTX A5000 ist ein Professional-Videobeschleuniger von NVIDIA. Die Veröffentlichung begann in April 2021. Die GPU hat eine Boost-Frequenz von 1695MHz. Es hat auch eine Speicherfrequenz von 2000MHz. Seine Eigenschaften sowie Benchmark-Ergebnisse werden im Folgenden detaillierter vorgestellt.

Basic

Markenname
NVIDIA
Plattform
Professional
Erscheinungsdatum
April 2021
Modellname
RTX A5000
Generation
Quadro
Basis-Takt
1170MHz
Boost-Takt
1695MHz
Shading-Einheiten
?
Die grundlegendste Verarbeitungseinheit ist der Streaming-Prozessor (SP), in dem spezifische Anweisungen und Aufgaben ausgeführt werden. GPUs führen paralleles Rechnen durch, was bedeutet, dass mehrere SPs gleichzeitig arbeiten, um Aufgaben zu verarbeiten.
8192
SM-Anzahl
?
Mehrere Streaming-Prozessoren (SPs) bilden zusammen mit anderen Ressourcen einen Streaming-Multiprozessor (SM), der auch als Hauptkern einer GPU bezeichnet wird. Zu diesen zusätzlichen Ressourcen gehören Komponenten wie Warp-Scheduler, Register und gemeinsamer Speicher. Der SM kann als Herz der GPU betrachtet werden, ähnlich wie ein CPU-Kern, wobei Register und gemeinsamer Speicher knappe Ressourcen innerhalb des SM sind.
64
Transistoren
28,300 million
RT-Kerne
64
Tensor-Kerne
?
Tensor-Kerne sind spezialisierte Verarbeitungseinheiten, die speziell für das Deep Learning entwickelt wurden und im Vergleich zum FP32-Training eine höhere Trainings- und Inferenzleistung bieten. Sie ermöglichen schnelle Berechnungen in Bereichen wie Computer Vision, Natural Language Processing, Spracherkennung, Text-zu-Sprache-Konvertierung und personalisierteEmpfehlungen. Die beiden bekanntesten Anwendungen von Tensor-Kernen sind DLSS (Deep Learning Super Sampling) und AI Denoiser zur Rauschreduzierung.
256
TMUs
?
Textur-Mapping-Einheiten (TMUs) sind Komponenten der GPU, die in der Lage sind, Binärbilder zu drehen, zu skalieren und zu verzerren und sie dann als Texturen auf jede Ebene eines gegebenen 3D-Modells zu platzieren. Dieser Prozess wird als Textur-Mapping bezeichnet.
256
L1-Cache
128 KB (per SM)
L2-Cache
6MB
Bus-Schnittstelle
PCIe 4.0 x16
Foundry
Samsung
Prozessgröße
8 nm
Architektur
Ampere
TDP (Thermal Design Power)
230W

Speicherspezifikationen

Speichergröße
24GB
Speichertyp
GDDR6
Speicherbus
?
Der Speicherbus bezieht sich auf die Anzahl der Bits, die das Videomemory innerhalb eines einzelnen Taktzyklus übertragen kann. Je größer die Busbreite, desto mehr Daten können gleichzeitig übertragen werden, was sie zu einem der entscheidenden Parameter des Videomemory macht. Die Speicherbandbreite wird wie folgt berechnet: Speicherbandbreite = Speicherfrequenz x Speicherbusbreite / 8. Wenn also die Speicherfrequenzen ähnlich sind, bestimmt die Speicherbusbreite die Größe der Speicherbandbreite.
384bit
Speichertakt
2000MHz
Bandbreite
?
Die Speicherbandbreite bezieht sich auf die Datenübertragungsrate zwischen dem Grafikchip und dem Videomemory. Sie wird in Bytes pro Sekunde gemessen, und die Formel zur Berechnung lautet: Speicherbandbreite = Arbeitsfrequenz × Speicherbusbreite / 8 Bit.
768.0 GB/s

Theoretische Leistung

Pixeltakt
?
Die Pixel-Füllrate bezieht sich auf die Anzahl der Pixel, die eine Grafikverarbeitungseinheit (GPU) pro Sekunde rendern kann, gemessen in MPixel/s (Millionen Pixel pro Sekunde) oder GPixel/s (Milliarden Pixel pro Sekunde). Es handelt sich dabei um die am häufigsten verwendete Kennzahl zur Bewertung der Pixelverarbeitungsleistung einer Grafikkarte.
162.7 GPixel/s
Texture-Takt
?
Die Textur-Füllrate bezieht sich auf die Anzahl der Textur-Map-Elemente (Texel), die eine GPU in einer Sekunde auf Pixel abbilden kann.
433.9 GTexel/s
FP16 (halbe Genauigkeit)
?
Eine wichtige Kennzahl zur Messung der GPU-Leistung ist die Gleitkomma-Rechenleistung. Halbgenaue Gleitkommazahlen (16 Bit) werden für Anwendungen wie maschinelles Lernen verwendet, bei denen eine geringere Genauigkeit akzeptabel ist. Einfach genaue Gleitkommazahlen (32 Bit) werden für übliche Multimedia- und Grafikverarbeitungsaufgaben verwendet, während doppelt genaue Gleitkommazahlen (64 Bit) für wissenschaftliches Rechnen erforderlich sind, das einen großen Zahlenbereich und hohe Genauigkeit erfordert.
27.77 TFLOPS
FP64 (Doppelte Gleitkommazahl)
?
Eine wichtige Kennzahl zur Messung der GPU-Leistung ist die Gleitkomma-Rechenleistung. Doppelt genaue Gleitkommazahlen (64 Bit) sind für wissenschaftliches Rechnen erforderlich, das einen großen Zahlenbereich und hohe Genauigkeit erfordert, während einfach genaue Gleitkommazahlen (32 Bit) für übliche Multimedia- und Grafikverarbeitungsaufgaben verwendet werden. Halbgenaue Gleitkommazahlen (16 Bit) werden für Anwendungen wie maschinelles Lernen verwendet, bei denen eine geringere Genauigkeit akzeptabel ist.
867.8 GFLOPS
FP32 (float)
?
Eine wichtige Kennzahl zur Messung der GPU-Leistung ist die Gleitkomma-Rechenfähigkeit. Gleitkommazahlen mit einfacher Genauigkeit (32 Bit) werden für allgemeine Multimedia- und Grafikverarbeitungsaufgaben verwendet, während Gleitkommazahlen mit doppelter Genauigkeit (64 Bit) für wissenschaftliche Berechnungen erforderlich sind, die einen großen Zahlenbereich und hohe Genauigkeit erfordern. Gleitkommazahlen mit halber Genauigkeit (16 Bit) werden für Anwendungen wie maschinelles Lernen verwendet, bei denen eine geringere Genauigkeit akzeptabel ist.
28.322 TFlops

Verschiedenes

Vulkan-Version
?
Vulkan ist eine plattformübergreifende Grafik- und Rechen-API der Khronos Group, die hohe Leistung und geringen CPU-Overhead bietet. Es ermöglicht Entwicklern die direkte Steuerung der GPU, reduziert den Rendering-Overhead und unterstützt Multi-Threading und Multi-Core-Prozessoren.
1.3
OpenCL-Version
3.0
OpenGL
4.6
DirectX
12 Ultimate (12_2)
CUDA
8.6
Stromanschlüsse
1x 8-pin
ROPs
?
Die Raster-Operations-Pipeline (ROPs) ist hauptsächlich für die Handhabung von Licht- und Reflexionsberechnungen in Spielen verantwortlich, sowie für die Verwaltung von Effekten wie Kantenglättung (AA), hoher Auflösung, Rauch und Feuer. Je anspruchsvoller die Kantenglättung und Lichteffekte in einem Spiel sind, desto höher sind die Leistungsanforderungen für die ROPs. Andernfalls kann es zu einem starken Einbruch der Bildrate kommen.
96
Shader-Modell
6.6
Empfohlene PSU (Stromversorgung)
550W

Shadow of the Tomb Raider 2160p

71 Fps

Shadow of the Tomb Raider 1440p

138 Fps

Shadow of the Tomb Raider 1080p

190 Fps

FP32 (float)

28.322 TFlops

3DMark Time Spy

14181

Blender

2981

OctaneBench

604

Vulkan

140875

OpenCL

152485

Im Vergleich zu anderen GPUs

SiliconCat Rangliste

90
Platz 90 unter allen GPU auf unserer Website
Shadow of the Tomb Raider 2160p
GeForce RTX 4090
NVIDIA, September 2022
195 Fps
RTX A5000
NVIDIA, April 2021
71 Fps
GeForce RTX 2080
NVIDIA, September 2018
45 Fps
Radeon RX 6700M
AMD, May 2021
34 Fps
GeForce RTX 2060
NVIDIA, January 2019
24 Fps
Shadow of the Tomb Raider 1440p
GeForce RTX 4090
NVIDIA, September 2022
289 Fps
RTX A5000
NVIDIA, April 2021
138 Fps
GeForce RTX 3060 8 GB
NVIDIA, October 2022
85 Fps
GeForce RTX 2070
NVIDIA, October 2018
69 Fps
GeForce GTX 1070
NVIDIA, June 2016
49 Fps
Shadow of the Tomb Raider 1080p
GeForce RTX 4090
NVIDIA, September 2022
307 Fps
RTX A5000
NVIDIA, April 2021
190 Fps
GeForce RTX 3070 Ti Mobile
NVIDIA, January 2022
131 Fps
GeForce GTX 1070 Ti
NVIDIA, November 2017
102 Fps
GeForce GTX 1660
NVIDIA, March 2019
74 Fps
FP32 (float)
Radeon RX 7800 XT
AMD, August 2023
36.571 TFlops
A10G
NVIDIA, April 2021
32.147 TFlops
RTX A5000
NVIDIA, April 2021
28.322 TFlops
Instinct MI210
AMD, December 2021
23.547 TFlops
Data Center GPU Max 1100
Intel, January 2023
22.214 TFlops
3DMark Time Spy
GeForce RTX 4090
NVIDIA, September 2022
36957
Radeon RX 6800
AMD, October 2020
17130
RTX A5000
NVIDIA, April 2021
14181
9099
GeForce RTX 2070 Mobile
NVIDIA, January 2019
7229
Blender
GeForce RTX 4090
NVIDIA, September 2022
12577
RTX A5000
NVIDIA, April 2021
2981
Radeon RX 6800M
AMD, May 2021
1424
Tesla M40 24 GB
NVIDIA, November 2015
589
Tesla K80
NVIDIA, November 2014
258
OctaneBench
GeForce RTX 4090
NVIDIA, September 2022
1341
RTX A5000
NVIDIA, April 2021
604
Tesla P40
NVIDIA, September 2016
167
GeForce GTX 780
NVIDIA, May 2013
88
T550 Mobile
NVIDIA, May 2022
47
Vulkan
GeForce RTX 4090
NVIDIA, September 2022
254749
RTX A5000
NVIDIA, April 2021
140875
GeForce GTX 1080 Ti
NVIDIA, March 2017
83205
Radeon RX 6550M
AMD, January 2023
54373
Radeon R9 M295X
AMD, November 2014
29028
OpenCL
L40S
NVIDIA, October 2022
362331
RTX A5000
NVIDIA, April 2021
152485
Arc A770M
Intel, January 2022
94927
Radeon RX 5700
AMD, July 2019
66428
GeForce GTX 1070
NVIDIA, June 2016
46137