Vorteile
- Höher Bandbreite: 5300 GB/s (5300 GB/s vs 8.19TB/s)
- Größer Speichergröße: 288GB (192GB vs 288GB)
- Neuer Erscheinungsdatum: January 2025 (December 2023 vs January 2025)
Basic
AMD
Markenname
AMD
December 2023
Erscheinungsdatum
January 2025
Desktop
Plattform
Desktop
Instinct MI300X
Modellname
Radeon Instinct MI355X
Instinct
Generation
Radeon Instinct
1000MHz
Basis-Takt
1000 MHz
2100MHz
Boost-Takt
2100 MHz
PCIe 5.0 x16
Bus-Schnittstelle
PCIe 5.0 x16
-
Transistoren
153 billion
-
Einheiten berechnen
304
-
Tensor-Kerne
?
Tensor-Kerne sind spezialisierte Verarbeitungseinheiten, die speziell für das Deep Learning entwickelt wurden und im Vergleich zum FP32-Training eine höhere Trainings- und Inferenzleistung bieten. Sie ermöglichen schnelle Berechnungen in Bereichen wie Computer Vision, Natural Language Processing, Spracherkennung, Text-zu-Sprache-Konvertierung und personalisierteEmpfehlungen. Die beiden bekanntesten Anwendungen von Tensor-Kernen sind DLSS (Deep Learning Super Sampling) und AI Denoiser zur Rauschreduzierung.
1216
-
TMUs
?
Textur-Mapping-Einheiten (TMUs) sind Komponenten der GPU, die in der Lage sind, Binärbilder zu drehen, zu skalieren und zu verzerren und sie dann als Texturen auf jede Ebene eines gegebenen 3D-Modells zu platzieren. Dieser Prozess wird als Textur-Mapping bezeichnet.
1216
-
Foundry
TSMC
-
Prozessgröße
3 nm
-
Architektur
CDNA 4.0
Speicherspezifikationen
192GB
Speichergröße
288GB
HBM3
Speichertyp
HBM3e
8192bit
Speicherbus
?
Der Speicherbus bezieht sich auf die Anzahl der Bits, die das Videomemory innerhalb eines einzelnen Taktzyklus übertragen kann. Je größer die Busbreite, desto mehr Daten können gleichzeitig übertragen werden, was sie zu einem der entscheidenden Parameter des Videomemory macht. Die Speicherbandbreite wird wie folgt berechnet: Speicherbandbreite = Speicherfrequenz x Speicherbusbreite / 8. Wenn also die Speicherfrequenzen ähnlich sind, bestimmt die Speicherbusbreite die Größe der Speicherbandbreite.
8192bit
5200MHz
Speichertakt
2000 MHz
5300 GB/s
Bandbreite
?
Die Speicherbandbreite bezieht sich auf die Datenübertragungsrate zwischen dem Grafikchip und dem Videomemory. Sie wird in Bytes pro Sekunde gemessen, und die Formel zur Berechnung lautet: Speicherbandbreite = Arbeitsfrequenz × Speicherbusbreite / 8 Bit.
8.19TB/s
Anzeige und Medien
-
Ausgänge
No outputs
Theoretische Leistung
1496 GTexel/s
Texture-Takt
?
Die Textur-Füllrate bezieht sich auf die Anzahl der Textur-Map-Elemente (Texel), die eine GPU in einer Sekunde auf Pixel abbilden kann.
2553.6 GTexel/s
1300 TFLOPS
FP16 (halbe Genauigkeit)
?
Eine wichtige Kennzahl zur Messung der GPU-Leistung ist die Gleitkomma-Rechenleistung. Halbgenaue Gleitkommazahlen (16 Bit) werden für Anwendungen wie maschinelles Lernen verwendet, bei denen eine geringere Genauigkeit akzeptabel ist. Einfach genaue Gleitkommazahlen (32 Bit) werden für übliche Multimedia- und Grafikverarbeitungsaufgaben verwendet, während doppelt genaue Gleitkommazahlen (64 Bit) für wissenschaftliches Rechnen erforderlich sind, das einen großen Zahlenbereich und hohe Genauigkeit erfordert.
653.7 TFLOPS
81.7 TFLOPS
FP64 (Doppelte Gleitkommazahl)
?
Eine wichtige Kennzahl zur Messung der GPU-Leistung ist die Gleitkomma-Rechenleistung. Doppelt genaue Gleitkommazahlen (64 Bit) sind für wissenschaftliches Rechnen erforderlich, das einen großen Zahlenbereich und hohe Genauigkeit erfordert, während einfach genaue Gleitkommazahlen (32 Bit) für übliche Multimedia- und Grafikverarbeitungsaufgaben verwendet werden. Halbgenaue Gleitkommazahlen (16 Bit) werden für Anwendungen wie maschinelles Lernen verwendet, bei denen eine geringere Genauigkeit akzeptabel ist.
81.72 TFLOPS
166.668
TFLOPS
FP32 (float)
?
Eine wichtige Kennzahl zur Messung der GPU-Leistung ist die Gleitkomma-Rechenfähigkeit. Gleitkommazahlen mit einfacher Genauigkeit (32 Bit) werden für allgemeine Multimedia- und Grafikverarbeitungsaufgaben verwendet, während Gleitkommazahlen mit doppelter Genauigkeit (64 Bit) für wissenschaftliche Berechnungen erforderlich sind, die einen großen Zahlenbereich und hohe Genauigkeit erfordern. Gleitkommazahlen mit halber Genauigkeit (16 Bit) werden für Anwendungen wie maschinelles Lernen verwendet, bei denen eine geringere Genauigkeit akzeptabel ist.
83.354
TFLOPS
Verschiedenes
19456
Shading-Einheiten
?
Die grundlegendste Verarbeitungseinheit ist der Streaming-Prozessor (SP), in dem spezifische Anweisungen und Aufgaben ausgeführt werden. GPUs führen paralleles Rechnen durch, was bedeutet, dass mehrere SPs gleichzeitig arbeiten, um Aufgaben zu verarbeiten.
19456
16 KB (per CU)
L1-Cache
16 KB (per CU)
16MB
L2-Cache
16 MB
750W
TDP (Thermal Design Power)
1400W
-
OpenCL-Version
3.0
-
Stromanschlüsse
None
-
Empfohlene PSU (Stromversorgung)
1800 W
Benchmarks
FP32 (float)
/ TFLOPS
Instinct MI300X
166.668
+100%
Radeon Instinct MI355X
83.354
In sozialen Medien teilen
Oder verlinken Sie uns
<a href="https://cputronic.com/de/gpu/compare/amd-instinct-mi300x-vs-amd-radeon-instinct-mi355x" target="_blank">AMD Instinct MI300X vs AMD Radeon Instinct MI355X</a>