Vorteile
- Höher Boost-Takt: 2800-2900 MHz (2800-2900 MHz vs 2200MHz)
- Neuer Erscheinungsdatum: February 2025 (February 2025 vs January 2022)
- Mehr Shading-Einheiten: 768 (256 vs 768)
Basic
Intel
Markenname
AMD
February 2025
Erscheinungsdatum
January 2022
Integrated
Plattform
Integrated
Krackan Point / Gorgon Point
Former Codename
-
4 nm
GPU Lithography
-
AMD Radeon 840M
Modellname
Radeon 680M
Radeon 800M Series
Generation
Rembrandt
-
Basis-Takt
2000MHz
2800-2900 MHz
Boost-Takt
2200MHz
Integrated
Bus-Schnittstelle
PCIe 4.0 x8
-
Transistoren
13,100 million
4
RT-Kerne
12
4
Einheiten berechnen
12
No
Tensor-Kerne
Tensor-Kerne sind spezialisierte Verarbeitungseinheiten, die speziell für das Deep Learning entwickelt wurden und im Vergleich zum FP32-Training eine höhere Trainings- und Inferenzleistung bieten. Sie ermöglichen schnelle Berechnungen in Bereichen wie Computer Vision, Natural Language Processing, Spracherkennung, Text-zu-Sprache-Konvertierung und personalisierteEmpfehlungen. Die beiden bekanntesten Anwendungen von Tensor-Kernen sind DLSS (Deep Learning Super Sampling) und AI Denoiser zur Rauschreduzierung.
-
16
TMUs
Textur-Mapping-Einheiten (TMUs) sind Komponenten der GPU, die in der Lage sind, Binärbilder zu drehen, zu skalieren und zu verzerren und sie dann als Texturen auf jede Ebene eines gegebenen 3D-Modells zu platzieren. Dieser Prozess wird als Textur-Mapping bezeichnet.
48
TSMC
Foundry
TSMC
4 nm
Prozessgröße
6 nm
RDNA 3.5
Architektur
RDNA 2.0
Speicherspezifikationen
Shared system memory
Speichergröße
System Shared
System shared
Speichertyp
System Shared
Dual-channel system memory, platform dependent
Speicherbus
Der Speicherbus bezieht sich auf die Anzahl der Bits, die das Videomemory innerhalb eines einzelnen Taktzyklus übertragen kann. Je größer die Busbreite, desto mehr Daten können gleichzeitig übertragen werden, was sie zu einem der entscheidenden Parameter des Videomemory macht. Die Speicherbandbreite wird wie folgt berechnet: Speicherbandbreite = Speicherfrequenz x Speicherbusbreite / 8. Wenn also die Speicherfrequenzen ähnlich sind, bestimmt die Speicherbusbreite die Größe der Speicherbandbreite.
System Shared
System memory dependent
Speichertakt
SystemShared
System memory dependent
Bandbreite
Die Speicherbandbreite bezieht sich auf die Datenübertragungsrate zwischen dem Grafikchip und dem Videomemory. Sie wird in Bytes pro Sekunde gemessen, und die Formel zur Berechnung lautet: Speicherbandbreite = Arbeitsfrequenz × Speicherbusbreite / 8 Bit.
System Dependent
Anzeige und Medien
Yes
AMD FreeSync
-
Encode/Decode
AV1 Encode/Decode
-
Adaptive-Sync, HBR3, UHBR10
DisplayPort Extensions
-
Encode/Decode
H.264 Hardware Encode/Decode
-
Encode/Decode
H.265 HEVC Hardware Encode/Decode
-
No hardware support
H.266 VVC Hardware Encode/Decode
-
2.3
HDCP Version
-
2.1
HDMI Version
-
No
Intel Quick Sync Video
-
7680x4320 @ 60Hz
Max Resolution DP
-
7680x4320 @ 60Hz
Max Resolution HDMI
-
1080p60 8bpc MPEG2, 1080p60 8bpc VC1, 1080p786 8/10bpc VP9, 2160p196 8/10bpc VP9, 4320p49 8/10bpc VP9, 1080p1200 8bpc H.264, 2160p300 8bpc H.264, 4320p75 8bpc H.264, 1080p786 8/10bpc H.265, 2160p196 8/10bpc H.265, 4320p49 8/10bpc H.265, 1080p960 8/10bpc AV1, 2160p240 8/10bpc AV1, 4320p60 8/10bpc AV1
Max Video Decode Bandwidth
-
1080p630 8bpc H.264, 1440p373 8bpc H.264, 2160p175 8bpc H.264, 1080p630 8bpc H.265, 1440p373 8bpc H.265, 2160p175 8bpc H.265, 4320p43 8bpc H.265, 1080p864 8/10bpc AV1, 1440p513 8/10bpc AV1, 2160p240 8/10bpc AV1, 4320p60 8/10bpc AV1
Max Video Encode Bandwidth
-
4
Number of Displays Supported
-
HDMI 2.1, DisplayPort 2.1, USB-C DisplayPort Alt Mode; device dependent
Ausgänge
Portable Device Dependent
Yes
USB Type-C DisplayPort Alternate Mode
-
Miracast
Wireless Display
-
Theoretische Leistung
22.4-23.2 GPixel/s
Pixeltakt
Die Pixel-Füllrate bezieht sich auf die Anzahl der Pixel, die eine Grafikverarbeitungseinheit (GPU) pro Sekunde rendern kann, gemessen in MPixel/s (Millionen Pixel pro Sekunde) oder GPixel/s (Milliarden Pixel pro Sekunde). Es handelt sich dabei um die am häufigsten verwendete Kennzahl zur Bewertung der Pixelverarbeitungsleistung einer Grafikkarte.
70.40 GPixel/s
44.8-46.4 GTexel/s
Texture-Takt
Die Textur-Füllrate bezieht sich auf die Anzahl der Textur-Map-Elemente (Texel), die eine GPU in einer Sekunde auf Pixel abbilden kann.
105.6 GTexel/s
2.87-2.97 TFLOPS
FP16 (halbe Genauigkeit)
Eine wichtige Kennzahl zur Messung der GPU-Leistung ist die Gleitkomma-Rechenleistung. Halbgenaue Gleitkommazahlen (16 Bit) werden für Anwendungen wie maschinelles Lernen verwendet, bei denen eine geringere Genauigkeit akzeptabel ist. Einfach genaue Gleitkommazahlen (32 Bit) werden für übliche Multimedia- und Grafikverarbeitungsaufgaben verwendet, während doppelt genaue Gleitkommazahlen (64 Bit) für wissenschaftliches Rechnen erforderlich sind, das einen großen Zahlenbereich und hohe Genauigkeit erfordert.
6.758 TFLOPS
89.6-92.8 GFLOPS
FP64 (Doppelte Gleitkommazahl)
Eine wichtige Kennzahl zur Messung der GPU-Leistung ist die Gleitkomma-Rechenleistung. Doppelt genaue Gleitkommazahlen (64 Bit) sind für wissenschaftliches Rechnen erforderlich, das einen großen Zahlenbereich und hohe Genauigkeit erfordert, während einfach genaue Gleitkommazahlen (32 Bit) für übliche Multimedia- und Grafikverarbeitungsaufgaben verwendet werden. Halbgenaue Gleitkommazahlen (16 Bit) werden für Anwendungen wie maschinelles Lernen verwendet, bei denen eine geringere Genauigkeit akzeptabel ist.
211.2 GFLOPS
1.48
TFLOPS
FP32 (float)
Eine wichtige Kennzahl zur Messung der GPU-Leistung ist die Gleitkomma-Rechenfähigkeit. Gleitkommazahlen mit einfacher Genauigkeit (32 Bit) werden für allgemeine Multimedia- und Grafikverarbeitungsaufgaben verwendet, während Gleitkommazahlen mit doppelter Genauigkeit (64 Bit) für wissenschaftliche Berechnungen erforderlich sind, die einen großen Zahlenbereich und hohe Genauigkeit erfordern. Gleitkommazahlen mit halber Genauigkeit (16 Bit) werden für Anwendungen wie maschinelles Lernen verwendet, bei denen eine geringere Genauigkeit akzeptabel ist.
3.379
TFLOPS
KI-Funktionen
No
Intel Deep Learning Boost on GPU
-
Up to 50 TOPS
NPU TOPS
-
Up to 59 TOPS
Processor Overall TOPS
-
Verschiedenes
Available
AMD SmartAccess Memory
-
16 total / 16 usable
Native PCIe Lanes
-
PCIe 4.0
PCI Express Version
-
256
Shading-Einheiten
Die grundlegendste Verarbeitungseinheit ist der Streaming-Prozessor (SP), in dem spezifische Anweisungen und Aufgaben ausgeführt werden. GPUs führen paralleles Rechnen durch, was bedeutet, dass mehrere SPs gleichzeitig arbeiten, um Aufgaben zu verarbeiten.
768
-
L1-Cache
128 KB per Array
-
L2-Cache
2MB
Shared with processor; platform dependent
TDP (Thermal Design Power)
System Dependent
1.4
Vulkan-Version
Vulkan ist eine plattformübergreifende Grafik- und Rechen-API der Khronos Group, die hohe Leistung und geringen CPU-Overhead bietet. Es ermöglicht Entwicklern die direkte Steuerung der GPU, reduziert den Rendering-Overhead und unterstützt Multi-Threading und Multi-Core-Prozessoren.
1.3
2.1
OpenCL-Version
2.0
4.6
OpenGL
4.6
No
CUDA
-
12 Ultimate (12_2)
DirectX
12 Ultimate (12_2)
None
Stromanschlüsse
None
8
ROPs
Die Raster-Operations-Pipeline (ROPs) ist hauptsächlich für die Handhabung von Licht- und Reflexionsberechnungen in Spielen verantwortlich, sowie für die Verwaltung von Effekten wie Kantenglättung (AA), hoher Auflösung, Rauch und Feuer. Je anspruchsvoller die Kantenglättung und Lichteffekte in einem Spiel sind, desto höher sind die Leistungsanforderungen für die ROPs. Andernfalls kann es zu einem starken Einbruch der Bildrate kommen.
32
6.7
Shader-Modell
6.7
Benchmarks
FP32 (float)
/ TFLOPS
Radeon 840M
1.48
Radeon 680M
3.379
+128%
3DMark Time Spy
Radeon 840M
1493
Radeon 680M
2399
+61%
Verwandte GPU-Vergleiche
In sozialen Medien teilen
Oder verlinken Sie uns
<a href="https://cputronic.com/de/gpu/compare/amd-radeon-840m-vs-amd-radeon-680m" target="_blank">AMD Radeon 840M vs AMD Radeon 680M</a>