AMD Instinct MI300X
vs
AMD Radeon Instinct MI355X

vs

Результат сравнения видеокарт

Ниже приведены результаты сравнения видеокарт AMD Instinct MI300X и AMD Radeon Instinct MI355X по ключевым характеристикам производительности, а также энергопотреблению и многому другому.

Преимущества

  • Выше Пропускная способность: 5300 GB/s (5300 GB/s vs 8.19TB/s)
  • Больше Объем памяти: 288GB (192GB vs 288GB)
  • Новее Дата выпуска: January 2025 (December 2023 vs January 2025)

Общая информация

AMD
Производитель
AMD
December 2023
Дата выпуска
January 2025
Desktop
Платформа
Desktop
Instinct MI300X
Название модели
Radeon Instinct MI355X
Instinct
Поколение
Radeon Instinct
1000MHz
Базоввая частота
1000 MHz
2100MHz
Boost Частота
2100 MHz
PCIe 5.0 x16
Интерфейс шины
PCIe 5.0 x16
-
Транзисторы
153 billion
-
Вычислительные юниты
304
-
Tensor ядра
?
Тензорные ядра — это специализированные процессоры, разработанные специально для глубокого обучения, обеспечивающие более высокую производительность обучения и вывода по сравнению с обучением FP32. Они позволяют выполнять быстрые вычисления в таких областях, как компьютерное зрение, обработка естественного языка, распознавание речи, преобразование текста в речь и персонализированные рекомендации. Два наиболее заметных применения тензорных ядер — это DLSS (Deep Learning Super Sampling) и AI Denoiser для снижения шума.
1216
-
TMU
?
Блоки наложения текстур (TMU) служат компонентами графического процессора, которые способны вращать, масштабировать и искажать двоичные изображения, а затем размещать их в виде текстур на любой плоскости заданной трехмерной модели. Этот процесс называется отображением текстур.
1216
-
Производитель
TSMC
-
Размер процесса
3 nm
-
Архитектура
CDNA 4.0

Характеристики памяти

192GB
Объем памяти
288GB
HBM3
Тип памяти
HBM3e
8192bit
Шина памяти
?
Ширина шины памяти обозначает количество бит данных, которые видеопамять может передать за один такт. Чем больше ширина шины, тем больший объем данных может быть передан мгновенно, что делает ее одним из важнейших параметров видеопамяти. Пропускная способность памяти рассчитывается как: Пропускная способность памяти = Частота памяти x Ширина шины памяти / 8. Следовательно, если частоты памяти одинаковы, ширина шины памяти будет определять размер пропускной способности памяти.
8192bit
5200MHz
Частота памяти
2000 MHz
5300 GB/s
Пропускная способность
?
Пропускная способность памяти — это скорость передачи данных между графическим чипом и видеопамятью. Он измеряется в байтах в секунду, и формула для его расчета: пропускная способность памяти = рабочая частота × ширина шины памяти / 8 бит.
8.19TB/s

Дисплей и мультимедиа

-
Выходы
No outputs

Теоретическая производительность

1496 GTexel/s
Текстурный филлрейт
?
Скорость заполнения текстуры — это количество элементов карты текстур (текселей), которые графический процессор может сопоставить с пикселями за одну секунду.
2553.6 GTexel/s
1300 TFLOPS
FP16 (half)
?
Важным показателем для измерения производительности графического процессора являются возможности вычислений с плавающей запятой. Числа с плавающей запятой половинной точности (16 бит) используются в таких приложениях, как машинное обучение, где допустима более низкая точность. Числа с плавающей запятой одинарной точности (32-битные) используются для обычных задач обработки мультимедиа и графики, а числа с плавающей запятой двойной точности (64-битные) необходимы для научных вычислений, требующих широкого числового диапазона и высокой точности.
653.7 TFLOPS
81.7 TFLOPS
FP64 (double)
?
Важным показателем для измерения производительности графического процессора являются возможности вычислений с плавающей запятой. Числа с плавающей запятой двойной точности (64-битные) необходимы для научных вычислений, требующих широкого числового диапазона и высокой точности, а числа с плавающей запятой одинарной точности (32-битные) используются для обычных задач обработки мультимедиа и графики. Числа с плавающей запятой половинной точности (16 бит) используются в таких приложениях, как машинное обучение, где допустима более низкая точность.
81.72 TFLOPS
166.668 TFLOPS
FP32 (float)
?
Важным показателем для измерения производительности графического процессора являются возможности вычислений с плавающей запятой. Числа с плавающей запятой одинарной точности (32-битные) используются для обычных задач обработки мультимедиа и графики, а числа с плавающей запятой двойной точности (64-битные) необходимы для научных вычислений, требующих широкого числового диапазона и высокой точности. Числа с плавающей запятой половинной точности (16 бит) используются в таких приложениях, как машинное обучение, где допустима более низкая точность.
83.354 TFLOPS

Другое

19456
Блоки шейдинга
?
Самым фундаментальным процессором является потоковый процессор (SP), в котором выполняются определенные инструкции и задачи. Графические процессоры выполняют параллельные вычисления, что означает, что несколько процессоров SP работают одновременно для обработки задач.
19456
16 KB (per CU)
Кэш L1
16 KB (per CU)
16MB
Кэш L2
16 MB
750W
TDP
1400W
-
Версия OpenCL
3.0
-
Разъемы питания
None
-
Требуемый блок питания
1800 W

Бенчмарки

FP32 (float) / TFLOPS
Instinct MI300X
166.668 +100%
Radeon Instinct MI355X
83.354