GeForce RTX 3090 Ti против Apple M3 Max GPU (40-core)

Мы провели детальное сравнение GeForce RTX 3090 Ti 24 ГБ с 84 конвейерами и 10752 шейдерами против Apple M3 Max GPU (40-core), которая вышла на 1 год и 8 месяцев позже и имеет 640 конвейеров и 5120 шейдеров. Ниже вы найдете детальные тесты производительности, игровые бенчмарки и спецификации GPU.

Обзор

Игры
Производительность в DirectX, OpenCL и Vulkan
Проф. приложения
3D моделирования, видеомонтаж и рендеринг
Искусственный интеллект
Возможности в задачах машинного обучения и ИИ
Энергоэффективность
Энергопотребление в различных сценариях
Оценка NanoReview
Общая оценка видеокарты

Ключевые отличия

Ключевые отличия и преимущества M3 Max GPU (40-core) перед RTX 3090 Ti
Причины выбрать GeForce RTX 3090 Ti
  • Существенно выше (в 2 раза) производительность в 3DMark Steel Nomad Lite
  • В 2.8 раза выше максимальная теоретическая производительность (40 vs 14.1 TFLOPS)
  • Обеспечивает в 2.5 раза лучшую пропускную способность памяти: 1008 против 409.6 ГБ/с
  • Набирает в 2.5 раза больше баллов в тесте GeekBench 6 Compute (232K против 94K)
  • Поддерживает технологию Nvidia DLSS 2
  • Обладает в 2.1 раза большим количеством шейдерных ядер (10752 против 5120)
Причины выбрать Apple M3 Max GPU (40-core)
  • Изготовлена по более эффективному 3 нм техпроцессу

Игровая производительность

Сравнение производительности (FPS) в популярных AAA-играх

Игры

Таблица FPS
Forza Horizon 5
200
136
126
99
-
The Witcher 3
214
185
130
71
-
Counter-Strike 2
286
213
154
85
-
Far Cry 6
160
151
133
83
-
Hogwarts Legacy
141
116
93
52
-
CoD: Modern Warfare III
186
174
139
90
-
Ghost of Tsushima
129
105
89
57
-
Cyberpunk 2077
158
140
98
44
-
Shadow of the Tomb Raider
254
237
183
101
-
Средний FPS
1080p High 192 -
1080p Ultra 162 -
1440p Ultra 127 -
4K Ultra 76 -
Погрешность Низкая Средняя

Бенчмарки

Тесты производительности видеокарт в бенчмарках

3D Mark

Бенчмарк, который напрямую коррелирует с производительностью в современных играх
Steel Nomad Lite Score
Time Spy 21855 -
Solar Bay 109239 49656
Port Royal 14890 -
Fire Strike 51935 -
Wild Life Extreme 48861 30893
Night Raid 156537 -
Источники: 3DMark [1], [2]

GeekBench 6 OpenCL

GPU тест для вычислительных задач (обработка изображений, компьютерное зрение, ML и другое)
GB6 Compute Score
RTX 3090 Ti +146%
232083
Background Blur 362.7 img/sec 157.6 img/sec
Face Detection 227.9 img/sec 100.9 img/sec
Horizon Detection 11.3 Gpixels/sec 3.99 Gpixels/sec
Edge Detection 15.9 Gpixels/sec 6.04 Gpixels/sec
Gaussian Blur 12.1 Gpixels/sec 5 Gpixels/sec
Feature Matching 1.56 Gpixels/sec 0.84 Gpixels/sec
Stereo Matching 1080 Gpixels/sec 363.8 Gpixels/sec
Particle Physics 31024.6 FPS 12226.9 FPS
API OpenCL OpenCL
Источники: Geekbench [3], [4]

Cinebench 2024 GPU

Тест производительности карты с использованием движка Cinema 4D от Maxon
Cinebench 2024 GPU

Passmark Graphics

Бенчмарк активно использует вычислительные шейдеры, мультитекстурирование и тесселяцию
G3D Mark Score
G2D Mark 1226 -
DirectX 11 238 FPS -
DirectX 12 121 FPS -
GPU Compute 16494 Ops/s -
Источники: PassMark [5] – 3325 samples

Blender

Тест производительности GPU в 3D-рендеринга
Blender GPU
6050.04
Источники: Blender [9], [10] – 1861 & 444 samples

Тесты ИИ

Производительность в задачах машинного обучения и ИИ

GeekBench 6 ML

GB6 ML Single Precision
GB6 ML Half Precision
GB6 ML Quantized
Image Classification (SP) 10246 8685
Image Segmentation (HP) 22830 20739
Image Super Resolution (Q) 23532 22775
Face Detection (HP) 48657 37676
Pose Estimation (Q) 147241 91609
Text Classification (SP) 2917 2909
Machine Translation (HP) 4427 5274
Object Detection (SP) 13323 7480
Depth Estimation (Q) 40055 38212
Style Transfer (SP) 298683 190681
Framework ONNX Core ML
Backend DirectML GPU
Источники: Geekbench [9], [10]
Результаты были получены с использованием разных ML фреймворков

Технические характеристики

Подробные характеристики GeForce RTX 3090 Ti и Apple M3 Max GPU (40-core)

Общая информация

Производитель Nvidia Apple
Сборка Дискретная Интегрированная
Дата выхода 29 марта 2022 31 октября 2023
Стартовая цена (РРЦ) 1999 $ -
Форм-фактор Десктоп Для ноутбука
Назначение Игровая Профессиональная
Сегмент Высокий Высокий
Архитектура Ampere Apple M GPU
Кодовое имя GA102 -
Аналог конкурента - - GeForce RTX 4070 Laptop
Преемник - - Apple M5 Max GPU (40-core)
Рекомендуемый процессор - Intel Core i9 12900K или лучше - Apple M3 Max или лучше
Используется в процессорах - - Apple M3 Max

Графический процессор

Базовая частота 1560 МГц 500 МГц
Boost частота 1860 МГц 1380 МГц
Шейдерные блоки 10752 5120
Текстурные блоки (TMUs) 336 320
Блоки вывода (ROPs) 112 160
Вычислительные блоки (Pipelines) 84 640
Тензорные ядра 336 -
Ядра трассировки лучей 84 -
Кэш L1 128KB per cluster -
Кэш L2 6MB shared -
Инструкций в такт 2 IPC 2 IPC

Теоретическая производительность

Pixel Fill Rate 208 ГПикс/с 221 ГПикс/с
Texture Fill Rate 625 ГТекс/с 442 ГТекс/с
FLOPS (FP32)
RTX 3090 Ti +184%
40 терафлопс
14.1 терафлопс

Производство

Интерфейс PCIe 4.0 x16 Custom
TGP 450 Вт 60 Вт
Производство Samsung TSMC
Техпроцесс 8 нм 3 нм
Размер кристалла 628 мм² -
Количество транзисторов 28 млрд. 56 млрд.
Плотность транзисторов 44.59 МТр/мм² -
Максимальная температура - 100°C

Память

Тип памяти GDDR6X System Shared
Объем памяти 24 ГБ -
Частота памяти 1313 МГц 6400 МГц
Эффективная частота памяти 21000 Мбит/с 12800 Мбит/с
Шина 384-бит 512-бит
ECC Нет Нет
Пропускная способность
RTX 3090 Ti +146%
1008 ГБ/с
409.6 ГБ/с

API

DirectX 12 -
Vulkan 1.3 -
OpenGL 4.6 -
OpenCL 3.0 -
CUDA 8.6 -
Трассировка лучей Да Да
DLSS DLSS 2 No
DisplayPort 1.4a -

Опрос

Выберите между двумя видеокартами
9 (75%)
3 (25%)
Всего проголосовало: 12

Мнение пользователей

Вы можете поделиться своим мнением или задать вопрос в комментариях ниже
🌐 Зарегистрируйте свой профиль и станьте частью сообщества NanoReview!