Три карти з одним кристалом GB202, однаковими 96 ГБ пам'яті й однаковими 24 064 CUDA-ядрами. Різниця сидить у тепловому бюджеті, типі кулера і пропускній здатності, причому останню NVIDIA у власну порівняльну таблицю не поставила. Ми зібрали числа з даташитів і whitepaper в одну таблицю.
Коротко
- Кремній однаковий: 24 064 CUDA-ядра, 752 тензорних, 188 RT-ядер, 96 ГБ GDDR7 з ECC, 512 біт
- Пропускна здатність 1792 ГБ/с у Workstation і Max-Q проти 1597 ГБ/с у Server Edition, різниця 10,88%
- Потужність 600 / 300 / 400-600 Вт, кулер наскрізний / турбіна / пасив
- vGPU є лише в Server Edition, до 48 віртуальних машин. У гайді Lenovo для Max-Q стоїть «No support»
- Карт у систему: дві на Workstation, до чотирьох на Max-Q, до восьми на Server Edition
Чого немає в порівняльній таблиці NVIDIA
На сторінці сімейства RTX PRO 6000 є таблиця, яка нібито порівнює три версії. У ній шість рядків: обсяг пам'яті, кількість DisplayPort, споживання, шина, формфактор і тип охолодження. Усе, що визначає різницю в роботі, з неї викинуто.
| Параметр | Чи є в офіційній таблиці |
|---|---|
| Обсяг пам'яті, споживання, шина, формфактор | є |
| Пропускна здатність пам'яті | немає |
| CUDA-ядра, AI TOPS | немає |
| MIG, vGPU | немає |
Склад таблиці перевірений на сторінці сімейства RTX PRO 6000 станом на липень 2026
Дійти до першоджерела й порівняти три SKU не вийде. Числа розкидані по трьох продуктових сторінках, трьох PDF-даташитах і whitepaper, де Server Edition не згадана.
Повна таблиця трьох версій
| Параметр | Workstation | Max-Q | Server Edition |
|---|---|---|---|
| CUDA-ядра | 24 064 | 24 064 | 24 064 |
| Пам'ять | 96 ГБ GDDR7 ECC | 96 ГБ GDDR7 ECC | 96 ГБ GDDR7 ECC |
| Пропускна здатність | 1792 ГБ/с | 1792 ГБ/с | 1597 ГБ/с |
| Boost-частота | 2617 МГц | не публікується | не публікується |
| FP32 | 125 TFLOPS | 110 TFLOPS | 120 TFLOPS |
| RT Core | 380 TFLOPS | 333 TFLOPS | 355 TFLOPS |
| AI TOPS, FP4 sparse | 4000 | 3511 | 4 PFLOPS |
| Споживання | 600 Вт | 300 Вт | 400-600 Вт |
| Охолодження | наскрізне, 2 осьові | турбіна назад | пасивне |
| Габарити, 2 слоти | 137 x 305 мм | 112 x 267 мм | 112 x 267 мм |
| MIG | 4x24, 2x48, 1x96 ГБ | 4x24, 2x48, 1x96 ГБ | до 4 по 24 ГБ |
| vGPU | немає | немає | до 48 vGPU |
| Confidential Computing, Secure Boot | не вказано | не вказано | є |
Джерела: даташит Workstation Edition, даташит Server Edition, whitepaper Blackwell PRO, Lenovo Press
1792 проти 1597 ГБ/с: на що це впливає насправді
Шина в усіх трьох однакова, 512 біт, тож уся різниця в частоті пам'яті: настільні версії мають GDDR7 на 28 Гбіт/с, серверна приблизно 25. Офіційно цю частоту NVIDIA не публікує ніде, вона виводиться зворотним рахунком із 1597 ГБ/с. Ядро теж пригальмоване, але менше: FP32 нижчий на 4%, RT-ядра на 6,6%, пам'ять на 10,88%.
Тепер найважливіше. Генерація токенів (фаза decode) читає всі ваги моделі на кожен токен, тому впирається у смугу майже лінійно: мінус 10,88% смуги дають близько мінус 10% токенів за секунду. А обробка промпту (prefill) це матричні множення, упор у тензорні ядра, і за FP4 обидві версії заявлені однаково. На довгих промптах і батчевому інференсі розрив буде меншим за 10%.
На що різниця не впливає: чи влізе модель. 96 ГБ у всіх трьох, і саме цей поріг дає найбільші стрибки. GamersNexus на Llama 3.3 70B зафіксували приріст проти RTX 5090 на 928%: чистий ефект того, що 32 ГБ не вистачає, а 96 вистачає.
Чесно про межу знань: прямого A/B-заміру двох версій на одному хості немає в жодному перевіреному джерелі. На форумі розробників NVIDIA це питання поставили в лютому 2026 і відповіді досі немає.
Кулер вирішує, скільки карт у вас буде
Workstation Edition має наскрізну конструкцію з двома осьовими вентиляторами: повітря заходить знизу, проходить крізь карту й виходить угору, в корпус. Для однієї карти це добре, GamersNexus заміряли 82 °C на ядрі, 88 °C на пам'яті й 32,5 dBA. Для двох гаряче повітря першої карти йде просто в другу. Реалістичний максимум тут дві карти.
Max-Q це та сама плата з класичною турбіною, яка викидає повітря назад через задню планку. Разом із удвічі нижчим лімітом потужності це дає до чотирьох карт у станцію, тому OEM-збірки з чотирма GPU роблять саме на ній. Ціна питання близько 12% на FP32.
| Платформа | Карт | Умова |
|---|---|---|
| Станція, Workstation Edition | 2 | упор у тепло, розмір і живлення |
| Станція, Max-Q | 4 | заявлено самою NVIDIA |
| Lenovo ThinkSystem SR650a V4 | 2 або 4 | 2 при 600 Вт, 4 при обмеженні 450 Вт |
| Референсна архітектура RTX PRO Server | 8 | 768 ГБ пам'яті, 12,8 ТБ/с сумарно |
Джерела: AEC Magazine, Lenovo Press LP2263, NVIDIA Enterprise RA
Server Edition вентилятора не має взагалі, повітря женуть крізь неї вентилятори стійки. У сертифікованому шасі це працює: HOSTKEY бачили до 83 °C у штатному режимі й до 90 °C у boost на 600 Вт. Поза сервером починається цирк. У гілці Level1Techs карта за пару хвилин доходила до 100 °C (аварійне вимкнення на 104 °C) і тягнула 125 Вт замість 600, бо душила себе сама. Вилікували кожухом і 60-міліметровим вентилятором високого тиску. Звучить це, судячи з опису в гілці, як пилосос Dyson на столі.
Кабель, який тихо ріже карту до 450 Вт
Найдорожча пастка в цій темі виглядає як брак. Роз'єм живлення в усіх трьох версіях один, 16-контактний 12V-2x6. Контакти SENSE0 і SENSE1 кодують потужність, яку блок готовий віддати, а карта читає цю конфігурацію і сама опускає стелю.
Показовий випадок. На Server Edition у шасі Supermicro nvidia-smi показував Max Power Limit: 450.00 W, і команда nvidia-smi -pl 600 нічого не змінювала. У відповіді від NVIDIA сказано, що карта не заблокована на заводі, стелю задає кабель: штатний CBL-PWEX-0962Y-30 сконфігурований на 450 Вт, для повних 600 потрібен CBL-PWEX-1364Y-30. Купувати окремо.
Іноді 450 Вт це навмисне рішення виробника сервера, щоб поставити вдвічі більше карт у те саме шасі. Скільки це коштує: у гілці Level1Techs на Workstation Edition зниження з 600 до 300 Вт дало падіння з 20,54 до 19,29 токена за секунду на Llama 3.3 70B Q8, тобто близько 6%. Половина ліміту потужності коштує менше, ніж здається. Але безплатною вона не буває.
MIG і vGPU: тут версії розходяться найсильніше
MIG заявлений у всіх трьох, до чотирьох ізольованих інстансів на карту. На настільних версіях він не вмикається з коробки: потрібен драйвер від 575.51.03, vBIOS від 98.02.55.00.00 і перемикання карти в обчислювальний режим утилітою DisplayModeSelector, після чого зображення зникає. Роздріб на старті їхав із vBIOS 98.02.52.00.02, і люди закономірно отримували Unable to enable MIG Mode: Not Supported.
З vGPU все однозначно. Її має тільки Server Edition, до 48 віртуальних машин на карту: чотири MIG-інстанси, і vGPU піднімає на кожному до дванадцяти ВМ. У гайді Lenovo для Max-Q рядок звучить дослівно: «vGPU software support: No support». Команда Proxmox каже те саме. Якщо у вас VDI або мультитенантний інференс, вибір зроблено за вас.
| Сценарій | Яка версія |
|---|---|
| Одна карта, максимум швидкості, рендер і локальні LLM | Workstation |
| Дві й більше карт у настільному корпусі, тиха кімната | Max-Q |
| Стійка, віртуалізація, VDI, Confidential Computing | Server Edition |
Зведення за даташитами трьох версій і MIG User Guide
Чого не знає ніхто
Офіційної частоти пам'яті й boost-частоти Server Edition NVIDIA не публікує, обидва числа доводиться виводити з інших. Порівняльного тесту двох версій на одному стенді не існує. Маси карт немає в жодному даташиті. Чи доступні на серверній версії конфігурації MIG 2x48 і 1x96 ГБ, прямо не сказано, згадано тільки 4x24. Рядка NVLink у даташитах немає взагалі, ні в позитивному, ні в негативному формулюванні.
Що з цього є в нас
- PNY NVIDIA RTX PRO 6000 Blackwell Workstation Edition 96 ГБ: 600 Вт, наскрізний кулер, є також OEM-варіант
- PNY NVIDIA RTX PRO 6000 Blackwell Max-Q: 300 Вт, турбіна, до чотирьох у станцію, є OEM-варіант
- PNY NVIDIA RTX PRO 6000 Server Edition 96 ГБ: пасив під стійку, єдина з vGPU і Confidential Computing
Часті питання
Чому серверна карта обмежена 450 Вт, якщо в специфікації 600?
Карта тут ні до чого. Стелю задають sense-контакти кабелю, і карта читає їх сама. Штатний кабель частини серверів сконфігурований на 450 Вт, тому nvidia-smi -pl 600 не спрацює. Лікується заміною кабелю, у Supermicro це CBL-PWEX-1364Y-30.
Якщо виставити серверній карті 600 Вт, вона зрівняється з Workstation?
Не повністю. Ліміт вирівняється, а пам'ять і частота ядра залишаться нижчими: 1597 проти 1792 ГБ/с і 120 проти 125 TFLOPS у FP32. Публічного заміру двох карт на одному стенді немає, тому точна цифра тут буде вигадкою.
Карта показує 100% завантаження, але споживає 125 Вт замість 600
Найімовірніше це пасивна Server Edition без обдуву: вона впирається в температурну стелю й ріже частоти до останнього. Побутові 120-міліметрові вентилятори такого потоку не дають. Потрібен кожух із вентилятором високого статичного тиску або сертифіковане шасі.
У Server Edition є 4 порти DisplayPort 2.1, але зображення немає
Так задумано. Датацентрові карти їдуть у режимі DisplayOFF, порти вмикає утиліта displaymodeselector, це підтверджували інженери NVIDIA. Складність у тому, що для перемикання потрібна вже завантажена система.
MIG видає «Not Supported» на новій карті
Перевірити три речі: драйвер R575 або новіший, vBIOS (потрібен від 98.02.55.00.00, роздріб їхав із 98.02.52.00.02) і режим дисплея, він має бути обчислювальним. Оновлення vBIOS видає постачальник карти.
Що дають дві карти замість однієї?
Не 192 ГБ одним шматком. NVLink не заявлений, обмін іде через PCIe 5.0 x16. Дві карти корисні для паралелізму по шарах, більшої кількості одночасних запитів або щоб тримати поруч кілька моделей.
Ці моделі є в каталозі
Не впевнені, яка з трьох версій ваша?
Напишіть, у якому корпусі чи шасі стоятиме карта, скільки їх планується і чи потрібна віртуалізація. Інженер підбере версію, перевірить живлення та кабелі й скаже, де ви втратите продуктивність.
Отримати консультацію


