-
Раньше заказчик покупал оборудование в одном месте, а тех, кто его внедрит, искал отдельно. Теперь обе части закрывает одна команда: ETE отвечает за серверы, GPU и сеть, Vixen.UNO за виртуализацию, облака и Kubernetes. За плечами партнёра 72 виртуализированные инфраструктуры и 42 миграции в облако. Разбираем, кто за что отвечает и что можно заказать вместе.
-
Страницу партнёров ведёт сам производитель, и карточка ETE там есть: шесть направлений компетенции, от серверных GPU до Omniverse. В перечне 714 компаний, полный набор из этих шести есть у 68, то есть 9,5%. Разбираем, что стоит за каждым направлением, почему в карточке нет ни одной розничной позиции и что партнёрский статус даёт покупателю на практике.
-
128 ГБ унифицированной памяти в коробке размером с толстый роутер. Собрали замеры независимых обозревателей и официальные числа NVIDIA, чтобы показать, где Spark силён, а где цифры из презентации расходятся с реальностью. Главное ограничение: 273 ГБ/с пропускной способности, из-за которых плотная модель на 70 миллиардов параметров выдаёт 2,7 токена в секунду на одном пользователе.
-
Из пятнадцати моделей Nutanix NX карты берут одиннадцать, а потолок на узел это четыре H100 или L40S в NX-9151-G9. Разобрали, какие узлы поддерживают GPU, сколько виртуалок выходит на карту через MIG и vGPU, и почему L40S на аппаратные слайсы не делится вообще. Плюс то, о чём молчат презентации: MIG выключает NVLink, а живая миграция требует одинакового железа на обоих хостах.
-
MIG режет карту аппаратно, vGPU делит время и требует лицензии на каждого пользователя. Разбираем, сколько виртуальных машин получается на RTX PRO 6000, RTX PRO 5000 и L40S, какие профили и лицензии для этого нужны, на каких гипервизорах работает MIG-backed vGPU и почему карта с MIG в даташите может не включать его на практике.
-
Одна карта даёт 48 ГБ и 300 Вт, вторая 96 ГБ и 600 Вт. Между ними удвоенная память, шина 512 бит вместо 384, тензорные ядра пятого поколения с поддержкой FP4 и аппаратное деление MIG, которого у Ada не было вообще. Собрали цифры из даташитов и реальных замеров, чтобы было видно, когда доплата за новое поколение окупается, а когда Ada закрывает задачу.
-
Кристалл AD102, 48 ГБ GDDR6 с ECC и 864 ГБ/с в пассивной карте на 350 Вт. Разбираем, чем L40S отличается от L40 (спойлер: только TDP и тензорные числа в даташите), сколько виртуальных рабочих мест она реально тянет и почему в рабочей станции греется до 100°C. Плюс честный список задач, где она проигрывает H100 и RTX 6000 Ada.
-
Паспортные 600 Вт на карте это требование к блоку питания, а не потребление машины. Собрали измеренные числа для станций на одну, две и четыре карты, разобрали sense-пины 12VHPWR и 12V-2x6 и объяснили, почему RTX PRO 6000 в сервере часто упирается в 450 Вт вместо 600. Плюс расчёт под украинскую линию на 16 ампер.
-
У трёх версий RTX PRO 6000 один кристалл GB202, 96 ГБ GDDR7 и 24 064 CUDA-ядра, но официальная таблица NVIDIA не показывает ни пропускной способности, ни MIG, ни vGPU. Мы собрали числа из даташитов и whitepaper: 1792 против 1597 ГБ/с, 600 против 300 Вт, сколько карт влезает в корпус и почему серверная карта тихо режется до 450 Вт из-за кабеля.
-
Один кристалл GB202, 24 064 CUDA-ядра и 96 ГБ GDDR7 с ECC в трёх версиях: Workstation, Max-Q и Server Edition. Разобрали, где разница между 1792 и 1597 ГБ/с действительно заметна, как на самом деле включается MIG и почему серверная карта молча садится на 450 Вт. Плюс замеры в Llama 3.3 70B, Blender и V-Ray и профиль потребления от простоя до тренировки.
-
Вычислительный кремний у двух карт одинаковый до последней цифры: те же 835 TFLOPS в TF32 и 3341 в FP8. Вся разница живёт в памяти, 141 ГБ против 94 и 4813 ГБ/с против 3938. Разобрали, на каких задачах прирост доходит до 3,4 раза, а где он равен нулю, и как посчитать, когда доплата за H200 NVL возвращается.
-
141 ГБ HBM3e и 4 813 ГБ/с против 94 ГБ и 3 938 ГБ/с у H100 NVL, при этом вычислительная часть у обеих карт одинаковая. Разбираем, какие модели влезают целиком, чем NVL отличается от SXM и сколько даёт NVLink-мостик на четыре карты. Отдельно о том, кому эта карта велика: прирост над H100 гуляет от нуля до 3,4 раза.
-
Веса модели считаются в одно действие, а KV-кеш съедает ещё столько же и больше: 70B с контекстом на 128 тысяч токенов это 180 ГБ на одного человека. Разбираем официальные формулы NVIDIA и показываем, сколько параллельных сессий вытянет карта на 32, 48, 72, 96 и 141 ГБ. Плюс две ловушки, из-за которых модель не стартует на карте, куда она по арифметике влезает.
Мы заботимся о вашей конфиденциальности
Этот веб-сайт использует файлы cookie для маркетинга и статистических целей, а также для безопасной и оптимальной работы сайта. Вы можете изменить это в настройках вашего браузера. Нажмите на кнопку «Согласиться», чтобы дать согласие на использование файлов cookie. Подробнее можно ознакомиться на странице Пользовательское соглашение.