|
Кількість
|
Вартість
|
||
|
|
|||
|
|
|||
Три різні задачі, три різні машини
Слово «AI-сервер» описує щонайменше три конфігурації, і між ними немає кращої. Є та, що відповідає вашій задачі.
- Навчання й донавчання моделей. Тут вирішує обсяг відеопам'яті й швидкість зв'язку між картами. H200 з її 141 ГБ дозволяє тримати в пам'яті те, що на менших картах доводиться різати на частини.
- Інференс під навантаженням. Модель уже навчена, і важлива кількість одночасних запитів на вкладений долар. Тут вигідніші кілька карт RTX PRO, ніж одна найдорожча.
- Локальна робота під столом. Компактна станція, яка тримає модель у себе, не віддає дані назовні й не шумить у кабінеті.
Про що питають перед замовленням
Скільки параметрів у моделі, з якою точністю плануєте рахувати й скільки користувачів працюватимуть одночасно. Цих трьох відповідей вистачає, щоб назвати потрібний обсяг відеопам'яті й кількість карт.
Далі йде місце розміщення. Стійка в серверній, тумба в офісі й полиця в кабінеті задають різні вимоги до шуму, живлення й охолодження.
Що входить у готову систему
Кожна конфігурація зібрана й перевірена цілком: карти, процесор із потрібним числом ліній PCIe, пам'ять під обсяг моделі, накопичувачі під датасети, живлення з запасом на піки. Систему можна змінити під вас, від обсягу дисків до мережевої карти під InfiniBand.
Опишіть задачу своїми словами, і ми запропонуємо конфігурацію з поясненням, чому саме такий набір.