NVIDIA H200 — ускоритель архитектуры Hopper с 141 ГБ памяти HBM3e и пропускной способностью памяти 4,8 ТБ/с на один GPU. Восемь H200 дают примерно 1,1 ТБ совокупной памяти ускорителей. Это не означает, что одна модель автоматически займёт весь этот объём: доступная память делится между весами, KV-кэшем, рабочими буферами и параллельными задачами.
Что означают 141 ГБ на ускоритель
Большой HBM-объём помогает разместить крупную модель или увеличить рабочий контекст и параллельность инференса. Для обучения он даёт больше пространства для весов, активаций и состояния оптимизатора. Фактический предел зависит от точности, метода обучения, длины контекста, размера пакета, программного стека и того, как распределяется модель между GPU.
В 8-GPU HGX H200 ускорители соединены через NVLink и NVSwitch. Преимущество такой связки раскрывается в параллельных задачах, где модель или вычисления распределены по нескольким GPU. Одна только сумма памяти не заменяет проверку межсоединений, загрузки данных и распределённого ПО.
Пример OEM-системы: GIGABYTE G593-SD1-AAX3
На сайте GIGABYTE указано, что G593-SD1-AAX3 — 5U-сервер с NVIDIA HGX H200 и восемью GPU SXM. Производитель также перечисляет два процессорных сокета под Intel Xeon Scalable 4-го или 5-го поколения, 32 слота DDR5 RDIMM, восемь фронтальных отсеков 2,5″ Gen5 NVMe/SATA/SAS-4 и комплект из четырёх основных плюс двух резервных блоков питания по 3000 Вт.
| Параметр | Данные производителя | Что уточнить в заказе |
|---|---|---|
| Ускорители | 8 × NVIDIA H200 SXM | точная ревизия и состав HGX-платформы |
| Память GPU | 141 ГБ HBM3e на GPU; около 1,1 ТБ на 8-GPU узел | память CPU отдельно от HBM |
| Процессоры | 2 × Intel Xeon Scalable, 4-е или 5-е поколение | модели CPU и фактический TDP |
| Оперативная память | 32 DIMM-слота DDR5 RDIMM | объём, частота и схема заполнения |
| Накопители | 8 × 2,5″ Gen5 NVMe/SATA/SAS-4 | интерфейсы и установленные SSD |
| Корпус и БП | 5U; 4+2 × 3000 Вт | нагрузка по фазам, разъёмы и кабели |
Габариты корпуса по спецификации — 447 × 219,7 × 945 мм, масса сервера — около 88 кг. Это данные платформы, а не обязательная комплектация конкретного коммерческого предложения. В спецификации заказа нужно отдельно зафиксировать CPU, объём RAM, SSD, сетевые карты, кабельный комплект, поставку и гарантию.
H200 SXM и H200 NVL — разные системные сценарии
H200 SXM используется в платформе HGX и высокоскоростной связке GPU внутри узла. H200 NVL — PCIe-ускоритель для более гибких, воздушно-охлаждаемых корпоративных конфигураций; NVIDIA описывает соединение до четырёх NVL-карт с NVLink-мостами. У SXM и NVL разные ограничения по TDP и системным платформам, поэтому спецификацию одного варианта нельзя переносить на другой.
Пример G593-SD1-AAX3 относится к H200 SXM / HGX. Если рассматривается PCIe-сервер с H200 NVL, нужно подбирать совместимую платформу отдельно и проверять поддержку GPU, мостов, охлаждения, блока питания и драйверов.
Кому подходит 8-GPU H200
Такой узел имеет смысл, когда бенчмарки или расчёт показывают пользу от большого общего пула GPU, а площадка способна принять многопроцессорный 5U-сервер с высокой плотностью тепла. Типичные направления — обучение и fine-tuning крупных моделей, интенсивный инференс, несколько параллельных AI-сервисов и вычислительные задачи, для которых нужна масштабируемая связка GPU.
Для RAG-сервиса с умеренным числом пользователей восемь H200 могут быть избыточны. Сначала оцените модель, среднюю и пиковую одновременность, длину контекста, требуемую задержку, формат точности и ожидаемый рост. Затем сравните 1-, 2-, 4- и 8-GPU варианты на одном тестовом наборе.
Что запросить перед коммерческим предложением
- Полный SKU сервера и точную модель каждой H200.
- Модели CPU, объём и схема установки RAM, состав накопителей.
- Сетевые адаптеры, их скорость и наличие требуемых кабелей/трансиверов.
- Требования по питанию, фазам, разъёмам, воздухообмену и сервисным зазорам.
- Подтверждённую дату расчёта цены, срок поставки, продавца и валюту договора.
- Гарантийный маршрут, комплект документов и состав работ при вводе системы в эксплуатацию.
Модельный ряд и каталог систем для AI помогают выбрать направление, но наличие и финальную конфигурацию нужно подтвердить для конкретного заказа. Для сравнения поколений смотрите материал H200 или B300.
Источники
- NVIDIA H200: официальные характеристики GPU и варианты SXM/NVL.
- GIGABYTE G593-SD1-AAX3: спецификация OEM-сервера.
Характеристики сведены по материалам производителей на 10 октября 2026 года. Заказная комплектация и доступность могут отличаться.
