Руководство по покупке GPU-сервера: как подобрать, закупить и развернуть оборудование для ИИ
Закупка инфраструктуры ИИ и GPU · Опубликовано 2026-07-25
Покупка GPU-сервера сводится к четырем решениям, принятым в правильном порядке: подобрать класс GPU под рабочую нагрузку, выбрать форм-фактор (PCIe или SXM), определиться между новым и восстановленным кремнием и выбрать платформу, чье питание, охлаждение и связность соответствуют требованиям GPU. Если порядок верный, остальное сводится к механике закупки; если перевернуть его (сначала платформа, нагрузка в конце), вы купите либо избыточную машину, либо машину, которая троттлит.
Это опорное руководство нашей серии об инфраструктуре для ИИ и GPU. Оно отражает то, как мы в AXISLINK на практике подбираем и просчитываем GPU-системы для покупателей, и по мере выхода остальных материалов серии будет ссылаться на подробные разборы цен, экспортных правил и сравнений конкретных моделей.
Коротко о главном
- Рабочая нагрузка определяет класс GPU; все остальное следует из этого
- Модули SXM дают полную пропускную способность интерконнекта; карты PCIe меняют скорость на гибкость
- Восстановленные GPU для дата-центров могут резко снизить затраты, если происхождение проверено
- Узел с 8 GPU - это проект по питанию и охлаждению, а не просто покупка сервера
- Передовые ИИ-ускорители подпадают под экспортный контроль: планируйте комплаенс до заказа
- Сроки поставки зависят от канала; вторичный рынок движется быстрее очередей на аллокацию
Начинайте с нагрузки, а не с GPU
Рынок говорит номерами моделей GPU, но подбор конфигурации начинается с того, что машина должна делать. Грубое соответствие в ландшафте текущего поколения:
| Рабочая нагрузка | Что важнее всего | Типичный класс GPU |
|---|---|---|
| Обучение и дообучение LLM | Объем памяти, пропускная способность интерконнекта, масштабирование на несколько GPU | Флагманские ускорители для дата-центров (класс H100/H200, SXM) |
| Инференс LLM в масштабе | Объем памяти на доллар, пропускная способность | Класс H100/A100 или инференс-карты с большой памятью (класс L40S) |
| Диффузионные модели, рендеринг, медиа | Чистая вычислительная мощность, VRAM, экосистема драйверов | Класс L40S или карты для рабочих станций (семейство RTX 6000) |
| Классический ML, аналитика, CV | Стоимость одного GPU, простота одного узла | Карты для дата-центров прошлого поколения (A100, вплоть до класса V100) |
| VDI и виртуальные рабочие станции | Модель лицензирования, плотность на карту | GPU, созданные специально для виртуализации |
Два практических вывода. Во-первых, флагманы прошлого поколения по-прежнему действительно полезны: кластер A100 и сегодня обучает и обслуживает серьезные модели, а на вторичном рынке стоит лишь долю цены нынешних флагманов. Во-вторых, покупка GPU крупнее, чем требует нагрузка, ничего не дает на будущее, если узким местом раньше станет интерконнект, хранилище или сеть.
PCIe или SXM: развилка форм-фактора
Одно и то же поколение GPU обычно выходит в двух исполнениях, и этот выбор задает облик всего сервера.
| Карты PCIe | Модули SXM | |
|---|---|---|
| Установка | Стандартные слоты во многих моделях серверов | Распаяны на выделенной базовой плате (класс HGX) |
| Пропускная способность GPU-GPU | Ограничена; мостовые коннекторы на некоторых парах | Полносвязный высокоскоростной интерконнект |
| Питание и охлаждение | Меньшее потребление на карту, воздушное охлаждение возможно в 2U | Максимальное потребление; требуется специализированное шасси |
| Гибкость | Карты можно добавлять и переносить между системами | Фиксированные конфигурации на 4 GPU или 8 GPU |
| Лучшее применение | Инференс, смешанные нагрузки, постепенное масштабирование | Обучение на нескольких GPU, где эффективность масштабирования окупается |
Честное эмпирическое правило из нашей практики просчета: однонодовые инференс-машины и смешанные исследовательские серверы обычно собираются на PCIe; серьезные кластеры для обучения на нескольких GPU собираются на SXM, и наценка покупает реальную пропускную способность обучения, а не цифру из спецификации.
Новые или восстановленные: что на самом деле предлагает вторичный рынок
GPU для дата-центров попадают на вторичный рынок, когда гиперскейлеры и ИИ-лаборатории обновляют парки. Это предложение делает ускорители прошлого поколения радикально дешевле новых флагманов, и именно так многие команды позволяют себе реальные мощности. Что отделяет хорошую покупку восстановленной техники от лотереи:
- Происхождение: кто эксплуатировал карту, в какой среде, почему вывели из эксплуатации
- Тестирование: результаты прогона по каждой карте, а не по партии, с проверками памяти и температур
- Письменно зафиксированная градация состояния, с фотографиями для бывшего в употреблении товара
- Гарантия: заявленное продавцом окно возврата, поскольку заводское покрытие редко переходит новому владельцу
- Состояние прошивки и лицензий: заблокированные или привязанные к вендору карты существуют и должны раскрываться
Это бизнес происхождения. Покупатели проводят покупки восстановленной техники через ответственного торгового контрагента, а не через объявление на маркетплейсе, потому что проверка, градация и возможность регресса и есть настоящий продукт; кремний в обоих случаях одинаков. Наш склад GPU и ускорителей явно указывает состояние и градацию ровно по этой причине.
Платформа: сервер вокруг GPU
GPU не работают сами по себе. Решение о платформе - то место, где бюджеты тихо ломаются.
Шасси и плотность
Типовые форматы: серверы 2U на 2-4 карты PCIe; башни и стоечные шасси 4U/5U на 4-8 карт PCIe с лучшим воздушным потоком; и специализированные платформы HGX 6U-8U, несущие 8 модулей SXM (класс Dell PowerEdge XE9680, класс HPE Cray, системы Supermicro HGX). Шасси, в которое карты помещаются, и шасси, которое охлаждает их под длительной нагрузкой, - не одно и то же.
Питание - скрытое ограничение
Флагманский узел с 8 GPU потребляет под нагрузкой порядка 10 кВт. Это больше, чем выдерживают многие офисные серверные, и заметная доля бюджета стойки в колокейшене. До заказа подтвердите энергобюджет стойки и мощность PDU, холодопроизводительность под фактически выделяемое тепло и то, тарифицирует ли площадка выделенную мощность. Не раз мы пересчитывали покупателю конфигурацию с одного узла на 8 GPU на два узла по 4 GPU исключительно из-за ограничений площадки по питанию.
CPU, память, хранилище, сеть
Правила баланса, работающие из поколения в поколение: системная память как минимум равна суммарной памяти GPU (для обучения комфортно вдвое больше); NVMe-скретч достаточно быстрый, чтобы непрерывно кормить GPU; а для обучения на нескольких узлах - фабрика (высокоскоростной Ethernet или класс InfiniBand) под стать амбициям, потому что голодающий интерконнект оставляет дорогой кремний простаивать.
Экспортный контроль: планируйте комплаенс до заказа
Передовые ИИ-ускорители подпадают под экспортный контроль, прежде всего под правила Бюро промышленности и безопасности США, ограничивающие поставку GPU верхнего уровня для дата-центров в отдельные направления. Что это означает для покупателя на практике:
- Доступность флагманских ускорителей различается по рынкам назначения; направления под ограничениями не могут законно получать отдельные SKU
- По контролируемым моделям продавцы будут запрашивать сведения о конечном пользователе и конечном применении; воспринимайте это как признак законопослушного контрагента, а не как трение
- Регулирование меняется; вашей отгрузкой управляет действующий свод правил, а не прошлогодний пересказ
Мы прямо пишем это в собственных условиях: заказы могут требовать сведений о конечном пользователе, и мы отказываемся от сделок, которые нельзя исполнить законно. Отдельное руководство этой серии подробнее разбирает правила для зарубежных покупателей.
Каналы закупки и сроки поставки
GPU-системы поставляются по трем широким каналам. OEM-аллокация (заказ сконфигурированной системы через каналы Dell, HPE, Supermicro или Lenovo) дает новые системы с гарантией, но сроки растягиваются при всплесках спроса. Вторичный рынок и рынок восстановленной техники движется быстрее всех и привлекательно оценивает прошлые поколения, а качество целиком держится на проверке. Торговые компании вроде нашей работают по обе стороны: находят новые или восстановленные GPU и платформы, проверяют и консолидируют их и отгружают с экспортной документацией из Гонконга или материкового Китая. Какой канал выигрывает, зависит от того, что для вас ограничение: бюджет, срок поставки или гарантийное покрытие.
Разобранный пример пути решения
Покупатель хочет дообучать открытые модели среднего размера и обслуживать несколько тысяч пользователей. Путь решения: нагрузка смешанная, обучение плюс инференс; объем памяти важнее пикового интерконнекта, поэтому 4-8 ускорителей PCIe класса H100/A100 выигрывают по цене у платы SXM; восстановленные карты A100 80GB с задокументированным происхождением вдвое сокращают бюджет на кремний; платформа - шасси 4U с резервированным питанием и NVMe-скретчем; проверка площадки подтверждает, что стойка потянет питание. Это полная, обоснованная спецификация, и каждый ее шаг - разговор, который мы еженедельно ведем с покупателями.
Частые вопросы
Чем GPU-сервер отличается от обычного сервера?
GPU-сервер построен вокруг питания и охлаждения ускорителей: более мощные блоки питания, воздушный поток, рассчитанный на карты или модули под длительной нагрузкой, и топология PCIe или SXM для их соединения. Обычный сервер иногда принимает одну или две карты; GPU-сервер спроектирован под полный комплект.
Покупать GPU-мощности или арендовать?
Аренда выигрывает для пиковых и исследовательских задач; покупка выигрывает, когда загрузка стабильна, важны гравитация данных или приватность, либо облачные цены на GPU превышают амортизированную стоимость железа при вашем режиме использования. Многие команды арендуют для прототипов и покупают для продакшена. Отдельное руководство серии разбирает эту арифметику.
Надежны ли восстановленные GPU для дата-центров?
Карты для дата-центров рассчитаны на непрерывную работу, и корректно выведенные из парка карты с результатами тестов по каждой единице живут долго. Риск сосредоточен в происхождении и тестировании, а не в самой идее кремния: покупайте товар с градацией, тестами и документами у ответственного продавца.
Сколько электричества нужно серверу с 8 GPU?
Флагманские узлы SXM с 8 GPU потребляют под нагрузкой порядка 10 кВт; сборки на PCIe меньше, но все равно намного больше обычной офисной проводки. Подтверждайте питание и охлаждение площадки до заказа, а не после доставки.
Можно ли позже проапгрейдить сервер с 4 GPU до 8 GPU?
На платформах PCIe - только если шасси, блоки питания и воздушный поток изначально рассчитывались под это. Базовые платы SXM - фиксированные конфигурации. Если рост вероятен, берите платформу побольше с меньшим числом карт и заполняйте ее со временем.
Закупаете это оборудование?
AXISLINK поставляет корпоративным покупателям по всему миру из Гонконга и материкового Китая, оформляя экспортную документацию и фрахт. Отправьте ваши требования и получите официальное коммерческое предложение, обычно в течение 24 часов.
Запросить коммерческое предложение