Перейти к содержимому
sales@axislinktrading.com
AXISLINKTRADING LIMITED

Руководство по покупке GPU-сервера: как подобрать, закупить и развернуть оборудование для ИИ

Закупка инфраструктуры ИИ и GPU · Опубликовано 2026-07-25

Покупка GPU-сервера сводится к четырем решениям, принятым в правильном порядке: подобрать класс GPU под рабочую нагрузку, выбрать форм-фактор (PCIe или SXM), определиться между новым и восстановленным кремнием и выбрать платформу, чье питание, охлаждение и связность соответствуют требованиям GPU. Если порядок верный, остальное сводится к механике закупки; если перевернуть его (сначала платформа, нагрузка в конце), вы купите либо избыточную машину, либо машину, которая троттлит.

Это опорное руководство нашей серии об инфраструктуре для ИИ и GPU. Оно отражает то, как мы в AXISLINK на практике подбираем и просчитываем GPU-системы для покупателей, и по мере выхода остальных материалов серии будет ссылаться на подробные разборы цен, экспортных правил и сравнений конкретных моделей.

Коротко о главном

  • Рабочая нагрузка определяет класс GPU; все остальное следует из этого
  • Модули SXM дают полную пропускную способность интерконнекта; карты PCIe меняют скорость на гибкость
  • Восстановленные GPU для дата-центров могут резко снизить затраты, если происхождение проверено
  • Узел с 8 GPU - это проект по питанию и охлаждению, а не просто покупка сервера
  • Передовые ИИ-ускорители подпадают под экспортный контроль: планируйте комплаенс до заказа
  • Сроки поставки зависят от канала; вторичный рынок движется быстрее очередей на аллокацию

Начинайте с нагрузки, а не с GPU

Рынок говорит номерами моделей GPU, но подбор конфигурации начинается с того, что машина должна делать. Грубое соответствие в ландшафте текущего поколения:

Рабочая нагрузкаЧто важнее всегоТипичный класс GPU
Обучение и дообучение LLMОбъем памяти, пропускная способность интерконнекта, масштабирование на несколько GPUФлагманские ускорители для дата-центров (класс H100/H200, SXM)
Инференс LLM в масштабеОбъем памяти на доллар, пропускная способностьКласс H100/A100 или инференс-карты с большой памятью (класс L40S)
Диффузионные модели, рендеринг, медиаЧистая вычислительная мощность, VRAM, экосистема драйверовКласс L40S или карты для рабочих станций (семейство RTX 6000)
Классический ML, аналитика, CVСтоимость одного GPU, простота одного узлаКарты для дата-центров прошлого поколения (A100, вплоть до класса V100)
VDI и виртуальные рабочие станцииМодель лицензирования, плотность на картуGPU, созданные специально для виртуализации

Два практических вывода. Во-первых, флагманы прошлого поколения по-прежнему действительно полезны: кластер A100 и сегодня обучает и обслуживает серьезные модели, а на вторичном рынке стоит лишь долю цены нынешних флагманов. Во-вторых, покупка GPU крупнее, чем требует нагрузка, ничего не дает на будущее, если узким местом раньше станет интерконнект, хранилище или сеть.

PCIe или SXM: развилка форм-фактора

Одно и то же поколение GPU обычно выходит в двух исполнениях, и этот выбор задает облик всего сервера.

Карты PCIeМодули SXM
УстановкаСтандартные слоты во многих моделях серверовРаспаяны на выделенной базовой плате (класс HGX)
Пропускная способность GPU-GPUОграничена; мостовые коннекторы на некоторых парахПолносвязный высокоскоростной интерконнект
Питание и охлаждениеМеньшее потребление на карту, воздушное охлаждение возможно в 2UМаксимальное потребление; требуется специализированное шасси
ГибкостьКарты можно добавлять и переносить между системамиФиксированные конфигурации на 4 GPU или 8 GPU
Лучшее применениеИнференс, смешанные нагрузки, постепенное масштабированиеОбучение на нескольких GPU, где эффективность масштабирования окупается

Честное эмпирическое правило из нашей практики просчета: однонодовые инференс-машины и смешанные исследовательские серверы обычно собираются на PCIe; серьезные кластеры для обучения на нескольких GPU собираются на SXM, и наценка покупает реальную пропускную способность обучения, а не цифру из спецификации.

Новые или восстановленные: что на самом деле предлагает вторичный рынок

GPU для дата-центров попадают на вторичный рынок, когда гиперскейлеры и ИИ-лаборатории обновляют парки. Это предложение делает ускорители прошлого поколения радикально дешевле новых флагманов, и именно так многие команды позволяют себе реальные мощности. Что отделяет хорошую покупку восстановленной техники от лотереи:

  • Происхождение: кто эксплуатировал карту, в какой среде, почему вывели из эксплуатации
  • Тестирование: результаты прогона по каждой карте, а не по партии, с проверками памяти и температур
  • Письменно зафиксированная градация состояния, с фотографиями для бывшего в употреблении товара
  • Гарантия: заявленное продавцом окно возврата, поскольку заводское покрытие редко переходит новому владельцу
  • Состояние прошивки и лицензий: заблокированные или привязанные к вендору карты существуют и должны раскрываться

Это бизнес происхождения. Покупатели проводят покупки восстановленной техники через ответственного торгового контрагента, а не через объявление на маркетплейсе, потому что проверка, градация и возможность регресса и есть настоящий продукт; кремний в обоих случаях одинаков. Наш склад GPU и ускорителей явно указывает состояние и градацию ровно по этой причине.

Платформа: сервер вокруг GPU

GPU не работают сами по себе. Решение о платформе - то место, где бюджеты тихо ломаются.

Шасси и плотность

Типовые форматы: серверы 2U на 2-4 карты PCIe; башни и стоечные шасси 4U/5U на 4-8 карт PCIe с лучшим воздушным потоком; и специализированные платформы HGX 6U-8U, несущие 8 модулей SXM (класс Dell PowerEdge XE9680, класс HPE Cray, системы Supermicro HGX). Шасси, в которое карты помещаются, и шасси, которое охлаждает их под длительной нагрузкой, - не одно и то же.

Питание - скрытое ограничение

Флагманский узел с 8 GPU потребляет под нагрузкой порядка 10 кВт. Это больше, чем выдерживают многие офисные серверные, и заметная доля бюджета стойки в колокейшене. До заказа подтвердите энергобюджет стойки и мощность PDU, холодопроизводительность под фактически выделяемое тепло и то, тарифицирует ли площадка выделенную мощность. Не раз мы пересчитывали покупателю конфигурацию с одного узла на 8 GPU на два узла по 4 GPU исключительно из-за ограничений площадки по питанию.

CPU, память, хранилище, сеть

Правила баланса, работающие из поколения в поколение: системная память как минимум равна суммарной памяти GPU (для обучения комфортно вдвое больше); NVMe-скретч достаточно быстрый, чтобы непрерывно кормить GPU; а для обучения на нескольких узлах - фабрика (высокоскоростной Ethernet или класс InfiniBand) под стать амбициям, потому что голодающий интерконнект оставляет дорогой кремний простаивать.

Экспортный контроль: планируйте комплаенс до заказа

Передовые ИИ-ускорители подпадают под экспортный контроль, прежде всего под правила Бюро промышленности и безопасности США, ограничивающие поставку GPU верхнего уровня для дата-центров в отдельные направления. Что это означает для покупателя на практике:

  • Доступность флагманских ускорителей различается по рынкам назначения; направления под ограничениями не могут законно получать отдельные SKU
  • По контролируемым моделям продавцы будут запрашивать сведения о конечном пользователе и конечном применении; воспринимайте это как признак законопослушного контрагента, а не как трение
  • Регулирование меняется; вашей отгрузкой управляет действующий свод правил, а не прошлогодний пересказ

Мы прямо пишем это в собственных условиях: заказы могут требовать сведений о конечном пользователе, и мы отказываемся от сделок, которые нельзя исполнить законно. Отдельное руководство этой серии подробнее разбирает правила для зарубежных покупателей.

Каналы закупки и сроки поставки

GPU-системы поставляются по трем широким каналам. OEM-аллокация (заказ сконфигурированной системы через каналы Dell, HPE, Supermicro или Lenovo) дает новые системы с гарантией, но сроки растягиваются при всплесках спроса. Вторичный рынок и рынок восстановленной техники движется быстрее всех и привлекательно оценивает прошлые поколения, а качество целиком держится на проверке. Торговые компании вроде нашей работают по обе стороны: находят новые или восстановленные GPU и платформы, проверяют и консолидируют их и отгружают с экспортной документацией из Гонконга или материкового Китая. Какой канал выигрывает, зависит от того, что для вас ограничение: бюджет, срок поставки или гарантийное покрытие.

Разобранный пример пути решения

Покупатель хочет дообучать открытые модели среднего размера и обслуживать несколько тысяч пользователей. Путь решения: нагрузка смешанная, обучение плюс инференс; объем памяти важнее пикового интерконнекта, поэтому 4-8 ускорителей PCIe класса H100/A100 выигрывают по цене у платы SXM; восстановленные карты A100 80GB с задокументированным происхождением вдвое сокращают бюджет на кремний; платформа - шасси 4U с резервированным питанием и NVMe-скретчем; проверка площадки подтверждает, что стойка потянет питание. Это полная, обоснованная спецификация, и каждый ее шаг - разговор, который мы еженедельно ведем с покупателями.

Частые вопросы

Чем GPU-сервер отличается от обычного сервера?

GPU-сервер построен вокруг питания и охлаждения ускорителей: более мощные блоки питания, воздушный поток, рассчитанный на карты или модули под длительной нагрузкой, и топология PCIe или SXM для их соединения. Обычный сервер иногда принимает одну или две карты; GPU-сервер спроектирован под полный комплект.

Покупать GPU-мощности или арендовать?

Аренда выигрывает для пиковых и исследовательских задач; покупка выигрывает, когда загрузка стабильна, важны гравитация данных или приватность, либо облачные цены на GPU превышают амортизированную стоимость железа при вашем режиме использования. Многие команды арендуют для прототипов и покупают для продакшена. Отдельное руководство серии разбирает эту арифметику.

Надежны ли восстановленные GPU для дата-центров?

Карты для дата-центров рассчитаны на непрерывную работу, и корректно выведенные из парка карты с результатами тестов по каждой единице живут долго. Риск сосредоточен в происхождении и тестировании, а не в самой идее кремния: покупайте товар с градацией, тестами и документами у ответственного продавца.

Сколько электричества нужно серверу с 8 GPU?

Флагманские узлы SXM с 8 GPU потребляют под нагрузкой порядка 10 кВт; сборки на PCIe меньше, но все равно намного больше обычной офисной проводки. Подтверждайте питание и охлаждение площадки до заказа, а не после доставки.

Можно ли позже проапгрейдить сервер с 4 GPU до 8 GPU?

На платформах PCIe - только если шасси, блоки питания и воздушный поток изначально рассчитывались под это. Базовые платы SXM - фиксированные конфигурации. Если рост вероятен, берите платформу побольше с меньшим числом карт и заполняйте ее со временем.

Закупаете это оборудование?

AXISLINK поставляет корпоративным покупателям по всему миру из Гонконга и материкового Китая, оформляя экспортную документацию и фрахт. Отправьте ваши требования и получите официальное коммерческое предложение, обычно в течение 24 часов.

Запросить коммерческое предложение