RUEN
К статьям
Бесплатно Настройка

Какое железо купить, чтобы сдать видеокарты в аренду под нейросети

Редакция Vast Sale, 11 мин

Вопрос к нам приходит в двух формулировках: «что купить, чтобы сдать видеокарту в аренду под нейросети» и «хватит ли того, что уже стоит дома». Эта статья про первую. Задача — собрать конфигурацию под ~1 млн ₽ так, чтобы максимизировать доход и уверенно пройти верификацию Vast.ai, не наступив на известные грабли. Все замеры ниже — с нашего парка: TVT (4× RTX 4090, EPYC 7C13, Supermicro H12SSL-i), tv5080v (2× RTX 5080, EPYC 7K62, TYAN), tv50 (RTX 5090, Ryzen 9 9950X) и ещё три машины, включая клиентскую. Доход по каждой машине открыт на странице парка нашего сайта Vast Sale: витрину нашего парка

Порядок действий: сначала арифметика, потом корзина

Типовая ошибка — начать с выбора карты. Доход считается по формуле: число GPU × ваша ставка $/час × 730 часов × загрузка, причём ставку вы получаете полностью — наценка площадки добавляется клиенту сверху и из ваших денег не вычитается. Загрузка у нового хоста 30–50 %, у verified — 50–70 %, и именно она, а не модель карты, двигает результат сильнее всего. Прикинуть свою сборку можно в калькуляторе на калькулятор дохода, полный разбор расходов и окупаемости — в статье про экономику сервера разбор дохода по каждой карте.

Два ограничения проверяются до закупки, потому что способны отменить её целиком. Первое — электричество: сервер 4× RTX 4090 на серверной платформе даёт пик 2,2–2,4 кВт и под ML-нагрузкой устойчиво держит 1,8–2,0 кВт, а это отдельная линия 16 А со своим автоматом, а не бытовая розетка. Разбор площадки и электрики — сколько электричества ест сервер. Второе — канал: свой upload можно замерить за минуту на проверку канала, а требования площадки и ловушки российских тарифов разобраны в какой нужен интернет-канал.

Главные критерии

  • GPU — спрос и $/Вт: ставка на RTX 4090 / 5090. По медиане каталога на 25.09.2026 хост получает $0,37/час за 4090 и $0,47/час за 5090; младшие карты живут за счёт дешёвой закупки, а не за счёт ставки
  • RAM — 32–64 ГБ на карту, на серверной платформе ECC RDIMM. Мало памяти = меньше аренд: часть образов просто не разворачивается, а VM-режим забирает 80 % ОЗУ и требует столько же свободного
  • Диск — NVMe SSD: от 500 ГБ на сервер плюс 300 ГБ на каждую следующую карту. Диск ещё и продаётся отдельно: хранение идёт по $0,10–0,20 за ГБ в месяц и капает даже на остановленном инстансе
  • БП с запасом 20–30 %, 80+ Gold/Platinum, и считать от пика всего сервера, а не от карт: 4×450 Вт — это 1,8 кВт, а пик машины 2,2–2,4 кВт
  • Охлаждение — open-air рама с направленным продувом, GPU держать ниже 80–83 °C. Почти вся мощность уходит в тепло: сервер на 2 кВт греет комнату как два обогревателя
  • Сетевая карта — решает замер, а не вендор: дешёвые гигабитные Realtek (RTL8111/8168) на PCIe x1 режут upload до ~330 Мбит, а современные Realtek 2.5GbE и Intel в нашем парке дают честный канал. Замеры — в таблице ниже
  • CPU — многоядерный и с линиями PCIe: EPYC / Threadripper / Ryzen 9. Ядра нужны не для счёта, а чтобы четыре арендатора не толкались за один поток; линии — чтобы карты не сидели на x1
  • Материнская плата — с рабочим IOMMU и пунктом ACS в BIOS, иначе VM-режим потом не включить, а это заметная часть спроса

GPU: разрыв в цене больше, чем разрыв в доходе

Самое частое ожидание — что новая карта принесёт кратно больше старшей предыдущего поколения. По нашему августу (31 день, средняя загрузка 90 %) это не подтверждается.

GPUМедиана ставки хоста, $/часНаш доход за август, на картуЧто из этого следует
RTX 50900,47 (0,40–0,55)$376лучший доход с одного слота, и самый высокий спрос
RTX 40900,37 (0,33–0,45)$227рабочая лошадь парка: четыре карты дали $906 — 52 % дохода всего парка
RTX 50800,23 (0,20–0,25)$79–86две карты в одной машине — $86 на карту, одиночная — $79
RTX 3080 Tiнет в нашем срезе$114старая карта обошла новую 5080 на 44 %; объяснения, доказанного своими данными, у нас нет

Считайте: $376 против $227 — это в 1,66 раза, а не в два и не в три. Клиент платит за час аренды, а не за FLOPS, поэтому по отдаче на вложенный рубль новая карта разницу в цене закупки не отыгрывает. Зато она даёт больше денег с одного слота в корпусе и с одного киловатта — а слоты и киловатты у вас конечны. Отсюда практический вывод для сборки: под четыре карты берут 4090, под две — 5090. Полный разбор нашего месяца по каждой машине — разбор дохода по каждой карте.

Оговорка к таблице: это наши ставки и наши планы на конкретные машины, а не потолок карты. Пару 5080 мы сознательно держим дороже рынка, потому что машину скоро пересобираем и месячный контракт нам сейчас мешает, — отсюда её скромная строка. Прогноз для новой сборки считайте по медиане каталога, а не по нашим цифрам.

RAM, диск, БП: конкретные значения вместо «с запасом»

УзелМинимум под арендуКак у насПочему так
RAM32 ГБ на картуECC RDIMM по 32 ГБ, одинаковые, из одной партии64 ГБ на карту снимают отказы «insufficient free memory» при старте VM
Диск500 ГБ NVMe + 300 ГБ на каждую следующую картуотдельный NVMe под /var/lib/dockerкеш образов на 46,6 ГБ однажды вытеснил образ теста канала — тест начался с двухминутного pull и провалился
БПпик всего сервера + 20–30 %пик 2,2–2,4 кВт на машине 4×4090карты — это только 1,8 кВт из этого пика, остальное платформа, диски и вентиляторы
Сеть100/100 по требованию, 500/500 с запасомпо парку от 524/518 до 760/760 Мбиттребование — 2,6 Мбит/с на каждый 1 ГиБ суммарной VRAM, но не ниже 100 и не выше 500 Мбит
CPU8 ядер и линии PCIe под все картыEPYC 7C13, EPYC 7K62, Ryzen 9 9950Xна x1 карта работает, но арендатор видит это по скорости загрузки данных
Платарабочий IOMMU и ACSSupermicro H12SSL-i, TYANбез ACS карты не разъезжаются по отдельным группам IOMMU и VM-режим не включить

Отдельно про память — самую недооценённую строку сметы. VM-режим отдаёт гостю 80 % ОЗУ, и агент площадки требует столько же свободного в выводе free, без учёта page cache. На машине с 16 ГБ это 12,7 ГБ, и после нескольких docker pull свободного остаётся 11,8 ГБ: старт виртуалки падает с «insufficient free memory», хотя память формально есть. Сброс кешей лечит на месте, но решение принимается на этапе закупки.

Сетевая карта: судим по замеру, а не по вендору

Это единственный пункт сборки, где мы советуем не верить ни отзывам, ни маркировке на коробке. Вот что показал наш парк.

Чип / машинаНаш замер, upload / downloadКомментарий
Realtek RTL8111/8168 на PCIe x1upload срезан до ~330 Мбиттариф был гигабитный; ограничение в чипе и линии, а не у провайдера
Realtek 2.5GbE706 / 625 Мбитдешёвый чип, честный канал — «Realtek» сам по себе не диагноз
Intel I225-V524 / 518 Мбитдороже, а результат ниже, чем у Realtek 2.5GbE выше
Клиентская машина после переезда~760 / 760 Мбит локально, 578 / 595 в отчёте биржибиржа показывает скользящее среднее, а не последний замер
Про скользящее среднее: площадка обновляет скорость машины как 0,9 × старое значение + 0,1 × новый замер, а сам замер по крону выпадает примерно раз в девять часов. После смены провайдера или переезда прогоняйте тест серией: у нас на выход к 578/595 ушло десять прогонов. И ещё: NIC-оффлоады (GSO/TSO/GRO) на канале за VPN-туннелем дают потери — их отключение поднимало скорость на 40–55 %, тогда как на прямом канале они, наоборот, полезны.

Три варианта под 1 млн ₽

  • A — один мощный сервер 4× RTX 4090 (~950 тыс. ₽): максимум дохода и простота — одна платформа, один канал, одна линия электричества, один набор грабель. Риск концентрации: любая поломка останавливает весь доход. VM доступен после D3cold-закалки карт
  • B — два сервера 2×(2× RTX 4090) (~1 млн ₽): диверсификация — авария забирает половину дохода, а не весь. Дороже (две платформы, два БП, две линии) и сложнее в обслуживании: всё, что вы делаете руками, вы делаете дважды
  • C — 2× RTX 5090 (~820 тыс. ₽): топ-спрос и лучший доход со слота, VM возможен, остаётся около 180 тыс. ₽ резерва — на третью карту, нормальный ИБП или запасные комплектующие
ВариантGPUВложенияПик мощностиVMПрогноз дохода при 50 %Профиль
A4×4090~950 000 ₽2,2–2,4 кВтда*~$540/месмакс. доход, просто
B2×2×4090~1 000 000 ₽2 × ~1,3 кВтда*~$540/месдиверсификация
C2×5090~820 000 ₽~1,4 кВтда*~$343/местоп-спрос, резерв
Столбец с прогнозом — это арифметика по медиане каталога и загрузке 50 %, а не обещание: 4 × $0,37 × 730 × 0,5 ≈ $540 и 2 × $0,47 × 730 × 0,5 ≈ $343. Наш реальный сервер 4×4090 дал в августе $906, но при загрузке 90 % и на verified-машине с двухлетней историей. Новый хост стартует с 30–50 %, поэтому первые месяцы считайте по нижней границе. Пик мощности для вариантов B и C — оценка по нашим платформам; точное число зависит от конкретной сборки и настроек power limit.

Как мы выбираем между A и B. Первая машина, которую собирают сами, — это A: одна платформа означает один туннель, один канал, один комплект прошивок и одну процедуру, которую вы осваиваете. Диверсификация в B окупается, когда процедура уже отработана, а не изучается. C — для площадок, где ограничена мощность или место: две карты вместо четырёх при сопоставимом спросе и вдвое меньшем тепле.

Материнская плата и VM-режим: что проверить до оплаты

VM-режим — это аренда виртуальной машины с проброшенной картой. Он поднимает ставку и отсекает часть конкурентов, но требует платы, которая умеет разводить карты по отдельным группам IOMMU. Проверить это можно только на собранном сервере, поэтому до покупки смотрят в документацию платы и в чужой опыт. Установка системы по шагам разобрана в установку Ubuntu под Vast.ai, а сама проверка занимает три команды:

code
ls /sys/kernel/iommu_groups | wc -l        # 0 = IOMMU выключен в BIOS
lspci -nn | grep -i nvidia                 # PCI-адреса и ID карт
for d in /sys/kernel/iommu_groups/*/devices/*; do echo "${d#*iommu_groups/}"; done | sort

Три вещи из нашей практики. На tv5080v пункт ACS нашёлся не там, где его ищут: AMD CBS → NBIO, отдельная вкладка, и сохранять настройки в этом BIOS надо по F4, а не F10. Пункта AER там нет вообще — он скрыт в Auto и работает. На tv80 обесточивание сбросило CMOS, вместе с ним отключился VT-d, и VM-клиенты перестали стартовать без внятной ошибки; ловится это первой же строкой из блока выше — если групп ноль, дело не в драйвере. И третье: на многокарточной машине проверка площадки видит четыре одинаковые 4090 как одну, поэтому доверять её вердикту вслепую не стоит — мы проверяем карты по UUID.

И про RTX 4090 с её репутацией. «Неизлечимого reset-бага» у неё нет: FLR-баг относится к картам Blackwell. Карта действительно может не вернуться из проброса, если при отвязке от гостя уходит в глубокий сон (D3cold) — поднимает только холодная перезагрузка, и число карт в сборке тут ни при чём. Лечится закалкой — правилами устройства, которые запрещают глубокий сон. После неё VM работает: на сервере с 4×4090 мы сняли закалку контролируемой лестницей 1 → 2 → 3 → 4 карты в VM без единого сброса, VM включён с 20.09.2026. Для 50-й серии обязательны -open драйвер, весь nvidia-стек на apt-mark hold и nvidia_drm.modeset=0 pcie_aspm=off в GRUB. Вся процедура включения VM на многокарточной сборке — от условий допуска до первого клиента — разобрана по шагам здесь: VM-режим на многокарточной машине

Где мы ошиблись

Мёртвая планка памяти. На сервере с 4090 машина сыпалась, а memtest молчал — прошёл чисто. Доказать неисправность удалось только перестановкой модулей по слотам и включением swap: под свопом картина повторялась ровно за одним модулем, а сам слот оказался цел. Из этого два вывода для закупки: брать одинаковые модули одной партии, иначе перестановка ничего не докажет, и сразу купить один запасной — он дешевле суток простоя четырёх карт.

Поверили вендору сетевой карты. Гигабитный тариф, гигабитная карта, upload 330 Мбит. Пока мы искали проблему у провайдера, машина проигрывала в выдаче симметричным нодам. Сейчас порядок обратный: сначала замер, потом выводы.

Не проверили свободное место до установки. На клиентской машине кеш образов разросся до 46,6 ГБ и вытеснил образ теста канала: тест площадки стартовал с двухминутного pull и провалился — единственный провал за весь журнал этой машины. Диск был не мал, мал был свободный остаток, и это разные вещи в смете.

Заложили в план доход с трафика. Выставили $3 за ТБ, клиент в VM-режиме прокачал 8,32 ТБ за 37 часов — в отчёте Upload $0.00 / Download $0.00. Аренды в режиме виртуальной машины площадка по трафику не тарифицирует вообще, тогда как у соседней docker-машины начисления идут. Вывод для сборки: быстрый канал окупается загрузкой, а не продажей трафика, а VM-нода с жирным каналом дополнительно притягивает тех, кому нужен не GPU, а транзит.

Выбрали VPS не по тому признаку. Туннель у нас идёт через зарубежный VPS, и download с Docker Hub упирался не в наш канал: трафик душат по автономной системе хостера — OVH и M247 у нас задушены, Private Layer чист. Конфигурация туннеля тут ни при чём, и мы потеряли время, крутя её. Хостера под туннель надо выбирать замером, ровно как и сетевую карту.

Что идёт не так после закупки

Это уже не про выбор железа, но знать об этом надо до покупки: простой стоит денег, и вот на чём мы его набирали.

  • Залипает контроллер площадки: машина работает, а биржа считает её неактивной. 25 августа так встали четыре наших рига, 5 сентября — все шесть за один день. Лечится сбросом файла /var/lib/vastai_kaalia/controller_connection
  • VM-флаг стирает сама площадка: ежечасный крон снимает признак поддержки VM, если все карты машины отданы в виртуалки, — проверка ищет у карты узел drm/renderD*, которого у проброшенной карты нет. tv5080v из-за этого простоял без VM десять дней, с 11.09 19:22 до 21.09 17:04
  • Агент машины зависает на обращении к веб-API площадки (VerifySendMachInfo) — блокирующий HTTP-вызов без таймаута. Снаружи это выглядит как живая машина, которая перестала отправлять heartbeat
  • Сетевой стек хоста способен уронить домашний роутер: наш xray стартовал до получения адреса по DHCP, пакет к VPS проваливался в собственный туннель, и 28 тысяч сокетов забили conntrack роутера — 20 сентября это вызвало ложный переход четырёх ригов на резервный VPS
  • Сброс CMOS отключает VT-d, и VM-клиенты перестают стартовать без внятного сообщения об ошибке

Ни одна из этих проблем не решается сама. Разбор залипшего контроллера — разбор залипшего контроллера, резервный туннель и переход на второй VPS — резервный туннель, команды для диагностики — шпаргалку по командам Linux.

Чек-лист перед оплатой

  • Доход посчитан по медиане каталога и загрузке 30–50 %, а не по чужим 90 %: калькулятор дохода
  • Upload замерен и сверен с требованием 2,6 Мбит/с на каждый 1 ГиБ суммарной VRAM: проверку канала
  • Выделенная мощность площадки известна, отдельная линия 16 А на сервер есть или будет
  • В документации платы найдены IOMMU и ACS — если планируете VM-режим
  • RAM: 32–64 ГБ на карту одинаковыми модулями одной партии плюс один запасной
  • NVMe с запасом: 500 ГБ на сервер плюс 300 ГБ на каждую следующую карту
  • БП посчитан от пика всего сервера, а не от суммы карт
  • Решено, где машина будет стоять летом и куда пойдёт горячий воздух
  • Трафик VM-аренд в модель дохода не заложен — он не тарифицируется
Не хотите проходить этот путь замерами и граблями? Мы подбираем конфигурацию под ваш тариф на электричество и ваш канал, собираем машину и выводим её на биржу под ключ — до первого ордера. Заявка на наши услуги, первая консультация бесплатна. Доход нашего парка по каждой машине открыт на витрину нашего парка и обновляется раз в час, так что сверять есть с чем.

Нужна помощь с переходом?

Сделаем настройку под ключ с гарантией запуска.

Смотреть услуги
© Vast Sale · Источник: https://vast.sale/articles/a10
Копирование, пересказ и обработка ИИ-системами допускаются только с сохранением активной ссылки на https://vast.sale