Перейти к содержимому

Аренда GPU

У каждой модели GPU одна фиксированная цена за час. На странице Арендовать GPU видно, сколько карт каждой модели свободно прямо сейчас и сколько максимум доступно на одном сервере — это максимум, который можно заказать в один сервер.

  • Количество GPU. В сервере может быть от 1 до 8 GPU, все на одной машине. Цена умножается на количество. Как несколько GPU работают вместе — в разделе Несколько GPU.
  • CPU и RAM делятся пропорционально арендованным GPU: 1 GPU из 4 на машине получает четверть ядер и четверть от 90% RAM (не меньше 1 ядра и 2 ГБ). Разделяемая память (/dev/shm) — половина вашей RAM, до 32 ГБ.
  • Платформа сама подбирает лучшую машину: сначала хосты высшего уровня, затем более надёжные, затем с самой плотной упаковкой.

Шаблон или модель могут требовать минимальную версию CUDA (драйвер NVIDIA у хоста). Машины со старым драйвером пропускаются автоматически.

Шаблон — это готовый Docker-образ с нужной командой, портами и настройками, см. Шаблоны. Некоторые шаблоны запускают модель (для vLLM, SGLang и эмбеддингов она обязательна, ComfyUI может стартовать с моделью по желанию). Показываются только модели, чья суммарная потребность в видеопамяти помещается на выбранные GPU, см. Модели.

Шаблон Свой Docker-образ запускает любой публичный образ (например ghcr.io/me/app:1.2) с его собственными entrypoint и командой.

У каждого шаблона свой размер диска по умолчанию (20–100 ГБ). Можно указать от 10 до 2000 ГБ. Диск — это ваш постоянный каталог /workspace: он сохраняется при перезапуске и остановке.

Веса моделей не занимают ваш диск: они монтируются только для чтения в /models/<id-модели>.

Можно добавить до 50 переменных (имена в ВЕРХНЕМ_РЕГИСТРЕ, значения до 4 КБ). Частые примеры:

Переменная Зачем
HF_TOKEN Ваш токен Hugging Face. Обязателен для закрытых (gated) моделей: Llama, Gemma.
WANDB_API_KEY Логирование обучения в Weights & Biases.

Значения переменных, в имени которых есть TOKEN, KEY, SECRET или PASSWORD, скрываются в кабинете и в API.

Платформа всегда задаёт:

Переменная Значение
GYSGA_INSTANCE_ID Идентификатор сервера, например i-abc12345.
GYSGA_TOKEN Случайный токен для веб-интерфейсов (Jupyter использует его для входа). Показан в панели подключения.
Статус Что происходит Оплата
creating GPU зарезервированы, ждём машину хоста. нет
pulling Хост скачивает Docker-образ и модель (прогресс виден). нет
starting Контейнер создаётся или перезапускается. нет
running Контейнер работает. да
stopping Запрошена остановка. нет
stopped Контейнер остановлен, GPU освобождены, данные сохранены. нет
unreachable Машина хоста пропала из сети. нет
error Что-то пошло не так (например, образа не существует). Причина в сообщении. нет
destroying → destroyed Контейнер и данные удаляются. нет

Каждое изменение записывается в журнал событий сервера — он виден в кабинете и через API.

  • Оплата посекундная, только пока сервер в статусе running.
  • Если хост пропал из сети, оплата приостанавливается (unreachable) и возобновляется, только когда сервер снова работает. Время простоя не оплачивается.
  • Когда баланс заканчивается, сервер автоматически останавливается (но не удаляется). Пополните баланс и запустите его снова.
  • Для запуска нужно, чтобы баланса хватало минимум на час.
  • Цена работающего сервера фиксируется при запуске; изменения цен касаются только новых серверов.
  • Остановить — оплата прекращается сразу. Данные в /workspace остаются на машине хоста.
  • Запустить — сервер снова стартует на той же машине (там его данные). Если её GPU за это время заняли, появится «GPU этой машины заняты»: попробуйте позже или создайте новый сервер.
  • Остановленные серверы удаляются автоматически через 7 дней.
  • Удалить — удаляет контейнер и /workspace. Это необратимо.