All articles
GPU Cloud Selection & Pricing/

Цены на аренду GPU взлетели на 55% за 30 дней

RTX 4090 подскочила на 113,5% до $1,01/час, а RTX 5090 выросла на 55%-данные рынка по 6817 отслеживаемым устройствам выявляют дефицит предложения и перегрев использования.

8 minutes read

A close-up of multiple GPU cards (RTX 5090, A100) arranged in ascending height order like a price chart, with dramatic red lighting casting sharp shadows that emphasize the upward trajectory, shot against a dark background with subtle — GPUniq
Данные на 1 источник

Черновик подготовлен AI-инструментами и отредактирован человеком. Характеристики и выводы проверены редактором GPUniq.

TL;DR

Цены на аренду RTX 4090 подскочили на 113,5% за 30 дней до медианы $1,01/час. RTX 5090 выросла на 55% до $1,15/час. Оба показателя - самые крутые скачки с Q2 2026, вызванные использованием на 80-100% премиум-потребительских и дата-центровых GPU. GPUniq GPU Rental Price Index (21 сентября 2026) отслеживает 98 моделей GPU на 6817 единиц. RTX 4080 Super имеет нулевые доступные предложения при 100% использовании. Полный рынок охватывает диапазон цен в 87 раз: от $0,08 до $7,01/час.


Самые крупные скачки цен

RTX 4090 - главная новость: +113,5% за 30 дней, достигнув медианы $1,01/час. Самый крупный скачок цены одной модели в текущем датасете GPUniq.

RTX 3090 идёт вторая с +95,5%. Медиана всё ещё только $0,30/час, поэтому абсолютный прирост небольшой, но процент показывает, что оборудование старого поколения попадает в ту же волну спроса. Это нас удивило.

A100 - единственный выброс в другую сторону. Упала на 10% до $1,64/час несмотря на 90% использование. Высокое использование обычно толкает цены вверх. Наиболее вероятное объяснение: корпоративные контракты поглощают ёмкость A100 по фиксированным ставкам, поэтому спотовый рынок сжимается, а не переоценивается вверх.

Полная картина для наиболее отслеживаемых моделей, данные GPUniq от 21 сентября 2026:

GPUМедиана $/часМин $/часИзменение за 30д %Использование %Доступные предложения
RTX 4080 Supern/an/an/a1000
H2007.014.97n/a9045
H1004.372.61n/a8061
RTX PRO 6000 Max-Q2.411.61n/a9018
RTX PRO 60002.311.66+13.480141
A1001.640.60-10.09076
RTX 50901.150.60+55.060585
RTX 40901.010.60+113.580244
RTX 30900.300.19+95.59075
RTX 5060 Ti0.250.19+37.69048
RTX A40000.160.13n/a8052
RTX 30600.100.08n/a80105

Самый дешёвый доступный GPU сейчас

RTX 3060 начинается с $0,08/час, медиана $0,10/час. Это минимум по всем 98 моделям. 105 активных предложений, 80% использование - не тривиально доступно, но далеко от распроданности.

RTX A4000 - следующий уровень на $0,13-$0,16/час. Полезен для инференс-задач, требующих больше VRAM, чем 3060, но без прыжка в ценовой диапазон $1,00+.

Бюджетный уровень ($0,08-$0,30/час) работает при 60-80% использовании. Этот запас важен: вы можете реально найти ёмкость, когда она вам нужна, чего нельзя сказать о чём-либо при 80-100% использовании прямо сейчас.

Если стоимость - главное ограничение и вы запускаете базовый инференс или лёгкую тонкую настройку, RTX 3060 на $0,10/час - честный ответ. 3090 на $0,30/час - лучший GPU, но +95,5% движение за 30 дней предполагает, что разрыв закрывается быстрее, чем ожидалось.


Насколько дефицитны премиум-GPU?

RTX 4080 Super рассказывает всю историю: 100% использование, нулевые доступные предложения, 219 отслеживаемых единиц. Полный распродаж.

H200 близко позади. 90% использование, только 45 предложений на 353 отслеживаемых единиц, $7,01/час медиана. Почти исчезла.

RTX 5090 - фактически самый доступный премиум-GPU прямо сейчас. 585 активных предложений из 1632 отслеживаемых единиц, 60% использование. Если вам нужны серьёзные вычисления и вы хотите вариативности, вот где существует предложение.

Паттерн последователен: дефицит толкает цену, но не всегда предсказуемо. RTX 4090 старше 5090 и дешевле в час, но выросла больше за 30 дней, потому что её использование плотнее (80% vs 60%) и доступный пул меньше (244 предложения vs 585).


Почему RTX 4090 опередила RTX 5090 в приросте?

Три фактора работают вместе.

Предложение. RTX 4090 достигла 80% использования при 244 доступных предложениях. RTX 5090 находится на 60% с 585 предложениями. Более плотный инвентарь означает, что любой скачок спроса сильнее и быстрее бьёт по цене.

Производственная блокировка. Модели и пайплайны, обученные на оборудовании RTX 4090, не мигрируют легко. Если ваш инференс-стек настроен на расположение памяти 4090 и характеристики CUDA, вы продолжаете арендовать 4090. Этот липкий спрос сжимает доступный пул даже когда 5090 технически превосходит.

Крах и восстановление минимума. Минимум цены 4090 упал в августе 2026 и сейчас восстанавливается. Крах минимума, за которым следует восстановление, производит завышенные процентные приросты даже если абсолютная цена остаётся ниже 5090. Движение с $0,47/час на $1,01/час - это +115%. Движение с $0,74/час на $1,15/час - это +55%. 5090 никогда не имела того же краха минимума, поэтому её восстановление выглядит меньше в процентных терминах.

Лестница стоимости поколений также стоит внимания: RTX 3090 на $0,30/час, RTX 4090 на $1,01/час, RTX 5090 на $1,15/час. Прыжок 3090-на-4090 - это 3,4x почасовой стоимости. Шаг 4090-на-5090 - только 14%. Это сжатие на вершине - новое явление.


H100 vs RTX 5090 для стоимости инференса

Почасово RTX 5090 на $1,15/час примерно в 3,8 раза дешевле H100 на $4,37/час.

Но почасовая ставка - не то же самое, что стоимость на инференс. H100 имеет более быструю пропускную способность памяти, NVLink для масштабирования на несколько GPU и MIG-разбиение для мультитенантных рабочих нагрузок. Для однотенантного пакетного инференса модели, которая помещается в 24 ГБ, RTX 5090 побеждает по стоимости. Для real-time-сервинга, обрабатывающего десятки одновременных запросов на нескольких GPU, архитектура H100 отбивает часть этой премии.

Практическое разделение:

  • Пакетный инференс, одна модель, толерантная к задержкам: RTX 5090 на $1,15/час
  • Real-time-сервинг, мультитенантный, чувствительный к задержкам: H100 на $4,37/час или H200 на $7,01/час
  • Бюджетный пакетный инференс, где модель помещается в 24 ГБ VRAM: RTX 3090 на $0,30/час

Одно, что данные сделали ясным: минимум H100 - $2,61/час. Самое дешёвое предложение H100 в 2,3 раза дороже медианы RTX 5090. Нет перекрытия в ценовых диапазонах. Если ваша рабочая нагрузка работает на потребительском оборудовании, решение прямолинейно.


Что движет волатильностью?

Сентябрь - исторически пиковый спрос на аренду GPU. Команды, которым нужны тонко настроенные модели, готовые к Q4, запускают обучение сейчас. Это не спекуляция - это показывается в данных использования каждый год примерно в это время.

Картина использования от GPUniq резкая. RTX 4080 Super на 100%, H200 на 90%, A100 на 90%, RTX 3090 на 90%, RTX 5060 Ti на 90%. Пять разных классов GPU выше 85% одновременно указывает на структурное давление, а не на сжатие одной модели.

6817 общих единиц на 98 моделях звучит как много. Это не так. RTX 4080 Super - 219 единиц всего. H200 - 353 единицы. Это тонкие рынки, где несколько сотен дополнительных запросов на аренду могут переместить использование с 70% на 100% за дни.

Блокировка провайдером усугубляет это. Старые модели GPU, удерживаемые долгоживущими производственными рабочими нагрузками, не возвращаются в пул аренды между заданиями. RTX 3090 на 90% использовании с только 75 доступными предложениями - хороший пример: большинство из 647 отслеживаемых единиц привязаны к существующим арендаторам.


Как зафиксировать стабильные ставки GPU

Избегайте чего-либо при 90-100% использовании, если вам нужны предсказуемые цены. RTX 4080 Super имеет нулевые предложения. A100, H200 и RTX 3090 все на 90%. Нет позиции для переговоров на этих рынках прямо сейчас.

RTX 5090 на 60% использовании и 585 активных предложениях - наиболее защищённый выбор для премиум-вычислений. Цены выросли на 55% за 30 дней, но запас использования означает меньше давления для другого скачка в ближайшем будущем по сравнению с 4090.

Для базовых рабочих нагрузок - предварительная обработка данных, инференс малых моделей, пакетные задания, не чувствительные к задержкам - RTX 3060 на $0,10/час по 30-дневному контракту - самый дешёвый способ зафиксировать ёмкость. 105 активных предложений при 80% использовании означает, что вы можете реально её получить.

Конкретные шаги:

1. Определите рабочие нагрузки под 12 ГБ VRAM и переместите их на RTX 3060 или A4000.
2. Для чего-либо, требующего 24 ГБ+, забронируйте RTX 5090 сейчас, пока использование на 60%.
3. Избегайте спотовых цен на RTX 4090 и RTX 4080 Super, пока использование не упадёт ниже 75%.
4. Проверяйте индекс GPUniq ежедневно через сентябрь — 30-дневные числа изменений движутся достаточно быстро, что неделя задержки меняет расчёты.

Движение RTX 4090 примерно с $0,47 на $1,01/час произошло достаточно быстро, что каждый, кто не следил за индексом, платил двойную цену, не зная, что это приближается.


Медианная почасовая ставка по всем GPU

Полный диапазон: $0,08/час (RTX 3060) до $7,01/час (H200). Это 87x разброс на 98 моделях.

Большая часть распределения находится в диапазоне потребительских GPU. RTX 5090 на $1,15/час - разумный среднерыночный ориентир для соотношения стоимости и производительности. Ниже этого вы торгуете вычислениями на экономию. Выше этого вы платите за корпоративные функции, пропускную способность памяти или многоGPU-ткань.

Корпоративные выбросы - класс H200 и A100 - представляют менее 5% предложений аренды, но доминируют в заголовках, потому что абсолютные суммы в долларах большие. Восемь H200 на неделю - это более $9000. Это не бюджет, который большинство команд авторизуют без конкретного обоснования.

Дешёвый конец всё ещё дешёвый. Середина дорожает быстро. Вершина либо распродана, либо оценена для команд с серьёзными бюджетами. Если вы запускаете реальные обучающие рабочие нагрузки, но не в масштабе гиперскейлера, RTX 5090 на $1,15/час - вероятно, где вы приземлитесь - и зафиксировать это перед тем, как использование поднимется выше 70%, - это правильный ход.

Методология

Prices are the minimum and the median hourly rate across GPUniq offers that were rentable at the moment of the snapshot, per GPU (an eight-card host counts as eight). Retail rates, platform margin included. The 30-day change compares the first and last daily median in the window.

Источники

  1. 1.GPUniq GPU price indexGPUniq (просмотрено )

Want cheap GPUs for your next project?

Browse live GPU prices and rent the right card in seconds — H100, A100, RTX 4090, and 50+ more models.

More from the GPUniq blog