Все статьи
LLM API Comparison & Cost/

GPT-6.1 Sol: API, цены и возможности

Разбор стоимости, контекстное окно 1,05 млн токенов, прирост CoT и региональные ограничения.

4 мин чтения

GPT-6.1 Sol: API, цены и возможности — GPUniq
Данные на 6 источников

Черновик подготовлен AI-инструментами и отредактирован человеком. Характеристики и выводы проверены редактором GPUniq.

TL;DR

Стоимость GPT-6.1 Sol составляет $2.00 за 1 млн входных токенов и $10.00 за 1 млн выходных токенов для стандартных запросов. При объеме данных свыше 272 тыс. токенов цена возрастает до $4.00 за 1 млн входных и $20.00 за 1 млн выходных токенов. Модель поддерживает контекстное окно в 1 050 000 токенов, до 128 000 токенов на выходе, а также нативную работу с текстом и изображениями. Успешность выполнения тестов на управляемость цепочкой рассуждений (Chain-of-Thought) достигает 44.8%. Пользовательская дообучение (fine-tuning) не поддерживается. Режим Fast недоступен при использовании резиденции данных в ЕС, а Ultrafast работает только через эндпоинты в США или глобальные эндпоинты.

Сколько стоит API?

Цена GPT-6.1 Sol зависит от длины контекста вашего запроса. OpenAI применяет стандартные тарифы для контекста до 272 тыс. токенов. Превышение этого порога удваивает стоимость как входных, так и выходных токенов.

Уровень контекстаВходной тариф ($/1 млн токенов)Выходной тариф ($/1 млн токенов)
Стандарт (<=272 тыс. токенов)$2.00$10.00
Длинный контекст (>272 тыс. токенов)$4.00$20.00

Стоимость вычислений масштабируется при увеличении параметра интенсивности рассуждений (reasoning effort). API поддерживает пять уровней: low, medium, high, xhigh и max.

Не используйте параметры "none" или "minimal" из старых эндпоинтов. GPT-6.1 Sol отклоняет оба варианта. Установите минимальный уровень на "low".

{
  "model": "gpt-6.1-sol",
  "reasoning_effort": "high",
  "messages": [
    {"role": "user", "content": "Analyze the attached codebase for concurrency bugs."}
  ]
}

Насколько велико контекстное окно?

GPT-6.1 Sol предлагает контекстное окно в 1 050 000 токенов. Максимальный объем выходных данных составляет 128 000 токенов за один вызов.

Если ваш запрос достигает 273 000 токенов, OpenAI тарифицирует весь объем по ставке $4.00/$20.00. Следите за накоплением контекста. Старайтесь удерживать историю динамических сообщений в пределах 272 тыс. токенов, чтобы избежать перехода в более дорогой тарифный план.

Насколько лучше стали рассуждения?

Данные бенчмарков OpenAI указывают на заметный прогресс в отслеживании многошаговых цепочек логических выводов. Для вывода Chain-of-Thought (CoT) объемом от 750 до 1 250 токенов GPT-6.1 Sol демонстрирует показатель успешности управляемости 44.8%. Это превосходит результаты GPT-6 Sol (23.2%) и GPT-5.6 Sol (16.1%).

МодельУспешность управляемости CoT (750-1250 токенов)Бенчмарки безопасности (сложные промпты)
GPT-5.6 Sol~16.1%-
GPT-6 Sol~23.2%Базовый уровень
GPT-6.1 Sol~44.8%Выше в 5 из 8 категорий

Архитектура безопасности также претерпела изменения. В тестах на сложных промптах GPT-6.1 Sol показала лучшие результаты, чем GPT-6 Sol, в 5 из 8 ключевых категорий безопасности.

Настройка высоких параметров рассуждений приближает общее качество ответов к модели Astra от OpenAI при выполнении сложных задач по программированию и работе с командной строкой.

Какие существуют ограничения по модальности и дообучению?

Модель поддерживает ввод текста, вывод текста и ввод изображений. Нативная интеграция инструментов включает поиск в интернете, поиск по файлам, генерацию изображений, интерпретатор кода и среду выполнения shell.

Ввод аудио и видео официально не поддерживается. Используйте специализированную мультимодальную инфраструктуру для обработки видео и аудио потоков.

Пользовательское дообучение (fine-tuning) также не поддерживается. Управляйте ответами модели с помощью промпт-инжиниринга, строгих системных ограничений или переключателей интенсивности рассуждений.

import openai

client = openai.OpenAI()

# Fine-tuning is unsupported; use reasoning_effort and strict system prompts
response = client.chat.completions.create(
    model="gpt-6.1-sol",
    reasoning_effort="medium",
    messages=[
        {"role": "system", "content": "You are a specialized code auditor enforcing strict compliance rules."},
        {"role": "user", "content": "Review this deployment manifest."}
    ]
)

Поддерживается ли резиденция данных в ЕС?

Стандартные эндпоинты поддерживают резиденцию данных в ЕС. OpenAI по умолчанию отключает модель в рабочих пространствах Enterprise и Edu, пока администратор не активирует её вручную.

Выбор маршрутизации влияет на гарантии резиденции. Режим Fast полностью недоступен при соблюдении правил резиденции данных в ЕС. Режим Ultrafast работает исключительно через эндпоинты в США или глобальные эндпоинты, минуя гарантии хранения данных только в ЕС.

Настраивайте API-клиенты внимательно, чтобы не нарушить требования к трансграничной передаче данных.

# Call the standard completion endpoint without Fast or Ultrafast flags
curl https://api.openai.com/v1/chat/completions \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6.1-sol",
    "reasoning_effort": "low",
    "messages": [{"role": "user", "content": "Ping test"}]
  }'

Стоит ли переходить с GPT-6 Sol?

Агенты, требующие сложных рассуждений или активного использования инструментов, получат заметный прирост точности. Увеличение управляемости CoT с 23.2% до 44.8% снижает количество ошибок при выполнении пошаговых логических цепочек.

Стандартные рабочие нагрузки до 272 тыс. токенов тарифицируются по $2.00 за 1 млн входных и $10.00 за 1 млн выходных токенов.

Будьте осторожны с запросами более 272 тыс. токенов. Тарифы возрастают до $4.00 за вход и $20.00 за выход, что удваивает ваши расходы, если промпты не контролируются.

Для обновления не требуются новые SDK. Просто измените название модели на gpt-6.1-sol, замените неподдерживаемые флаги "none" или "minimal" на "low" и скорректируйте лимиты вашего приложения.

Читайте также в блоге GPUniq

Методология

Facts are compiled from the vendor's own announcement and documentation, linked below, at the time of writing; where the vendor hasn't published a number it is marked as such. GPUniq prices, when the model is already available here, come from our live catalog.

Источники

  1. 1.GPT-6.1 Sol Model | OpenAI API — OpenAI (просмотрено )
  2. 2.Addendum to GPT-6 Astra System Card: GPT-6.1 Sol — OpenAI (просмотрено )
  3. 3.Compare models | OpenAI API — OpenAI (просмотрено )
  4. 4.Pricing | OpenAI API — OpenAI (просмотрено )
  5. 5.OpenAI launches GPT-6 Sol and Luna, boasting lower cost and fewer mistakes — TechCrunch (просмотрено )
  6. 6.The 5 biggest announcements from OpenAI's blockbuster AI conference — Axios (просмотрено )

Нужны недорогие GPU под ваш проект?

Живые цены на аренду GPU и нужная карта за пару кликов — H100, A100, RTX 4090 и ещё 50+ моделей. Оплата картой РФ или по счёту.

Ещё в блоге GPUniq