Все статьи
LLM API Comparison & Cost/

Claude Opus 5.5: на 40% ниже затраты на вычисления, сопоставимая производительность

Последняя модель Anthropic снижает затраты на вывод до $4/$20 за миллион токенов при производительности, соответствующей Claude Fable 5.1 - с контекстом 1M и выводом на 30% быстрее.

5 мин чтения

Claude Opus 5.5: на 40% ниже затраты на вычисления, сопоставимая производительность — GPUniq
Данные на 3 источника

Черновик подготовлен AI-инструментами и отредактирован человеком. Характеристики и выводы проверены редактором GPUniq.

TL;DR

Claude Opus 5.5 стоит $4 за миллион входных токенов и $20 за миллион выходных токенов. Anthropic указывает примерно на 40% снижение затрат на вычисления и эксплуатацию по сравнению с Opus 5. Производительность соответствует Claude Fable 5.1 на большинстве задач, вывод генерируется примерно на 30% быстрее, контекстное окно 1M токенов сохранено.

Разбор цен

Здесь важны пять позиций.

ПозицияЦена, $/M токенов
Входные токены$4.00
Выходные токены$20.00
Чтение кэша$0.20
Запись кэша на 5 минут$5.00
Запись кэша на 1 час$8.00

Чтение кэша по $0.20/M в 20 раз дешевле стандартного входа. Именно в этом разрыве накапливаются реальные сбережения в многооборотных или RAG-рабочих нагрузках. Окно 5 минут стоит $5.00/M для записи; если сеанс длится дольше, альтернатива - уровень сохранения на 1 час по $8.00/M. Ни один из них не бесплатен, поэтому считайте: стоимость записи окупается только если один и тот же кэшированный префикс читается достаточно много раз.

Производительность в сравнении с альтернативами

По официальному объявлению Anthropic, Opus 5.5 обеспечивает производительность, сопоставимую с Claude Fable 5.1 на большинстве задач. Это значимое утверждение: модель с примерно на 40% ниже затратами на вычисления и эксплуатацию, чем её предшественник, соответствует отдельной линейке моделей.

Генерация выходных данных примерно на 30% быстрее, чем Opus 5, согласно тому же источнику. Также упоминается улучшение возможностей в виде меньшего количества потребляемых токенов на задачу.

В Automated Behavioral Audit от Anthropic Opus 5.5 набирает наивысший балл среди всех протестированных моделей Claude на сегодняшний день. Это набор для выравнивания и безопасности, а не общий бенчмарк рассуждений, поэтому учитывайте это соответственно.

ПараметрOpus 5.5Opus 5
Цена входа, $/M$4.00-
Цена выхода, $/M$20.00-
Контекстное окно1M токенов-
Макс. выход на запрос128K токенов-
Скорость вывода~на 30% быстреебазовая
Behavioral Auditнаивысший-

Максимальный выход составляет 128K токенов на запрос или до 300K через бета-версию Batch API для выходов, согласно Anthropic.

Доступность

Выпущена 22 сентября 2026 года. ID модели: claude-opus-5-5.

Доступна на:

  • Claude API (все клиенты)
  • Amazon Bedrock как anthropic.claude-opus-5-5
  • Google Cloud как claude-opus-5-5
  • Microsoft Foundry как claude-opus-5-5
  • Claude.ai на планах Pro, Max, Team и Enterprise

Если конкретная платформа ограничивает функцию, проверьте документацию этой платформы напрямую.

Адаптивное мышление включено по умолчанию и не может быть отключено. Вы можете управлять им через параметр усилия, но полностью отключить его невозможно.

Должен ли я переходить с Opus 5?

Для высокообъёмного вывода математика проста. Anthropic указывает примерно на 40% снижение затрат на вычисления и эксплуатацию по сравнению с Opus 5, что может привести к значительной экономии в масштабе ещё до использования кэширования. Добавьте кэширование подсказок в типичный RAG-конвейер и сэкономьте ещё больше.

Нет критических изменений в основном контракте API. ID модели меняется, и это в основном всё для стандартных текстовых рабочих нагрузок. Постоянное включение адаптивного мышления - главное изменение поведения: простые запросы, которые ранее возвращались быстро, могут потребить больше токенов для внутреннего рассуждения. Планируйте это.

Я рекомендую начать с теневого тестирования на вашем существующем наборе подсказок перед переводом производственного трафика. Граничные случаи в структурированном выводе или использовании инструментов - это место, где обычно появляются неожиданности.

Что ломается при обновлении?

Три вещи, которые нужно проверить перед переключением.

Во-первых, инструмент computer_20251124 удалён. Если вы используете компьютерное использование, обновитесь до поддерживаемой версии инструмента согласно документации Anthropic. Вызовы с использованием старого ID инструмента будут отклонены.

Во-вторых, адаптивное мышление не может быть отключено. Если ваше приложение зависит от предсказуемых низколатентных ответов на простые запросы, протестируйте фактическую задержку под новой моделью. Накладные расходы на рассуждение реальны.

В-третьих, стоимость записи кэша может отличаться от более ранних бета-ставок. Если вы построили модели затрат на основе более ранних бета-цен, пересчитайте по таблице выше.

Блоки мышления привязаны к модели и контексту разговора и не могут быть отредактированы. Дата знаний - июнь 2026 года.

# Старый вызов инструмента - будет ошибка на Opus 5.5
tool = {"type": "computer_20251124", ...}

# Используйте это вместо этого
tool = {"type": "computer_20250102", ...}

Как кэширование экономит деньги

Чтение кэша по $0.20/M в сравнении со стандартным входом по $4.00/M - это 20-кратная разница. Для любой подсказки с большим статическим префиксом этот разрыв быстро накапливается.

Конкретный пример с использованием таблицы цен: системная подсказка из 50K токенов, прочитанная 100 раз, стоит $20.00 по стандартным входным ставкам (50,000 x 100 x $4/M). С чтением кэша это стоит $1.00 (50,000 x 100 x $0.20/M). Запись кэша - это одноразовая стоимость $0.25 (50,000 x $5/M). Чистая экономия в этом сеансе: $18.75.

Окно 5 минут охватывает большинство интерактивных сеансов. Для пакетных заданий, работающих дольше, уровень сохранения на 1 час по $8.00/M стоимости записи стоит того, если один и тот же префикс появляется во многих запросах в этом окне.

Многооборотные разговоры получают наибольшую выгоду. Каждый оборот, который повторно использует накопленный контекст, избегает повторного выставления счёта за полную историю по входным ставкам.

Поддержка облачных платформ

Несколько платформ подтверждены как доступные согласно объявлению Anthropic.

ПлатформаID моделиПримечания
Claude APIclaude-opus-5-5Все клиенты
Amazon Bedrockanthropic.claude-opus-5-5Вывод по требованию
Google Cloudclaude-opus-5-5-
Microsoft Foundryclaude-opus-5-5-

Для цен на выделенную пропускную способность на Bedrock или скидок на обязательства на Vertex проверьте эти платформы напрямую.

Расчётная стоимость за задачу

Используя опубликованные ставки и простую арифметику токенов:

ЗадачаПрибл. входные токеныПрибл. выходные токеныРасчётная стоимость, $
Простой запрос1,0005000.014
RAG с кэшированной подсказкой50K кэшировано + 1K свежих5000.024
Анализ длинного контекста100,00010,0000.60
Пакетное задание, за запрос5,0002,0000.060

Строка RAG предполагает, что подсказка из 50K токенов уже кэширована (чтение по $0.20/M) и только 1K свежих токенов выставляются по $4.00/M. Эти числа иллюстративны; ваши подсчёты токенов будут отличаться.

Методология

Facts are compiled from the vendor's own announcement and documentation, linked below, at the time of writing; where the vendor hasn't published a number it is marked as such. GPUniq prices, when the model is already available here, come from our live catalog.

Источники

  1. 1.Claude Opus 5.5 – Anthropic announcement — Anthropic (просмотрено )
  2. 2.Claude Opus 5.5 – Claude Platform Docs overview — Anthropic (просмотрено )
  3. 3.Claude Opus 5.5 – Amazon Bedrock model card — Amazon Web Services (просмотрено )

Нужны недорогие GPU под ваш проект?

Живые цены на аренду GPU и нужная карта за пару кликов — H100, A100, RTX 4090 и ещё 50+ моделей. Оплата картой РФ или по счёту.

Ещё в блоге GPUniq