Черновик подготовлен AI-инструментами и отредактирован человеком. Характеристики и выводы проверены редактором GPUniq.
TL;DR
Claude Opus 5.5 стоит $4 за миллион входных токенов и $20 за миллион выходных токенов. Anthropic указывает примерно на 40% снижение затрат на вычисления и эксплуатацию по сравнению с Opus 5. Производительность соответствует Claude Fable 5.1 на большинстве задач, вывод генерируется примерно на 30% быстрее, контекстное окно 1M токенов сохранено.
Разбор цен
Здесь важны пять позиций.
| Позиция | Цена, $/M токенов |
|---|---|
| Входные токены | $4.00 |
| Выходные токены | $20.00 |
| Чтение кэша | $0.20 |
| Запись кэша на 5 минут | $5.00 |
| Запись кэша на 1 час | $8.00 |
Чтение кэша по $0.20/M в 20 раз дешевле стандартного входа. Именно в этом разрыве накапливаются реальные сбережения в многооборотных или RAG-рабочих нагрузках. Окно 5 минут стоит $5.00/M для записи; если сеанс длится дольше, альтернатива - уровень сохранения на 1 час по $8.00/M. Ни один из них не бесплатен, поэтому считайте: стоимость записи окупается только если один и тот же кэшированный префикс читается достаточно много раз.
Производительность в сравнении с альтернативами
По официальному объявлению Anthropic, Opus 5.5 обеспечивает производительность, сопоставимую с Claude Fable 5.1 на большинстве задач. Это значимое утверждение: модель с примерно на 40% ниже затратами на вычисления и эксплуатацию, чем её предшественник, соответствует отдельной линейке моделей.
Генерация выходных данных примерно на 30% быстрее, чем Opus 5, согласно тому же источнику. Также упоминается улучшение возможностей в виде меньшего количества потребляемых токенов на задачу.
В Automated Behavioral Audit от Anthropic Opus 5.5 набирает наивысший балл среди всех протестированных моделей Claude на сегодняшний день. Это набор для выравнивания и безопасности, а не общий бенчмарк рассуждений, поэтому учитывайте это соответственно.
| Параметр | Opus 5.5 | Opus 5 |
|---|---|---|
| Цена входа, $/M | $4.00 | - |
| Цена выхода, $/M | $20.00 | - |
| Контекстное окно | 1M токенов | - |
| Макс. выход на запрос | 128K токенов | - |
| Скорость вывода | ~на 30% быстрее | базовая |
| Behavioral Audit | наивысший | - |
Максимальный выход составляет 128K токенов на запрос или до 300K через бета-версию Batch API для выходов, согласно Anthropic.
Доступность
Выпущена 22 сентября 2026 года. ID модели: claude-opus-5-5.
Доступна на:
- Claude API (все клиенты)
- Amazon Bedrock как
anthropic.claude-opus-5-5 - Google Cloud как
claude-opus-5-5 - Microsoft Foundry как
claude-opus-5-5 - Claude.ai на планах Pro, Max, Team и Enterprise
Если конкретная платформа ограничивает функцию, проверьте документацию этой платформы напрямую.
Адаптивное мышление включено по умолчанию и не может быть отключено. Вы можете управлять им через параметр усилия, но полностью отключить его невозможно.
Должен ли я переходить с Opus 5?
Для высокообъёмного вывода математика проста. Anthropic указывает примерно на 40% снижение затрат на вычисления и эксплуатацию по сравнению с Opus 5, что может привести к значительной экономии в масштабе ещё до использования кэширования. Добавьте кэширование подсказок в типичный RAG-конвейер и сэкономьте ещё больше.
Нет критических изменений в основном контракте API. ID модели меняется, и это в основном всё для стандартных текстовых рабочих нагрузок. Постоянное включение адаптивного мышления - главное изменение поведения: простые запросы, которые ранее возвращались быстро, могут потребить больше токенов для внутреннего рассуждения. Планируйте это.
Я рекомендую начать с теневого тестирования на вашем существующем наборе подсказок перед переводом производственного трафика. Граничные случаи в структурированном выводе или использовании инструментов - это место, где обычно появляются неожиданности.
Что ломается при обновлении?
Три вещи, которые нужно проверить перед переключением.
Во-первых, инструмент computer_20251124 удалён. Если вы используете компьютерное использование, обновитесь до поддерживаемой версии инструмента согласно документации Anthropic. Вызовы с использованием старого ID инструмента будут отклонены.
Во-вторых, адаптивное мышление не может быть отключено. Если ваше приложение зависит от предсказуемых низколатентных ответов на простые запросы, протестируйте фактическую задержку под новой моделью. Накладные расходы на рассуждение реальны.
В-третьих, стоимость записи кэша может отличаться от более ранних бета-ставок. Если вы построили модели затрат на основе более ранних бета-цен, пересчитайте по таблице выше.
Блоки мышления привязаны к модели и контексту разговора и не могут быть отредактированы. Дата знаний - июнь 2026 года.
# Старый вызов инструмента - будет ошибка на Opus 5.5
tool = {"type": "computer_20251124", ...}
# Используйте это вместо этого
tool = {"type": "computer_20250102", ...}
Как кэширование экономит деньги
Чтение кэша по $0.20/M в сравнении со стандартным входом по $4.00/M - это 20-кратная разница. Для любой подсказки с большим статическим префиксом этот разрыв быстро накапливается.
Конкретный пример с использованием таблицы цен: системная подсказка из 50K токенов, прочитанная 100 раз, стоит $20.00 по стандартным входным ставкам (50,000 x 100 x $4/M). С чтением кэша это стоит $1.00 (50,000 x 100 x $0.20/M). Запись кэша - это одноразовая стоимость $0.25 (50,000 x $5/M). Чистая экономия в этом сеансе: $18.75.
Окно 5 минут охватывает большинство интерактивных сеансов. Для пакетных заданий, работающих дольше, уровень сохранения на 1 час по $8.00/M стоимости записи стоит того, если один и тот же префикс появляется во многих запросах в этом окне.
Многооборотные разговоры получают наибольшую выгоду. Каждый оборот, который повторно использует накопленный контекст, избегает повторного выставления счёта за полную историю по входным ставкам.
Поддержка облачных платформ
Несколько платформ подтверждены как доступные согласно объявлению Anthropic.
| Платформа | ID модели | Примечания |
|---|---|---|
| Claude API | claude-opus-5-5 | Все клиенты |
| Amazon Bedrock | anthropic.claude-opus-5-5 | Вывод по требованию |
| Google Cloud | claude-opus-5-5 | - |
| Microsoft Foundry | claude-opus-5-5 | - |
Для цен на выделенную пропускную способность на Bedrock или скидок на обязательства на Vertex проверьте эти платформы напрямую.
Расчётная стоимость за задачу
Используя опубликованные ставки и простую арифметику токенов:
| Задача | Прибл. входные токены | Прибл. выходные токены | Расчётная стоимость, $ |
|---|---|---|---|
| Простой запрос | 1,000 | 500 | 0.014 |
| RAG с кэшированной подсказкой | 50K кэшировано + 1K свежих | 500 | 0.024 |
| Анализ длинного контекста | 100,000 | 10,000 | 0.60 |
| Пакетное задание, за запрос | 5,000 | 2,000 | 0.060 |
Строка RAG предполагает, что подсказка из 50K токенов уже кэширована (чтение по $0.20/M) и только 1K свежих токенов выставляются по $4.00/M. Эти числа иллюстративны; ваши подсчёты токенов будут отличаться.
Методология
Facts are compiled from the vendor's own announcement and documentation, linked below, at the time of writing; where the vendor hasn't published a number it is marked as such. GPUniq prices, when the model is already available here, come from our live catalog.
Источники
- 1.Claude Opus 5.5 – Anthropic announcement — Anthropic (просмотрено )
- 2.Claude Opus 5.5 – Claude Platform Docs overview — Anthropic (просмотрено )
- 3.Claude Opus 5.5 – Amazon Bedrock model card — Amazon Web Services (просмотрено )
Нужны недорогие GPU под ваш проект?
Живые цены на аренду GPU и нужная карта за пару кликов — H100, A100, RTX 4090 и ещё 50+ моделей. Оплата картой РФ или по счёту.
