Коротко. Anthropic выпустила Claude Opus 5.5 22 сентября 2026 года. Модель предназначена для длительного агентного программирования и профессиональной работы с документами и инструментами. Цена Claude API — $4 за 1 млн входных и $20 за 1 млн выходных токенов; чтение кэша стоит $0,20. Anthropic оценивает типичную стоимость задачи примерно на 40% ниже Opus 5 благодаря тарифу и меньшему расходу токенов. Это заявление производителя, а не гарантия экономии в каждом процессе. Анонс Anthropic, документация модели.
Статья для руководителей разработки, CTO и команд, которые выбирают модель для кода, аналитики и ИИ-агентов. Факты и тарифы проверены 22 сентября 2026 года. Здесь рассмотрены опубликованные возможности, стоимость и процедура проверки; сравнение не заменяет собственный тест на рабочем наборе задач.
Содержание
- Что такое Claude Opus 5.5
- Что изменилось относительно Opus 5
- Цена Claude Opus 5.5 и расчет бюджета
- Что показывают бенчмарки
- Где использовать модель
- Ограничения и безопасность
- Доступность и API
- Миграция с Opus 5
- Как проверить модель на своих задачах
- Частые вопросы
- Как AI рассвет помогает оценить Opus 5.5
- Вывод
Что такое Claude Opus 5.5
Claude Opus 5.5 — новая модель Anthropic из семейства Claude 5.5 с идентификатором API claude-opus-5-5. Компания рекомендует ее как отправную точку для большинства рабочих нагрузок, особенно для длительных задач программирования и анализа. Для более требовательных сценариев Anthropic предлагает сравнить ее с Claude Fable 5.1 на собственных тестах. Обзор линейки.
«Агентная» задача здесь означает не один ответ в чате, а последовательность чтения файлов, вызовов инструментов, изменений, проверок и исправлений. Качество такой работы зависит и от модели, и от окружения: прав доступа, инструментов, тестов, объема контекста и условий остановки. Поэтому высокий результат на публичной таблице не означает, что произвольный агент можно сразу допустить к производственным данным.
У Opus 5.5 контекстное окно 1 млн токенов, предельный обычный вывод 128 тыс. токенов, текстовый и графический вход и текстовый выход. Адаптивное мышление постоянно включено; глубину можно регулировать параметром effort, значение по умолчанию — medium. Надежная граница знаний в документации указана как июнь 2026 года. Свежие факты модель должна получать из проверенных источников, а не из памяти параметров. Спецификация Anthropic.
Что изменилось относительно Opus 5
| Параметр | Claude Opus 5 | Claude Opus 5.5 | Что проверить у себя |
|---|---|---|---|
| Вход, $/1 млн токенов | 5 | 4 | Доля некэшированного контекста |
| Выход, $/1 млн токенов | 25 | 20 | Объем ответа и рассуждения |
| Чтение кэша, $/1 млн токенов | 0,50 | 0,20 | Повторяемость системного контекста |
| Запись кэша 5 минут, $/1 млн токенов | 6,25 | 5 | Частота обновления промпта |
| Типичная стоимость задачи | базовая | по оценке Anthropic примерно на 40% ниже | Фактические токены и повторные вызовы |
| Скорость генерации | базовая | Anthropic заявляет более чем на 30% выше | Задержка полного процесса |
Цены, условия кэша и формулировка о типичной стоимости взяты из анонса и страницы модели. Процент экономии относится к тестовым нагрузкам Anthropic и включает изменение числа токенов на задачу. Он не равен простой разнице тарифов: тариф входа и выхода снизился на 20%, а чтение кэша — на 60%.
Улучшение заметно и в сценариях, где важно удерживать длинную цепочку работы. Anthropic описывает более сильные результаты в агентном кодировании, работе с компьютером и профессиональной аналитике. Компания также отмечает более ясную коммуникацию: модель чаще ставит вывод впереди подробностей и следует заданным правилам письма. Это полезно для ревью, но стиль ответа нужно проверять отдельно от правильности действий. Анонс Anthropic.
Цена Claude Opus 5.5 и расчет бюджета
Базовые API-тарифы на 22 сентября 2026 года: $4 за миллион входных токенов, $20 за миллион выходных, $0,20 за миллион прочитанных из кэша. Запись кэша на пять минут стоит $5, на час — $8 за миллион токенов. Fast mode оценивается отдельно: $8 за миллион входных и $40 за миллион выходных токенов; Anthropic заявляет скорость до 2,5 раза выше обычного режима. Для пакетной обработки предусмотрена скидка 50% на вход и выход. Страница модели, анонс.
Пример расчета, а не счета компании: один вызов с 100 тыс. обычных входных и 10 тыс. выходных токенов стоит (100 000 / 1 000 000 × $4) + (10 000 / 1 000 000 × $20) = $0,60 без кэша и платных инструментов. Если 80 тыс. входных токенов действительно читаются из кэша, а 20 тыс. обрабатываются как обычный вход, цена этой части составит $0,016 + $0,08; с теми же 10 тыс. выходных общий пример — $0,296. Реальный счет зависит от политики кэширования, длительности хранения, промахов кэша и тарификации остальных вызовов.
Для бюджета важнее стоимость принятого результата, а не цена миллиона токенов. Пусть агент сделал десять попыток, из которых шесть прошли тесты и ревью. Тогда полную стоимость всех десяти попыток нужно делить на шесть, учитывая также время человека на проверку и исправление. Дешевый единичный вызов может оказаться дорогим маршрутом, если агент часто повторяет работу.
| Компонент полной стоимости | Что записывать в журнал |
|---|---|
| Токены | вход, выход, cache read, cache write, повторные попытки |
| Инструменты | платные вызовы поиска, вычислений и внешних сервисов |
| Время | задержка до проверенного результата, а не только первого ответа |
| Проверка | минуты ревьюера, тестовые прогоны, исправления |
| Риск | доля задач с откатом, нарушением границ или фактической ошибкой |
Что показывают бенчмарки
Anthropic сообщает для Opus 5.5 66,4% на Terminal-Bench 4.0, 54,4% на FrontierCode v1.1 и 40,0% на AutomationBench при указанных компанией настройках. В ее таблице Opus 5 получает соответственно 52,3%, 48,0% и 26,9%. На GDPval-AA v2.1 Opus 5.5 достигает 1846 Elo против 1708 у Opus 5. Эти цифры относятся к разным наборам задач и не складываются в общий «процент интеллекта». Методика и сноски Anthropic.
Для интерпретации важны три детали. Во-первых, настройки усилия отличаются: большинство результатов Opus 5.5 указаны при max, а Terminal-Bench — при xhigh. Во-вторых, агентный результат зависит от инструментов и тестового окружения. В-третьих, сам производитель предупреждает, что небольшие разницы бенчмарков хуже предсказывают различия на реальной работе. Поэтому таблица полезна для выбора кандидатов в тест, а решение о закупке требует своего корпуса задач. Анонс Anthropic.
Отдельный сигнал дают результаты ранних пользователей, но это кейсы, выбранные для публикации производителем, а не независимая репрезентативная выборка. Anthropic описывает миграцию крупной кодовой базы и длительные рабочие сессии. Их нельзя пересчитывать в обещание сроков для любого проекта: сложность кода, качество тестов, доступ к инструментам и критерий завершения различаются. Кейсы в анонсе.
Где использовать модель
Длительное программирование
Opus 5.5 логично проверить на миграциях, рефакторинге нескольких репозиториев, анализе ошибок и ревью патчей. Для этих задач важны воспроизводимые тесты и ясный критерий завершения. Дайте агенту ограниченную ветку, набор разрешенных команд и журнал диффов. Приемка должна включать тесты, человеческое ревью измененных участков и проверку сторонних зависимостей. Публичный результат FrontierCode показывает потенциал, но не подтверждает качество конкретного репозитория. Anthropic.
Работа с документами и знаниями
Для анализа отчетов, договоров и разнородных корпоративных файлов модель может готовить сводку, таблицу расхождений и список вопросов. Каждый вывод должен ссылаться на фрагмент исходного документа. В финансовых и юридических процессах проверяющий должен иметь возможность восстановить путь от вывода к источнику. Контекстное окно в миллион токенов помогает загрузить большой материал, но не отменяет проверки полноты поиска и правильности цитат. Спецификация.
Агентные процессы между приложениями
Модель можно оценивать на задачах, где агент читает входящие обращения, сверяет запись в системе и готовит черновик действия. На первом этапе оставьте запись, платеж, изменение прав и отправку сообщений за человеком. Критерии проверки — правильный выбор данных, отсутствие лишних действий, время до завершения и доля кейсов, требующих вмешательства. AutomationBench проверяет похожий класс сценариев, но бизнес-процесс с собственными данными может дать иную картину. Описание теста в анонсе.
Ограничения и безопасность
Anthropic сообщает, что Opus 5.5 устойчивее Opus 5 к prompt injection в опубликованных условиях испытаний и лучше проходит ее поведенческий аудит. При этом компания прямо признает ограничения таких оценок. Prompt injection — инструкция злоумышленника внутри внешнего материала, которую агент ошибочно принимает за команду. Защита модели снижает риск, но не заменяет изоляцию инструментов, права по минимуму и подтверждение необратимых действий. Анонс и описание защиты.
Подробные условия и границы испытаний Anthropic вынесла в системную карту Opus 5.5. Для практической схемы защиты внешнего контента полезен отдельный разбор мультимодальной prompt injection.
Поскольку Anthropic считает модель сопоставимой с Claude Mythos 5.1 в биологии и кибербезопасности, для части исследовательского доступа действуют специальные программы проверки организаций. Не следует предполагать, что возможность из публичного бенчмарка автоматически доступна любому аккаунту и в любом окружении. Анонс Anthropic.
Операционные ограничения тоже существенны. Миллион токенов контекста — максимальная вместимость, а не доказательство одинаковой точности на любой позиции длинного файла. Более высокий effort может увеличить расход и задержку. У моделей с одинаковым названием на разных облачных платформах отличаются доступ, квоты и настройки. Перед запуском проверьте данные, которые можно передавать провайдеру, регион обработки и правила хранения в своем договоре и консоли.
Доступность и API
По заявлению Anthropic, Claude Opus 5.5 доступна в Claude и на Claude Platform, а также через Amazon Web Services, Google Cloud и Microsoft Azure. В Claude API используется имя claude-opus-5-5. На странице модели указан активный статус и дата выпуска 22 сентября 2026 года. Фактический доступ, квоты и регион следует смотреть в конкретном аккаунте. Анонс, документация.
Не смешивайте цену API и подписку Claude. Подписка ограничивается правилами плана и периодов использования, а API тарифицирует токены и отдельные режимы. Рост пятичасовых лимитов для Pro, Max, Team и некоторых Enterprise-планов заявлен Anthropic, но он не означает безлимитный доступ. Анонс Anthropic.
Миграция с Opus 5
Замена только строки модели способна сломать существующий агент. Руководство Anthropic перечисляет четыре изменения: мышление нельзя выключить; принудительный вызов инструмента возвращает ошибку; блоки мышления привязаны к модели и разговору; ранняя версия инструмента computer use computer_20251124 не принимается в Claude API и Google Cloud. Меняется и вид промежуточного ответа между вызовами инструментов: пользовательский текст может оказаться в блоке thinking, пустом при стандартном значении display.
Порядок миграции:
- Снимите базовую линию. Сохраните набор реальных обезличенных запросов, ответы Opus 5, токены, время, ошибки и принятые результаты.
- Проверьте параметры. Найдите в коде отключение thinking, forced tool use, перенос блоков между разговорами и старую версию computer use.
- Запустите парный прогон. Одни и те же задачи выполните в одинаковом окружении на старой и новой модели, зафиксировав
effort. - Проверьте потоковые интерфейсы. Если приложение показывает пользователю промежуточный прогресс, убедитесь, что изменение блоков не оставляет пустой экран.
- Выпустите постепенно. Начните с малой доли обратимых задач и заранее определите условие возврата на Opus 5.
Как проверить модель на своих задачах
Практический набор должен включать не только удачные примеры. Возьмите типичные задачи, сложные случаи, неполные входные данные и попытки подменить инструкции внутри документов. Разделите их по важности: дешевые массовые операции, сложные исследования и действия с высоким ущербом при ошибке. Для каждого кейса запишите ожидаемый артефакт, критерии приемки и недопустимые действия.
Если команда выбирает модель для нескольких процессов, используйте единые критерии и маршрутизатор моделей для бизнеса как дополнительный план архитектуры. Наличие маршрутизатора само по себе не сокращает счет: экономию должен показать замер полной цепочки.
Минимальный протокол оценки: одинаковый ввод и инструменты для двух моделей; не менее одного слепого ревью там, где оценка субъективна; автоматические тесты для кода; ссылки на исходники для аналитики; полный учет токенов и времени человека. Число кейсов определяется разнообразием процесса, а не магическим порогом. Если набор мал, опубликуйте это как ограничение, а не как уверенное обобщение.
| Вопрос | Метрика приемки |
|---|---|
| Делает ли агент нужную работу? | доля принятых результатов по заранее записанным критериям |
| Сколько стоит итог? | расходы на все попытки / число принятых результатов |
| Укладывается ли в процесс? | время до принятого результата, включая ревью |
| Управляем ли риск? | лишние вызовы инструментов, откаты, нарушения прав |
| Сохраняется ли качество? | повторные прогоны на разных типах входа |
Методика этой статьи — сопоставление анонса Anthropic, официальных спецификаций и опубликованных условий бенчмарков на дату проверки. Мы не проводили собственное сравнение моделей и не выдаем показатели производителя за результат клиента. Это важно, потому что настройки агента, состав задач и стоимость проверки меняют вывод.
Частые вопросы
Когда вышла Claude Opus 5.5?
Anthropic указывает дату выпуска 22 сентября 2026 года. Доступ в конкретном облаке и аккаунте проверяется отдельно. Источник.
Сколько стоит Claude Opus 5.5 API?
Базовый тариф — $4 за миллион входных и $20 за миллион выходных токенов; чтение кэша — $0,20 за миллион. Fast mode и длительная запись кэша стоят иначе. Источник.
Как называется модель в API?
Идентификатор Claude API — claude-opus-5-5. Его поддержку и квоты проверьте в своем проекте. Источник.
Правда ли Opus 5.5 дешевле Opus 5 на 40%?
Это оценка Anthropic для типичных задач с учетом числа токенов и нового тарифа. Тариф обычного входа и выхода снижен на 20%; фактическая экономия конкретной команды зависит от кэша, повторов и режима усилия. Источник.
Нужно ли всем переходить с Opus 5?
Нет универсального ответа. Перед миграцией проверьте несовместимые параметры API и сравните долю принятых результатов, стоимость и задержку на собственных задачах. Изменения API.
Подходит ли модель для автономного агента?
Подходит как кандидат для теста, но полномочия агента задаются системой. Ограничьте права, проверяйте внешние данные, журналируйте действия и подтверждайте необратимые операции человеком.
Как AI рассвет помогает оценить Opus 5.5
AI рассвет может связать выбор модели с проверяемым процессом компании:
- описать один процесс, его текущую стоимость, источники данных и критерий приемки;
- подготовить ограниченный агентный или RAG-контур для работы с кодом и корпоративными знаниями;
- провести тестирование модели на типичных и сложных задачах с учетом токенов, времени проверки и ошибок;
- настроить интеграцию, контролируемый запуск, обучение команды и поддержку выбранного процесса.
Первый шаг — выбрать один обратимый сценарий, записать его baseline, данные, ограничения и приемочный критерий. Обсудить задачу.
Вывод
Claude Opus 5.5 сочетает более низкие API-тарифы с сильными опубликованными результатами в агентном кодировании и профессиональной работе. Для бизнеса решение о переходе зависит от того, дает ли модель больше принятых результатов на собственных задачах при приемлемой цене, задержке и риске. Начните с парного теста против текущей модели, проверьте несовместимости API и открывайте агенту полномочия постепенно.