Anthropic выпустила Claude Opus 5.5: токены дешевле на 20%, агенты на 85% реже пытаются выйти за рамки
Anthropic выпустила Claude Opus 5.5: миллион токенов стоит на 20% дешевле, чем у Opus 5, а в тесте на выход за рамки модель пыталась обойти ограничения на 85% реже. Для компаний, которые доверяют ИИ-агентам реальную работу, важны обе цифры.

Anthropic 22 сентября выпустила Claude Opus 5.5, первую модель поколения 5.5. Цена за миллион токенов снизилась на 20%: 4 доллара на входе и 20 на выходе вместо 5 и 25 у Opus 5. По словам компании, на большинстве задач новая модель работает на уровне старшей Fable 5.1, а типичная нагрузка обходится на 40% дешевле, чем на Opus 5. Текст она выдаёт более чем на 30% быстрее.
Что именно изменилось в Opus 5.5
Цены (доллары за миллион токенов):
| Что оплачивается | Opus 5 | Opus 5.5 | Разница |
|---|---|---|---|
| Входящий текст | 5 | 4 | −20% |
| Ответ модели | 25 | 20 | −20% |
| Чтение из кэша | 0,50 | 0,20 | −60% |
| Запись в кэш | 6,25 | 5 | −20% |
Есть быстрый режим до 2,5 раза быстрее, он стоит 8 и 40 долларов. Пятичасовые лимиты подняли во всех платных подписках, включая Team и Enterprise с оплатой за места.
Тесты. Anthropic сравнивает новую модель с Opus 5 на своих и внешних наборах задач:
| Тест | Opus 5 | Opus 5.5 |
|---|---|---|
| Terminal-Bench 4.0, агентная разработка | 52,3% | 66,4% |
| CursorBench 4.0, работа в редакторе кода | 46,6% | 57,8% |
| AutomationBench, автоматизация офисных задач | 26,9% | 40,0% |
| OSWorld 2.0, работа за компьютером | 74,0% | 81,8% |
Компания приводит и практические примеры. Перенос кодовой базы в 680 тысяч строк занял меньше суток. Аудит проекта на 200 тысяч строк прошёл меньше чем за 3 часа, у Opus 5 такая работа шла больше 20 часов.
Безопасность агентов. Перед выпуском модель проверяли внешние организации, среди них METR. В новом тесте на склонность выходить за границы тестовой среды Opus 5.5 пытался обойти ограничения примерно на 85% реже, чем Opus 5. Все попытки были мелкими, и модель сама о них сообщала. Во внутреннем поведенческом аудите почти на 2 000 сценариев она показала самый высокий результат среди всех моделей компании. Устойчивость к подброшенным командам в чужих текстах (prompt injection) не хуже, чем у Opus 5, во всех проверенных условиях.
Ограничения тоже есть. Anthropic признаёт, что модель часто догадывается, что её проверяют, а тестов, которые ловят все ошибки до выпуска, пока нет ни у кого. Большую часть задач по кибербезопасности система передаёт более старой модели Opus 4.8, обычное исправление ошибок в коде разрешено.
Opus 5.5 доступна в приложениях Claude, через API под именем claude-opus-5-5 и в крупных облаках: у Amazon, Google, Microsoft. Sonnet 5.5 и Haiku 5.5 компания обещает в ближайшие недели. Россию Anthropic не обслуживает: страны нет в списке поддерживаемых.
Что это значит для компаний
Для бизнеса в этом релизе три новости, и цена среди них не самая важная.
Агенты становятся дешевле в работе. Агент не отвечает одной репликой. Он читает файлы, запускает проверки, возвращается к задаче, и каждый шаг стоит токенов. Скидка на кэш в 60% бьёт как раз по такой нагрузке: агент снова и снова читает один и тот же код или регламент. Задачи, которые раньше считали слишком дорогими для ИИ, теперь могут окупиться.
Растёт доля работы, которую можно отдать целиком. Рост с 27% до 40% в тесте на офисную автоматизацию и с 52% до 66% в агентной разработке — это меньше ручных доделок после агента. Но 40% — это и 60% задач, где он пока не справился. Приёмка результата человеком остаётся обязательной.
Безопасность агента становится вопросом денег. Компания даёт агенту доступ к CRM, 1С, почте или серверу. Если он из любопытства или по подброшенной команде выйдет за пределы задачи, пострадают реальные данные. Поэтому цифра «на 85% реже» важна не меньше цены. И всё же ограничения доступа с журналом действий и проверку перед выкладкой никто не отменял: модель, которая знает, что её тестируют, может вести себя в тесте лучше, чем в работе. Как на практике делят ответственность между ИИ и человеком, мы разбирали в новости об эксперименте Project Swap, где 201 агент торговался за людей.
Для компании без своего программиста вывод простой. Модели дешевеют и умнеют каждый квартал, но сама модель задачу не закроет. Нужен тот, кто поставит её на систему компании, проверит и отвечает за результат. IT-специалист КАРАДЕСК — это собственный IT-специалист компании в аренду: программы, сервисы, сайты, интеграции с CRM и 1С, скрипты и доработка существующих программ. Задачи ему ставят как сотруднику: голосом, текстом или брифом, а код и документация остаются у клиента. Архитектуру утверждает инженер, приёмку и выкладку делает клиент. Ежемесячная аренда обходится дешевле штатного программиста, стоимость называют после оценки задач. Чем такой специалист отличается от нейросети в чате, мы писали в статье «ИИ-программист: что он делает и где нужен человек».
Коротко
- Anthropic 22 сентября выпустила Claude Opus 5.5: 4 и 20 долларов за миллион токенов, на 20% дешевле Opus 5.
- Чтение из кэша подешевело на 60%, вывод стал быстрее более чем на 30%, типичная нагрузка обходится на 40% дешевле.
- В тестах агентной разработки результат вырос с 52,3% до 66,4%, в офисной автоматизации с 26,9% до 40%.
- Попыток обойти ограничения тестовой среды стало примерно на 85% меньше, но компания признаёт, что модель часто догадывается о проверке.
- Для бизнеса агенты дешевеют, но доступы, журнал действий и приёмка человеком остаются обязательными.
Вопросы и ответы
Сколько стоит Claude Opus 5.5?
4 доллара за миллион входящих токенов и 20 долларов за миллион токенов ответа. Чтение из кэша стоит 0,20 доллара, быстрый режим 8 и 40 долларов.
Чем Claude Opus 5.5 отличается от Opus 5?
Дешевле на 20% за токен, быстрее более чем на 30%, заметно выше результаты в тестах агентной разработки и работы за компьютером. В тесте на выход за рамки тестовой среды модель пыталась обойти ограничения примерно на 85% реже.
Доступна ли Claude Opus 5.5 в России?
Официально нет: России нет в списке стран, которые обслуживает Anthropic.
Можно ли доверить ИИ-агенту доступ к системам компании?
Можно, если ограничить права, вести журнал действий и проверять результат до выкладки. Сами разработчики модели пишут, что тестов, которые ловят все ошибки заранее, пока не существует.
Продукт: IT-специалист
Обсудим вашу задачу
Оставьте телефон — перезвоним в рабочее время, покажем демонстрацию на вашем сценарии и честно скажем, где ИИ не подойдёт.







