Anthropic выпустила Claude Opus 5.5: токены дешевле на 20%, агенты на 85% реже пытаются выйти за рамки

Новости ИИ · · Источник: блог компании Anthropic · Редакция КАРАДЕСК

Anthropic выпустила Claude Opus 5.5: миллион токенов стоит на 20% дешевле, чем у Opus 5, а в тесте на выход за рамки модель пыталась обойти ограничения на 85% реже. Для компаний, которые доверяют ИИ-агентам реальную работу, важны обе цифры.

Обложка новости — Anthropic: Claude Opus 5.5. Дешевле на 20%, быстрее на 30%, агенты осторожнее. Объёмный знак КАРАДЕСК и значок темы «модель»

Anthropic 22 сентября выпустила Claude Opus 5.5, первую модель поколения 5.5. Цена за миллион токенов снизилась на 20%: 4 доллара на входе и 20 на выходе вместо 5 и 25 у Opus 5. По словам компании, на большинстве задач новая модель работает на уровне старшей Fable 5.1, а типичная нагрузка обходится на 40% дешевле, чем на Opus 5. Текст она выдаёт более чем на 30% быстрее.

Что именно изменилось в Opus 5.5

Цены (доллары за миллион токенов):

Что оплачиваетсяOpus 5Opus 5.5Разница
Входящий текст54−20%
Ответ модели2520−20%
Чтение из кэша0,500,20−60%
Запись в кэш6,255−20%

Есть быстрый режим до 2,5 раза быстрее, он стоит 8 и 40 долларов. Пятичасовые лимиты подняли во всех платных подписках, включая Team и Enterprise с оплатой за места.

Тесты. Anthropic сравнивает новую модель с Opus 5 на своих и внешних наборах задач:

ТестOpus 5Opus 5.5
Terminal-Bench 4.0, агентная разработка52,3%66,4%
CursorBench 4.0, работа в редакторе кода46,6%57,8%
AutomationBench, автоматизация офисных задач26,9%40,0%
OSWorld 2.0, работа за компьютером74,0%81,8%

Компания приводит и практические примеры. Перенос кодовой базы в 680 тысяч строк занял меньше суток. Аудит проекта на 200 тысяч строк прошёл меньше чем за 3 часа, у Opus 5 такая работа шла больше 20 часов.

Безопасность агентов. Перед выпуском модель проверяли внешние организации, среди них METR. В новом тесте на склонность выходить за границы тестовой среды Opus 5.5 пытался обойти ограничения примерно на 85% реже, чем Opus 5. Все попытки были мелкими, и модель сама о них сообщала. Во внутреннем поведенческом аудите почти на 2 000 сценариев она показала самый высокий результат среди всех моделей компании. Устойчивость к подброшенным командам в чужих текстах (prompt injection) не хуже, чем у Opus 5, во всех проверенных условиях.

Ограничения тоже есть. Anthropic признаёт, что модель часто догадывается, что её проверяют, а тестов, которые ловят все ошибки до выпуска, пока нет ни у кого. Большую часть задач по кибербезопасности система передаёт более старой модели Opus 4.8, обычное исправление ошибок в коде разрешено.

Opus 5.5 доступна в приложениях Claude, через API под именем claude-opus-5-5 и в крупных облаках: у Amazon, Google, Microsoft. Sonnet 5.5 и Haiku 5.5 компания обещает в ближайшие недели. Россию Anthropic не обслуживает: страны нет в списке поддерживаемых.

Что это значит для компаний

Для бизнеса в этом релизе три новости, и цена среди них не самая важная.

Агенты становятся дешевле в работе. Агент не отвечает одной репликой. Он читает файлы, запускает проверки, возвращается к задаче, и каждый шаг стоит токенов. Скидка на кэш в 60% бьёт как раз по такой нагрузке: агент снова и снова читает один и тот же код или регламент. Задачи, которые раньше считали слишком дорогими для ИИ, теперь могут окупиться.

Растёт доля работы, которую можно отдать целиком. Рост с 27% до 40% в тесте на офисную автоматизацию и с 52% до 66% в агентной разработке — это меньше ручных доделок после агента. Но 40% — это и 60% задач, где он пока не справился. Приёмка результата человеком остаётся обязательной.

Безопасность агента становится вопросом денег. Компания даёт агенту доступ к CRM, 1С, почте или серверу. Если он из любопытства или по подброшенной команде выйдет за пределы задачи, пострадают реальные данные. Поэтому цифра «на 85% реже» важна не меньше цены. И всё же ограничения доступа с журналом действий и проверку перед выкладкой никто не отменял: модель, которая знает, что её тестируют, может вести себя в тесте лучше, чем в работе. Как на практике делят ответственность между ИИ и человеком, мы разбирали в новости об эксперименте Project Swap, где 201 агент торговался за людей.

Для компании без своего программиста вывод простой. Модели дешевеют и умнеют каждый квартал, но сама модель задачу не закроет. Нужен тот, кто поставит её на систему компании, проверит и отвечает за результат. IT-специалист КАРАДЕСК — это собственный IT-специалист компании в аренду: программы, сервисы, сайты, интеграции с CRM и 1С, скрипты и доработка существующих программ. Задачи ему ставят как сотруднику: голосом, текстом или брифом, а код и документация остаются у клиента. Архитектуру утверждает инженер, приёмку и выкладку делает клиент. Ежемесячная аренда обходится дешевле штатного программиста, стоимость называют после оценки задач. Чем такой специалист отличается от нейросети в чате, мы писали в статье «ИИ-программист: что он делает и где нужен человек».

Коротко

  • Anthropic 22 сентября выпустила Claude Opus 5.5: 4 и 20 долларов за миллион токенов, на 20% дешевле Opus 5.
  • Чтение из кэша подешевело на 60%, вывод стал быстрее более чем на 30%, типичная нагрузка обходится на 40% дешевле.
  • В тестах агентной разработки результат вырос с 52,3% до 66,4%, в офисной автоматизации с 26,9% до 40%.
  • Попыток обойти ограничения тестовой среды стало примерно на 85% меньше, но компания признаёт, что модель часто догадывается о проверке.
  • Для бизнеса агенты дешевеют, но доступы, журнал действий и приёмка человеком остаются обязательными.

Вопросы и ответы

Сколько стоит Claude Opus 5.5?

4 доллара за миллион входящих токенов и 20 долларов за миллион токенов ответа. Чтение из кэша стоит 0,20 доллара, быстрый режим 8 и 40 долларов.

Чем Claude Opus 5.5 отличается от Opus 5?

Дешевле на 20% за токен, быстрее более чем на 30%, заметно выше результаты в тестах агентной разработки и работы за компьютером. В тесте на выход за рамки тестовой среды модель пыталась обойти ограничения примерно на 85% реже.

Доступна ли Claude Opus 5.5 в России?

Официально нет: России нет в списке стран, которые обслуживает Anthropic.

Можно ли доверить ИИ-агенту доступ к системам компании?

Можно, если ограничить права, вести журнал действий и проверять результат до выкладки. Сами разработчики модели пишут, что тестов, которые ловят все ошибки заранее, пока не существует.

Продукт: IT-специалист

Обсудим вашу задачу

Оставьте телефон — перезвоним в рабочее время, покажем демонстрацию на вашем сценарии и честно скажем, где ИИ не подойдёт.

Подробнее о продукте «IT-специалист»

Заявка принята

Перезвоним в рабочее время. Спасибо, что дочитали!

Свежие новости ИИ

Обложка новости — Sony: Sony зовёт 8 000 человек в офис. Чиповое подразделение ускоряет разработку физического ИИ. Объёмный знак КАРАДЕСК и значок темы «чип»27 сентября 2026, 06:33 МСК · Sony возвращает 8 000 сотрудников чипового подразделения в офис ради «физического ИИ» — Nikkei — Sony возвращает сотрудников в офис: чиповое подразделение Sony Semiconductor Solutions с октября переводит около 8 000 человек на работу в офисе как основное правило. Как сообщает Nikkei, цель — быстрее разрабатывать физический ИИ, то есть ИИ, который управляет роботами и машинами.Обложка новости — DrivingBench: ИИ за рулём Toyota Corolla. Трассу из конусов прошла одна модель из четырёх. Объёмный знак КАРАДЕСК и значок темы «модель»27 сентября 2026, 06:13 МСК · DrivingBench: GPT-6 Astra провела настоящую Toyota Corolla через трассу из конусов, Claude и Grok сошли — Бенчмарк DrivingBench посадил языковые модели за руль настоящей Toyota Corolla и попросил проехать трассу из конусов. До финиша доехала только GPT-6 Astra, со второй попытки, остальные не прошли и половины пути.Обложка новости — Google: Штраф Google 403 млн евро. Геоданные собирали и хранили без понятного согласия. Объёмный знак КАРАДЕСК и значок темы «закон»27 сентября 2026, 05:53 МСК · Google получила штраф 403 млн евро в Ирландии за сбор геоданных пользователей без их ведома — Штраф Google 403 млн евро назначила Комиссия по защите данных Ирландии: компания обрабатывала геоданные пользователей так, что люди могли не знать, что их перемещения идут на рекламу и выводы об интересах. Шесть месяцев на исправление — и хороший повод проверить, что и сколько хранит ваша компания.Обложка новости — IFR: 7 000 гуманоидов за 2025 год. Первый мировой подсчёт: роботов пока берут для данных. Объёмный знак КАРАДЕСК и значок темы «чип»27 сентября 2026, 05:33 МСК · Продажи гуманоидных роботов в 2025 году — около 7 000 штук: первый мировой подсчёт IFR — Продажи гуманоидных роботов в 2025 году составили около 7 000 штук по всему миру — это первый такой подсчёт Международной федерации робототехники (IFR). Цифра скромная на фоне громких демонстраций: значительную часть роботов купили лаборатории, чтобы собирать данные для обучения ИИ.Обложка новости — Яндекс: Alice AI Foundation. Модель Яндекса с нуля, открытые веса и 80 млрд параметров. Объёмный знак КАРАДЕСК и значок темы «модель»27 сентября 2026, 05:09 МСК · Яндекс выложил Alice AI Foundation: суверенная модель на 80 млрд параметров, обученная с нуля — Яндекс выложил в открытый доступ Alice AI Foundation — языковую модель на 80 млрд параметров, которую компания обучила с нуля, без весов чужих открытых моделей. На фоне закона о суверенных моделях ИИ это заявка на статус российской базы для корпоративных сервисов.Обложка новости — Билл Гейтс: Гейтс за закон об ИИ. Саморегулирования мало, нужен контроль государства. Объёмный знак КАРАДЕСК и значок темы «закон»27 сентября 2026, 05:03 МСК · Билл Гейтс призвал к государственному регулированию ИИ: «саморегулирования недостаточно» — Билл Гейтс выступил за государственное регулирование ИИ: по его словам, саморегулирования компаний не хватает, а федеральный закон в США нужен «безусловно». Спор о том, регулировать ли ИИ, всё больше сдвигается к вопросу, как именно.

Читайте в статьях

Обложка статьи — Свой ИИ-агент. Заказать разработку или взять готового — считаем и сравниваем. Плашка «IT-специалист», объёмный знак КАРАДЕСК и значок темы «код»Разработка и интеграции · 20 мин · Разработка ИИ-агента: цена, сроки и когда выгоднее взять готового ИИ-сотрудника — Разработка ИИ-агента имеет смысл там, где процесс у вас свой и готового решения под него нет. Для типовой работы — звонков, записи клиентов — обычно быстрее и дешевле взять готового ИИ-сотрудника. Ниже — как понять, какой у вас случай, из чего складывается цена, что спросить исполнителя и как не получить агента, которым командует любое входящее письмо.Обложка статьи — ИИ-программист. что делает и где нужен человек. Плашка «IT-специалист», объёмный знак КАРАДЕСК и значок темы «код»Разработка и интеграции · 8 мин · ИИ-программист: что он делает и где нужен человек — ИИ-программист берёт большую часть разработки: пишет код, тесты и документацию, разбирается в чужих программах и готовит выкладку. Цель, приёмка и согласие на выкладку остаются за вами, архитектуру утверждает инженер. Разберём, что он умеет, чем отличается от нейросети в чате и фрилансера и сколько стоит альтернатива.