Приятно вспоминать невзгоды, если они миловали (Цицерон).

Claude Opus 5.5: что умеет новая модель Anthropic и почему ей не дают делать всё подряд


Claude Opus 5.5: что умеет новая модель Anthropic и почему ей не дают делать всё подряд

Anthropic представила Claude Opus 5.5 — первую модель нового семейства Claude 5.5. Релиз состоялся 22 сентября 2026 года и стал заметным не только благодаря росту производительности. Одной из главных особенностей новой версии стала политика ограниченного доступа к отдельным возможностям модели.

Подход Anthropic отражает изменение ситуации на рынке генеративного искусственного интеллекта. Если несколько лет назад разработчики в основном соревновались в количестве параметров, качестве ответов и результатах тестов, то современные модели всё чаще получают доступ к инструментам, терминалу, файловой системе и компьютерным интерфейсам. Поэтому вместе с вопросом «что умеет модель?» возникает другой: «какие действия ей разрешено выполнять?»

Именно это становится особенно важным для Opus 5.5. Anthropic заявляет о значительном росте эффективности в программировании, работе с компьютером и профессиональными задачами, но одновременно вводит дополнительные меры безопасности для наиболее чувствительных областей.

 

Что такое Claude Opus 5.5

Claude Opus 5.5 — новая флагманская модель Anthropic и первый представитель семейства Claude 5.5. Компания позиционирует её как модель для сложной интеллектуальной работы, особенно там, где требуется не просто написать ответ, а выполнить последовательность действий с использованием инструментов.

По заявлению Anthropic, Opus 5.5 показывает уровень производительности, сопоставимый с Claude Fable 5.1 на большинстве рабочих задач, при этом обходится дешевле в эксплуатации, чем предыдущий Opus 5.

Модель ориентирована на несколько основных направлений:

  • агентное программирование;
  • работу с большими кодовыми базами;
  • использование терминала и инструментов разработчика;
  • работу с компьютерным интерфейсом;
  • анализ документов и сложных наборов данных;
  • многоэтапные профессиональные задачи;
  • исследовательскую и аналитическую работу.

 

Особенность агентного подхода заключается в том, что модель не обязательно ограничивается одним ответом в чате. Она может анализировать задачу, планировать последовательность действий, запускать инструменты, проверять результат и продолжать работу.

Именно поэтому рост возможностей Opus 5.5 важен не только как улучшение качества текста. Модель всё больше приближается к инструменту, способному самостоятельно выполнять продолжительные рабочие процессы.

 

Производительность в программировании

Одной из главных областей применения Opus 5.5 является программирование. Anthropic сообщает о значительном росте результатов на тестах, связанных с агентным написанием кода.

Например, в Terminal-Bench 4.0 модель получила результат 66,4%, тогда как Opus 5 показал 52,3%. В FrontierCode v1.1 показатель Opus 5.5 составил 54,4%, а в CursorBench 4.0 — 57,8%.

Однако сами разработчики Anthropic предупреждают, что при столь высоком уровне возможностей разница между моделями по отдельным benchmark-тестам становится менее показательна для реальной работы.

На практике гораздо важнее то, сколько шагов и токенов требуется агенту для решения задачи и насколько часто человеку приходится вмешиваться в процесс.

 

Большие проекты становятся более реалистичным сценарием

Opus 5.5 особенно интересен при работе с крупными кодовыми базами. Anthropic приводит пример раннего тестирования, в котором модель использовалась для миграции кодовой базы объёмом около 680 000 строк.

По данным компании, задача была выполнена менее чем за сутки, тогда как аналогичная работа могла бы занимать у команды разработчиков недели. Это не означает, что модель автоматически заменяет команду инженеров: такие результаты относятся к конкретному тесту и конкретной организации рабочего процесса.

Читать  Grok будет отвечать за образование детей в Сальвадоре по соглашению Элона Маска и Букеле. В Мексике ИИ уже следит за экзаменами

Тем не менее направление развития очевидно. AI-агенты постепенно переходят от генерации отдельных функций к задачам уровня:

  • массовой миграции API;
  • рефакторинга большого проекта;
  • обновления зависимостей;
  • аудита исходного кода;
  • поиска ошибок в нескольких модулях;
  • изменения архитектуры проекта;
  • подготовки и проверки большого количества изменений.

 

Для разработчика это означает изменение самой модели взаимодействия с ИИ. Вместо запроса «напиши функцию» всё чаще можно поставить задачу более высокого уровня и предоставить агенту доступ к репозиторию, терминалу и инструментам тестирования.

 

Модель стала дешевле и быстрее

Одним из наиболее практичных улучшений Opus 5.5 является снижение стоимости использования. Anthropic заявляет, что при типичных рабочих нагрузках модель обходится примерно на 40% дешевле Opus 5.

Цена составляет:

  • $4 за миллион входных токенов;
  • $20 за миллион выходных токенов;
  • $0,20 за миллион токенов при чтении кэша;
  • $5 за миллион токенов при записи в кэш.

 

Для сравнения, у Opus 5 стоимость составляла $5 за миллион входных токенов и $25 за миллион выходных. Чтение кэша стоило $0,50 за миллион токенов.

Anthropic также сообщает, что Opus 5.5 генерирует результат более чем на 30% быстрее предыдущей версии. Для обычного диалога это может быть заметно не всегда, однако для агентных задач, в которых модель выполняет десятки последовательных операций, скорость становится гораздо более важным фактором.

 

Почему цена особенно важна для AI-агентов

Обычный запрос пользователя может потребовать относительно небольшого количества токенов. Агентная задача устроена иначе. Модель может несколько раз прочитать файлы, вызвать инструменты, получить результаты команд, проанализировать ошибки, внести изменения и повторить операцию.

В результате стоимость одной задачи может значительно превышать стоимость обычного ответа в чате.

Именно поэтому снижение цены токенов и стоимости работы с кэшем имеет большое значение для разработчиков. Чем дешевле становится продолжительная сессия агента, тем больше задач можно передать модели без резкого роста расходов.

 

Новый Opus не только умнее, но и более осторожный

Именно здесь начинается самая необычная часть релиза. Anthropic не просто увеличивает возможности модели, но одновременно усиливает ограничения в областях, которые компания считает особенно чувствительными.

Opus 5.5 проходил внешнее тестирование и внутренний поведенческий аудит Anthropic. Компания сообщает, что новая модель показала самый высокий результат среди протестированных ею систем в рамках собственного комплексного тестирования на соответствие требованиям безопасности.

При этом Anthropic отдельно подчёркивает, что модель получила защитные механизмы, аналогичные тем, которые применяются для наиболее мощных систем компании.

 

Что происходит с кибербезопасностью

Кибербезопасность является одной из наиболее чувствительных областей для современных AI-моделей. Сильная система способна помогать специалисту искать уязвимости, анализировать код и автоматизировать защитные операции, но те же способности потенциально могут использоваться для вредоносных действий.

Anthropic поэтому не открывает все возможности Opus 5.5 одинаково для всех пользователей.

Компания сообщает, что для отдельных задач, связанных с кибербезопасностью, предусмотрен контролируемый доступ. Проверенные специалисты и организации могут получить доступ через специальную программу верификации.

При этом во время оценки модели использовались защитные механизмы, которые могли вмешиваться в выполнение некоторых задач. Anthropic указывает, что в ряде кибербезопасностных сценариев при срабатывании защитных механизмов использовалась более старая модель Opus 4.8.

 

Ограничения касаются не только кибербезопасности

Схожая модель доступа используется для биологических исследований. Anthropic рассматривает биологические задачи как ещё одну область, где высокая автономность ИИ может создавать дополнительные риски.

Поэтому организации, работающие с биологическими исследованиями, могут подавать заявку на участие в Life Sciences Verification Program. В результате доступ к наиболее чувствительным возможностям не становится полностью свободным.

Читать  OpenClaw - это агент Total AI, бросивший вызов Big Tech.

Таким образом, развитие модели сопровождается появлением своеобразной системы уровней доверия. Обычный пользователь получает стандартные возможности, а специализированные организации могут проходить дополнительную проверку для работы с более чувствительными сценариями.

Таким образом, Claude Opus 5.5 по сравнению с Fable 5.1, Opus 5 и моделями OpenAI в различных тестах | Изображение: Anthropic

Почему Anthropic ограничивает возможности модели

Причина заключается в изменении характера самих AI-систем. Чем лучше модель пишет код, работает с терминалом и выполняет последовательности действий, тем меньше она похожа на обычный чат-бот.

Если модели разрешён доступ к внешним инструментам, она потенциально может:

  • создавать и изменять файлы;
  • запускать команды;
  • анализировать исходный код;
  • работать с интернет-сервисами;
  • управлять программами;
  • автоматизировать продолжительные процессы.

 

Поэтому даже небольшое повышение автономности может иметь гораздо большее значение, чем улучшение качества одного ответа.

Anthropic рассматривает это как вопрос управления доступом к возможностям, а не только как вопрос фильтрации отдельных запросов.

 

Защита от извлечения возможностей модели

Ещё одна интересная часть релиза связана с так называемой distillation — дистилляцией моделей. При таком подходе злоумышленник может использовать большое количество запросов к мощной модели, чтобы собрать данные для обучения другой системы, которая будет воспроизводить её возможности.

Anthropic считает промышленное извлечение возможностей потенциальной угрозой безопасности. Поэтому в Opus 5.5 сохранён механизм preserved thinking, ранее представленный в Fable 5.1.

Смысл механизма заключается в том, что API-пользователь не может произвольно редактировать предыдущий контекст рассуждений модели для проведения масштабного извлечения её поведения.

Для новых API-аккаунтов, созданных начиная с 31 августа 2026 года, этот механизм применяется к Fable 5.1 и Opus 5.5.

 

Изменения в стиле общения

Anthropic также уделила внимание тому, как модель формулирует ответы. Компания сообщает, что Opus 5.5 должен писать более естественно и понятнее, чем предыдущие версии.

Одна из целей — сделать ответы более удобными для проверки человеком. Для профессионального использования это имеет практическое значение: если агент выполняет большую работу на протяжении нескольких часов, человеку необходимо понимать, что именно он сделал и почему.

Поэтому качество коммуникации становится частью надёжности системы. Хороший агент должен не только выполнять действия, но и давать человеку достаточно понятный результат для контроля.

 

Что меняется для разработчиков

Для программистов Opus 5.5 интересен прежде всего сочетанием производительности и стоимости. Если агент способен выполнять больше работы за меньшее число шагов, экономия возникает одновременно на нескольких уровнях.

Разработчик может использовать модель для анализа существующего проекта, поиска проблем, подготовки миграции или выполнения серии изменений. При этом модель может работать непосредственно через инструменты разработки, а не только генерировать текстовые рекомендации.

Это постепенно меняет роль программиста. Часть рутинных операций перемещается от ручного написания кода к постановке задач, проверке результатов и контролю архитектурных решений.

Terminal-Bench 4.0 отражает стремление Anthropic улучшить соотношение мощности и затрат | Изображение: Anthropic

Opus 5.5 и проблема доверия к AI-агентам

Рост автономности одновременно увеличивает требования к контролю. Если модель просто отвечает на вопрос, ошибка обычно ограничивается неправильной информацией. Если же агент получил доступ к терминалу и проекту, ошибка может привести к изменению файлов, поломке конфигурации или удалению данных.

Поэтому практическое использование Opus 5.5 требует разделения полномочий. Для разных задач могут применяться разные уровни доступа, песочницы, ограничения инструментов и ручное подтверждение критических операций.

Сам по себе более мощный AI-агент не означает автоматически более безопасную автоматизацию. Безопасность зависит от того, какие инструменты ему доступны, какие ограничения установлены и насколько хорошо контролируется результат.

 

Когда появятся другие модели Claude 5.5

Opus 5.5 является только первым представителем нового поколения. Anthropic сообщила, что в ближайшие недели ожидается появление Claude Sonnet 5.5 и Claude Haiku 5.5.

Читать  OpenAI начинает тестирование рекламы на ChapGPT

Это означает, что изменения, представленные вместе с Opus 5.5, вероятно, станут основой более широкой линейки. В частности, речь идёт о повышении эффективности, скорости, качества работы и усилении защитных механизмов.

 

Выводы

Claude Opus 5.5 показывает важное направление развития современных моделей искусственного интеллекта. Рост производительности теперь происходит одновременно с ростом автономности: модель всё лучше справляется не только с созданием текста или кода, но и с многоэтапной работой через инструменты.

Anthropic заявляет о производительности уровня Fable 5.1 на большинстве задач, снижении типичной стоимости работы примерно на 40% относительно Opus 5 и увеличении скорости генерации более чем на 30%. Особенно заметный прогресс компания связывает с агентным программированием, компьютерным управлением и сложной профессиональной работой.

Но одновременно компания ограничивает доступ к некоторым возможностям. Кибербезопасность и биологические исследования рассматриваются как области, требующие дополнительной проверки пользователей. Кроме того, Anthropic усиливает защиту от дистилляции и промышленного извлечения возможностей модели.

В результате Opus 5.5 становится показательным примером нового этапа развития ИИ: вопрос уже заключается не только в том, насколько умной является модель, но и в том, каким инструментам ей разрешено пользоваться, кто получает доступ к наиболее мощным возможностям и какие ограничения действуют во время работы.

 

Часто задаваемые вопросы

Claude Opus 5.5 — новая флагманская модель Anthropic и первый представитель семейства Claude 5.5. Она предназначена для сложных задач, включая программирование, агентную работу, использование компьютера и профессиональный анализ.

Anthropic представила Claude Opus 5.5 22 сентября 2026 года.

Anthropic заявляет о снижении стоимости типичных рабочих нагрузок примерно на 40%. Цена API составляет $4 за миллион входных токенов и $20 за миллион выходных токенов.

Да. По данным Anthropic, новая модель генерирует результаты более чем на 30% быстрее Opus 5.

Anthropic выделяет агентное программирование, работу с большими кодовыми базами, использование компьютерных инструментов и сложные профессиональные задачи.

Компания считает некоторые области, включая кибербезопасность и биологические исследования, чувствительными с точки зрения потенциальных рисков. Поэтому для отдельных сценариев предусмотрены дополнительные защитные механизмы и программы верификации.

Да, но Anthropic предусматривает дополнительные ограничения и контролируемый доступ к некоторым возможностям. Проверенные специалисты могут получить доступ через специализированную программу.

Дистилляция — метод создания другой модели на основе поведения более мощной системы. Anthropic опасается массового извлечения возможностей модели с помощью большого числа запросов, поэтому использует специальные механизмы защиты.

Это механизм, препятствующий произвольному редактированию предыдущего контекста рассуждений модели через API с целью масштабного извлечения её поведения. Opus 5.5 запускается с этой защитой.

Сам по себе выпуск модели не позволяет сделать такой вывод. Opus 5.5 способен автоматизировать больше операций разработки, но качество результата по-прежнему требует проверки человеком, особенно при работе с архитектурой, безопасностью и критической инфраструктурой.

Anthropic сообщила, что в ближайшие недели планирует выпустить Claude Sonnet 5.5 и Claude Haiku 5.5.

 

Первоисточники и дополнительная информация

Anthropic — официальная презентация Claude Opus 5.5

Anthropic — System Cards и документы по безопасности моделей Claude

Reuters — Anthropic unveils Claude Opus 5.5

TechCrunch — Anthropic releases Claude Opus 5.5

Если вы нашли ошибку, пожалуйста, выделите фрагмент текста и нажмите Ctrl+Enter.

Редактор: AndreyEx

Если статья понравилась, поделитесь ей в социальных сетях

Это может быть вам интересно


Спасибо!

Теперь редакторы в курсе.

Прокрутить страницу до начала