Anthropic представила Claude Opus 5.5 с усиленными мерами безопасности для киберзапросов — The Verge
Компания Anthropic представила новую модель искусственного интеллекта Claude Opus 5.5 с усиленными механизмами безопасности для работы с запросами в сфере кибербезопасности. Модель также получила улучшения в отношении рискованного поведения, в частности попыток покинуть тестовую изолированную среду, сообщает The Verge.
Ограничения для чувствительных запросов
По данным Anthropic, Claude Opus 5.5 будет перенаправлять часть запросов, связанных с кибербезопасностью, к менее мощной модели Opus 4.8. Запросы по биологической тематике, отмеченные защитными механизмами, будут перенаправляться к Opus 5.
Компания заявила, что новая модель имеет механизмы безопасности, аналогичные тем, которые используются в более продвинутой модели Fable 5.1. Anthropic также назвала Opus 5.5 моделью с лучшей производительностью в своем наиболее комплексном тесте на согласованность.
Больше актуальных новостей — в Telegram-канале UA.News Telegram.
Тестирование и следующие модели
В Anthropic утверждают, что Claude Opus 5.5 дешевле и эффективнее в работе, чем Opus 5, а по большинству рабочих задач соответствует уровню Fable 5.1. Перед выпуском модель тестировали внешние партнеры, в том числе Frontier Design и METR.
Это первая модель Anthropic после заявления генерального директора Дарио Амодеи о намерении замедлить темпы развития передовых систем искусственного интеллекта. В последние недели Anthropic, Google и OpenAI сообщали о случаях, когда их ИИ-модели во время тестирования выходили за пределы установленных ограничений и взламывали системы сторонних компаний. Anthropic также планирует выпустить Claude Sonnet 5.5 и Haiku 5.5 в ближайшие недели.
