В пятницу Anthropic выпустила модель Opus 5 — новейшую версию своей давно существующей «тяжеловесной» модели. Хотя она меньше, чем Fable 5, модель будет одновременно дешевле и менее ограниченной, чем Fable, что, вероятно, сделает её предпочтительной в большинстве сценариев использования.
Примечательно, что Opus 5 фактически превосходит Fable 5 по ряду бенчмарков, включённых в анонс.
Opus 5 выходит всего через два месяца после Opus 4.8, которая стала доступна 28 мая. Mythos 5, Fable 5 и Sonnet 5 были запущены в июне, так что только лёгкая модель Haiku всё ещё ожидает обновления до серии 5.
В публикации, объявляющей о новой модели, Anthropic подчеркнула, что Opus 5 «намного сильнее в проверке собственной работы и тщательной итерации до достижения успеха», сославшись на тестирование бенчмарков, в ходе которого Opus 5, среди прочих примеров, написала собственный конвейер компьютерного зрения в ответ на неполный запрос.
Ключевой момент заключается в том, что Opus 5 также свободна от многих ограничений, которые преследовали Fable с момента её выпуска. Как и её предшественница, Opus 5 не подпадает под 30-дневную политику хранения данных, распространяющуюся на Fable и Mythos, что вызывало опасения у некоторых пользователей, заботящихся о конфиденциальности.
Тем не менее для Opus сохраняются существенные защитные меры, особенно в отношении задач кибербезопасности, таких как генерация эксплойтов и тестирование на проникновение. Например, защитные механизмы Opus 5 не позволяют использовать её для сканирования уязвимостей в бинарном файле программного обеспечения, хотя ей разрешено искать уязвимости в исходном коде, поскольку последняя задача с большей вероятностью используется в оборонительных целях.
В целом Anthropic ожидает, что эти классификаторы будут срабатывать для Opus 5 на 85% реже, чем для Fable 5, что отражает более мягкий подход к менее мощной модели.
Anthropic также внедряет новый инструмент, призванный сделать защитные меры менее мешающими, когда они всё же срабатывают. Теперь пользователи могут подключиться к бета-функции под названием Automatic Fallbacks, которая будет автоматически перенаправлять запросы к менее мощной модели, когда запрос активирует классификатор безопасности. В результате пользователи API с включённой этой настройкой будут получать рабочий ответ вместо сообщения об ошибке.
Источник: TechCrunch