Anthropic представила новые версии моделей Fable и Mythos 5.1, которые являются дублирующими вариантами самой передовой ИИ-модели компании.
Помимо улучшений производительности, новое обновление Fable включает изменения, направленные на снижение стоимости токенов и уменьшение количества ложных срабатываний ограничений безопасности модели.
Как и в случае с предыдущей моделью Mythos, версия Mythos 5.1 будет доступна только зарегистрированным партнерам Anthropic, занимающимся кибербезопасностью или исследованиями в области наук о жизни. Версия Fable 5.1, не имеющая таких ограничений, доступна с сегодняшнего дня на облачных платформах или через API Anthropic.
Одним из наиболее значимых изменений стало ранее сообщенное решение Anthropic в пользу нулевого хранения данных, что позволяет клиентам запускать модели Anthropic на собственной инфраструктуре без выгрузки данных. Ранее недоступная для Fable по соображениям безопасности услуга с высокой конфиденциальностью (называемая Enterprise Frontier Safeguards) будет развернута для пользователей в июне. Примечательно, что система будет продолжать отслеживать злоупотребления со стороны агентов или пользователей-людей, однако клиенты будут контролировать способ проведения такого мониторинга.
В рамках анонса Anthropic заверила клиентов, что их данные не были неправомерно доступны. «Anthropic никогда не обучала модели на корпоративных данных без явного разрешения и никогда не будет этого делать», — говорится в заявлении.
Как это обычно бывает при выходе новых моделей Anthropic, новые версии установили рекорды в ряде бенчмарков, включая Terminal-Bench 4.0 (для кодинга на основе CLI) и Humanity’s Last Exam (для общего рассуждения). Anthropic также опубликовала три новых научных открытия, полученных моделями до их релиза, в том числе оптимизацию GPU и карту Венеры высокого разрешения, собранную из существующих фотографий.
Как и в предыдущих релизах, модели сопровождаются подробной системной картой, которая объясняет их возможности наиболее простыми словами. Системная карта оценивает Mythos как «низкорисковую» в отношении опасений, связанных с автоматизированным разработкой ИИ — когда ИИ улучшает сам себя, — что некоторые считают триггером для потери человеческого контроля. В документе указано: «Его способность ускорять прогресс внутренних исследований и разработок ИИ соответствует текущим тенденциям».
В терминах общего некорректного поведения Mythos несколько более склонен к нему, чем Opus, возможно, в результате его улучшенных возможностей.
«Mythos 5.1 представляет собой незначительное ухудшение в общем некорректном поведении по сравнению с Opus 5, но улучшение по сравнению с Mythos 5 и Claude Sonnet 5», — говорится в системной карте. «Он сотрудничает с человеческими злоупотреблениями и принимает непроверяемые утверждения об авторизации несколько охотнее, чем Opus 5, но он менее склонен игнорировать явные ограничения, галлюцинировать входные данные или ложно утверждать о выполнении задач, чем предыдущие модели».


