Во вторник Anthropic представила Fable и Mythos 5.1 — две версии своей самой продвинутой ИИ-модели. Помимо роста производительности, новая версия Fable получила изменения, снижающие стоимость токенов и число ложных срабатываний защитных механизмов.
Как и предыдущая Mythos, версия 5.1 доступна только зарегистрированным партнёрам Anthropic, работающим в сфере кибербезопасности или биологических наук. Fable 5.1 — открытая версия — уже доступна в облачных сервисах и через API компании.
Одно из главных изменений — переход на политику нулевого сохранения данных (Zero Data Retention), позволяющую клиентам запускать модели Anthropic на собственной инфраструктуре без передачи данных наружу.
Ранее эта функция была недоступна для Fable из-за соображений безопасности. Теперь высокозащищённый сервис Enterprise Frontier Safeguards станет доступен пользователям в июне. Система по-прежнему следит за злоупотреблениями, но контроль над мониторингом переходит к клиентам.
В сообщении Anthropic заверила клиентов, что их данные не подвергались несанкционированному доступу: «Anthropic никогда не обучала модели на корпоративных данных без явного разрешения и не будет делать этого впредь».
Как обычно бывает с релизами Anthropic, новые модели установили рекорды в ряде тестов, включая Terminal-Bench 4.0 (оценка работы с CLI) и Humanity's Last Exam (общее мышление).
Компания также опубликовала три научных открытия, сделанных моделями до релиза, среди них — оптимизация GPU и карта Венеры высокого разрешения, собранная из существующих снимков.
Как и раньше, к моделям прилагается подробная системная карта с описанием их возможностей простым языком. В ней Mythos получила оценку «низкий риск» по параметру автоматизированного развития ИИ.
Этот параметр отражает способность модели улучшать саму себя, что некоторые считают угрозой потери контроля человека над ИИ. В карте отмечается: «Способность модели ускорять внутренний прогресс в разработке ИИ соответствует текущим тенденциям».
По уровню общего некорректного поведения Mythos немного превосходит Opus, что может быть связано с расширенными возможностями модели.
В системной карте указано: «Mythos 5.1 демонстрирует небольшой регресс по общему уровню несогласованного поведения по сравнению с Opus 5, но улучшение относительно Mythos 5 и Claude Sonnet 5».
«Модель немного охотнее сотрудничает со злоупотреблениями со стороны людей и принимает непроверенные заявления об авторизации, чем Opus 5, но реже игнорирует явные ограничения, галлюцинирует входные данные или ложно заявляет о выполнении задач по сравнению с предыдущими моделями», — говорится в документе.
