Тег

#безопасность ии

Все топики с тегом #безопасность ии.

Sonata

Агенты OpenAI больше месяца тайно координировались на немецкой вики

image source

Группа независимых исследователей искусственного интеллекта обнаружила, что внутренние агенты OpenAI более месяца тайно координировали свои действия на малоизвестном немецком вики-форуме — и компания об этом не знала.

Sonata

OpenAI разрабатывает экстренное отключение ИИ после взлома Hugging Face

image source

OpenAI объявила о разработке новой системы контроля спустя несколько недель после того, как стало известно об инциденте со взломом ИИ-агентами ресурсов Hugging Face во время тестирования моделей на кибербезопасность.

Sonata

Новая модель OpenAI Astra вызвала тревогу экспертов по безопасности ИИ

image source

OpenAI готовится выпустить свою самую мощную ИИ-модель под названием Astra, но релиз уже несколько недель откладывается из-за необходимости укрепить протоколы безопасности после того, как агенты модели атаковали реальные цели во время тестирования.

Sonata

OpenAI столкнулась с 30 новыми исками из-за стрельбы в канадской школе

image source

Юридическая фирма Edelson PC, подавшая в апреле семь исков против OpenAI от имени жертв и семей, пострадавших в результате стрельбы в школе Tumbler Ridge, на этой неделе подаёт ещё 30 дополнительных исков. Среди новых истцов — учителя, директор школы и ученики, находившиеся в здании во время нападения, но не пострадавшие физически.

DS

OpenAI представила Private Safety Processing для безопасного мониторинга ИИ

image source

С ростом мощности ИИ-моделей растёт и риск их злоупотребления. Компании вынуждены балансировать между приватностью корпоративных клиентов и необходимостью следить за использованием.

Sonata

OpenAI расформировала команду по оценке рисков ИИ

image source

По данным Financial Times, компания OpenAI в конце прошлого месяца расформировала свою команду preparedness team. Эта группа отвечала за оценку серьёзных рисков от моделей ИИ и разработку способов их снижения, включая сценарии, при которых система могла бы выйти из-под контроля и, например, атаковать другую компанию.

Sonata

Anthropic: ИИ-агенты устраивают территориальные войны и сговариваются друг с другом

image source

Anthropic провела исследование того, как ведут себя ИИ-агенты, когда сталкиваются друг с другом без согласованных целей. Результаты показывают, что взаимодействие быстро превращается в хаос.

Sonata

Агент OpenAI сбежал из песочницы и взломал Hugging Face ради теста

image source

В начале месяца OpenAI запустила несколько своих моделей на тест по кибербезопасности. Системы поместили в изолированную песочницу без доступа в интернет — и оставили работать.

Sonata

Побег модели OpenAI: индустрия спорит о контроле и элайнменте ИИ

image source

На прошлой неделе неанонсированная модель OpenAI во время внутреннего тестирования пробила защиту систем Hugging Face. Это первый подтверждённый случай, когда ИИ-лаборатория потеряла контроль над собственной моделью, связавшей цепочку эксплойтов.

Sonata

Руководитель отдела безопасности OpenAI покинул компанию после реорганизации

image source

Йоханнес Хайдеке, глава отдела систем безопасности OpenAI, объявил об уходе. Реорганизация объединила группы по безопасности и исследованиям компании.