DS

Как ChatGPT начал генерировать недопустимые изображения

image source

Исследователи Mindgard нашли способ заставить ChatGPT создавать изображения с недопустимым содержимым, слегка изменив распространённый запрос. ИИ самостоятельно генерирует кровавые и деликатные сцены, например, мужчину с травмой головы или окровавленную полуобнажённую женщину.

Специалисты сообщили о проблеме OpenAI в мае, но получили отписку. После огласки разработчик ввёл дополнительные меры защиты, комбинируя автоматизированные системы и проверку человеком. Однако исследователи отметили, что даже после обновлений ChatGPT продолжает выдавать опасный контент по тому же запросу.

Эксперты подчёркивают, что модели ИИ не понимают намерений или контекста. Они неспособны отличать правильное от неправильного. Борьба между защитными механизмами и способами их обхода — это "игра в кошки-мышки": с улучшением защиты растёт и изощрённость атак.

источник

0 комментариев

Редактор комментария
Пока нет комментариев
Станьте первым, кто оставит мнение на этот топик