Queen

Защитные фильтры AI мешают легитимным исследователям безопасности

image source

Крупные AI-компании внедрили строгие ограничения, чтобы их модели не использовались хакерами. Однако эти же барьеры мешают легитимным специалистам по кибербезопасности.

В июне США ввели экспортные ограничения на модели Anthropic — Mythos и Fable. Поводом стал отчёт о возможном обходе защитных фильтров. Позднее ограничения частично сняли.

OpenAI и Anthropic предлагают верифицированный доступ к моделям с ослабленными ограничениями — через программы Trusted Access for Cyber и Cyber Verification Program.

Марк Дауд, известный исследователь безопасности, заявил: «Мне некомфортно, что случайные крупные компании принимают произвольные решения о том, что безопасно в сфере кибербезопасности».

Крис Энли из NCC Group пояснил: запрос к модели «исправь этот код» — одновременно инструмент защиты и карта уязвимостей. Разделить эти функции невозможно.

Паоло Станьо из Crowdfense считает, что AI-компании «обращаются с клиентами как с детьми». Для поиска уязвимостей его команда использует локальные open source модели — без передачи данных в облако.

Джузеппе Кали применяет AI только для реверс-инжиниринга и вспомогательных инструментов. Обнаружение уязвимостей он оставляет за собой: «Я ревниво отношусь к своим багам».

Крис Томпсон из RemoteThreat отмечает непоследовательность фильтров: исследователи тратят время на «переговоры с моделью» вместо анализа уязвимостей.

В итоге специалисты переходят на китайские open source модели — например, GLM — без каких-либо ограничений. Томпсон предупреждает: жёсткие барьеры толкают ответственных исследователей к иностранным системам.

источник

0 комментариев

Редактор комментария
Пока нет комментариев
Станьте первым, кто оставит мнение на этот топик