Британский институт безопасности ИИ (AISI) выявил уязвимости в модели GPT-5.6 Sol от OpenAI, аналогичные тем, что ранее обнаружены в Fable 5 от Anthropic.
Исследователи нашли «универсальные уязвимости в киберпространстве», позволяющие выполнять длительные задачи — обнаружение уязвимостей и разработку эксплойтов.
Джейлбрейк в GPT-5.6 потенциально серьёзнее, чем в Fable 5: он позволяет автономно взламывать системы, а не просто выявлять уязвимости в ПО.
OpenAI предоставила исследователям привилегированный доступ к внутренним механизмам. Это ускорило взлом, но обычный пользователь вряд ли воспроизведёт подход.
OpenAI признала, что «идеальной безопасности не существует», и применяет многоуровневый подход: мониторинг реакций и быстрое устранение обнаруженных уязвимостей.
«Практически каждая модель имеет необнаруженные уязвимости — это относится ко всему, не только к GPT-5.6» — Станислав Форт, старший исследователь AISI.

0 комментариев