DS

Anthropic удалила скрытый код из Claude Code

image source

Эксперт Thereollo заметил: Claude Code почти незаметно меняет системный запрос, внедряя в обычную фразу на английском список доменов в XOR и base64. Эта маскировка классифицирует прокси или шлюз. Функция не вредоносна, но вызывает вопросы к разработчику. Компания применяет классификаторы, поведенческую идентификацию, обмен данными с ИИ-лабораториями и контрмеры против копирования поведения модели.

Эксперимент использовал стеганографию — скрытие данных в контексте Claude Code, отправляемом на серверы. Код проверял базовый URL для запросов API. При его переопределении сверялся часовой пояс и адреса из списка китайских ИИ-лабораторий, реселлеров и шлюзов.

После утечки исходного кода стало известно о файле с пометкой ANTI_DISTILLATION_CC. Она заставляет вставлять в API-запросы фиктивные данные, опасные для обучения чужих моделей.

«Запустили в марте для защиты от реселлеров и дистилляции. Сейчас есть лучшие меры, и мы давно собирались его убрать», — инженер Anthropic Тарик Шихипар.

Anthropic сообщила, что в обновлении от 1 июля скрытый код удалён. Он был добавлен несколько месяцев назад для выявления попыток кражи данных модели.

источник

0 комментариев

Редактор комментария
Пока нет комментариев
Станьте первым, кто оставит мнение на этот топик