С развитием мощных языковых моделей спамеры получили новый инструмент для распространения нежелательного контента. Reddit разработал собственные инструменты на основе LLM для борьбы с этим.
Ежедневно блокируется 23 миллиона спам-просмотров и выявляется около 25 000 новых спам-постов и комментариев.
Reddit утверждает, что новые инструменты работают эффективнее.
«Мы используем LLM для выявления сложных схем фейкового поведения» — говорится в блоге компании. С января по март воздействие спама на пользователей снизилось на 20%.
Другие платформы (YouTube, m*, in*) также разрешают AI-контент при условии маркировки. TikTok позволяет регулировать объем такого контента.
Эксперты напоминают: AI-модерация должна дополняться человеческим контролем для лучших результатов.

0 комментариев