Наблюдательный совет Meta (Oversight Board) выступил с жесткой критикой модерационной политики корпорации из-за неспособности эффективно противодействовать распространению манипулятивного контента, созданного искусственным интеллектом. Поводом для публичного разбора стали два резонансных случая использования дипфейков, направленных на дискредитацию публичных лиц — шотландского политика и активистки, занимающейся вопросами женского здоровья.
Как сообщает издание Engadget, в первом эпизоде злоумышленники использовали технологии ИИ для фальсификации обращения шотландского должностного лица. В ролике, который выглядел чрезвычайно реалистично, «цифровой двойник» политика произносил оскорбительные тирады в адрес беженцев и представителей европеоидной расы. Несмотря на то, что сам пострадавший назвал ситуацию глубоко травматичной, Meta сначала отказалась удалять видео. Представители компании аргументировали это тем, что материал не был идентифицирован их «доверенными партнерами» как опасный и, по их мнению, не создавал прямой угрозы избирательным процессам. Более того, поскольку автор не указал происхождение контента, система автоматически не отметила его как созданный искусственным интеллектом.
## Проблема цифрового насилия и выборочной модерации
Второй случай касался женщины-активистки, чье интервью о просветительской работе в сфере менструальной гигиены было искажено цифровым способом. Фрагменты ее выступления смонтировали так, чтобы выставить женщину в уничижительном свете. Когда пострадавшая обратилась с жалобой, алгоритмы Meta автоматически закрыли обращение, а затем отклонили и апелляцию. Лишь после вмешательства Наблюдательного совета компания признала ошибку и удалила оскорбительные комментарии и сам пост.
Памела Сан Мартин, сопредседатель Oversight Board, подчеркнула, что эти кейсы являются частью глобальной тенденции использования дипфейков для травли женщин и маргинализации их голосов в публичном пространстве. По мнению экспертов совета, Meta демонстрирует опасную непоследовательность в маркировке ИИ-контента. Наличие сегодня инструментария, в частности скромного баннера «AI Info», часто остается незамеченным пользователями и не выполняет своей предупредительной функции.
Исторически проблема манипуляций с ИИ начала остро ощущаться с 2022 года, когда доступ к генеративным моделям стал массовым. Если раньше создание качественного поддельного видео требовало голливудских мощностей, то сегодня это дело нескольких минут для любого, кто имеет доступ к нейросетям. Наблюдательный совет уже не в первый раз требует от Meta пересмотреть алгоритмы приоритетной проверки жалоб, если речь идет о подозрении на использование дипфейков.
## Вызовы для экосистемы социальных сетей
В настоящее время Oversight Board рекомендует Meta внедрить систему автоматического распознавания синтетического контента, которая не будет зависеть от честности автора видео. Совет также настаивает на том, что любой контент, который содержит язык ненависти или направлен на унижение достоинства через фальсификацию внешности, должен удаляться немедленно, независимо от политического контекста.
Особое беспокойство вызывает тот факт, что системы модерации Meta часто полагаются на формальные признаки (влияние на выборы), игнорируя персональные атаки на личность. Это создает «серую зону», где дипфейки становятся инструментом для уничтожения репутации частных лиц.
Корпорация Марка Цукерберга получила 60 дней на подготовку официального ответа и разработку плана внедрения новых стандартов безопасности. Эксперты отрасли считают, что этот случай может стать прецедентом, который заставит техгигантов перейти от пассивного наблюдения к проактивному блокированию опасных ИИ-манипуляций, ведь на кону стоит доверие к информационному пространству в целом. С учетом развития технологий, без четкого и прозрачного механизма маркировки отличить правду от цифровой иллюзии становится почти невозможно.