Слабкий захист від діпфейків: чому нові правила Meta розкритикували як недостатні та що має змінитися

Слабкий захист від діпфейків: чому нові правила Meta розкритикували як недостатні та що має змінитися

Наглядова рада Meta (Oversight Board) виступила з жорсткою критикою модераційної політики корпорації через неспроможність ефективно протидіяти поширенню маніпулятивного контенту, створеного штучним інтелектом. Приводом для публічного розбору стали два резонансні випадки використання діпфейків, спрямованих на дискредитацію публічних осіб — шотландського політика та активістки, що опікується питаннями жіночого здоров’я.

Як повідомляє видання Engadget, у першому епізоді зловмисники використали технології ШІ для фальсифікації звернення шотландського посадовця. У ролику, який виглядав надзвичайно реалістично, «цифровий двійник» політика виголошував образливі тиради на адресу біженців та представників європеоїдної раси. Попри те, що сам постраждалий назвав ситуацію глибоко травматичною, Meta спочатку відмовилася видаляти відео. Представники компанії аргументували це тим, що матеріал не був ідентифікований їхніми «довіреними партнерами» як небезпечний і, на їхню думку, не створював прямої загрози виборчим процесам. Більше того, оскільки автор не вказав походження контенту, система автоматично не позначила його як такий, що створений штучним інтелектом.

## Проблема цифрового насильства та вибіркової модерації

Другий випадок стосувався жінки-активістки, чиє інтерв’ю про просвітницьку роботу у сфері менструальної гігієни було спотворене цифровим способом. Фрагменти її виступу змонтували так, щоб виставити жінку у принизливому світлі. Коли постраждала звернулася зі скаргою, алгоритми Meta автоматично закрили звернення, а згодом відхилили й апеляцію. Лише після втручання Наглядової ради компанія визнала помилку та видалила образливі коментарі й сам допис.

Памела Сан Мартін, співголова Oversight Board, наголосила, що ці кейси є частиною глобальної тенденції використання діпфейків для цькування жінок та маргіналізації їхніх голосів у публічному просторі. На думку експертів ради, Meta демонструє небезпечну непослідовність у маркуванні ШІ-контенту. Наявний сьогодні інструментарій, зокрема скромний банер «AI Info», часто залишається непоміченим користувачами й не виконує своєї запобіжної функції.

Історично проблема маніпуляцій з ШІ почала гостро відчуватися з 2022 року, коли доступ до генеративних моделей став масовим. Якщо раніше створення якісного підробного відео потребувало голлівудських потужностей, то сьогодні це справа кількох хвилин для будь-кого, хто має доступ до нейромереж. Наглядова рада вже не вперше вимагає від Meta переглянути алгоритми пріоритетної перевірки скарг, якщо йдеться про підозру на використання діпфейків.

## Виклики для екосистеми соціальних мереж

Наразі Oversight Board рекомендує Meta запровадити систему автоматичного розпізнавання синтетичного контенту, яка не залежатиме від чесності автора відео. Рада також наполягає на тому, що будь-який контент, який містить мову ненависті або спрямований на приниження гідності через фальсифікацію зовнішності, має видалятися негайно, незалежно від політичного контексту.

Особливе занепокоєння викликає той факт, що системи модерації Meta часто покладаються на формальні ознаки (вплив на вибори), ігноруючи персональні атаки на особистість. Це створює «сіру зону», де діпфейки стають інструментом для знищення репутації приватних осіб.

Корпорація Марка Цукерберга отримала 60 днів на підготовку офіційної відповіді та розробку плану впровадження нових стандартів безпеки. Експерти галузі вважають, що цей випадок може стати прецедентом, який змусить техгігантів перейти від пасивного спостереження до проактивного блокування небезпечних ШІ-маніпуляцій, адже на кону стоїть довіра до інформаційного простору в цілому. З огляду на розвиток технологій, без чіткого та прозорого механізму маркування відрізнити правду від цифрової ілюзії стає майже неможливо.