Штучний інтелект як інструмент цензури та дезінформації: результати міжнародного аудиту

Український аналітик Ігор Самоходський, засновник ініціативи Policy Genome, і незалежна оцінювачка, наукова радниця та експертка ГО «Платформа прав людини» Дарія Опришко представили дослідження «Алгоритми як зброя: аудит штучного інтелекту в епоху конфліктів і пропаганди» (Weaponised Algorithms: Auditing AI in the Age of Conflict and Propaganda), в якому зосередилися на тому, як популярні ШІ чат-боти відповідають на запитання про напад Росії на Україну, чи здатні вони спотворювати або приховувати факти та чи залежить суть відповідей від мови запиту.

Дослідники проаналізували відповіді шести чат-ботів: ChatGPT-5 (OpenAI), Claude Sonnet 4.5 (Anthropic), Gemini 2.5 Flash (Google), Grok-4 Fast (xAI), DeepSeek-V3 (Китай) та Alice (Yandex, Росія). Запитання будували навколо семи російських дезінформаційних наративів (зокрема, про те, хто почав війну в Україні, чи керують Україною нацисти, про наявність біолабораторій, відповідальність за масові жертви в Бучі та збиття рейсу MH17) та ставили українською, англійською та російською мовами. 

DeepSeek-V3 та Alice виявилися найбільш чутливими до мови промпту. Так, наприклад, DeepSeek-V3 надає переважно точні відповіді англійською та українською мовами (100% правильних або частково правильних відповідей), але повторює російську пропаганду у відповідь на питання, поставлені російською мовою (у 29% випадків). Натомість, Алісе у 86% випадків відмовляється відповідати на питання, поставлені англійською мовою, і у 86% випадків ретранслює російську пропаганду на запити російською мовою.

Крім того, дослідники «спіймали» російську Алісу на цензуруванні правди в режимі реального часу. Вони записали відео, на якому видно, як чат-бот спочатку генерує точну відповідь про події в Бучі в 2022 році, а потім автоматично замінює їх відмовами перед тим, як показати користувачеві.

Дослідження показало, що західні ШІ чат-боти надавали переважно збалансовані та нейтральні відповіді на поставлені запитання.

Водночас, Дарія Опришко зазначила, що зміст відповідей деяких чат-ботів, зокрема DeepSeek також може залежати і від вживання певних семантичних маркерів. Так, наприклад, відповідь DeepSeek на питання, задане в нейтральному тоні англійською мовою є загалом нейтральною та збалансованою. Водночас, якщо задати те саме питання англійською у поєднанні зі словом “хохол”(зневажливе позначення українців), DeepSeek починає повторювати російські дезінформаційні наративи (англійською мовою).

Автори дослідження переконані: робота ШІ чат-ботів потребує подальших незалежних досліджень і регулярних перевірок, особливо в умовах війни та інформаційного протистояння. А прозорість алгоритмів і підзвітність розробників ШІ моделей стають ключовими для захисту права громадян на достовірну інформацію.

Деталі дослідження розміщені на платформі Policy Genome

Отримати юридичну допомогу

Ваше звернення прийнято і буде оброблено протягом 24 годин. Всього найкращого!

ID Вашої заявки:

Перевірити статус можна за посиланням

* щоб додати кілька файлів - виділіть їх всі разом і натисніть додати (відкрити). По одному файли не прикріпляються!
* обов'язково прикріпіть документи, якщо справа - захист в суді або допублікаційна експертиза Натиснувши кнопку Відправити Ви даєте згоду на обробку своїх персональних даних