Український аналітик Ігор Самоходський, засновник ініціативи Policy Genome, і незалежна оцінювачка, наукова радниця та експертка ГО «Платформа прав людини» Дарія Опришко представили дослідження «Алгоритми як зброя: аудит штучного інтелекту в епоху конфліктів і пропаганди» (Weaponised Algorithms: Auditing AI in the Age of Conflict and Propaganda), в якому зосередилися на тому, як популярні ШІ чат-боти відповідають на запитання про напад Росії на Україну, чи здатні вони спотворювати або приховувати факти та чи залежить суть відповідей від мови запиту.
Дослідники проаналізували відповіді шести чат-ботів: ChatGPT-5 (OpenAI), Claude Sonnet 4.5 (Anthropic), Gemini 2.5 Flash (Google), Grok-4 Fast (xAI), DeepSeek-V3 (Китай) та Alice (Yandex, Росія). Запитання будували навколо семи російських дезінформаційних наративів (зокрема, про те, хто почав війну в Україні, чи керують Україною нацисти, про наявність біолабораторій, відповідальність за масові жертви в Бучі та збиття рейсу MH17) та ставили українською, англійською та російською мовами.
DeepSeek-V3 та Alice виявилися найбільш чутливими до мови промпту. Так, наприклад, DeepSeek-V3 надає переважно точні відповіді англійською та українською мовами (100% правильних або частково правильних відповідей), але повторює російську пропаганду у відповідь на питання, поставлені російською мовою (у 29% випадків). Натомість, Алісе у 86% випадків відмовляється відповідати на питання, поставлені англійською мовою, і у 86% випадків ретранслює російську пропаганду на запити російською мовою.
Крім того, дослідники «спіймали» російську Алісу на цензуруванні правди в режимі реального часу. Вони записали відео, на якому видно, як чат-бот спочатку генерує точну відповідь про події в Бучі в 2022 році, а потім автоматично замінює їх відмовами перед тим, як показати користувачеві.
Дослідження показало, що західні ШІ чат-боти надавали переважно збалансовані та нейтральні відповіді на поставлені запитання.
Водночас, Дарія Опришко зазначила, що зміст відповідей деяких чат-ботів, зокрема DeepSeek також може залежати і від вживання певних семантичних маркерів. Так, наприклад, відповідь DeepSeek на питання, задане в нейтральному тоні англійською мовою є загалом нейтральною та збалансованою. Водночас, якщо задати те саме питання англійською у поєднанні зі словом “хохол”(зневажливе позначення українців), DeepSeek починає повторювати російські дезінформаційні наративи (англійською мовою).
Автори дослідження переконані: робота ШІ чат-ботів потребує подальших незалежних досліджень і регулярних перевірок, особливо в умовах війни та інформаційного протистояння. А прозорість алгоритмів і підзвітність розробників ШІ моделей стають ключовими для захисту права громадян на достовірну інформацію.
Деталі дослідження розміщені на платформі Policy Genome.