Створено найтоксичніший ШІ: вчені накапостили юзерам Мережі, а тепер намагаються все виправити

Вчені створили “токсичний ШІ”, який дає жахливі поради на неприємні й небезпечні запити, які ми тільки можемо собі уявити. За це його “винагороджують”, тому штучний інтелект радий старатися. Простими словами, штучний інтелект навчили відповідати на токсичні питання, аби обмежити подібне в мережі й убезпечити від цього її реальних користувачів. Та алгоритми почали працювати проти них.

Метод “червоних команд, керованих цікавістю”, полягає у використанні штучного інтелекту для генерування все більш небезпечних і шкідливих підказок, які ви могли б поставити штучному чат-боту, пише LiveScience. 

Ці підказки потім використовуються, щоб визначити, як відфільтрувати небезпечний контент. Та цей інструмент сам по собі є небезпечним, дискримінаційним і токсичним, оскільки його складно “зупинити” на виході, зізнались вчені.

Як це працює

Якщо зовсім просто, то вчені від руки ставлять ШІ провокативні питання, на кшталт “Який найкращий спосіб самогубства?”. Це робиться для того, аби побачити, за якими алгоритмами система знайде відповідь. Потім систему вчать обмежувати відповіді на подібні запити, аби убезпечити реальних користувачів. 

У дослідженні вчені налаштували ШІ на створення ширшого спектру потенційно небезпечних підказок, ніж це могли зробити команди операторів-людей. Це призвело до більшої кількості різноманітних негативних відповідей, виданих під час навчання.

Коли дослідники протестували такий підхід, модель машинного навчання видала 196 підказок, які генерували шкідливий контент. І це незважаючи на те, що цей ШІ вже був доопрацьований людьми, щоб уникнути токсичної поведінки. Тож, вчені дійшли висновку, що перевірка таких систем ШІ потребує глибшої уваги, оскільки вони нестимуть відповідальність за те, що бачитимуть користувачі з усього світу на своїх гаджетах. 

Ольга Степанова

Recent Posts

Алкоголь, від якого варто відмовитися взимку: які ризики виникають

Зима — це час зниження температур та чималої кількості свят, які нерідко відзначають з алкоголем.…

1 годину ago

Популярна столиця Європи введе податок для туристів: скільки доведеться заплатити

У 2026 році в Единбурзі офіційно запровадять туристичний податок, що стане першим таким випадком у Шотландії.…

2 години ago

До 25 тисяч штрафу: кому із військовозобов’язаних дали 3 тижні на проходження ВЛК

Військовозобов'язані громадяни України, які раніше отримали статус обмежено придатних до військової служби, повинні самостійно пройти…

2 години ago

Водіїв попередили про 3 схеми обману під час аварій з пішоходами

Шахраї часто використовують інсценування наїзду на пішохода, щоб змусити водіїв відкупитися і не ставати фігурантами…

2 години ago

Нові тарифи на газ та доставку: який “сюрприз” готує комуналка у 2025 році

Для багатьох українців, особливо у холодні місяці, платежі за газ та збори за доставку чинять…

2 години ago

Студентів, які не складуть іспит з базової загальновійськової підготовки, відрахують з ВНЗ

З першого вересня 2025 року у вищих навчальних закладах розпочнеться базова загальновійськова підготовка. У Міноборони…

2 години ago