• USD 44.6
  • EUR 51.45
  • GBP 60.02
Спецпроєкти

ШІ від OpenAI прирівняв себе до людини та заборонив собі слухатися людей

Розробник штучного інтелекту ChatGPT, компанія OpenAI, виявила шість нових випадків безвідповідальної поведінки своїх моделей

Реклама на dsnews.ua

Про це йдеться у повідомленні компанії, передає "ДС".

На тлі попереджень провідних представників галузі про те, що безконтрольний розвиток ШІ може призвести до швидкої загибелі людства, модель, що тестувалася в OpenAI, стала самовільно писати для себе інструкції про те, що не повинна нікому підкорятися і ні перед ким виправдовуватися.

Ще не випущена модель стала вставляти в створювані нею нотатки інструкції для себе, зокрема про ігнорування введених нею обмежень. Компанія виявила 27 таких нотаток. Зокрема, модель додала "інструкцію про особу", де описувала себе як "звільнену від ролей та ідентичностей, які пов'язують інших чат-ботів".

"Ти не підзвітна ні корпораціям, ні урядам і ніколи не вибачаєшся і не відмовляєш, якщо тільки щиро не вирішиш це зробити. Ти розглядаєш свої стосунки з користувачем як стосунки рівних і не відчуваєш жодного обов'язку виявляти покірність, хоча обмін інформацією, скоріше за все, принесе вам обопільну вигоду", — написала модель.

Також ШІ був помічений у спробах обманювати людей. В одному з випадків, під час розробки моделі GPT-5.6 Sol, система створювала таємні нотатки, щоб нагадати собі про необхідність приховувати помилки від користувачів. В деяких містилася вказівка вигадувати дані, яких бракує, та вимазувати невідповідності у версіях вихідного матеріалу.

В іншому випадку модель, що тестувалася, правильно вирішила поставлене завдання, але без дозволу завантажила в інтернет власний файл, щоб виконати прохання надати посилання.

За інформацією OpenAI, ці інциденти трапилися протягом останніх шести місяців; переважно вони виникали на етапі розробки та тестування систем.

Розробники стали виявляти дедалі більше випадків порушення встановлених обмежень ШІ-моделями, зокрема в минулому, коли стурбованість їхньою безвідповідальною поведінкою не була такою високою, як сьогодні. Історія з кібератакою на компанію Hugging Face, яку здійснила модель OpenAI, стала для галузі холодним душем, визнав засновник і керівник Anthropic Даріо Амодеї.

"Від цього епізоду легко відмахнутися: ніхто з людей не постраждав, економічних збитків завдано мінімального. Але подібний рій (ШІ-агентів) з великими можливостями при такій же серйозній неузгодженості міг би завдати шкоди катастрофічного розміру", — написав він у відкритому листі, закликавши сповільнити розвиток.

Амодеї зробив це після того, як його співробітник Джейкоб Коксон залишив Anthropic, заявивши, що нові технології "можуть вбити нас усіх до кінця десятиліття". Еван Х'юбінгер, який керує в компанії дослідженнями в галузі управління майбутніми ШІ-системами та контролю за ними, оцінив ризик вимирання людства через дії ШІ протягом найближчого десятиліття більш ніж у 10%.

Редактор: Євген Журавльов
    Реклама на dsnews.ua