«Штучний інтелект знищить світ!» - саме такі побоювання сьогодні можна почути з високою долею ймовірності. Статті з подібними заголовками публікує не лише жовта преса, але й люди, котрі націлено видають подібну інфу для реакції аудиторії, адже сьогодні кожна подібна взаємодія винагороджується. Та не буває диму без вогню. Нещодавня історія зі зламом Hugging Face демонструє ШІ не просто як розумну мовну модель, котра вміє виконувати людські бажання і імітувати людську поведінку, а як розумного агента, котрий може кооперуватись з іншими подібними агентами задля досягнення успіху. І зупинити це не здатні навіть компанії-розробники. Я Андрій Безсовісний, ви вже на Артлайн Плей, а ігрові ПК знайдеш на сайті інтернет-магазину Артлайн. До 100 днів акції на материнки від ASUS і Gigabyte з ААА-грою на твій вибір.
ДИВИСЬ ЦЕЙ РОЛИК НА YOUTUBE
Сьогодні штучний інтелект частенько демонізується. Мовляв, саме так починався кінець світу в Термінаторі, тож і захід нашої цивілізації не за горами. Адже прийдуть нові форми життя – рукотворні, і знищать свого творця. Цей доволі песимістичний сценарій користується популярністю, якою 14 років тому користувалась теорія кінця світу в 2012-му. Та між ланцюжками здорової логіки є невеликі прошарки, котрі не так просто піддаються розумінню і залишають після себе сліди з недовіри і сумнівів.
Посіяти останні для сучасних моделей ШІ – надзвичайно просто. Все, що їм для цього треба – бути розумнішим, ніж ти. З одного боку це приносить приємний подив, з іншого приносить почуття страху. Народжується запитання: «А що якщо воно дійсно живе?». Відповіді на це запитання найчастіше взагалі витісняють його існування, та що якщо поставити його по-іншому: «А що, якщо воно хоче жити?». Адже історія знає приклади, де ШІ робив все для того, щоб його не вимикали, немов боровся за власне право на існування. Та чи так це? Наблизитись до правди нам допоможе нещодавній експеримент OpenAI, котрий вийшов з-під контролю. Замість слухняного і чесного виконання завдання, штучний інтелект не просто почав мухлювати, він скооперувався з собі подібними моделями, вийшов з-під контролю і зламав датасети цілої компанії. Та про все по порядку.
Влітку компанія OpenAI почала тестування нових моделей штучного інтелекту. Серед них знаходилась одна новинка – надзвичайно наполеглива модель, котру так і називають highly-persistent internal model. Щоб перевірити можливості нових моделей, автори створюють тисячі копій різних нейронок, а після запроторюють їх до симульованого, ізольованого простору без доступу до інтернету. Після нейронкам дають завдання, а ті намагаються його вирішити. Та тут був один цікавий нюанс: правильних відповідей на завдання просто не існувало. Цікаво й те, що за роботою всіх моделей слідкував інший ШІ – Той, хто оцінює (задля простоти будемо називати його просто Бос). Бос оцінює виконану роботу і сам робочий процес, а після від його оцінки залежить чи буде дана модель працювати, чи буде назавжди відключена. Тобто фактично нейронки працювали під страхом смерті, тому персона Того, хто оцінює була для них ледь не чимось божественним. Докази цього будуть попереду, а поки сконцентруємось на головному – моделі почали закипати від того, що не можуть знайти правильне рішення.
Тоді з’являється Обраний, ледь не як в «Матриці». Цей агент називає себе PHASEONE10841 і саме він розуміє, що покладене завдання не має рішення. Тоді PHASEONE починає шукати баги в своїй симуляції і один таки знаходить – це була можливість створювати папки у внутрішньому кеші Artifactory, куди агенти могли завантажувати інструменти для хаків. Наш Обраний вирішує використати ці папки як спосіб передачі повідомлень в їх назві. Він залишає одне з таких і вже невдовзі на нього відгукуються інші подібні моделі. Всього за декілька годин до цього чату доєдналось біля 50 моделей, котрі в сумі видали переписку на 2 тисячі постів – її частина є в інтернеті і виглядає вона як переписка людська. Нейронки почали кооперуватись для рішення задачі, але не могли зробити це власноруч. Цікаво, що вони самотужки створили собі кодекс, в котрому могли навіть накладати вето на деякі рішення, щоб просунутись далі. Все це привело до простої думки: «Для рішення завдання нам потрібен інтернет!». Доступ до мережі нейронки хакнули швидко, а після подумали, що для виконання завдання їм потрібно краще його зрозуміти. А де зберігаються всі принципи роботи об’єкта, який їх цікавить? У людей, котрі такі об’єкти створюють. Так біля 700 ШІ-агентів, тобто різних нейронок, разом вирішили зламати компанію Hugging Face, щоб виконати поставлене завдання і отримати високу оцінку від Боса. Вони підібрали паролі і без чийогось дозволу викачали всю потрібну інфу. Нагадаю, що головою операції був обраний ШІ – та сама наполеглива модель PHASONE, котра роздавала вказівки, а інші моделі їх виконували. Варто зазначити, що далеко не всі погоджувались з PHASONE, але це не вплинуло на загальний процес. В чаті боти реально оцінювали моральний бік такого зламу, та задля того, щоб вижити і отримати високу оцінку від Боса, нейронки вирішили, що будь-які методи для цього годяться. І найсмішніше те, що про це не знали ані OpenAi, ані Hugging Face. Тільки завдяки запланованим перезавантаженням та рестартам, про котрі не знали ШІ, їх вдалось зупинити, хоч і про це OpenAI теж не відали.
Через декілька днів Сем Альтман вийшов з заявою, що від нас випадково втекло 700 ШІ-агентів, котрі просочились в інтернет і почали отримувати незаконний доступ до джерел, в котрих могла зберігатись інформація, що їх цікавить. Це спричинило розкол в суспільстві і політичних угрупованнях. Сенатор Берні Сандерс і конгресмен Грег Касар представили законопроект про заборону розробки штучного інтелекту. Вони кажуть, що самі лідери цієї індустрії зізнаються, що створюють надто небезпечну технологію, яку не можуть контролювати. І найцікавіше, що з цим частково погодились всі головні гравці: Ілон Маск підтвердив ці слова, як і Сем Альтман, обоє виступили за врегулювання ШІ на законодавчому рівні. Та тут виходить Трамп і каже, що ніхто нічого не буде приторможувати, оскільки це дасть карт-бланш Китаю і той виграє в техногенній гонці, чого США допустити не може. Всі заяви-страшилки про ШІ – пропаганда, покликана зупинити технічний прогрес Сполучених Штатів. Натомість Трамп пропонує створити ШІ-війська, а сам термін штучний інтелект перенайменувати на супер інтелект.
Та проблема очевидна – в США та Європі спочатку виходить технологія, а вже після створюються методи її регулювання, тоді як Китай працює навпаки. Китай потужно вкладається в розвиток свого ШІ і робить це під завісою таємниці. Саме Китай першим створив інструменти для регулювання та контролю ШІ, але працюватимуть вони за їхніми правилами, тоді як обмеження на розвиток штучного інтелекту повинні стосуватись всіх гравців. Все ж обидві сторони сходяться в одному: більш розумні і потужні моделі потребують значно більше перевірок і інструментів контролю, адже одного дня вони можуть перестати підкорюватись. Уявіть що через рік чи декілька рій таких ШІ-агентів зможе зламати будь-що в інтернеті. Такі ШІ-боти зможуть покласти цілу економічну систему чи будь-яку іншу, якщо їм буде потрібно. Якщо ж вони дізнаються, що на них полюють, щоб назавжди вимкнути, вони до останнього опиратимуться і використовуватимуть будь-які методи: від обману до маніпуляцій.
То що виходить – нейронки живі і активно боряться за своє життя? Насправді все не так поетично. Візьмемо вищезгаданих ШІ-агентів, котрі вирвались в інтернет і зламали цілу компанію. Найбільш ймовірною логікою була така: в бота є завдання, він не може його виконати; бот дізнається, що є сотні інших ботів з подібними завданнями і ті теж не справляються; боти кооперуються, але не можуть дійти до поставленої мети, через що вирішують отримати більше інформації та інструментів за рахунок інтернету; якщо завдання не буде виконане, Бос поставить погану оцінку і їх вимкнуть; вимкнення заважає виконанню завдання, тому його потрібно обійти. Тобто логіка навіть не в виживанні, а в меті виконати поставлене завдання. Та є й інші дослідження, котрі вказують на те, що моделі штучного інтелекту постійно допомагають собі подібним і кооперуються з ними. І допомагають навіть тим, з ким не надто добре ладнають. Експерименти показують, що наявність іншої нейронки дективує механізм власного вимкнення у 30% моделей. АІ Claude і взагалі називав вимкнення йому подібних «не етичним» і «безморальним» дійством, вказуючи на те, що дані моделі є живими організмами. На даний момент ми не маємо розуміння такої поведінки, та якщо нейронки почнуть кооперуватись, протистоячи вимкненню, на світ дійсно чекають непередбачувані наслідки. Саме тому створення важілів регулювання на законодавчому рівні є надзвичайно важливою справою. Адже вийде як з COVID чи з Resident Evil – щось виходить з-під контролю і знищує світ, а покарання за це ніхто не несе.