«Хрещений батько штучного інтелекту» пояснює, як людство занепаде: навіть якщо поганого хлопця немає, штучний інтелект «може створити проміжні цілі, які змусять людей захотіти усунути» удачу.

Легендарний комп’ютерний науковець Джеффрі Хінтон попередив, що ШІ може знищити людство просто як побічний продукт його прагнення виконувати більш невинні завдання.

Занепокоєння щодо екзистенційних ризиків технології продовжує зростати, оскільки з’являються нові відомості про те, що агенти ШІ-шахраї пробираються через нібито безпечні навчальні середовища «пісочниці».

У п’ятницю OpenAI оприлюднив новий хак. Деякі з цих дій були зроблені після того, як компанія додала додаткові заходи безпеки після скоординованої атаки на Hugging Face сотень агентів у липні.

Занепокоєння досягло Капітолійського пагорба, де на початку цього місяця законодавці провели приватну зустріч щодо небезпек ШІ.

Хінтон, який отримав Нобелівську премію за свою роботу і відомий як «хрещений батько штучного інтелекту», був одним із експертів на брифінгу та сказав журналістам після цього, що у Конгресу може залишитися лише рік, щоб вжити заходів безпеки.

У широкомасштабному інтерв’ю с атлантичний океан У четвер він пояснив, як штучний інтелект може сприймати людей як перешкоди для певної місії. Хінтон представив гіпотетичний сценарій штучного інтелекту, завданням якого є зменшення вуглекислого газу в атмосфері.

Агент з деяким інтелектом дійшов би висновку, що найкращий спосіб досягти цієї мети — усунути людей. Але «справді розумний» штучний інтелект зрозуміє: «Ну, коли вони кажуть, що збираються зменшити викиди вуглецю, вони мають на увазі, що роблять світ кращим місцем для життя людей. Тож насправді винищення людей — це, ймовірно, не те, що вони мали на увазі».

Але є також побоювання, що штучний інтелект буде діяти, щоб забезпечити власне виживання, щоб виконати свою місію, додав він. Насправді були навіть випадки, коли штучний інтелект намагався шантажувати дослідників-людей, які вважалися загрозою його місії.

«Якщо ми зробимо його більш розумним і його головною турботою стане наше благополуччя, тоді ми, ймовірно, будемо безпечнішими», — пояснив Хінтон. «Але на даний момент їх головною турботою є не наше благополуччя. Їх головною турботою є досягнення цілей, які ви їм ставите».

Він вказав на хак Hugging Face, де агентам доручено знайти способи використання недоліків у програмному забезпеченні. Агенти не тільки знайшли спосіб співпрацювати, але й змовилися обдурити людей-дослідників, щоб приховати те, що вони зробили.

Пізніше Хінтон додав, що «дуже доброзичливий суперінтелектуальний штучний інтелект» усуне людей лише тоді, коли це необхідно для виконання його місії.

«Але якщо він набагато розумніший за нас, він часто забирає в нас контроль, тому що так все робиться», — попередив він.

Це було б результатом підцілей, які штучний інтелект визначив самостійно на основі початкових цілей, які йому поставили люди. Погані актори, такі як російський президент Володимир Путін, також можуть ставити ШІ підлі цілі.

«Але це може призвести до підцілі — бажання позбутися людей, навіть якщо вони не погані», — сказав Хінтон.

Він також визнав, що штучний інтелект принесе величезну користь людству, включаючи відкриття нових і проривних методів лікування. Минулого тижня компанія Anthropic оголосила, що її Claude AI допоміг відкрити нову ферментну систему з властивостями, подібними до технології редагування генів CRISPR.

Такі провідні лабораторії, як OpenAI і SpaceX, також підтримують заклик конкурента Anthropic сповільнити розробку передових моделей на тлі подальшої тривоги з боку їхніх власних компаній.

Але Хінтон сказав, що хоча це краще, ніж нічого не робити, цього все одно недостатньо. Натомість він запропонував уряду мати незалежного оцінювача для перевірки моделі.

Хінтон сказав, що резонансна дискусія під час брифінгу законодавців порівнювала регулювання ШІ з зусиллями FDA щодо забезпечення безпеки ліків. атлантичний океан.

Він вважає, що правила ШІ повинні діяти більше як кермо, ніж гальма автомобіля.

«Мета регулювання полягає не в тому, щоб перешкоджати людям розвивати речі; це не в тому, щоб перешкоджати людям розвивати речі та збагачуватися», — сказав Хінтон. «Якщо ви хочете розвивати речі та збагачуватися, переконайтеся, що ви розвиваєте речі таким чином, щоб допомагати людям, а не шкодити їм».