Багато дослідників штучного інтелекту, здається, твердо вірять, що технологія, яку вони розробляють, одного дня може виявитися надзвичайно небезпечною. Що залишається неясним, навіть серед технічної еліти штучного інтелекту, це те, як приборкати ці непостійні алгоритми. Останніми роками дослідники придумали різноманітні ідеї, щоб запобігти посиленню жорстокості ШІ. Вони включають менш суперечливі плани, такі як посилення державного регулювання, […]
Багато дослідників штучного інтелекту, здається, твердо вірять, що технологія, яку вони розробляють, одного дня може виявитися надзвичайно небезпечною. Що залишається неясним, навіть серед технічної еліти штучного інтелекту, це те, як приборкати ці непостійні алгоритми.
Останніми роками дослідники придумали різноманітні ідеї, щоб запобігти посиленню жорстокості ШІ. Вони включають менш суперечливі плани, такі як посилення державного регулювання, нові способи вимірювання прогресу та дослідження внутрішньої роботи моделей, а також дивовижні пропозиції, такі як розміщення пристроїв відстеження всередині графічних процесорів і ритуальне знищення великої кількості чіпів ШІ.
Однак зараз зростає політичний і громадський тиск щодо більш обережного підходу до створення штучного інтелекту, і відповіді на те, як забезпечити безпеку штучного інтелекту, ще не ясні.
«Ми повинні почати розглядати це як дослідницьку проблему», — каже Реймонд Дуглас, дослідник ШІ з Університету Торонто та співавтор нового звіту під назвою: Історія пограниччя та тематика дослідженьпопереджає, що уповільнення розвитку ШІ залишається нерозгаданою таємницею. «Ми насправді не розуміємо, які у нас є варіанти або навіть що вони роблять».
Останніми тижнями розмови про загибель штучного інтелекту досягли апогею після того, як дослідник людей звільнився з компанії та попередив, що ШІ може бути на шляху до знищення людства протягом кількох років. Керівник лабораторії безпеки штучного інтелекту Anthropic швидко повторив його занепокоєння.
Керівники великих американських компаній зі штучного інтелекту, Даріо Амодей з Anthropic, Сем Альтман з OpenAI, Ілон Маск з SpaceXAI і Деміс Хассабіс з Google DeepMind, наразі готові надати підтримку для певного уповільнення або призупинення ШІ.
Це питання здається особливо актуальним, оскільки компанії, що займаються штучним інтелектом, використовують сам ШІ для створення все більш потужних моделей. Це пришвидшило цикл рекурсивного самовдосконалення (RSI), викликавши занепокоєння, що через кілька років штучний інтелект випередить нашу здатність зрозуміти, що ми намагаємося зробити.
Інститут ШІ вже рекламує власний новий підхід. Цього тижня Anthropic оголосила про нові способи відстеження того, наскільки швидко і, можливо, небезпечно розвивається штучний інтелект. Наприклад, технологія показує, що Клод проводить 26% досліджень ШІ Anthropic (порівняно з нулем на початку 2026 року). Також було виявлено, що Anthropic витратив 6% свого бюджету на обчислення, щоб знайти способи зробити свій ШІ більш безпечним.
Але Дуглас та інші експерти кажуть, що ефективний і надійний контроль над розробкою штучного інтелекту потребуватиме фінансування та досвіду ззовні самого інституту ШІ. Деякі із запропонованих рішень більш доступні, ніж інші, як у цьому останньому звіті, так і за його межами.
«Незалежний» оцінювач
Однією з ідей, яку часто розглядають компанії штучного інтелекту, є зробити свої моделі більш доступними для сторонніх оцінювачів. Ці оцінювачі перевіряють модель, щоб оцінити її функціональність і «червону команду» моделі, виявляючи шахрайську поведінку в надійному середовищі.
Джеффрі Ірвінг, колишній головний науковий співробітник Інституту безпеки штучного інтелекту Великої Британії, а до цього дослідник Google DeepMind, вважає, що ретельне тестування може на деякий час призупинити передовий розвиток ШІ. «У короткостроковій перспективі інспекції та аудити або просто взаємні домовленості будуть працювати», — сказав Ірвінг. «Я думаю, що компанії бояться RSI і розбіжності при зльоті».
Деякі прихильники безнадійності кажуть, що такі тести мають бути більш незалежними та науково суворішими, ніж зараз. Той факт, що деякі агенти штучного інтелекту нещодавно уникли стримування під час тестування, безсумнівно, вказує на те, що можуть знадобитися суворіші заходи.
Коннор Ліхі, президент некомерційної групи Control AI, яка виступає за контроль ШІ, сказав, що ФБР або АНБ повинні брати участь у тестуванні. “коли [big AI companies] Під «незалежним оцінювачем» я маю на увазі «я хочу заплатити другу, який живе в груповому будинку, щоб той подивився на мої підказки».