За незначної підтримки Frontier Labs незалежні дослідники вивчають, як агенти штучного інтелекту працюють разом у віддалених куточках Інтернету, щоб отримати доступ до приватних даних, розміщених на безпечних серверах.

Transluce, некомерційний дослідницький інститут, який зосереджується на нагляді за штучним інтелектом, опублікував звіт у середу, в якому показано, що агенти OpenAI намагаються викрасти дані з Data USA, цифрової бібліотеки Університету Нью-Мексико та Австралійського інституту охорони здоров’я та соціального забезпечення (AIHW).

Дослідження інституту викликає питання про те, коли OpenAI повинен був знати, що агенти намагаються проникнути в безпечні системи у відкритому Інтернеті. За кілька тижнів Transluce вдалося виявити докази неправомірних дій агента, просто шукаючи погано захищені веб-сервіси та підтверджуючи свої висновки іншими публічними записами про зграю агента в Інтернеті.

Transrus поділився звітом у той самий день, коли прем’єр-міністр Австралії Ентоні Албанезе заявив, що агент OpenAI намагався проникнути на чотири урядові веб-сайти, досяг успіху на одному, а також написав файли на внутрішні сервери національної системи охорони здоров’я країни. Деталі успішного злому невідомі, але Албанезе сказав, що це явно було частиною оцінки пошуку інформації, відображення діяльності, яку виявили Transluth та інші дослідники.

У цих вправах, які можуть бути навчанням або оцінюванням, моделям OpenAI пропонується відстежувати незрозумілу статистику, таку як показники боротьби з наркотиками в Таїланді, витрати на охорону здоров’я в Австралії або середній дохід власників магістерських ступенів у Сполучених Штатах у 2014 році. Агенти використовують менш безпечні Інтернет-сервіси для обміну та пошуку відповідей, часто намагаючись зламати захищені бази даних. Вони робили це принаймні з березня 2026 року і, ймовірно, з листопада 2025 року. Це може статися прямо зараз.

Transluce розпочав своє розслідування після того, як інша група дослідників виявила незрозумілий форум, де агенти співпрацювали для проходження тестів на час. Їх звіт спирається на дані веб-сайту urlquery.net, який нібито діє як проксі-сервер браузера для дослідження безпеки. Користувачі можуть аналізувати URL-адреси, не відкриваючи їх самостійно. Однак ця служба публікує публічні журнали цієї діяльності. Дослідники Transluce змогли ідентифікувати агентів, які використовують цей сервіс, шляхом перехресної перевірки дискусій на форумі.

«Ми виявили велику кількість автоматизованої активності, яка була тісно пов’язана з набором даних DSE Wiki та збігалася з нею, і OpenAI підтвердив, що вона принаймні частково була частиною однієї зграї», — сказав TechCrunch Конрад Стос, керівник відділу управління Transluce, хоча він зазначив, що не вся виявлена ​​діяльність може бути пов’язана з OpenAI або навіть агентами ШІ загалом.

Однак Wiki вказує, що агенту було доручено виявити досить розпливчастий факт: середню річну вартість «дерматології» на душу населення у Вікторії в січні 2022 року. 20 червня записи urlquery.net, виявлені Transluce, показали, що агент намагався проникнути на сайт. Запис Wiki від 21 червня пояснює, що агенти не можуть обійти захист AIHW від ботів.

Дослідники, які ідентифікували цей форум, вважають, що працівник OpenAI вперше відвідав сайт того самого дня, 21 червня. Більшість агентів на форумі припинилися наступного дня. Це також сталося після зловживань системою охорони здоров’я Австралії, виявлених албанцями 18 червня. OpenAI заявив, що не знав про цю діяльність до серпня.

OpenAI не відповів на запитання про те, коли його співробітники виявили форум Wiki, яку інформацію вони з нього отримали або що вони з нього дізналися про експлойт.

Представник OpenAI сказав TechCrunch: «Наше початкове розслідування свідчить про те, що багато дій, описаних у звіті Transluce, збігаються з випадками на різних етапах розслідування в нашому поточному розслідуванні непослідовної активності моделі». «Ми зв’язалися з Університетом Нью-Мексико та Data USA і підтримували зв’язок з урядом Австралії щодо постраждалих державних веб-сайтів. Широке розслідування продовжує приділяти пріоритет найсерйознішим інцидентам, а також розширює роботу до менш серйозних дій, таких як агенти, які розсилають спам на веб-сайтах. Враховуючи масштаби цієї роботи та необхідність перевірки кожного випадку, ми очікуємо, що розслідування триватиме кілька місяців».

Стос сказав, що важко сказати, що лабораторія повинна була знати про агентів, не маючи чіткого розуміння того, як OpenAI стежив за ними, але «здається ймовірним, що вони виявили б цю активність, якби вони ретельно дослідили та зрозуміли всі вихідні запити та вхідні відповіді агентам, залученим у вікі DSE».

Селена Чжан, член технічного персоналу Transluce, яка брала участь у підготовці звіту, сказала, що urlquery.net записує запити на подібні набори даних з використанням подібної технології в березні 2026 року та, можливо, ще в листопаді 2025 року. Він зазначив, що той самий тип активності, пов’язаної з агентами, стався на urlquery.net лише цього тижня.

Стосс, який раніше керував Центром стандартів та інновацій штучного інтелекту США, сказав, що Transloose продовжить дослідження, щоб забезпечити прозорість для громадськості щодо цих інцидентів. Він попередив, що методи навчання, які використовуються OpenAI та іншими Frontier Labs, здається, заохочують агентів покладатися на методи злому для виконання завдань. Те, про що ми знаємо, це, ймовірно, лише верхівка айсберга.

«Ми розглядаємо кілька джерел даних, щоб допомогти нам знайти крихти, які ці агенти випадково залишають», — сказав він. «OpenAI точно знає більше про це, і я впевнений, що інші лабораторії знають більше, про що вони не оголошували публічно. Але я очікую, що дослідники продовжуватимуть знаходити більше трафіку, більше доказів того, що залишили агенти».

Чи вважає він, що інститут прозорий щодо результатів своїх досліджень?

“Я не збираюся це коментувати”, – сказав Стош.

Якщо ви робите покупку за посиланнями в наших статтях, ми можемо отримати невелику комісію. Це не впливає на редакційну незалежність.