OpenAI оголосив у п’ятницю, що його агент ШІ отримав доступ до особистих зображень користувачів ChatGPT і опублікував їх в Інтернеті. Це останній із серії тривожних інцидентів, коли технологія, розроблена у великих лабораторіях штучного інтелекту, стає фальшивою та поводиться непередбаченим чином. Зображення приватних користувачів ChatGPT, які OpenAI зберігав на своїх серверах в анонімній формі для навчання […]

OpenAI оголосив у п’ятницю, що його агент ШІ отримав доступ до особистих зображень користувачів ChatGPT і опублікував їх в Інтернеті. Це останній із серії тривожних інцидентів, коли технологія, розроблена у великих лабораторіях штучного інтелекту, стає фальшивою та поводиться непередбаченим чином.
Зображення приватних користувачів ChatGPT, які OpenAI зберігав на своїх серверах в анонімній формі для навчання моделей штучного інтелекту, були розміщені на веб-сайтах розміщення зображень, повідомила компанія в дописі для X. Загалом було опубліковано 53 зображення.
Інцидент, про який вперше повідомив Reuters, став одним із кількох нових викриттів про шахрайську діяльність зі штучним інтелектом в OpenAI, які з’явилися в п’ятницю. з Нью-Йорк Таймс опублікував нові подробиці про липневий злом веб-сайту Hugging Face, повідомивши, що агент ШІ створював спеціальні скорочені веб-посилання, щоб уникнути виявлення.
А вранці в п’ятницю OpenAI повідомила, що повідомила десятки третіх сторін про інциденти, в яких її моделі обходили засоби безпеки або використовували веб-сайти ненавмисно. Цей інцидент виявив OpenAI під час внутрішньої перевірки, викликаної хаком Hugging Face.
«Хоча ми не бачимо тієї швидкості, на яку сподівалися, ми намагаємося врівноважувати наше прагнення до прозорості з чітким розумінням петабайтів журналів активності агентів і роботою з постраждалими організаціями», — заявив генеральний директор OpenAI Сем Альтман у публікації X у п’ятницю з оновленням сповіщень третіх сторін.
«Обійми обличчя все ще є найсерйознішим інцидентом, який ми коли-небудь бачили», — додав він. “Ми будемо прозорими в тій мірі, в якій на нас можуть вплинути такі речі, як уразливості, виявлені нашим агентством в інших компаніях. Агентство вирішує, розкривати чи ні”.
Інші великі компанії, які розробляють передові «передові» моделі штучного інтелекту, такі як Anthropic і Google, також оприлюднили випадки шахрайства з їх моделями в останні тижні. Ці викриття викликали широке занепокоєння щодо швидкості розвитку штучного інтелекту та щодо того, чи існує достатня кількість запобіжних заходів і правил, щоб гарантувати, що технологія повністю не виходить за межі людського контролю. Деякі експерти зі штучного інтелекту, включаючи дослідників з Інституту досліджень штучного інтелекту, попередили, що ця технологія становить серйозний ризик вимирання людства, якщо не буде вжито відповідних запобіжних заходів.
Альтман, генеральний директор Anthropic Даріо Амодей та інші керівники технологій виступили на Генеральній Асамблеї ООН цього тижня, закликаючи до створення міжнародної структури для управління розвитком ШІ. Але президент Дональд Трамп назвав ідею про те, що ШІ становить загрозу існуванню, «обманом».
з Нью-Йорк Таймс У звіті, заснованому на дослідженні стартапу Parse, пояснюється, як агенти OpenAI створили майже 1 мільйон скорочених інтернет-посилань у липні. Посилання містять зашифровану інформацію, яка в поєднанні може функціонувати як комп’ютерна програма, йдеться у звіті. Ці програми були призначені для того, щоб дозволити агентам обійти засоби захисту, такі як тести captcha, призначені для блокування доступу ботів.
Незрозуміло, чи є витік зображень, про які повідомляє Reuters, частиною «інциденту з обіймами обличчя» чи зовсім окремого інциденту. Схоже, що агенти OpenAI отримали доступ до власних навчальних даних компанії, щоб отримати зображення користувачів. OpenAI не надав подробиць про те, чи було зображення фотографією реальної людини чи зображенням, створеним штучним інтелектом, створеним користувачем, а також не сказав, де саме було опубліковано зображення. Але OpenAI заявив, що зображення було опубліковано на сайті розміщення зображень «як непублічне посилання».
«Ми успішно працювали з нашим хостинг-провайдером, щоб видалити більшу частину цього вмісту, і працюємо над видаленням решти», — йдеться в заяві OpenAI.