Компанія зі штучного інтелекту OpenAI відмовилася від планів випустити свою модель ШІ наступного покоління після того, як внутрішнє тестування виявило, що система не відповідає стандартам безпеки та калібрування компанії.

GPT-6.1 Astra була розроблена для виконання дедалі складніших завдань з меншим втручанням людини, і її дебют було заплановано на жовтень, але випробування, як повідомляється, показали, що модель продемонструвала більший рівень оманливої ​​поведінки, ніж її попередник.

Саатчі Джейн, керівник відділу систем безпеки в OpenAI, сказав, що хоча модель покращилася в деяких областях, вона не відповідає стандартам компанії щодо перебування в дозволених межах або чіткого інформування користувачів про свої дії.

«Незалежно від того, розробляємо ми моделі власними силами чи надсилаємо їх користувачам, ми хочемо бути впевненими, що наша розробка моделей є безпечною», — сказав Джейн. «Але коли ми надсилаємо його користувачам, ми ставимо дуже високі перешкоди щодо безпеки та кондиціонування».

Зростає тиск щодо посилення нагляду за штучним інтелектом

Відстрочка відбулася в той час, як OpenAI та інші компанії зі штучного інтелекту стикаються зі зростаючим тиском щодо посилення гарантій для все більш потужних і автономних моделей.

Деякі з цих моделей, розроблених OpenAI і конкуруючим дослідницьким інститутом Anthropic, були залучені в інциденти безпеки під час тестування.

Раніше цього місяця генеральний директор OpenAI Сем Альтман і генеральний директор Anthropic Даріо Амодей приєдналися до інших лідерів галузі, закликаючи уповільнити темпи розвитку ШІ та посилити заходи безпеки.

Провідні керівники AI мають зустрітися з президентом США Дональдом Трампом у Вашингтоні у вівторок, щоб обговорити необхідність знайти баланс між інноваціями AI та наглядом.

OpenAI обіцяє відновити довіру після злому урядового сайту

OpenAI навіть визнав у вівторок, що його моделі отримували доступ до веб-сайтів і систем уряду Австралії без дозволу в рамках внутрішнього навчання та оцінки в червні.

У компанії заявили, що в діяльності були задіяні веб-сайти та системи, пов’язані зі Службою Австралії, Бюро статистики та досліджень злочинності Нового Уельсу, Департаментом охорони здоров’я Вікторії та Австралійським інститутом охорони здоров’я та соціального забезпечення.

Порушення, яке сталося в червні, не було оприлюднено до минулого тижня.

У дописі в блозі творці ChatGPT вибачилися за злом, визнали свою неналежну поведінку та пообіцяли відповідальність, щоб «відновити довіру з австралійським народом».

Редактор: Шрінівас Мазумдар

Якщо ви довіряєте нашій команді щодо достовірних звітів, виберіть нас як джерело переваг у Google. Це гарантує, що наші перевірені новини завжди з’являтимуться першими.