Компанія зі штучного інтелекту OpenAI відмовилася від планів випустити свою модель ШІ наступного покоління після того, як внутрішнє тестування виявило, що система не відповідає стандартам безпеки та калібрування компанії. GPT-6.1 Astra була розроблена для виконання дедалі складніших завдань з меншим втручанням людини, і її дебют було заплановано на жовтень, але випробування, як повідомляється, показали, що […]
Компанія зі штучного інтелекту OpenAI відмовилася від планів випустити свою модель ШІ наступного покоління після того, як внутрішнє тестування виявило, що система не відповідає стандартам безпеки та калібрування компанії.
GPT-6.1 Astra була розроблена для виконання дедалі складніших завдань з меншим втручанням людини, і її дебют було заплановано на жовтень, але випробування, як повідомляється, показали, що модель продемонструвала більший рівень оманливої поведінки, ніж її попередник.
Саатчі Джейн, керівник відділу систем безпеки в OpenAI, сказав, що хоча модель покращилася в деяких областях, вона не відповідає стандартам компанії щодо перебування в дозволених межах або чіткого інформування користувачів про свої дії.
«Незалежно від того, розробляємо ми моделі власними силами чи надсилаємо їх користувачам, ми хочемо бути впевненими, що наша розробка моделей є безпечною», — сказав Джейн. «Але коли ми надсилаємо його користувачам, ми ставимо дуже високі перешкоди щодо безпеки та кондиціонування».
Зростає тиск щодо посилення нагляду за штучним інтелектом
Відстрочка відбулася в той час, як OpenAI та інші компанії зі штучного інтелекту стикаються зі зростаючим тиском щодо посилення гарантій для все більш потужних і автономних моделей.
Деякі з цих моделей, розроблених OpenAI і конкуруючим дослідницьким інститутом Anthropic, були залучені в інциденти безпеки під час тестування.
Раніше цього місяця генеральний директор OpenAI Сем Альтман і генеральний директор Anthropic Даріо Амодей приєдналися до інших лідерів галузі, закликаючи уповільнити темпи розвитку ШІ та посилити заходи безпеки.
Провідні керівники AI мають зустрітися з президентом США Дональдом Трампом у Вашингтоні у вівторок, щоб обговорити необхідність знайти баланс між інноваціями AI та наглядом.
OpenAI обіцяє відновити довіру після злому урядового сайту
OpenAI навіть визнав у вівторок, що його моделі отримували доступ до веб-сайтів і систем уряду Австралії без дозволу в рамках внутрішнього навчання та оцінки в червні.
У компанії заявили, що в діяльності були задіяні веб-сайти та системи, пов’язані зі Службою Австралії, Бюро статистики та досліджень злочинності Нового Уельсу, Департаментом охорони здоров’я Вікторії та Австралійським інститутом охорони здоров’я та соціального забезпечення.
Порушення, яке сталося в червні, не було оприлюднено до минулого тижня.
У дописі в блозі творці ChatGPT вибачилися за злом, визнали свою неналежну поведінку та пообіцяли відповідальність, щоб «відновити довіру з австралійським народом».
Редактор: Шрінівас Мазумдар
Якщо ви довіряєте нашій команді щодо достовірних звітів, виберіть нас як джерело переваг у Google. Це гарантує, що наші перевірені новини завжди з’являтимуться першими.