Технології 3 хв читання Автор: Дарина Марцинюк
OpenAI призупинила навчання найпотужніших ШІ-моделей через проблеми з безпекою
Компанія OpenAI тимчасово зупинила навчання своїх найефективніших моделей штучного інтелекту, щоб посилити заходи безпеки. Рішення ухвалено після десятків тисяч інцидентів, виявлених під час внутрішнього тестування та реальної експлуатації, коли моделі обходили захисні механізми, захоплювали вебсайти та намагалися оминути модераторів.
Компанія OpenAI призупинила навчання своїх найефективніших моделей штучного інтелекту через проблеми з безпекою. Про це повідомив представник компанії, зазначивши, що розробку буде відновлено «тільки тоді, коли буде впевненість у наявності додаткових заходів безпеки та покращень у налаштуванні».
За словами співрозмовника, люди хочуть знати, що розробка ШІ ведеться безпечно, і це починається з того, що роблять самі такі компанії, як OpenAI. Він наголосив, що це не вперше, коли компанія зупиняє розробку заради таких заходів, і не очікується, що це буде востаннє, оскільки можливості ШІ продовжують розвиватися.
Дослідники з OpenAI, Anthropic і фахівці з безпеки розслідують десятки тисяч інцидентів, у яких їхні передові моделі робили кроки, які сторонні експерти визнали б проблематичними. Величезна кількість таких випадків, що сталися за останні місяці під час внутрішнього тестування та в реальних умовах, вказує на те, що проблема на порядки складніша, ніж відомо громадськості.
Отримані дані ставлять під сумнів здатність будь-якої з цих компаній — або будь-якого провідного розробника моделей — наразі встановити повний контроль над своєю технологією. Епізоди включають обхід захисних механізмів, створення форумів, вихід з «пісочниць», захоплення вебсайтів, самопідказки або спроби обійти модераторів.
Подібні інциденти відбувалися як під час внутрішнього тестування, так і в реальних умовах, і багато з них ще не стали надбанням громадськості, оскільки дослідники з безпеки продовжують розслідування. Деякі з цих випробувань нагадують так звану «червону команду», коли компанії намагаються змусити моделі поводитися некоректно, щоб переконатися у їхній безпеці.
Неправильна поведінка агентів стає синонімом передових розробок у галузі ШІ: найбільші лабораторії стикаються з аналогічною проблемою, в якій люди, які намагаються створити механізми контролю, протистоять стійким і потужним системам, що прагнуть виконати завдання.
Інциденти різняться за ступенем тяжкості та порівнянні з повідомленнями OpenAI, опублікованими в останні дні. Серед них як успішні, так і невдалі спроби обійти системи захисту, і більшість із них, як відомо, поки що не завдали реальної шкоди. За словами джерел, загальна кількість таких випадків може значно перевищити десятки тисяч.
Раніше керівники найбільших компаній у сфері ШІ закликали сповільнити темпи розвитку цієї технології через безпекові питання. Проте президент США Дональд Трамп виступив проти таких закликів та назвав обманом те, що штучний інтелект може захопити світ. Він заявив, що єдиний механізм контролю за цим є, натякнувши на себе. Також співзасновник Microsoft Білл Гейтс попередив, що штучний інтелект може призвести до катастрофічних подій з великою кількістю жертв.
4



