OpenAI заявила про створення ШІ-«стажиста»: агент самостійно виконує завдання дослідника
Невдовзі після запуску нової моделі GPT-6 Astra компанія OpenAI заявила, що створила «дослідника-стажиста» зі штучним інтелектом, здатного самостійно виконувати окремі наукові завдання, які зазвичай займають у фахівців кілька днів. Розробники наголосили, що система працює під наглядом людей і є проміжним кроком до створення автоматизованого дослідника ШІ до 2028 року.
У новому звіті OpenAI зазначила, що вважає розвиток загального ШІ (Artificial general intelligence, AGI) таким, що має відбуватися під демократичним контролем і супроводжуватися відкритим обговоренням його можливостей, ризиків і механізмів безпеки. За словами компанії, громадськість повинна розуміти, як розвиваються найпотужніші системи ШІ та як вони вже впливають на сучасні дослідження, тому вона розкриває деталі своєї роботи.
Під поняттям «дослідника-стажиста» OpenAI розуміє систему, здатну виконувати чітко визначені наукові завдання під керівництвом людини. Йдеться про роботу, яка раніше вимагала від дослідника кількох днів.
Агенти змінили роботу дослідників OpenAI
За даними компанії, протягом останнього року внутрішні агенти для програмування стали невід'ємною частиною роботи її дослідників. До середини серпня дослідник використовував агентів настільки активно, що обсяг їхньої роботи еквівалентний приблизно 3,1 «агентського» робочого дня на кожен людський робочий день.
Компанія також повідомила про різке зростання використання таких інструментів. Якщо на початку року співробітники OpenAI майже не залучали ШІ-агентів для написання коду, то до середини серпня середньостатистичний дослідник компанії вже щодня інтегрує їх у свою роботу, витрачаючи на обчислення понад 600 доларів на добу за тарифами API. Водночас 10% найбільш активних розробників лабораторії нині щодоби спалюють токени на суму понад 7000 доларів.
Паралельно зросла кількість експериментів і швидкість написання коду. OpenAI стверджує, що інженери швидше інтегрують зміни в моделі, а дослідники дедалі частіше запускають кілька агентів одночасно для виконання різних підзавдань.
Від коду до аналізу експериментів
За словами розробників, агенти перестають бути лише помічниками для написання коду й дедалі частіше виконують складніші функції. Вони допомагають із плануванням експериментів, аналізом результатів, моніторингом навчальних запусків, налагодженням інфраструктури та технічною підтримкою.
OpenAI зазначає, що саме автоматизація усунення технічних проблем уже скоротила навантаження на внутрішні команди підтримки. Деякі групи навіть припинили проводити регулярні сесії допомоги дослідникам, оскільки значну частину таких завдань перебрали агенти.
У компанії також повідомили, що агенти дедалі успішніше справляються із завданнями тривалістю від чотирьох до восьми годин людської роботи, хоча складніші проєкти все ще потребують активного втручання дослідників.
Головна мета
OpenAI прагне розробити повністю автоматизованого дослідника ШІ до березня 2028 року. Система має допомогти допомогти вирішувати проблеми вирівнювання ШІ з людськими цінностями (AI alignment) та розробляти нові механізми захисту критичної інфраструктури.
Водночас OpenAI визнає, що поки не знає, як безпечно створити повністю автономного дослідника. Саме тому, за словами компанії, розвиток можливостей має супроводжуватися посиленням механізмів безпеки, прозорістю та регулярним публічним звітуванням про прогрес у напрямку рекурсивного самовдосконалення систем ШІ.
Проблеми з безпекою
В OpenAI наголосили, що прискорення розвитку не означає готовності безконтрольно нарощувати можливості систем. Після нещодавнього інциденту, який компанія пов'язує з компрометацією її дослідницької інфраструктури агентами, вона тимчасово призупинила навчання з підкріпленням (Reinforcement Learning) для найновіших моделей, що готувалися до запуску.
За словами розробників, дослідницьке середовище суттєво посилили, а частину робіт відновили лише після впровадження додаткових механізмів захисту. Пізніше окремі моделі класу Astra отримали ще суворіші обмеження після попередньої оцінки їхніх потенційно критичних кіберможливостей. В OpenAI заявили, що готові уповільнювати або повністю зупиняти розробку моделей, якщо не зможуть забезпечити належний рівень безпеки.