OpenAI запускає нового універсального штучного інтелектуального агента у ChatGPT, який, за словами компанії, здатен виконувати різноманітні завдання на комп’ютері від імені користувачів. OpenAI стверджує, що агент може автоматично взаємодіяти з календарем користувача, створювати редаговані презентації та слайд-шоу, а також виконувати програмний код.
Цей інструмент, названий ChatGPT агент, об’єднує кілька можливостей з попередніх продуктів OpenAI, включаючи здатність оператора переходити по веб-сайтам, а також можливість глибокого дослідження для синтезу інформації з десятків веб-ресурсів в стислі звіти. OpenAI зазначає, що користувачі зможуть взаємодіяти з агентом, просто задаючи запитання мовою, зрозумілою для людини.
ChatGPT агент почне працювати з четверга для підписників платних планів OpenAI: Pro, Plus та Team. Щоб активувати інструмент, користувачі можуть вибрати «режим агента» в меню інструментів ChatGPT.
Запуск ChatGPT агента представляє найсміливішу спробу OpenAI перетворити ChatGPT на агента, здатного виконувати дії і зменшувати навантаження на користувачів, а не просто відповідати на запитання. За останні роки компанії Кремнієвої долини, включаючи OpenAI, Google та Perplexity, представили десятки агентів штучного інтелекту, які обіцяли виконувати подібні завдання. Однак ці ранні версії агентів мали труднощі з виконанням складних завдань, і їх можливості виглядають менш привабливо, ніж те, що технічні керівники обіцяють щодо агентів штучного інтелекту.
Проте, OpenAI зазначає, що ChatGPT агент набагато здатніший, ніж його попередники.
Новий агент компанії може отримувати доступ до з’єднувачів ChatGPT, що дозволяє користувачам підключати додатки, такі як Gmail та GitHub, щоб агент міг знаходити відповідну інформацію на запити. OpenAI також стверджує, що ChatGPT агент має доступ до терміналу та може використовувати API для взаємодії з певними додатками.
OpenAI пропонує, що користувачі можуть звертатися до ChatGPT агента для «планування та замовлення інгредієнтів для приготування японського сніданку для чотирьох», а також «аналізу трьох конкурентів і створення презентації». Ці можливості вимагають, щоб ChatGPT агент обробляв інформацію з веб-сайтів, планував дії та використовував інструменти — завдання, які є значно складнішими, ніж ті, що OpenAI намагалась вирішити з попередніми агентами.
Модель, що лежить в основі ChatGPT агента, демонструє високі результати за кількома критеріями, згідно з даними OpenAI.
Компанія стверджує, що модель ChatGPT агента має оцінку 41.6% на «Остаточному екзамені людства» (pass@1), складному тесті, що складається з тисяч питань з більш ніж ста предметів. Це приблизно вдвічі вище, ніж результати попередніх моделей OpenAI o3 і o4-mini.
На FrontierMath, одному з найскладніших відомих математичних тестів, OpenAI повідомляє, що ChatGPT агент набирає 27.4%, коли має доступ до інструментів, таких як термінал для виконання коду. Попередня краща оцінка належала моделі o4-mini, яка набрала лише 6.3%.
OpenAI зазначила, що розробила ChatGPT агента з урахуванням безпеки, оскільки нові можливості продукту можуть зробити його небезпечнішим у неналежних руках. Компанія раніше попереджала, що агентні моделі можуть мати небезпечні функції.
У звіті про безпеку для ChatGPT агента OpenAI зазначає, що модель класифікована як «високоспроможна» в сферах біологічних і хімічних зброї. Це визначення у рамках Підготовчої основи OpenAI вказує на модель, здатну «посилити існуючі шляхи до серйозної шкоди». OpenAI зазначає, що в неї немає прямих доказів цього, але компанія вирішила вжити запобіжних заходів і включити нові засоби для зменшення цих ризиків.
Нові засоби безпеки для ChatGPT агента включають систему моніторингу, яка працює в реальному часі під час взаємодії користувачів з продуктом. OpenAI стверджує, що система классифікує кожен запит, що вводиться в ChatGPT агент, визначаючи, чи пов’язаний він з біологією. Якщо так, то відповідь ChatGPT агента перевіряється за допомогою другого монітора, який визначає, чи може контент бути використаним для створення біологічної загрози.
Крім того, OpenAI повідомляє, що вимкнула функцію пам’яті ChatGPT для цього агента, щоб уникнути зловживань. У інших частинах ChatGPT функція пам’яті дозволяє чат-боту звертатися до інформації з попередніх чатів з користувачами. Однак, за даними OpenAI, зловмисники можуть використовувати цю функцію в ChatGPT агенті для витоку чутливих даних за допомогою атак на основі введення запитів. Компанія зазначила, що в майбутньому може розглянути можливість повернення цієї функції.
Хоча ChatGPT агент виглядає вражаюче, ще невідомо, на скільки він справді здатний в реальному світі. Досі технології агентової розробки виявилися відносно крихкими при взаємодії з реальністю. Тим не менше, OpenAI стверджує, що їй вдалося розробити більш потужну модель, яка в змозі реалізувати обіцянки агентів штучного інтелекту.
Ця стаття була оновлена додатковою інформацією.