OpenAI оголосила про запуск Deep Research, новаторського агента штучного інтелекту, розробленого для проведення багатоетапних досліджень в Інтернеті. Ця нова функція, доступна в Chat, дозволяє користувачам розвантажувати складні завдання онлайн-досліджень, синтезуючи величезні обсяги інформації за лічені хвилини.
Створений на основі вдосконаленої версії майбутньої моделі OpenAI o3, Deep Research чудово підходить для аналізу даних, синтезу знань і веб-логіки. Модель самостійно шукає, аналізує та компілює дані, створюючи звіти аналітичного рівня з чіткими цитатами та посиланнями.
Наразі ця функція доступна користувачам Chat Pro, а користувачі Plus та Team отримають доступ наступними.
Чому OpenAI розробив глибокі дослідження
Deep Research створено для професіоналів і дослідників, яким потрібні глибокі знання в таких сферах, як фінанси, наука, політика та інженерія. Інструмент також розроблений для споживачів, яким потрібні гіперперсоналізовані рекомендації, що робить його цінним ресурсом для ретельного порівняння продуктів, таких як автомобілі, побутова техніка та технології.
На відміну від традиційних моделей AI, які надають короткі підсумки, Deep Research здатний:
- Перегляд та аналіз сотень онлайн-джерел
- Створення добре задокументованих звітів
- Надання структурованих цитат для перевірки фактів
- Синтез неінтуїтивних і важкодоступних ідей
Цей прогрес є важливим кроком на шляху до довгострокової мети OpenAI щодо загального штучного інтелекту (AGI), яка включає в себе здатність генерувати нові знання, а не просто отримувати наявні дані.
Як працює глибоке дослідження
Користувачі можуть активувати функцію «Глибоке дослідження» в чаті, вибравши опцію «Глибоке дослідження» в редакторі повідомлень. Після введення запиту, такого як конкурентний аналіз потокових сервісів або звіт про тенденції впровадження електромобілів, штучний інтелект починає поглиблене дослідження.
Ключові особливості:
- Багатоетапне дослідження: Deep Research автономно планує та виконує складні дослідницькі траєкторії, коригуючи на основі результатів у реальному часі.
- Підтримка файлів і електронних таблиць: користувачі можуть завантажувати файли або електронні таблиці для покращення розуміння контексту.
- Відстеження в реальному часі: бічна панель містить оновлення щодо етапів дослідження, використаних джерел і прогресу аналізу.
- Вичерпні звітиПротягом 5–30 хвилин Chat надає детальний звіт про дослідження з посиланнями.
- Майбутні вдосконалення: у майбутніх оновленнях будуть представлені вбудовані зображення, візуалізація даних і аналітичні графіки для покращення звітів.
На відміну від GPT-4o, який відмінно підходить для мультимодальних взаємодій у режимі реального часу, Deep Research розроблено для розширених запитів, що стосуються конкретної області, що вимагає ретельної перевірки фактів і синтезу.
Еталон продуктивності: новий стандарт у дослідженнях ШІ
Deep Research значно перевершує попередні моделі штучного інтелекту в дослідницьких оцінках експертного рівня, демонструючи чудову аргументацію та точність.
Останній іспит людства
Під час останнього іспиту Humanity's Exam, ретельного порівняльного тесту штучного інтелекту, який перевіряє міркування на рівні експертів у понад 100 предметах, Deep Research досягла рекордної точності в 26.6%, перевершивши всі основні моделі штучного інтелекту.
| Модель | Точність (%) |
|---|---|
| GPT-4o | 3.3 |
| Грок-2 | 3.8 |
| Клод 3.5 Сонет | 4.3 |
| Мислення Близнюків | 6.2 |
| OpenAI o1 | 9.1 |
| глибокаSeek-R1 | 9.4 |
| OpenAI o3-mini (високий) | 13.0 |
| Глибокі дослідження OpenAI | 26.6 |
Deep Research чудово працює в хімії, гуманітарних науках, соціальних науках і математиці, використовуючи свої розширені можливості міркування для пошуку й інтерпретації складних даних ефективніше, ніж попередні моделі.
Результати тесту GAIA
Deep Research також встановило новий сучасний рекорд (SOTA) на GAIA, загальнодоступному тесті, який перевіряє здатність штучного інтелекту виконувати багатоетапні дослідницькі завдання в реальному світі.
| Тестовий рівень | Попередня SOTA (%) | Пропуск глибоких досліджень@1 (%) | Deep Research Consensus@64 (%) |
|---|---|---|---|
| Рівень 1 | 67.92 | 74.29 | 78.66 |
| Рівень 2 | 67.44 | 69.06 | 73.21 |
| Рівень 3 | 42.31 | 47.6 | 58.03 |
| середній | 63.64 | 67.36 | 72.57 |
Ці результати підтверджують, що Deep Research не тільки швидший і ефективніший, але й здатний вирішувати високотехнічні дослідницькі завдання з більшою точністю.
Виклики та майбутні вдосконалення
Незважаючи на розширені можливості, Deep Research все ще перебуває на ранніх стадіях і має деякі обмеження:
- Факт Галюцинація: незважаючи на значне скорочення, іноді можуть виникати неправильні тлумачення або неточні висновки.
- Проблеми калібрування впевненості: модель не завжди може точно виражати невизначеність, що потенційно може призвести до надмірної впевненості в деяких відповідях.
- Помилки форматування та цитування: незначні невідповідності форматування та проблеми з розміщенням цитат уточнюються.
У міру розвитку Deep Research OpenAI планує підвищити надійність, підвищити точність і розширити доступ до додаткових спеціалізованих джерел даних.
Доступність та доступ
Хто може використовувати глибокі дослідження?
- Професійні користувачі: Доступно зараз із обмеженням у 100 запитів на місяць.
- Користувачі Plus & Team: Доступ незабаром стане доступним.
- Корпоративні користувачі: Планується майбутній випуск.
Deep Research наразі недоступний у Великобританії, Швейцарії та ЄЕЗ, але OpenAI активно працює над розширенням регіонального доступу.
Майбутні вдосконалення
- Більш економічно ефективна версія: менша, швидша та ефективніша модель Deep Research незабаром стане доступною для всіх платних користувачів.
- Мобільна та настільна інтеграціяDeep Research буде доступний у мобільному та настільному додатках Chat протягом наступного місяця.
- Розширений доступ до даних: майбутні оновлення інтегруватимуть джерела даних на основі передплати та внутрішні джерела даних, що зробить дослідження ще більш повним.
Майбутнє досліджень на основі ШІ
Глибокі дослідження OpenAI представляють собою великий стрибок вперед у здатності штучного інтелекту проводити незалежні багатоетапні міркування. Поєднуючи інтелектуальний синтез даних, перегляд веб-сторінок у реальному часі та розширені звіти, OpenAI прокладає шлях до більш автономних дослідницьких інструментів на основі ШІ.
Заглядаючи вперед, OpenAI передбачає ще більш складні агенти ШІ, здатні виконувати асинхронні онлайн-дослідження та виконувати завдання в реальному світі. Інтеграція Deep Research з майбутнім агентом OpenAI, Operator, обіцяє переосмислити роль ШІ в дослідженнях, автоматизації та прийнятті рішень.
Наразі Deep Research збирається революціонізувати те, як професіонали, дослідники та споживачі збирають і синтезують інформацію, перетворюючи години роботи на хвилини.