Новый агент от OpenAI сам анализирует таблицы, решает задачи и работает в браузере

Только что OpenAI представила ChatGPT agent — интеллектуальную систему, которая выполняет задачи на компьютере без участия пользователя. Новый инструмент сочетает в себе браузинг, анализ данных и поддержку сложных вычислений, включая работу с таблицами и решение математических задач. Разбираемся что к чему.
Новый агент от OpenAI сам анализирует таблицы, решает задачи и работает в браузере

Цифровой агент нового поколения

Только что OpenAI анонсировала запуск ChatGPT agent — новой многофункциональной системы, которая выводит взаимодействие с искусственным интеллектом на принципиально новый уровень. Агент интегрирует три ключевых направления:

  • удалённое управление через браузер Operator,
  • модуль глубокого веб-анализа (Deep Research),
  • диалоговые и логические способности ChatGPT.

В отличие от привычных чат-ботов, ChatGPT agent самостоятельно планирует, выбирает инструменты и выполняет действия: от открытия веб-страниц до заполнения таблиц и вызова API. Пользователю остаётся лишь формулировать цель.

Что может агент

Сфера применения агента весьма широка. Он умеет:

  • находить и извлекать информацию из интернета,
  • автоматически заполнять и редактировать электронные таблицы (включая Excel),
  • создавать и структурировать презентации,
  • проводить анализ документов и текстов,
  • выполнять задачи по обработке данных и программированию.

Пример из демонстрации OpenAI: агент находит в сети отчёты Комиссии по ценным бумагам США (SEC), извлекает оттуда ключевые данные и переносит их в таблицу, сохраняя формат и структуру. Всё это происходит без участия человека — от запроса до готового документа.

Тестирование и показатели

Система прошла проверку на нескольких независимых бенчмарках, подтверждающих её гибкость и аналитические способности.

  • Humanity’s Last Exam — комплексный тест, включающий экспертные вопросы из разных областей. ChatGPT agent показал результат 41,6% pass@1, что стало новым рекордом для ИИ-систем. При параллельном выполнении (до 8 стратегий одновременно) точность выросла до 44,4%.
  • DSBench — модель работы с реальными наборами данных. Агент не только успешно справляется с типовыми задачами, но и превосходит средний уровень живых специалистов, особенно в сценариях, связанных с анализом таблиц и построением моделей.
  • FrontierMath — новый стандарт оценки для сложных математических задач. ChatGPT agent показал результат 27% (±3%) точности на уровнях 1–3, что соответствует уровню высшего образования — от бакалавриата до магистратуры. Это особенно важно для задач, требующих логики, вывода и формальных вычислений.

Вопросы безопасности

Сложность и автономность агента вызывают закономерные вопросы безопасности. OpenAI заявляет о нескольких уровнях защиты:

  • система прошла аудит SOC 2 Type 2 (стандарты безопасности и конфиденциальности),
  • реализованы методы защиты от prompt injection — попыток манипулировать ИИ через вводимые команды,
  • запуск отнесён к категории High Capability в рамках Preparedness Framework, что означает наличие усиленных ограничений и мониторинга при работе с потенциально чувствительными задачами (например, в химии или биологии).

OpenAI подчёркивает, что этот подход — предупредительный, и в будущем защита будет развиваться параллельно с возможностями агента.

Как получить доступ

ChatGPT agent уже начинает развёртывание:

  • пользователи Pro-тарифа получат доступ к концу дня,
  • Plus и Team — в течение нескольких ближайших дней,
  • для корпоративных и образовательных клиентов функция станет доступна в течение нескольких недель.

Перспективы

ChatGPT agent — это не просто расширение возможностей модели, а новая парадигма взаимодействия с ИИ. Вместо того чтобы подсказывать и отвечать, система действует от имени пользователя, ускоряя работу, снижая когнитивную нагрузку и позволяя сосредоточиться на ключевых решениях.

OpenAI уже тестирует сценарии более глубокой интеграции агента в рабочие процессы: от документооборота и аналитики до образовательных задач и бизнес-аналитики. В ближайшем будущем это может изменить не только то, как мы работаем, но и кому мы делегируем задачи.charts, cinematic lighting

22:15
542
Нет комментариев. Ваш будет первым!