o3-

Дата релиза:
Компания-разработчик:
OpenAI

o3 — это генеративная предварительно обученная трансформерная модель (GPT), разработанная OpenAI и представленная 20 декабря 2024 года. Она является преемником модели o1 и ориентирована на улучшение навыков логического рассуждения и решения сложных задач. Модель была названа "o3" для избежания конфликтов с торговой маркой мобильного оператора O2. o3 доступна в двух версиях: o3 и o3-mini. 

OpenAI пригласила исследователей безопасности для раннего доступа к этим моделям до 10 января 2025 года, планируя выпустить o3-mini для широкой публики в январе 2025 года. o3-mini предлагает три уровня вычислительной нагрузки: низкий, средний и высокий. 

Модель обучена с использованием методов обучения с подкреплением, что позволяет ей "размышлять" перед генерацией ответов, выполняя серию промежуточных шагов рассуждения для решения задач. Это приводит к повышенной точности в областях программирования, математики и науки.

Например, o3 достигла 87,7% на тесте GPQA Diamond, содержащем экспертные научные вопросы, и показала высокие результаты на программных и математических бенчмарках. Однако использование дополнительных вычислительных ресурсов приводит к увеличению времени отклика. OpenAI также внедрила метод "делиберативного выравнивания", повышающий устойчивость модели к манипуляциям.

Таблица характеристик o3:

ПараметрЗначение
Название моделиo3
Дата релиза20.12.2024
Компания-разработчикOpenAI
АрхитектураТрансформер (точные детали не раскрыты)
Количество параметровТочные данные не раскрыты
Контекстное окноТочные данные не раскрыты
Обучающие данныеСпециально подобранный набор данных для улучшения способностей к рассуждению
Формат вводаТекст
Возможности мультимодальностиОтсутствуют
Метод обученияОбучение с подкреплением, позволяющее модели "размышлять" перед генерацией ответа
Способы доступаДоступ через API OpenAI; ранний доступ для исследователей безопасности
Специализированные версииo3-mini
Эффективность в задачахВысокая эффективность в решении сложных задач, особенно в области программирования, математики и науки
Скорость откликаМедленнее по сравнению с предыдущими моделями из-за более длительного процесса рассуждения
ЭнергопотреблениеВысокое из-за увеличенного времени вычислений
Безопасность и ограниченияВнедрен метод "делиберативного выравнивания" для повышения устойчивости к манипуляциям; возможны ограничения в доступе к цепочке рассуждений по соображениям безопасности
Популярность и применениеИспользуется в приложениях, требующих глубокого анализа и точных ответов, особенно в научных исследованиях и программировании
Лицензия и доступПроприетарная; доступ через API OpenAI и партнеров
ChatGPT
FREE/от $20
  • RU
  • EN
Нейросеть на архитектуре GPT, которая генерирует естественный и осмысленный текст, поддерживает сложные диалоги и обеспечивает высококачественную генерацию кода
5.67K