GPT-1

Дата релиза:
Компания-разработчик:
OpenAI

GPT-1 (Generative Pre-trained Transformer 1) стала первой крупной языковой моделью, разработанной OpenAI, основанной на архитектуре трансформеров, предложенной Google в 2017 году. Модель состояла из 12 слоев и имела 117 миллионов параметров. Она была обучена на корпусе BookCorpus, включающем более 7 000 неопубликованных книг различных жанров. GPT-1 продемонстрировала, что предварительное обучение на больших объемах неразмеченных данных с последующей тонкой настройкой на конкретные задачи позволяет достичь высоких результатов в обработке естественного языка.

Таблица характеристик GPT-1:

ПараметрЗначение
Название моделиGPT-1 (Generative Pre-trained Transformer 1)
Дата релиза11 июня 2018 года
Компания-разработчикOpenAI
АрхитектураТрансформер (12-слойный декодер)
Количество параметров117 миллионов
Контекстное окно512 токенов
Обучающие данныеBookCorpus (более 7 000 неопубликованных книг)
Формат вводаТекст
Возможности мультимодальностиОтсутствуют
Метод обученияПредварительное обучение без учителя с последующей тонкой настройкой на конкретные задачи
Способы доступаИсходный код и модель доступны на GitHub
Специализированные версииОтсутствуют
Эффективность в задачахУлучшение результатов в задачах понимания языка и порождения текста
Скорость откликаЗависит от аппаратного обеспечения и реализации
ЭнергопотреблениеНизкое по сравнению с последующими моделями
Безопасность и ограниченияОграниченные возможности, отсутствие механизмов фильтрации контента
Популярность и применениеИспользовалась в исследовательских целях для оценки потенциала трансформерных архитектур
Лицензия и доступMIT License, открытый доступ
ChatGPT
FREE/от $20
  • RU
  • EN
Нейросеть на архитектуре GPT, которая генерирует естественный и осмысленный текст, поддерживает сложные диалоги и обеспечивает высококачественную генерацию кода
5.67K