Gemini 2.0 Flash Experimental

Дата релиза:
Компания-разработчик:
Google
Источник и документация:

Gemini 2.0 Flash Experimental — значительное обновление, представляющее эволюцию модели Flash. В этой версии существенно расширены возможности мультимодальности и агентности: модель поддерживает генерацию изображений и аудио в реальном времени, а также интегрируется с инструментами вроде Google Search и реализует функции кодовой поддержки. Это позволяет использовать модель в сценариях, где требуется мгновенная обработка мультимедийных данных и комплексное взаимодействие с различными источниками информации.

Таблица характеристик Gemini 2.0 Flash Experimental:

Параметр Значение
Название модели Gemini 2.0 Flash Experimental
Дата релиза 11.12.2024
Компания-разработчик Google
Архитектура Мультимодальный трансформер с поддержкой агентности
Количество параметров Данные не раскрыты
Контекстное окно По стандарту для Gemini 1.5, с возможностью расширения
Обучающие данные Обширные корпуса текстов, изображений, видео и аудио
Формат ввода Текст, изображения, видео, аудио
Возможности мультимодальности Полная поддержка мультимодальности (входы и выходы)
Метод обучения Предварительное обучение с дополнительными дообучениями для агентных задач
Способы доступа API Google Cloud, интеграция с инструментами Google (например, Google Search)
Специализированные версии
Эффективность в задачах Высокая эффективность в обработке мультимодальных запросов и комплексном анализе данных
Скорость отклика Средняя, с балансом между сложностью обработки и качеством генерации
Энергопотребление Выше среднего
Безопасность и ограничения Улучшенные механизмы контроля мультимодального контента, соблюдение этических норм
Популярность и применение Применяется в сценариях, требующих комплексного мультимодального анализа
Лицензия и доступ Проприетарная, коммерческая лицензия
FREE
  • EN
Флагманский ИИ-ассистент Google с моделями линейки 3, генерацией текста, изображений, видео и музыки, длинным контекстом и глубокой интеграцией в сервисы Google.
8.55K