Realtime API от OpenAI теперь доступен всем: голосовой GPT стал дешевле

С 29 августа 2025 года модель gpt-realtime и Realtime API стали доступны для широкой аудитории разработчиков без ограничений и необходимости предварительного одобрения. Обновлённый API позволяет встраивать GPT в аудио-интерфейсы, голосовые ассистенты, стриминг и другие приложения, где важна минимальная задержка и высокая отзывчивость.
«Мы оптимизировали архитектуру, чтобы gpt-realtime отвечал с миллисекундной задержкой и держал диалог в реальном времени»,
- говорится в официальном анонсе OpenAI.
Новая модель стала продолжением gpt-4o-realtime-preview, но теперь это полноценный публичный релиз с доработанным API и доступной документацией.
Цены стали ниже на 20%
OpenAI одновременно объявила о снижении цен на аудио-токены для gpt-realtime:
- $32 / 1M входных аудио-токенов (≈2900 рублей)
- $64 / 1M выходных токенов (≈5800 рублей)
- Для кэшированных входов — всего $0.40 / 1M (≈36 рублей)
Это примерно на 20% дешевле, чем стоимость ранней версии preview. Такой шаг делает использование голосового GPT значительно более доступным, особенно для разработчиков в сферах customer support, real-time перевода и голосовых ассистентов.
Меньше токенов - меньше трат
Для экономии при длительных сессиях OpenAI внедрила тонкую настройку контекста диалога. Теперь разработчики могут:
- устанавливать интеллектуальные лимиты на токены
- обрезать несколько реплик сразу, а не только последнюю
Это важно в сценариях, где диалог длится десятки минут или часов. Например, в голосовых помощниках или техподдержке. Механизм помогает удерживать стоимость под контролем без потери связности беседы.
Как начать работу
Для интеграции доступны: