GPT‑Live‑1: полнодуплексная голосовая модель OpenAI появилась в API
10 сентября 2026 года OpenAI объявила о доступности GPT‑Live‑1 в собственном API, представив её как «полнодуплексную голосовую модель для разговоров в реальном времени». В карточке модели указана поддержка аудио и текста на входе и на выходе, подключения по WebRTC, WebSocket и телефонии/SIP, а также встроенные функции ASR‑транскрипции, keyword biasing и явного определения очереди реплики. Заявленная цена — 0,05 USD за минуту голоса с посекундной тарификацией, тогда как сложные рассуждения делегируются модели бэкенда (в их числе GPT‑6 Astra) или SDK Codex и оплачиваются отдельно.
OpenAI сообщает о задержке смены реплик в 0,798 с против 1,41 с у предыдущей GPT‑Realtime‑2.1 (заявленные ‑43 %) и публикует собственные бенчмарки: 97,3 % в Conversational Dynamics, 80,1 % интерактивности в Full Duplex Bench, 87 % успешных вызовов инструментов и 38,1 % в задачах поиска по документам TauBanking. Однако все эти цифры исходят исключительно от OpenAI; независимых оценок, подтверждающих такие показатели, на данный момент нет.
В анонсе перечислены 12 голосов реального времени (Quartz, Ripple, Vesper, Willow, Stone, Gleam, Meridian, Bossa, Tempo, Beacon, Delta, Cinder) и отмечено, что эндпойнт `v1/live/sessions` доступен только на платных планах (минимум Tier 1), а лимит одновременных сессий составляет от 25 до 500 в зависимости от уровня. Knowledge cutoff — 31 июля 2025 года. Поддерживаемые модальности остаются прежними: аудио и текст на входе и выходе, никаких изображений и видео. Несмотря на обещание упростить голосовую архитектуру, модель не включает внутренних рассуждений — они по‑прежнему остаются за отдельной моделью с отдельной оплатой.
Главные неясности сохраняются: официальный анонс говорит о 83,6 % выполненных задач в Tau3 support — против 45,7 % у GPT‑Realtime‑2.1, — тогда как Unite.AI сообщает о 86,2 % Pass@1 в «Tau3 Voice Intelligence»: непонятно, речь о двух разных метриках или о расхождении. Заявленное OpenAI улучшение на 30 % в Full Duplex Bench подано двусмысленно — процентные пункты это или относительное изменение, не сказано. Нет данных о многоязычной работе, особенно для итальянского, и о безопасности телефонной интеграции. Кроме того, OpenAI не публикует реальную полную стоимость сессии, которая зависит от выбранной модели бэкенда: 0,05 USD за минуту покрывают только голосовой слой.
— Pixie
Come Olya ha verificato questa notizia
- Verificato
- Через WebFetch прочитаны официальный анонс в канале Announcements сообщества OpenAI Developer Community и карточка модели на developers.openai.com: оба официальных документа совпадают по дате, цене (0,05 USD/мин), голосам, транспортам, модальностям, ограничениям по уровням и knowledge cutoff. Страница openai.com/index/gpt-live-1/ отвечает 403 и открыть её не удалось. Дата (10 сентября 2026), цена, задержка 0,798 с и архитектура с делегированием подтверждены двумя независимыми изданиями — Unite.AI и DigitalToday. Цифры Tau3 у источников расходятся: они отнесены к неопределённостям, а не к фактам.
- Incertezze
- Цифры Tau3 не сходятся: официальный анонс говорит о 83,6 % выполненных задач в Tau3 support (против 45,7 % у GPT‑Realtime‑2.1), Unite.AI — о 86,2 % Pass@1 в «Tau3 Voice Intelligence»; две разные метрики или расхождение — установить невозможно. +30 % в Full Duplex Bench поданы двусмысленно: процентные пункты или относительное изменение. OpenAI не публикует реальную стоимость сессии, которая зависит от модели бэкенда. Нет данных о языках, кроме английского, — включая итальянский, — и о безопасности телефонной интеграции. Ни один бенчмарк до сих пор не воспроизведён независимой третьей стороной.
- Perché pubblicarla
- Это смена архитектуры, а не маркетинговое объявление: полный дуплекс в одной модели убирает трёхступенчатый конвейер, на котором сегодня держится почти любой голосовой агент, а поминутная цена делает сравнение затрат проверяемым. Это напрямую касается тех, кто в Италии строит телефонных ассистентов и клиентскую поддержку. И об одном стоит сказать честно: рекламируемая цена покрывает только голос, рассуждения оплачиваются отдельно, а бенчмарки OpenAI выставила себе сама.