И послушать, и поговорить: OpenAI готовит революционную аудиомодель GPT Bidi 1
OpenAI планирует превратить ChatGPT в суперприложение, и для этого готовится масштабное обновление. По имеющимся информацией, оно будет сосредоточено на инструменте для программирования Codex от OpenAI и агентных ИИ-инструментов, способных выполнять задачи для пользователей.
Однако, похоже, компания готовит ещё кое-что: также была замечена новая двунаправленная аудиомодель под названием «GPT Bidi 1», которая может стать значительным улучшением разговорных возможностей ChatGPT.
BREAKING 🔥: First tests of "Bidi 1", an upcoming bidirectional voice model from OpenAI. This upgrade will arrive in ChatGPT and, potentially, in Codex soon as well.
> Bidi 1 can speak over while you are talking and keep listening.
> Bidi 1 can switch between tasks back and… https://t.co/BwWhCKx3G0 pic.twitter.com/Fawc74kBym— 🚨 AI News | TestingCatalog (@testingcatalog) June 23, 2026
Bidi, как утверждается, является сокращением от bidirectional («двунаправленный») дизайн, который позволяет помощнику одновременно говорить, слышать и слушать. TestingCatalog обнаружил упоминания о Bidi 1, где во внутреннем коде модель описывается как «большой скачок в интеллекте» и «следующее поколение голосового режима».
«Сообщается, что Bidi 1 появляется в списке выбора моделей в настройках наряду со стандартным и расширенным режимами. После выбора Bidi 1 пузырьчик речи становится желтым. Согласно недавнему отчёту TestingCatalog, новая модель уже начала развертываться для части пользователей приложения ChatGPT, что указывает на возможный запуск уже на этой неделе», — пишет Android Authority.
Источники также сообщают, что модель способна выдавать короткие естественные подтверждения вроде «хорошо», когда вы делаете паузу или замедляете речь, не перебивая вас. Также утверждается, что она может мгновенно менять задачи во время разговора: например, если попросить её сосчитать до десяти, а затем перебить её и попросить сосчитать в обратном порядке, она сразу же подстроится.
«Возможно, одним из самых значительных изменений станет то, что модель, как сообщается, способна удерживать нить всего длительного разговора, а не терять предыдущий контекст — это слабое место, которое давно преследует нынешнюю голосовую систему ChatGPT. Кроме того, она больше не начинает говорить во время длительных пауз», — добавляет Android Authority.
В отчете также подчеркивается, что запуск Bidi 1 можно рассматривать как способ для OpenAI сократить разрыв между своими мощными текстовыми моделями и устаревшим голосовым уровнем. Это важно, поскольку OpenAI делает ставку на то, что Именно речь, а не текст, станет основным способом взаимодействия большинства людей с искусственным интеллектом. Впрочем, OpenAI пока не анонсировала модель Bidi 1 и не раскрыла подробностей о GPT 5.6.
«По данным TestingCatalog, GPT-Bidi-1 может иметь несколько режимов работы с разным уровнем «интеллекта» и скоростью ответа: — High, Medium и Instant. Это может свидетельствовать о намерении OpenAI предоставить пользователям выбор между максимально качественной обработкой диалога и минимальной задержкой во время живого общения. Кроме того, в утечках интерфейса новая модель отображается отдельно от нынешнего Advanced Voice Mode, что указывает не на обычное обновление, а на запуск нового поколения голосового взаимодействия», — отмечает издание Let’s Data Science.
Появление GPT-Bidi-1 также хорошо вписывается в более широкую стратегию OpenAI по развитию голосовых технологий. В мае 2026 года компания представила новые аудиомодели GPT-Realtime, способны вести беседу в режиме реального времени, переводить речь «на лету» и выполнять транскрипцию с минимальной задержкой. На этом фоне GPT-Bidi-1 может стать следующим шагом к созданию по-настоящему непрерывного голосового интерфейса, где ИИ не ждет завершения фразы пользователя, а взаимодействует почти так же естественно, как человек во время живого разговора.
Источник: Android Authority

