LIVE
Модель OpenAI сама взломала HuggingFace — и это изменило риторику всей индустрии Боты обогнали людей в интернете — и на этом можно заработать 200 миллионов Рынок кибербезопасности скупает компании, которые следят за ИИ-агентами Альтман впервые признал: скорость разработки ИИ пора сбавить Стартап обвинил крупную компанию в краже продукта после девяти месяцев «сотрудничества» Модель OpenAI сама взломала HuggingFace — и это изменило риторику всей индустрии Боты обогнали людей в интернете — и на этом можно заработать 200 миллионов Рынок кибербезопасности скупает компании, которые следят за ИИ-агентами Альтман впервые признал: скорость разработки ИИ пора сбавить Стартап обвинил крупную компанию в краже продукта после девяти месяцев «сотрудничества»
Новости ИИ

OpenAI учит голос не перебивать и держать долгий разговор

автор: shmelev дата: 9 июля 2026 чтение: 2 мин

OpenAI выпустила новые голосовые модели — GPT-Live-1 и облегчённую GPT-Live-1 mini, — и главное здесь не красивое название, а архитектура. Это полнодуплексные модели: они умеют говорить и слушать одновременно, а значит, пользователь может перебить ассистента на полуслове, и тот естественно отреагирует, а не продолжит бубнить свой заранее просчитанный ответ.

Старая система в ChatGPT работала иначе — через цепочку из трёх отдельных моделей: одна переводила речь в текст, вторая генерировала ответ, третья озвучивала его. Каждый шаг добавлял задержку и терял нюансы естественного разговора. Новая архитектура объединяет это в единый поток, который к тому же умеет молчать и слушать подолгу, не теряя нити беседы — пока не понадобится ответить.

OpenAI отчиталась, что более 150 миллионов человек уже пользуются голосовыми функциями ChatGPT. Продакт-лид направления рассказал, что лично вёл 30–40-минутные разговоры с ассистентом на прогулках — и в компании явно делают ставку именно на длинные, естественные диалоги как будущий интерфейс работы с компьютером вообще, а не только с чат-ботом. Здесь же читается намёк на слухи о собственных AI-наушниках OpenAI, хотя официально о железе речи не было.

Правда, до совершенства ещё далеко: во время демонстрации живого перевода на хинди голос модели звучал с явным американским акцентом и слегка книжной, неестественной интонацией. OpenAI подчёркивает, что новая система оптимизирована для «большинства разговорных языков», но не уточняет, для каких именно. И хотя конкуренты — Apple с Siri, Amazon с Alexa, стартапы вроде Sesame — тоже двигаются в сторону более живых голосовых интерфейсов, именно от того, кто первым сделает разговор с машиной неотличимым от разговора с человеком, будет зависеть, кто станет владельцем этого нового интерфейса.

Во что углубиться:

  • Слухи о AI-наушниках OpenAI: Что известно о планах компании выпустить собственное устройство в 2026 году
  • Полнодуплексные голосовые модели: Чем архитектура отличается от классической связки speech-to-text и text-to-speech
  • Sesame и другие стартапы разговорного AI: Кто ещё соревнуется за звание самого естественного голосового ассистента

Реклама
ЛИДЕРБОРД · 728 × 90зона «Реклама: между секциями»