OpenAI анонсирует революционный Voice Mode и партнёрство с Джонни Айвом для нового устройства
Компания OpenAI представила Voice Mode для ChatGPT, обеспечивающий практически мгновенный голосовой диалог, и объявила о совместной работе с легендарным дизайнером Джонни Айвом над созданием нового устройства, ориентированного на голос.
OpenAI представила Voice Mode для ChatGPT и анонсировала партнерство с дизайнером Джонни Айвом для создания нового устройства. Компания нацелена на максимально естественное и мгновенное голосовое взаимодействие, выходящее за рамки умных колонок и текстовых интерфейсов.
Новый Voice Mode работает не как простая диктовка текста. Ассистент слушает постоянно, реагирует почти без задержек, поддерживает естественный темп разговора и может говорить одновременно с пользователем. Это создает эффект живого диалога. Ранее ходили слухи о совместном проекте Сэма Альтмана и Джонни Айва. Теперь ясно, что это будет устройство, похожее на умную колонку, но с ключевым акцентом на голос. Запуск Voice Mode создает технологическую основу для этого аппаратного продукта. Голос становится не просто способом управления, а основным каналом для непрерывного диалога с ИИ.
Для отрасли это означает потенциальный сдвиг. Взаимодействие с ИИ-ассистентами часто напоминало транзакцию: запрос - ожидание - ответ. Новая модель стремится стереть эти границы, превратив общение в плавный разговор. Это открывает новые возможности для интеграции ИИ в повседневную жизнь. Успех может подстегнуть конкурентов вроде Google, Amazon и Apple к пересмотру своих голосовых интерфейсов.
Эта инициатива ведет к нескольким последствиям. Во-первых, к конвергенции программных и аппаратных решений. Устройство от Айва и Альтмана может стать физическим воплощением новой философии взаимодействия. Во-вторых, к росту важности мультимодальности, где голос интегрируется с другими формами ввода и вывода данных. В-третьих, к технологическому вызову. Успех зависит не только от скорости реакции, но и от способности модели поддерживать глубокий контекст в реальном времени.
По данным источника, общение с новой системой уже через несколько фраз вызывает ощущение разговора с человеком. Конечная цель - сделать интерфейс невидимым. Если OpenAI удастся масштабировать технологию и воплотить ее в удобном устройстве, это может переопределить то, как мы общаемся с машинами. Речь идет о переходе от эпизодических команд к непрерывному, контекстно-осознанному диалогу, что потребует серьезных доработок в архитектуре моделей и инфраструктуре обработки данных в реальном времени.


