Дом
Амбициозные планы OpenAI в области аудио бросают вызов господству Кремниевой долины в сфере экранных технологий

OpenAI активно развивает направление аудио-ИИ, и речь идет о гораздо большем, чем просто улучшение голоса ChatGPT. Согласно недавнему отчету издания The Information, за последние два месяца компания объединила несколько инженерных, продуктовых и исследовательских команд для модернизации своих аудиомоделей. Эти усилия направлены на подготовку к выпуску персонального устройства с приоритетом на аудио, запуск которого ожидается примерно через год.
Этот стратегический сдвиг отражает общее направление развития технологической индустрии — движение к будущему, в котором экраны уходят на второй план, а аудио становится основным интерфейсом. Благодаря умным колонкам голосовые помощники уже появились в более чем трети американских домохозяйств. Meta недавно представила функцию для своих умных очков Ray-Ban, которая использует массив из пяти микрофонов, чтобы помочь пользователям слышать разговоры в шумной обстановке, фактически превращая лицо пользователя в устройство направленного прослушивания. Между тем, в июне Google начала тестировать «Audio Overviews», преобразуя результаты поиска в устные резюме, а Tesla интегрирует чат-бота Grok от xAI в свои автомобили, чтобы создать диалогового помощника, который управляет всем — от навигации до климат-контроля — с помощью естественной речи.
Не только гиганты индустрии делают эту ставку. Появилось множество стартапов с тем же основным убеждением, хотя и с неоднозначными результатами. Создатели Humane AI Pin потратили сотни миллионов, прежде чем их носимое устройство без экрана стало широко цитируемым предостерегающим примером. Кулон Friend AI, обещающий записывать вашу жизнь и служить компаньоном, вызвал серьезные опасения по поводу конфиденциальности и экзистенциальный дискомфорт. Сейчас как минимум две компании, включая Sandbar и компанию под руководством основателя Pebble Эрика Мигиковского, разрабатывают кольца с ИИ, запуск которых запланирован на 2026 год, позволяющие пользователям буквально разговаривать со своей рукой.
Хотя дизайн устройств различается, основной принцип остается неизменным: звук — это интерфейс будущего. Любая среда — ваш дом, ваша машина и даже вы сами — превращается в панель управления.
Сообщается, что новая аудиомодель OpenAI, ожидаемая в начале 2026 года, будет отличаться более естественным звучанием речи, уметь реагировать на перебивания, как настоящий собеседник, и даже говорить, пока говорит пользователь — способность, которой лишены нынешние модели. Говорят также, что компания планирует выпустить набор устройств, в который, возможно, войдут очки или динамики без экрана, призванные служить скорее компаньонами, чем простыми инструментами.
Это развитие событий не является полностью неожиданным. Как отмечает The Information, бывший руководитель отдела дизайна Apple Джони Айв, присоединившийся к инициативе OpenAI по разработке аппаратного обеспечения после приобретения его компании io за 6,5 миллиарда долларов в мае, уделяет приоритетное внимание снижению зависимости от устройств. Он рассматривает дизайн, ориентированный на аудио, как возможность исправить недостатки предыдущей бытовой электроники.
Связанная статья
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её
Google тестирует агента Remy AI для Gemini по мере смещения фокуса на управление пользователями
Согласно Business Insider, Google тестирует Remy, нового ИИ-персонального агента для Gemini. Этот инструмент предназначен для выполнения задач от имени пользователей, упрощая как профессиональные рабочие процессы, так и повседневные рутины.В настоящ
Как исправить Core Web Vitals для улучшения позиций в поисковой выдаче
Оптимизация написания комментариев в отчетных карточках с помощью ИИ-инструментовВведениеИИ-инструменты для генерации комментариев в отчетных карточкахMagic SchoolAlmanac AIChat GPTИспользование Magic School для генерации комментариев в отчетны
Рекомендации по связанным специальным темам
Комментарии (1)

OpenAI активно развивает направление аудио-ИИ, и речь идет о гораздо большем, чем просто улучшение голоса ChatGPT. Согласно недавнему отчету издания The Information, за последние два месяца компания объединила несколько инженерных, продуктовых и исследовательских команд для модернизации своих аудиомоделей. Эти усилия направлены на подготовку к выпуску персонального устройства с приоритетом на аудио, запуск которого ожидается примерно через год.
Этот стратегический сдвиг отражает общее направление развития технологической индустрии — движение к будущему, в котором экраны уходят на второй план, а аудио становится основным интерфейсом. Благодаря умным колонкам голосовые помощники уже появились в более чем трети американских домохозяйств. Meta недавно представила функцию для своих умных очков Ray-Ban, которая использует массив из пяти микрофонов, чтобы помочь пользователям слышать разговоры в шумной обстановке, фактически превращая лицо пользователя в устройство направленного прослушивания. Между тем, в июне Google начала тестировать «Audio Overviews», преобразуя результаты поиска в устные резюме, а Tesla интегрирует чат-бота Grok от xAI в свои автомобили, чтобы создать диалогового помощника, который управляет всем — от навигации до климат-контроля — с помощью естественной речи.
Не только гиганты индустрии делают эту ставку. Появилось множество стартапов с тем же основным убеждением, хотя и с неоднозначными результатами. Создатели Humane AI Pin потратили сотни миллионов, прежде чем их носимое устройство без экрана стало широко цитируемым предостерегающим примером. Кулон Friend AI, обещающий записывать вашу жизнь и служить компаньоном, вызвал серьезные опасения по поводу конфиденциальности и экзистенциальный дискомфорт. Сейчас как минимум две компании, включая Sandbar и компанию под руководством основателя Pebble Эрика Мигиковского, разрабатывают кольца с ИИ, запуск которых запланирован на 2026 год, позволяющие пользователям буквально разговаривать со своей рукой.
Хотя дизайн устройств различается, основной принцип остается неизменным: звук — это интерфейс будущего. Любая среда — ваш дом, ваша машина и даже вы сами — превращается в панель управления.
Сообщается, что новая аудиомодель OpenAI, ожидаемая в начале 2026 года, будет отличаться более естественным звучанием речи, уметь реагировать на перебивания, как настоящий собеседник, и даже говорить, пока говорит пользователь — способность, которой лишены нынешние модели. Говорят также, что компания планирует выпустить набор устройств, в который, возможно, войдут очки или динамики без экрана, призванные служить скорее компаньонами, чем простыми инструментами.
Это развитие событий не является полностью неожиданным. Как отмечает The Information, бывший руководитель отдела дизайна Apple Джони Айв, присоединившийся к инициативе OpenAI по разработке аппаратного обеспечения после приобретения его компании io за 6,5 миллиарда долларов в мае, уделяет приоритетное внимание снижению зависимости от устройств. Он рассматривает дизайн, ориентированный на аудио, как возможность исправить недостатки предыдущей бытовой электроники.
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её
Как исправить Core Web Vitals для улучшения позиций в поисковой выдаче
Оптимизация написания комментариев в отчетных карточках с помощью ИИ-инструментовВведениеИИ-инструменты для генерации комментариев в отчетных карточкахMagic SchoolAlmanac AIChat GPTИспользование Magic School для генерации комментариев в отчетны











