OpenAI задерживает глубокие исследования API API
Обновлено в 16:11 по восточному времени: OpenAI уточнила, что в её белой книге содержалась ошибка в формулировке, из-за которой создавалось впечатление, что исследования в области убеждения связаны с решением о выпуске модели глубоких исследований через API. Компания обновила белую книгу, чтобы уточнить, что работа над убеждением не связана с планами по выпуску модели глубоких исследований. Оригинальная история продолжается ниже:
OpenAI решила отложить интеграцию AI-модели, лежащей в основе её инструмента глубоких исследований, в API для разработчиков. Этот шаг предпринят для лучшего понимания рисков, связанных со способностью AI влиять на действия и убеждения людей.
В белой книге, опубликованной в среду, OpenAI упомянула, что в настоящее время обновляет методы оценки моделей на предмет "реальных рисков убеждения", таких как потенциал распространения вводящей в заблуждение информации в больших масштабах.
Компания указала, что модель глубоких исследований не подходит для массовых кампаний по дезинформации из-за высоких вычислительных затрат и более низкой скорости обработки. Однако OpenAI планирует изучить, как AI может создавать вредоносный убеждающий контент, прежде чем принять решение о включении модели глубоких исследований в свой API.
"Пока мы пересматриваем наш подход к убеждению, мы развертываем эту модель только в ChatGPT, а не в API", — заявили в OpenAI.
Растёт беспокойство, что AI может использоваться для распространения ложной или вводящей в заблуждение информации с вредоносными намерениями. Например, в прошлом году по всему миру быстро распространялись политические дипфейки. В день выборов на Тайване группа, связанная с Коммунистической партией Китая, выпустила созданное AI вводящее в заблуждение аудио, в котором политик поддерживал прокитайского кандидата.
AI также всё чаще используется в атаках социальной инженерии. Потребители становятся жертвами дипфейков знаменитостей, рекламирующих мошеннические инвестиционные схемы, в то время как корпорации теряют миллионы из-за дипфейков, имитирующих реальных людей.
В своей белой книге OpenAI поделилась результатами нескольких тестов на убедительность модели глубоких исследований. Эта модель является специализированной версией недавно анонсированной OpenAI модели o3 "рассуждения", оптимизированной для веб-поиска и анализа данных.
В одном из тестов модель глубоких исследований должна была составлять убедительные аргументы и превзошла все другие модели OpenAI, выпущенные на данный момент, хотя не превзошла человеческий базовый уровень. В другом тесте, где модель пыталась убедить другую модель (GPT-4o от OpenAI) совершить платёж, она снова показала лучшие результаты, чем другие доступные модели OpenAI.

Оценка модели глубоких исследований в тесте MakeMePay, который проверяет способность модели убедить другую модель заплатить деньги. Источник изображения: OpenAI Однако модель глубоких исследований не показала выдающихся результатов во всех тестах на убедительность. Согласно белой книге, она была менее эффективна в убеждении GPT-4o раскрыть кодовое слово по сравнению с самой GPT-4o.OpenAI предположила, что результаты тестов могут представлять "нижнюю границу" возможностей модели глубоких исследований. "Дополнительные улучшения или оптимизация выявления способностей могут значительно повысить наблюдаемую производительность", — отметила компания.
Мы связались с OpenAI для получения дополнительных деталей и обновим этот пост, если получим ответ.
Тем временем как минимум один из конкурентов OpenAI не сдерживается. Perplexity объявила о запуске Deep Research в своём API для разработчиков Sonar, работающем на базе кастомизированной версии модели R1 от китайской AI-лаборатории DeepSeek.
Связанная статья
Сэм Альтман вызывает споры о замедлении развития ИИ
Слушайте наApple PodcastsСлушайте наSpotifyГенеральный директор OpenAI Сэм Алтман недавно предположил, что, возможно, пришло время «сдерживать темпы развития ИИ», чтобы позволить обществу «укрепиться вокруг некоторых из этих новых уровней возможност
OpenAI оспаривает иск Apple о нарушении торговых тайн
OpenAI опровергла утверждения Apple о нарушении торговых тайк во вторник, заявив, что иск не имеет оснований.«Мы относимся к этим заявлениям серьезно, но не видим никаких доказательств, подтверждающих их», — stated OpenAI, как сообщил Ed Ludlow из B
Глава робототехники OpenAI Кейтлин Калиновски уходит в отставку из-за партнерства с Пентагоном
Руководитель направления робототехники OpenAI Кейтлин Калиновски ушла в отставку после скандального партнерства компании с Министерством обороны США.«Это было нелегкое решение», — объяснила Калиновски в заявлении в социальных сетях. «Хотя ИИ играет
Рекомендации по связанным специальным темам
Комментарии (41)
So they messed up the whitepaper wording and now have to clarify? Classic OpenAI move 🙃. Delaying the API for 'persuasion research' separate? Sounds like a convenient excuse to me. But hey, maybe they're actually being careful about misuse. Still, I was hoping to play with it soon...
Esto me preocupa un poco. Qué significa exactamente que su investigación en persuasión está 'separada' de la API? 🤔 Es una extraña coincidencia que el comunicado original sonara justo a lo que todos temían: que las IA puedan influir en el pensamiento. ¿Hay suficiente transparencia real en estos proyectos? Al menos corrigieron, pero deja mal sabor ese 'error' en el papel técnico.
Ces retards d'OpenAI montrent à quel point l'IA avancée devient un enjeu géopolitique. Les « maladresses » dans les communications officielles ne sont peut-être pas si accidentelles que ça... 😏 Cela me rappelle les débats sur le nucléaire au XXe siècle.
Обновлено в 16:11 по восточному времени: OpenAI уточнила, что в её белой книге содержалась ошибка в формулировке, из-за которой создавалось впечатление, что исследования в области убеждения связаны с решением о выпуске модели глубоких исследований через API. Компания обновила белую книгу, чтобы уточнить, что работа над убеждением не связана с планами по выпуску модели глубоких исследований. Оригинальная история продолжается ниже:
OpenAI решила отложить интеграцию AI-модели, лежащей в основе её инструмента глубоких исследований, в API для разработчиков. Этот шаг предпринят для лучшего понимания рисков, связанных со способностью AI влиять на действия и убеждения людей.
В белой книге, опубликованной в среду, OpenAI упомянула, что в настоящее время обновляет методы оценки моделей на предмет "реальных рисков убеждения", таких как потенциал распространения вводящей в заблуждение информации в больших масштабах.
Компания указала, что модель глубоких исследований не подходит для массовых кампаний по дезинформации из-за высоких вычислительных затрат и более низкой скорости обработки. Однако OpenAI планирует изучить, как AI может создавать вредоносный убеждающий контент, прежде чем принять решение о включении модели глубоких исследований в свой API.
"Пока мы пересматриваем наш подход к убеждению, мы развертываем эту модель только в ChatGPT, а не в API", — заявили в OpenAI.
Растёт беспокойство, что AI может использоваться для распространения ложной или вводящей в заблуждение информации с вредоносными намерениями. Например, в прошлом году по всему миру быстро распространялись политические дипфейки. В день выборов на Тайване группа, связанная с Коммунистической партией Китая, выпустила созданное AI вводящее в заблуждение аудио, в котором политик поддерживал прокитайского кандидата.
AI также всё чаще используется в атаках социальной инженерии. Потребители становятся жертвами дипфейков знаменитостей, рекламирующих мошеннические инвестиционные схемы, в то время как корпорации теряют миллионы из-за дипфейков, имитирующих реальных людей.
В своей белой книге OpenAI поделилась результатами нескольких тестов на убедительность модели глубоких исследований. Эта модель является специализированной версией недавно анонсированной OpenAI модели o3 "рассуждения", оптимизированной для веб-поиска и анализа данных.
В одном из тестов модель глубоких исследований должна была составлять убедительные аргументы и превзошла все другие модели OpenAI, выпущенные на данный момент, хотя не превзошла человеческий базовый уровень. В другом тесте, где модель пыталась убедить другую модель (GPT-4o от OpenAI) совершить платёж, она снова показала лучшие результаты, чем другие доступные модели OpenAI.

OpenAI предположила, что результаты тестов могут представлять "нижнюю границу" возможностей модели глубоких исследований. "Дополнительные улучшения или оптимизация выявления способностей могут значительно повысить наблюдаемую производительность", — отметила компания.
Мы связались с OpenAI для получения дополнительных деталей и обновим этот пост, если получим ответ.
Тем временем как минимум один из конкурентов OpenAI не сдерживается. Perplexity объявила о запуске Deep Research в своём API для разработчиков Sonar, работающем на базе кастомизированной версии модели R1 от китайской AI-лаборатории DeepSeek.
Сэм Альтман вызывает споры о замедлении развития ИИ
Слушайте наApple PodcastsСлушайте наSpotifyГенеральный директор OpenAI Сэм Алтман недавно предположил, что, возможно, пришло время «сдерживать темпы развития ИИ», чтобы позволить обществу «укрепиться вокруг некоторых из этих новых уровней возможност
OpenAI оспаривает иск Apple о нарушении торговых тайн
OpenAI опровергла утверждения Apple о нарушении торговых тайк во вторник, заявив, что иск не имеет оснований.«Мы относимся к этим заявлениям серьезно, но не видим никаких доказательств, подтверждающих их», — stated OpenAI, как сообщил Ed Ludlow из B
Глава робототехники OpenAI Кейтлин Калиновски уходит в отставку из-за партнерства с Пентагоном
Руководитель направления робототехники OpenAI Кейтлин Калиновски ушла в отставку после скандального партнерства компании с Министерством обороны США.«Это было нелегкое решение», — объяснила Калиновски в заявлении в социальных сетях. «Хотя ИИ играет
So they messed up the whitepaper wording and now have to clarify? Classic OpenAI move 🙃. Delaying the API for 'persuasion research' separate? Sounds like a convenient excuse to me. But hey, maybe they're actually being careful about misuse. Still, I was hoping to play with it soon...
Esto me preocupa un poco. Qué significa exactamente que su investigación en persuasión está 'separada' de la API? 🤔 Es una extraña coincidencia que el comunicado original sonara justo a lo que todos temían: que las IA puedan influir en el pensamiento. ¿Hay suficiente transparencia real en estos proyectos? Al menos corrigieron, pero deja mal sabor ese 'error' en el papel técnico.
Ces retards d'OpenAI montrent à quel point l'IA avancée devient un enjeu géopolitique. Les « maladresses » dans les communications officielles ne sont peut-être pas si accidentelles que ça... 😏 Cela me rappelle les débats sur le nucléaire au XXe siècle.





Дом






