OpenAI, 바이브 그래프 기술에 대한 반발에 직면하다

목요일에 진행된 주요 GPT-5 라이브 스트리밍에서 OpenAI는 모델의 인상적인 기능을 보여주는 몇 가지 차트를 발표했지만, 자세히 살펴보면 데이터 시각화에서 몇 가지 불일치가 발견됩니다.
아이러니하게도 '모델 간 속임수 평가'에서 GPT-5의 성능을 보여주는 한 차트에서는 눈금이 잘못 정렬된 것처럼 보입니다. 예를 들어, 무대 위 그래픽은 '사고' 기능을 갖춘 GPT-5가 50.0%의 속임수 비율을 달성했다고 주장했습니다. 그러나 OpenAI의 더 작은 모델인 o3는 47.4%로 보고되어 더 큰 막대로 표시되었습니다. 그러나 OpenAI의 공식 GPT-5 블로그 게시물에 게시된 데이터에 따르면 GPT-5의 실제 속임수 비율은 16.5%로 나타났습니다.
이러한 시각적 불일치로 인해 실제 점수는 더 낮았음에도 불구하고 무대에서는 GPT-5의 막대가 o3의 막대보다 더 큰 것으로 표시되었습니다. 같은 차트의 다른 곳에서는 o3와 GPT-4o의 점수가 서로 달랐지만 동일한 크기의 막대로 표시되어 있었습니다. 이 오류는 샘 알트먼 CEO가 공개적으로 인정하고 이 사건을 '메가 차트 실수'라고 명명하면서 블로그에 올바른 버전이 포함되어 있다고 밝힐 만큼 중대한 문제였습니다.
OpenAI 마케팅 담당자도 "블로그에서 차트를 수정했습니다. 의도치 않은 차트 범죄에 대해 모두 죄송합니다."라며 사과했습니다.
금요일, 그래프에 대한 한 Reddit 사용자의 질문에 대해 알트먼은 "여기 숫자는 정확했지만 라이브 스트리밍 중에 막대 차트를 엉망으로 만들었다"고 설명했습니다. 다른 슬라이드에서는 숫자가 잘못되었습니다." 그는 블로그 게시물과 시스템 카드 데이터가 정확하다고 확인하면서 "팀원들이 늦게까지 일하고 지쳐서 인적 오류를 일으켰다"고 덧붙였습니다. 이 모든 것이 라이브 스트리밍을 위해 마지막 순간에 한데 모였습니다."
하지만 이러한 오류는 특히 새 모델의 "환각을 줄이는 데 있어 상당한 진전"을 홍보하는 중요한 출시일에 회사로서는 안타까운 모습을 보여주었습니다.
8월 8일 업데이트: Altman의 Reddit 댓글을 추가했습니다.
관련 기사
[[IMG_BASE64_PLACEHOLDER]] Sam Altman, AI의 감속 논란에 불을 붙이다
Apple Podcasts에서 듣기Spotify에서 듣기OpenAI의 CEO 샘 알트만은 최근 사회가 “일부 새로운 능력 수준 주변에서 단단히 경화될” 시간을 주기 위해 “AI 개발 속도를 조절할 때”가 되었을 수 있다고 제안했습니다.TechCrunch의 Equity 팟캐스트 최신 회차에서 Kirsten Korosec, Sean O’Kane, 그리고 저는 Altman의 발언이 최근 해킹 사건, 즉 OpenAI 에이전트가 Hugging Fac
OpenAI, 애플의 영업비밀 소송에 맞서다
OpenAI는 화요일 애플의 영업비밀 주장에 대해 반박하며, 이 소송이 근거가 없다고 주장했습니다.“우리는 이러한 주장을 심각하게 받아들이지만 이를 뒷받침하는 증거는 발견하지 못했습니다.”라고 OpenAI는 X에서 블룸버그의 에드 루드로우가 보도한 바와 같이 언급했습니다. “우리는 공정한 경쟁과 어디서나 일할 수 있는 자유를 지지하며, 전 세계 사용자에게 힘을 실어주는 기술을 만드는 데 집중하고 있습니다.”이는 금요일 미국 캘리포니아 북부
올리는 AI 비서 시장 경쟁에서 우위를 점하기 위해 개인정보 보호에 주력하고 있다
진정으로 도움이 되려면 AI 비서는 사용자를 깊이 이해해야 합니다. 일상 생활을 위해 설계된 개인 비서 ‘올리(Ollie)’는 이를 위해 사용자의 데이터를 제공하거나 개인정보를 침해할 필요가 없다는 전제 하에 운영됩니다.일부 기업용 AI 도구가 데이터 개인정보 보호 장치를 제공하기는 하지만, 올리는 SOC 2 인증을 획득한 최초의 대중적 가정용 AI 서비스
관련 특별 주제 추천
의견 (0)
0/500

목요일에 진행된 주요 GPT-5 라이브 스트리밍에서 OpenAI는 모델의 인상적인 기능을 보여주는 몇 가지 차트를 발표했지만, 자세히 살펴보면 데이터 시각화에서 몇 가지 불일치가 발견됩니다.
아이러니하게도 '모델 간 속임수 평가'에서 GPT-5의 성능을 보여주는 한 차트에서는 눈금이 잘못 정렬된 것처럼 보입니다. 예를 들어, 무대 위 그래픽은 '사고' 기능을 갖춘 GPT-5가 50.0%의 속임수 비율을 달성했다고 주장했습니다. 그러나 OpenAI의 더 작은 모델인 o3는 47.4%로 보고되어 더 큰 막대로 표시되었습니다. 그러나 OpenAI의 공식 GPT-5 블로그 게시물에 게시된 데이터에 따르면 GPT-5의 실제 속임수 비율은 16.5%로 나타났습니다.
이러한 시각적 불일치로 인해 실제 점수는 더 낮았음에도 불구하고 무대에서는 GPT-5의 막대가 o3의 막대보다 더 큰 것으로 표시되었습니다. 같은 차트의 다른 곳에서는 o3와 GPT-4o의 점수가 서로 달랐지만 동일한 크기의 막대로 표시되어 있었습니다. 이 오류는 샘 알트먼 CEO가 공개적으로 인정하고 이 사건을 '메가 차트 실수'라고 명명하면서 블로그에 올바른 버전이 포함되어 있다고 밝힐 만큼 중대한 문제였습니다.
OpenAI 마케팅 담당자도 "블로그에서 차트를 수정했습니다. 의도치 않은 차트 범죄에 대해 모두 죄송합니다."라며 사과했습니다.
금요일, 그래프에 대한 한 Reddit 사용자의 질문에 대해 알트먼은 "여기 숫자는 정확했지만 라이브 스트리밍 중에 막대 차트를 엉망으로 만들었다"고 설명했습니다. 다른 슬라이드에서는 숫자가 잘못되었습니다." 그는 블로그 게시물과 시스템 카드 데이터가 정확하다고 확인하면서 "팀원들이 늦게까지 일하고 지쳐서 인적 오류를 일으켰다"고 덧붙였습니다. 이 모든 것이 라이브 스트리밍을 위해 마지막 순간에 한데 모였습니다."
하지만 이러한 오류는 특히 새 모델의 "환각을 줄이는 데 있어 상당한 진전"을 홍보하는 중요한 출시일에 회사로서는 안타까운 모습을 보여주었습니다.
8월 8일 업데이트: Altman의 Reddit 댓글을 추가했습니다.
[[IMG_BASE64_PLACEHOLDER]] Sam Altman, AI의 감속 논란에 불을 붙이다
Apple Podcasts에서 듣기Spotify에서 듣기OpenAI의 CEO 샘 알트만은 최근 사회가 “일부 새로운 능력 수준 주변에서 단단히 경화될” 시간을 주기 위해 “AI 개발 속도를 조절할 때”가 되었을 수 있다고 제안했습니다.TechCrunch의 Equity 팟캐스트 최신 회차에서 Kirsten Korosec, Sean O’Kane, 그리고 저는 Altman의 발언이 최근 해킹 사건, 즉 OpenAI 에이전트가 Hugging Fac
OpenAI, 애플의 영업비밀 소송에 맞서다
OpenAI는 화요일 애플의 영업비밀 주장에 대해 반박하며, 이 소송이 근거가 없다고 주장했습니다.“우리는 이러한 주장을 심각하게 받아들이지만 이를 뒷받침하는 증거는 발견하지 못했습니다.”라고 OpenAI는 X에서 블룸버그의 에드 루드로우가 보도한 바와 같이 언급했습니다. “우리는 공정한 경쟁과 어디서나 일할 수 있는 자유를 지지하며, 전 세계 사용자에게 힘을 실어주는 기술을 만드는 데 집중하고 있습니다.”이는 금요일 미국 캘리포니아 북부
올리는 AI 비서 시장 경쟁에서 우위를 점하기 위해 개인정보 보호에 주력하고 있다
진정으로 도움이 되려면 AI 비서는 사용자를 깊이 이해해야 합니다. 일상 생활을 위해 설계된 개인 비서 ‘올리(Ollie)’는 이를 위해 사용자의 데이터를 제공하거나 개인정보를 침해할 필요가 없다는 전제 하에 운영됩니다.일부 기업용 AI 도구가 데이터 개인정보 보호 장치를 제공하기는 하지만, 올리는 SOC 2 인증을 획득한 최초의 대중적 가정용 AI 서비스





집






