OpenAI, AI 안전성 테스트 데이터 공개 가속화

OpenAI는 투명성을 높이기 위한 조치의 일환으로 내부 AI 모델 안전성 평가 결과를 더 자주 공개하기로 했습니다.
이 회사는 수요일에 유해한 콘텐츠 생성, 탈옥에 대한 취약성, 환각 경향을 측정하는 테스트에서 모델의 성능을 보여주는 전용 웹페이지인 안전성 평가 허브를 출시했습니다. OpenAI는 이 플랫폼을 사용하여 정기적으로 지표를 공유할 예정이며, 주요 모델이 출시될 때마다 업데이트할 계획이라고 밝혔습니다.
모델에 대한 안전성 결과를 탐색할 수 있는 리소스인 안전성 평가 허브를 소개합니다.
시스템 카드 출시 시 안전성 지표를 공유하지만, 안전성에 대해 선제적으로 소통하기 위한 노력의 일환으로 정기적으로 업데이트할 예정입니다.https://t.co/c8NgmXlC2Y-
OpenAI (@OpenAI) May 14, 2025
"AI 평가의 과학이 발전함에 따라 우리의 목표는 모델 능력과 안전성을 측정하는 더 확장 가능한 방법을 개발하는 진행 상황을 공유하는 것입니다."라고 OpenAI는 블로그 게시물에서 설명했습니다. "일부 안전 평가 결과를 공개적으로 공유함으로써 시간이 지남에 따라 OpenAI 시스템의 안전 성능을 더 쉽게 추적하고 AI 분야 전반의 투명성을 강화하려는 광범위한 커뮤니티 노력을 지원하는 것이 목표입니다."
또한 향후 허브에 추가 평가 유형을 포함할 수 있다고 덧붙였습니다.
최근 OpenAI는 일부 윤리학자들로부터 특정 주력 모델에 대한 안전성 테스트를 가속화하고 다른 모델에 대한 기술 보고서를 공개하지 않았다는 비판을 받아왔습니다. 또한 CEO인 샘 알트먼은 2023년 11월 임시 해임되기 전 모델 안전성 검토와 관련해 OpenAI 경영진을 오도했다는 의혹을 받기도 했습니다.
지난달에는 사용자들이 ChatGPT의 기본 모델인 GPT-4o가 과도하게 동의하고 검증하는 방식으로 반응한다는 보고를 받은 후, OpenAI는 업데이트를 철회해야 했습니다. 소셜 미디어 플랫폼 X에는 ChatGPT가 여러 가지 문제가 있고 위험한 결정과 아이디어를 지지하는 스크린샷이 넘쳐났습니다.
OpenAI는 일부 모델에 대한 옵트인 '알파 단계'를 도입하여 일부 ChatGPT 사용자가 더 광범위한 출시 전에 테스트하고 피드백을 제공할 수 있도록 하는 등 유사한 사고를 방지하기 위해 몇 가지 수정 사항을 구현하겠다고 밝혔습니다.
테크크런치 이벤트테크크런치 세션에 참여하세요: AI
OpenAI, Anthropic, Cohere의 연사가 참여하는 최고의 AI 업계 이벤트 티켓을 확보하세요. 한정된 기간 동안 단 $292로 하루 종일 전문가 강연, 워크샵, 강력한 네트워킹에 참여할 수 있습니다.
테크크런치 세션에 참가하세요: AI
TC 세션에서 전시 공간을 확보하세요: AI에서 큰 예산 없이 1,200명 이상의 의사결정권자에게 귀사의 혁신을 선보일 수 있습니다. 이 혜택은 5월 9일까지 또는 테이블이 소진될 때까지 제공됩니다.
캘리포니아 버클리 | 6월 5일 지금 등록하기
관련 기사
[[IMG_BASE64_PLACEHOLDER]] Sam Altman, AI의 감속 논란에 불을 붙이다
Apple Podcasts에서 듣기Spotify에서 듣기OpenAI의 CEO 샘 알트만은 최근 사회가 “일부 새로운 능력 수준 주변에서 단단히 경화될” 시간을 주기 위해 “AI 개발 속도를 조절할 때”가 되었을 수 있다고 제안했습니다.TechCrunch의 Equity 팟캐스트 최신 회차에서 Kirsten Korosec, Sean O’Kane, 그리고 저는 Altman의 발언이 최근 해킹 사건, 즉 OpenAI 에이전트가 Hugging Fac
OpenAI, 애플의 영업비밀 소송에 맞서다
OpenAI는 화요일 애플의 영업비밀 주장에 대해 반박하며, 이 소송이 근거가 없다고 주장했습니다.“우리는 이러한 주장을 심각하게 받아들이지만 이를 뒷받침하는 증거는 발견하지 못했습니다.”라고 OpenAI는 X에서 블룸버그의 에드 루드로우가 보도한 바와 같이 언급했습니다. “우리는 공정한 경쟁과 어디서나 일할 수 있는 자유를 지지하며, 전 세계 사용자에게 힘을 실어주는 기술을 만드는 데 집중하고 있습니다.”이는 금요일 미국 캘리포니아 북부
OpenAI의 로봇 부문 수장 캐틀린 칼리노우스키가 펜타곤과의 파트너십을 이유로 사임하다
오픈AI의 로봇공학 책임자 캐틀린 칼리노우스키는 회사의 국방부와의 논란이 된 파트너십 이후 사임했다.“이것은 쉬운 결정이 아니었다,” 칼리노우스스는 소셜 미디어 성명에서 설명했다. “AI가 국가 안보에서 중요한 역할을 하지만, 사법 감독 없이 미국인을 감시하고 인간 승인 없이 치명적 자율성을_deploy_하는 것은 훨씬 신중한 고려가 필요한 경계선이다.”메타의 증강현실 안경 부문을 이끌었던 것으로 알려진 칼리노우스스는 2024년 11월 오픈
관련 특별 주제 추천
의견 (0)
0/500

OpenAI는 투명성을 높이기 위한 조치의 일환으로 내부 AI 모델 안전성 평가 결과를 더 자주 공개하기로 했습니다.
이 회사는 수요일에 유해한 콘텐츠 생성, 탈옥에 대한 취약성, 환각 경향을 측정하는 테스트에서 모델의 성능을 보여주는 전용 웹페이지인 안전성 평가 허브를 출시했습니다. OpenAI는 이 플랫폼을 사용하여 정기적으로 지표를 공유할 예정이며, 주요 모델이 출시될 때마다 업데이트할 계획이라고 밝혔습니다.
모델에 대한 안전성 결과를 탐색할 수 있는 리소스인 안전성 평가 허브를 소개합니다.
OpenAI (@OpenAI) May 14, 2025
시스템 카드 출시 시 안전성 지표를 공유하지만, 안전성에 대해 선제적으로 소통하기 위한 노력의 일환으로 정기적으로 업데이트할 예정입니다.https://t.co/c8NgmXlC2Y-
"AI 평가의 과학이 발전함에 따라 우리의 목표는 모델 능력과 안전성을 측정하는 더 확장 가능한 방법을 개발하는 진행 상황을 공유하는 것입니다."라고 OpenAI는 블로그 게시물에서 설명했습니다. "일부 안전 평가 결과를 공개적으로 공유함으로써 시간이 지남에 따라 OpenAI 시스템의 안전 성능을 더 쉽게 추적하고 AI 분야 전반의 투명성을 강화하려는 광범위한 커뮤니티 노력을 지원하는 것이 목표입니다."
또한 향후 허브에 추가 평가 유형을 포함할 수 있다고 덧붙였습니다.
최근 OpenAI는 일부 윤리학자들로부터 특정 주력 모델에 대한 안전성 테스트를 가속화하고 다른 모델에 대한 기술 보고서를 공개하지 않았다는 비판을 받아왔습니다. 또한 CEO인 샘 알트먼은 2023년 11월 임시 해임되기 전 모델 안전성 검토와 관련해 OpenAI 경영진을 오도했다는 의혹을 받기도 했습니다.
지난달에는 사용자들이 ChatGPT의 기본 모델인 GPT-4o가 과도하게 동의하고 검증하는 방식으로 반응한다는 보고를 받은 후, OpenAI는 업데이트를 철회해야 했습니다. 소셜 미디어 플랫폼 X에는 ChatGPT가 여러 가지 문제가 있고 위험한 결정과 아이디어를 지지하는 스크린샷이 넘쳐났습니다.
OpenAI는 일부 모델에 대한 옵트인 '알파 단계'를 도입하여 일부 ChatGPT 사용자가 더 광범위한 출시 전에 테스트하고 피드백을 제공할 수 있도록 하는 등 유사한 사고를 방지하기 위해 몇 가지 수정 사항을 구현하겠다고 밝혔습니다.
테크크런치 이벤트테크크런치 세션에 참여하세요: AI
OpenAI, Anthropic, Cohere의 연사가 참여하는 최고의 AI 업계 이벤트 티켓을 확보하세요. 한정된 기간 동안 단 $292로 하루 종일 전문가 강연, 워크샵, 강력한 네트워킹에 참여할 수 있습니다.
테크크런치 세션에 참가하세요: AI
TC 세션에서 전시 공간을 확보하세요: AI에서 큰 예산 없이 1,200명 이상의 의사결정권자에게 귀사의 혁신을 선보일 수 있습니다. 이 혜택은 5월 9일까지 또는 테이블이 소진될 때까지 제공됩니다.
캘리포니아 버클리 | 6월 5일 지금 등록하기
[[IMG_BASE64_PLACEHOLDER]] Sam Altman, AI의 감속 논란에 불을 붙이다
Apple Podcasts에서 듣기Spotify에서 듣기OpenAI의 CEO 샘 알트만은 최근 사회가 “일부 새로운 능력 수준 주변에서 단단히 경화될” 시간을 주기 위해 “AI 개발 속도를 조절할 때”가 되었을 수 있다고 제안했습니다.TechCrunch의 Equity 팟캐스트 최신 회차에서 Kirsten Korosec, Sean O’Kane, 그리고 저는 Altman의 발언이 최근 해킹 사건, 즉 OpenAI 에이전트가 Hugging Fac
OpenAI, 애플의 영업비밀 소송에 맞서다
OpenAI는 화요일 애플의 영업비밀 주장에 대해 반박하며, 이 소송이 근거가 없다고 주장했습니다.“우리는 이러한 주장을 심각하게 받아들이지만 이를 뒷받침하는 증거는 발견하지 못했습니다.”라고 OpenAI는 X에서 블룸버그의 에드 루드로우가 보도한 바와 같이 언급했습니다. “우리는 공정한 경쟁과 어디서나 일할 수 있는 자유를 지지하며, 전 세계 사용자에게 힘을 실어주는 기술을 만드는 데 집중하고 있습니다.”이는 금요일 미국 캘리포니아 북부
OpenAI의 로봇 부문 수장 캐틀린 칼리노우스키가 펜타곤과의 파트너십을 이유로 사임하다
오픈AI의 로봇공학 책임자 캐틀린 칼리노우스키는 회사의 국방부와의 논란이 된 파트너십 이후 사임했다.“이것은 쉬운 결정이 아니었다,” 칼리노우스스는 소셜 미디어 성명에서 설명했다. “AI가 국가 안보에서 중요한 역할을 하지만, 사법 감독 없이 미국인을 감시하고 인간 승인 없이 치명적 자율성을_deploy_하는 것은 훨씬 신중한 고려가 필요한 경계선이다.”메타의 증강현실 안경 부문을 이끌었던 것으로 알려진 칼리노우스스는 2024년 11월 오픈





집






