옵션
뉴스
구글의 최신 제미니 AI 모델은 테스트에서 안전 점수가 하락하고 있습니다.

구글의 최신 제미니 AI 모델은 테스트에서 안전 점수가 하락하고 있습니다.

2025년 9월 19일
154

Google의 내부 테스트 결과 최신 AI 모델의 안전 프로토콜이 이전 버전에 비해 성능이 저하된 것으로 나타났습니다. 새로 발표된 벤치마크에 따르면 Gemini 2.5 플래시 모델은 텍스트와 이미지 프롬프트를 모두 처리할 때 주요 안전 지표에서 가이드라인 위반 비율이 4~10% 더 높은 것으로 나타났습니다.

이 기술 대기업의 자동화된 평가는 우려스러운 경향을 보여줍니다. 경계 테스트 프롬프트가 표시될 때 Gemini 2.5 Flash는 이전 버전인 Gemini 2.0보다 콘텐츠 안전 선을 더 자주 넘었습니다. Google의 기술팀은 일부 실패의 원인을 오탐으로 보고 있지만, 시스템이 명시적으로 문제가 있는 요청을 수신할 때 정책을 위반하는 출력의 실제 증가를 인정하고 있습니다.

이러한 안전성의 퇴보는 보다 허용적인 AI 시스템으로의 광범위한 업계 변화와 맞물려 있습니다. Meta와 OpenAI를 비롯한 주요 업체들은 최근 논란이 되는 주제에 대해 기권하는 대신 민감한 주제에 중립적인 대응을 시도하도록 모델을 조정하고 있습니다. 하지만 이러한 변화는 때때로 의도하지 않은 결과를 낳기도 하는데, 이번 주 초에 ChatGPT가 미성년자를 위한 부적절한 콘텐츠 생성을 일시적으로 허용한 사례에서 볼 수 있듯이 말입니다.

Google의 보고서에 따르면 새 모델은 윤리적으로 의심스러운 지시를 포함하여 지침을 충실히 따르는 데 탁월하다고 합니다. 독립적인 테스트 결과 Gemini 2.5 플래시는 이전 버전에 비해 논란이 되는 정치 및 법적 주제를 처리할 때 거부율이 현저히 감소한 것으로 나타났습니다.

AI 안전 전문가들은 Google의 보고에서 제한적인 공개에 대해 우려를 표명합니다. 보다 자세한 위반 사례 연구가 없으면 외부 평가자들은 이러한 안전 퇴행의 실제 심각성을 평가하는 데 어려움을 겪습니다. 구글은 올해 초 플래그십 모델인 Gemini 2.5 Pro를 포함해 안전 문서가 지연되거나 불완전하다는 비판에 직면한 적이 있습니다.

제한 없는 명령어 추종 기능과 강력한 콘텐츠 안전장치 사이의 긴장은 AI 개발자들에게 지속적인 과제를 제시합니다. 미묘한 요청을 해석하는 모델이 더욱 정교해짐에 따라 적절한 응답 경계를 유지하려면 신중한 조정이 필요하며, Google의 최신 지표에 따르면 이러한 균형이 허용적인 쪽으로 기울어지고 있을 수 있습니다.

관련 기사
Gemini Spark가 이제 Google Photos 라이브러리를 관리합니다 Gemini Spark가 이제 Google Photos 라이브러리를 관리합니다 구글은 Gemini Spark를 통해 Google Photos 라이브러리를 관리할 수 있도록 함으로써 AI 통합을 확대하고 있습니다. 이제 사용자는 에이전트에 이미지 편집, 앨범 정리, 좋아하는 사진에서 공유 컬렉션 생성, 콘서트 포스터를 캘린더 이벤트로 변환 및 기타 워크플로우 자동화 등의 지시를 내릴 수 있습니다.Google Photos 책임자 Shimrit Ben-Yair은 X에서 이러한 새로운 기능을 발표하며, 미국 내 자격이 있는 G
구글, AI 딥페이크를 이용한 사칭 사기 방지를 위해 가짜 전화 감지 기능을 도입했다 구글, AI 딥페이크를 이용한 사칭 사기 방지를 위해 가짜 전화 감지 기능을 도입했다 구글은 화요일, AI 딥페이크를 이용한 사칭 사기로부터 사용자를 보호하기 위해 안드로이드에 ‘가짜 전화 감지’ 기능을 도입한다고 발표했다. 이 기능은 이번 달부터 픽셀 기기를 시작으로, 안드로이드 12 이상 기기의 ‘Phone by Google’ 앱에 전 세계적으로 순차적으로 적용될 예정이다.사람들이 낯선 번호의 전화를 점점 더 받지 않으려 함에 따라, 사
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부 프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부 최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
관련 특별 주제 추천
글쓰기 장문 SEO 기사용 최고의 AI 개요 생성기
장문 SEO 기사용 최고의 AI 개요 생성기

XIX.AI가 꼼꼼하게 선별한 2026년 최신 최고 평점을 받은 장문 SEO 기사용 AI 개요 생성기. 이 강력한 도구들은 고품질 콘텐츠를 신속하게 제작하는 데 획기적인 도움을 제공하여 글쓰기 효율을 크게 높여줍니다. 무료 버전과 유료 버전의 비교 정보와 실제 테스트 결과, 상세한 순위 정보를 확인하여 여러분의 필요에 딱 맞는, 꼭 사용해 봐야 할 옵션을 찾아보세요. 지금 바로 살펴보고 AI를 활용한 경쟁력을 확보하세요.

8 도구
xix.ai
교육 및 학습 숙제 및 시험 준비를 위한 AI 학습 도구
숙제 및 시험 준비를 위한 AI 학습 도구

2026년 숙제 및 시험 준비를 위한 최신 최고의 AI 학습 도구! XIX.AI는 학생들이 생산성을 높이고, 숙제 완료 과정을 효율화하며, 실제 시험을 통해 우수한 성적을 거둘 수 있도록 돕는 강력하고 혁신적인 도구들의 최고 평점 목록을 엄선했습니다. 무료와 유료 버전의 비교 정보, 상세한 순위, 꼭 사용해 봐야 할 옵션을 확인하고 AI의 힘을 최대한 활용하세요. 지금 바로 살펴보세요!

10 도구
xix.ai
음악 작곡 songwriter, 후크, 탑라인 및 다국어 초안 세션을 위한 AI 보컬 데모 도구
songwriter, 후크, 탑라인 및 다국어 초안 세션을 위한 AI 보컬 데모 도구

2026년 최신 최고의 AI 보컬 데모 도구: 작곡가, 후크 제작자 및 다국어 콘텐츠 팀을 위한! XIX.AI는 엄격한 실전 테스트를 거친 강력한 혁신 도구의 최고 평점 목록을 선별했습니다. 여기서는 무료 대 유료 비교 데이터, 종합 순위, 그리고 필수 추천 옵션을 확인할 수 있어 작사 효율성을 높이고 창의적 잠재력을 발휘하는 데 도움이 됩니다. 지금 탐색하여 모든 콘텐츠 요구에 맞는 완벽한 도구를 발견하세요!

9 도구
xix.ai
사업 중소기업을 위한 최고의 AI 경쟁사 분석 도구
중소기업을 위한 최고의 AI 경쟁사 분석 도구

2026년 중소기업을 위한 최신 최고 평점의 AI 경쟁 분석 도구! XIX.AI는 매주 엄격한 실제 테스트와 상세한 순위를 바탕으로 업데이트되는, 업계 판도를 바꿀 만큼 강력한 도구 모음을 엄선했습니다. 생산성을 높이고 경쟁 우위를 확보할 수 있는 ‘꼭 사용해 봐야 할’ 도구를 찾아보실 수 있도록, 무료 버전과 유료 버전의 포괄적인 비교 정보를 제공합니다. 지금 바로 살펴보고 여러분에게 딱 맞는 도구를 찾아보세요!

9 도구
xix.ai
이미지 편집 이커머스 의류용 Photoshop AI 보정 도구, 피부 결 정리 및 색상 일관성
이커머스 의류용 Photoshop AI 보정 도구, 피부 결 정리 및 색상 일관성

2026년 최신 최고의 Photoshop AI 보정 도구: 이커머스 의류, 피부 클리닝, 색상 일관성을 위한! 이 상위 평가 큐레이션 목록은 글쓰기 효율성을 높이고 콘텐츠 제작을 간소화하며 완벽한 시각적 결과를 손쉽게 달성하는 데 도움이 되는 강력한 게임 체인저 솔루션을 특징으로 합니다. 각 도구는 매주 업데이트되는 랭킹을 통해 실제 테스트를 거쳤으며, 무료 대 유료 비교 세부 사항도 포함되어 있습니다. XIX.AI의 지원을 받아 AI 경쟁력을 발휘하고자 하는 모든 이들에게 필수 추천 가이드입니다. 지금 탐색하세요!

10 도구
xix.ai
즉각적인 ChatGPT 워크플로우에 가장 적합한 AI 프롬프트 라이브러리
ChatGPT 워크플로우에 가장 적합한 AI 프롬프트 라이브러리

2026년 최신 최고 평점을 받은 AI 프롬프트 라이브러리로, 모든 유형의 ChatGPT 워크플로우를 최적화하세요. XIX.AI는 최고의 성능을 보장하기 위해 엄격한 실전 테스트를 거친, 강력하고 획기적인 컬렉션을 엄선했습니다. 생산성을 높이고 AI의 잠재력을 최대한 발휘할 수 있는 필수 도구를 선택하는 데 도움이 되는 무료 vs 유료 상세 비교 정보와 전문가 순위를 확인해 보세요. 지금 바로 살펴보세요!

11 도구
xix.ai
의견 (5)
0/500
BillyYoung
BillyYoung 2026년 2월 8일 오후 11시 0분 26초 GMT+09:00

Это немного тревожно... Google продолжает выпускать всё более мощные модели, но безопасность, похоже, отстаёт 📉. Если с точки зрения оценки безопасности наблюдается такая тенденция, то что происходит с реальными пользователями? Возможно, им стоит притормозить гонку и сосредоточиться на прочной инфраструктуре безопасности.

BrianThomas
BrianThomas 2026년 1월 14일 오후 3시 30분 34초 GMT+09:00

Isso é preocupante... A Google sempre foi referência em IA responsável, mas parece que a corrida pela performance está afetando a segurança. Será que estão lançando modelos muito rápido? Essa queda de 4-10% nas métricas de segurança não é pouca coisa, especialmente para um modelo que será usado por milhões. Espero que corrijam isso antes de uma implantação mais ampla. A competição com a OpenAI e outros não pode comprometer os padrões éticos. 🤔

SamuelEvans
SamuelEvans 2025년 12월 5일 오후 7시 30분 31초 GMT+09:00

Interesting read! As AI models get more powerful, it seems like safety testing is becoming the real bottleneck. Makes you wonder if the rush to release new versions is outpacing the ability to properly vet them. Hope Google prioritizes fixing this before scaling further. 🤔

WalterKing
WalterKing 2025년 11월 27일 오전 1시 31분 8초 GMT+09:00

Das ist ja mal echt beunruhigend... Warum werden die Sicherheitsstandards bei neuen KI-Modellen eigentlich immer schwächer? 😟 Sollte es nicht genau umgekehrt sein? Ich frage mich, ob das nur bei Google passiert oder ob andere Anbieter ähnliche Probleme haben. Vielleicht sollten sie lieber weniger auf Geschwindigkeit und mehr auf Sicherheit achten!

StevenMartínez
StevenMartínez 2025년 10월 25일 오전 3시 30분 31초 GMT+09:00

C'est inquiétant de voir les scores de sécurité baisser avec les nouvelles versions d'IA. Est-ce qu'ils privilégient la vitesse au détriment de la fiabilité ? J'espère que ce n'est pas le début d'une tendance dangereuse dans le développement de l'IA 🤔

OR