옵션
뉴스
새로운 ‘Gemini 3 Deep Think’ 출시, 프로그래밍 및 연구 부문 랭킹 1위 차지 — 이를 능가하는 모델은 단 7개뿐

새로운 ‘Gemini 3 Deep Think’ 출시, 프로그래밍 및 연구 부문 랭킹 1위 차지 — 이를 능가하는 모델은 단 7개뿐

2026년 6월 25일
132

구글의 ‘Gemini3Deep Think’가 오늘 대대적인 업데이트를 단행했습니다. 심층 추론을 위해 설계된 이 모델은 프로그래밍 분야에서 최정상 수준의 성능을 발휘할 뿐만 아니라, 과학 연구 및 고난도 엔지니어링 분야에서도 새로운 기록을 세우며 AI 추론 능력의 비약적인 발전을 보여주었습니다.

image.png

'Gemini3Deep Think'의 두드러진 성과:

프로그래밍 숙련도: Codeforces 알고리즘 경진 플랫폼에서 3455라는 인상적인 Elo 점수를 기록했습니다. 이는 최상위권 인간 경쟁자들과 어깨를 나란히 하는 수준으로, 전 세계에서 단 7명의 인간만이 이 모델을 이길 수 있습니다. 참고로, 1년 전 가장 강력한 o3 모델의 점수는 2727이었습니다.

과학 연구를 위한 강력한 두뇌: 이 모델은 엄격한 논리적 추론을 보여주며, 인간 동료 심사위원들조차 간과했던 고수준 물리학 및 수학 논문의 미묘한 오류를 포착해 냈습니다. 또한 “에르도스 추측”과 관련된 몇 가지 난해한 문제들을 증명하는 데도 성공했습니다.

스케치에서 실물 제품까지: 공학 분야에서 이 모델은 손으로 그린 스케치를 직접 분석하여 고충실도 3D 모델 파일(예: 노트북 스탠드)로 렌더링할 수 있어, 물리적 부품 모델링 효율을 10배나 높여줍니다.

벤치마크 테스트에서 포괄적인 돌파구: ‘라스트 휴먼 익스암(HLE)’에서 48.4%의 점수를 기록했으며, ARC-AGI-2 벤치마크에서는 84.6%라는 인상적인 정확도를 달성하며 1위를 차지했습니다.

현재 구글은 AI Ultra 구독자들에게 새 버전을 공개했으며, 선별된 연구자 및 기업들에게 처음으로 API 접근 권한을 제공했습니다. 제미니(Gemini)의 이번 대대적인 업그레이드는 경쟁사들의 추론 모델에 대한 강력한 대응으로 평가받고 있습니다.

관련 기사
ByteDance의 Seed가 글로벌 캠퍼스 채용을 시작하며, 최상위 대형 모델 인재 영입을 위해 가상 주식을 제공합니다 ByteDance의 Seed가 글로벌 캠퍼스 채용을 시작하며, 최상위 대형 모델 인재 영입을 위해 가상 주식을 제공합니다 대규모 언어 모델의 치열한 경쟁 구도에서 최상위 인재 확보는 여전히 가장 중요한 전략적 자산입니다.4월 1일, ByteDance은 대규모 모델 인재 양성 프로그램의 일환으로 글로벌 캠퍼스 채용 프로그램 Seed를 시작한다고 발표했습니다. 이 캠페인은 2027년 졸업 예정자와 현재 인턴을 대상으로 전 세계 AI 분야의 엘리트 연구 및 엔지니어링 전문가를 식별하고 확보하는 것을 목표로 합니다.확장: 전 세계 100명의 "AI 시드" 식별급속한
법적 분쟁 속에서 Suno의 워터마크 삽입 법적 분쟁 속에서 Suno의 워터마크 삽입 Suno는 사용자가 AI 생성 음악을 생성할 수 있게 하는 플랫폼으로, 플랫폼에서 생성된 트랙에 레이블을 지정하고 다운로드를 제한하며, 무단 복제를 억제하기 위해 커뮤니티 기준을 업데이트하는 새로운 기능을 공개했습니다. 이러한 업데이트는 Suno가 레이블 및 아티스트 조직으로부터 여러 소송에 직면하는 시점에 이루어집니다.공동 창립자이자 CEO인 Mikey Shulman은 블로그 게시물을 통해 핵심 원칙을 제시하며, 플랫폼이 광범위한 청중을 대
머스크, Grok 구축 과정에서 사용자 코드 유출 인정, 모든 과거 데이터 삭제 약속 머스크, Grok 구축 과정에서 사용자 코드 유출 인정, 모든 과거 데이터 삭제 약속 Elon Musk는 Grok Build와 관련된 프라이버시 논란에 대해 직접적으로 언급하며, 사건의 타당성을 확인하기 위해 간단한 "True"로 답변했습니다. 그는 SpaceXAI에 이전에 업로드된 모든 사용자 데이터를 영구적으로 삭제하겠다고 약속하며, "바이트 하나도 남기지 않겠다"고 밝혔습니다. 이는 주요 기술 리더가 실수를 공개적으로 인정하고 사용자 데이터를 능동적으로 삭제한 AI 산업 최초의 사례입니다.안전 연구원의 '피싱' 테스트는
관련 특별 주제 추천
디자인과 예술 캐릭터 시트, 무드보드, 피치 데크를 위한 AI 비주얼 스타일 레퍼런스 도구
캐릭터 시트, 무드보드, 피치 데크를 위한 AI 비주얼 스타일 레퍼런스 도구

2026년 캐릭터 시트, 무드보드, 피치 데크를 위한 최신 최고의 AI 비주얼 스타일 레퍼런스 도구가 XIX.AI에 공개되었습니다! 엄선된 이 최고 평점 목록에는 엄격한 실전 테스트를 거친, 게임의 판도를 바꿀 만큼 강력한 도구들이 포함되어 있습니다. 무료와 유료 버전의 비교 정보, 상세한 순위, 창의력을 높이고 작업 흐름을 효율화하는 데 도움이 될 필수 추천 도구를 확인해 보세요. 지금 바로 살펴보고 생산성을 높여줄 완벽한 도구를 찾아보세요!

11 도구
xix.ai
SEO 검색 전략 수립을 위한 최고의 AI SERP 분석 도구
검색 전략 수립을 위한 최고의 AI SERP 분석 도구

2026년 검색 전략을 위한 최신 최고의 AI SERP 분석 도구는 XIX.AI가 엄격한 실전 테스트를 거쳐 엄선하고 매주 순위를 업데이트하여 제공합니다. 이 강력한 도구들을 활용하면 숨겨진 최적화 기회를 발굴하고, 콘텐츠 성과를 높이며, 검색 분야에서 경쟁 우위를 확보할 수 있습니다. 지금 바로 검색 전략을 한 단계 업그레이드해 줄 완벽한 도구를 찾아보세요. 지금 바로 확인해 보세요!

13 도구
xix.ai
데이터 분석 SaaS 및 이커머스 팀을 위한 KPI 모니터링용 최고의 AI 이상 감지 도구
SaaS 및 이커머스 팀을 위한 KPI 모니터링용 최고의 AI 이상 감지 도구

2026년 최신 최고의 KPI 모니터링용 AI 이상 탐지 도구 SaaS 및 이커머스 팀을 위한 상위 평가 도구! XIX.AI는 엄격한 실제 테스트와 매주 업데이트되는 순위를 기반으로 강력한 게임 체인저 컬렉션을 선별했습니다. 생산성을 높이고 AI 경쟁력을 발휘할 수 있는 필수 솔루션을 식별하는 데 도움이 되는 상세한 무료 대 유료 비교 인사이트를 찾을 수 있습니다. 지금 탐색하세요!

10 도구
xix.ai
글쓰기 장문 SEO 기사용 최고의 AI 개요 생성기
장문 SEO 기사용 최고의 AI 개요 생성기

XIX.AI가 꼼꼼하게 선별한 2026년 최신 최고 평점을 받은 장문 SEO 기사용 AI 개요 생성기. 이 강력한 도구들은 고품질 콘텐츠를 신속하게 제작하는 데 획기적인 도움을 제공하여 글쓰기 효율을 크게 높여줍니다. 무료 버전과 유료 버전의 비교 정보와 실제 테스트 결과, 상세한 순위 정보를 확인하여 여러분의 필요에 딱 맞는, 꼭 사용해 봐야 할 옵션을 찾아보세요. 지금 바로 살펴보고 AI를 활용한 경쟁력을 확보하세요.

8 도구
xix.ai
교육 및 학습 숙제 및 시험 준비를 위한 AI 학습 도구
숙제 및 시험 준비를 위한 AI 학습 도구

2026년 숙제 및 시험 준비를 위한 최신 최고의 AI 학습 도구! XIX.AI는 학생들이 생산성을 높이고, 숙제 완료 과정을 효율화하며, 실제 시험을 통해 우수한 성적을 거둘 수 있도록 돕는 강력하고 혁신적인 도구들의 최고 평점 목록을 엄선했습니다. 무료와 유료 버전의 비교 정보, 상세한 순위, 꼭 사용해 봐야 할 옵션을 확인하고 AI의 힘을 최대한 활용하세요. 지금 바로 살펴보세요!

10 도구
xix.ai
음악 작곡 songwriter, 후크, 탑라인 및 다국어 초안 세션을 위한 AI 보컬 데모 도구
songwriter, 후크, 탑라인 및 다국어 초안 세션을 위한 AI 보컬 데모 도구

2026년 최신 최고의 AI 보컬 데모 도구: 작곡가, 후크 제작자 및 다국어 콘텐츠 팀을 위한! XIX.AI는 엄격한 실전 테스트를 거친 강력한 혁신 도구의 최고 평점 목록을 선별했습니다. 여기서는 무료 대 유료 비교 데이터, 종합 순위, 그리고 필수 추천 옵션을 확인할 수 있어 작사 효율성을 높이고 창의적 잠재력을 발휘하는 데 도움이 됩니다. 지금 탐색하여 모든 콘텐츠 요구에 맞는 완벽한 도구를 발견하세요!

9 도구
xix.ai
의견 (1)
0/500
WillPerez
WillPerez 2026년 7월 8일 오전 3시 0분 15초 GMT+09:00

I've been testing Gemini 3 Deep Think for a few days, and honestly, it's mind-blowing how it handles complex code refactoring. But I wonder if this level of compute is sustainable for everyday developers? 🤔

OR