새로운 ‘Gemini 3 Deep Think’ 출시, 프로그래밍 및 연구 부문 랭킹 1위 차지 — 이를 능가하는 모델은 단 7개뿐
구글의 ‘Gemini3Deep Think’가 오늘 대대적인 업데이트를 단행했습니다. 심층 추론을 위해 설계된 이 모델은 프로그래밍 분야에서 최정상 수준의 성능을 발휘할 뿐만 아니라, 과학 연구 및 고난도 엔지니어링 분야에서도 새로운 기록을 세우며 AI 추론 능력의 비약적인 발전을 보여주었습니다.

'Gemini3Deep Think'의 두드러진 성과:
프로그래밍 숙련도: Codeforces 알고리즘 경진 플랫폼에서 3455라는 인상적인 Elo 점수를 기록했습니다. 이는 최상위권 인간 경쟁자들과 어깨를 나란히 하는 수준으로, 전 세계에서 단 7명의 인간만이 이 모델을 이길 수 있습니다. 참고로, 1년 전 가장 강력한 o3 모델의 점수는 2727이었습니다.
과학 연구를 위한 강력한 두뇌: 이 모델은 엄격한 논리적 추론을 보여주며, 인간 동료 심사위원들조차 간과했던 고수준 물리학 및 수학 논문의 미묘한 오류를 포착해 냈습니다. 또한 “에르도스 추측”과 관련된 몇 가지 난해한 문제들을 증명하는 데도 성공했습니다.
스케치에서 실물 제품까지: 공학 분야에서 이 모델은 손으로 그린 스케치를 직접 분석하여 고충실도 3D 모델 파일(예: 노트북 스탠드)로 렌더링할 수 있어, 물리적 부품 모델링 효율을 10배나 높여줍니다.
벤치마크 테스트에서 포괄적인 돌파구: ‘라스트 휴먼 익스암(HLE)’에서 48.4%의 점수를 기록했으며, ARC-AGI-2 벤치마크에서는 84.6%라는 인상적인 정확도를 달성하며 1위를 차지했습니다.
현재 구글은 AI Ultra 구독자들에게 새 버전을 공개했으며, 선별된 연구자 및 기업들에게 처음으로 API 접근 권한을 제공했습니다. 제미니(Gemini)의 이번 대대적인 업그레이드는 경쟁사들의 추론 모델에 대한 강력한 대응으로 평가받고 있습니다.
관련 기사
ByteDance의 Seed가 글로벌 캠퍼스 채용을 시작하며, 최상위 대형 모델 인재 영입을 위해 가상 주식을 제공합니다
대규모 언어 모델의 치열한 경쟁 구도에서 최상위 인재 확보는 여전히 가장 중요한 전략적 자산입니다.4월 1일, ByteDance은 대규모 모델 인재 양성 프로그램의 일환으로 글로벌 캠퍼스 채용 프로그램 Seed를 시작한다고 발표했습니다. 이 캠페인은 2027년 졸업 예정자와 현재 인턴을 대상으로 전 세계 AI 분야의 엘리트 연구 및 엔지니어링 전문가를 식별하고 확보하는 것을 목표로 합니다.확장: 전 세계 100명의 "AI 시드" 식별급속한
법적 분쟁 속에서 Suno의 워터마크 삽입
Suno는 사용자가 AI 생성 음악을 생성할 수 있게 하는 플랫폼으로, 플랫폼에서 생성된 트랙에 레이블을 지정하고 다운로드를 제한하며, 무단 복제를 억제하기 위해 커뮤니티 기준을 업데이트하는 새로운 기능을 공개했습니다. 이러한 업데이트는 Suno가 레이블 및 아티스트 조직으로부터 여러 소송에 직면하는 시점에 이루어집니다.공동 창립자이자 CEO인 Mikey Shulman은 블로그 게시물을 통해 핵심 원칙을 제시하며, 플랫폼이 광범위한 청중을 대
머스크, Grok 구축 과정에서 사용자 코드 유출 인정, 모든 과거 데이터 삭제 약속
Elon Musk는 Grok Build와 관련된 프라이버시 논란에 대해 직접적으로 언급하며, 사건의 타당성을 확인하기 위해 간단한 "True"로 답변했습니다. 그는 SpaceXAI에 이전에 업로드된 모든 사용자 데이터를 영구적으로 삭제하겠다고 약속하며, "바이트 하나도 남기지 않겠다"고 밝혔습니다. 이는 주요 기술 리더가 실수를 공개적으로 인정하고 사용자 데이터를 능동적으로 삭제한 AI 산업 최초의 사례입니다.안전 연구원의 '피싱' 테스트는
관련 특별 주제 추천
의견 (1)
0/500
구글의 ‘Gemini3Deep Think’가 오늘 대대적인 업데이트를 단행했습니다. 심층 추론을 위해 설계된 이 모델은 프로그래밍 분야에서 최정상 수준의 성능을 발휘할 뿐만 아니라, 과학 연구 및 고난도 엔지니어링 분야에서도 새로운 기록을 세우며 AI 추론 능력의 비약적인 발전을 보여주었습니다.

'Gemini3Deep Think'의 두드러진 성과:
프로그래밍 숙련도: Codeforces 알고리즘 경진 플랫폼에서 3455라는 인상적인 Elo 점수를 기록했습니다. 이는 최상위권 인간 경쟁자들과 어깨를 나란히 하는 수준으로, 전 세계에서 단 7명의 인간만이 이 모델을 이길 수 있습니다. 참고로, 1년 전 가장 강력한 o3 모델의 점수는 2727이었습니다.
과학 연구를 위한 강력한 두뇌: 이 모델은 엄격한 논리적 추론을 보여주며, 인간 동료 심사위원들조차 간과했던 고수준 물리학 및 수학 논문의 미묘한 오류를 포착해 냈습니다. 또한 “에르도스 추측”과 관련된 몇 가지 난해한 문제들을 증명하는 데도 성공했습니다.
스케치에서 실물 제품까지: 공학 분야에서 이 모델은 손으로 그린 스케치를 직접 분석하여 고충실도 3D 모델 파일(예: 노트북 스탠드)로 렌더링할 수 있어, 물리적 부품 모델링 효율을 10배나 높여줍니다.
벤치마크 테스트에서 포괄적인 돌파구: ‘라스트 휴먼 익스암(HLE)’에서 48.4%의 점수를 기록했으며, ARC-AGI-2 벤치마크에서는 84.6%라는 인상적인 정확도를 달성하며 1위를 차지했습니다.
현재 구글은 AI Ultra 구독자들에게 새 버전을 공개했으며, 선별된 연구자 및 기업들에게 처음으로 API 접근 권한을 제공했습니다. 제미니(Gemini)의 이번 대대적인 업그레이드는 경쟁사들의 추론 모델에 대한 강력한 대응으로 평가받고 있습니다.
ByteDance의 Seed가 글로벌 캠퍼스 채용을 시작하며, 최상위 대형 모델 인재 영입을 위해 가상 주식을 제공합니다
대규모 언어 모델의 치열한 경쟁 구도에서 최상위 인재 확보는 여전히 가장 중요한 전략적 자산입니다.4월 1일, ByteDance은 대규모 모델 인재 양성 프로그램의 일환으로 글로벌 캠퍼스 채용 프로그램 Seed를 시작한다고 발표했습니다. 이 캠페인은 2027년 졸업 예정자와 현재 인턴을 대상으로 전 세계 AI 분야의 엘리트 연구 및 엔지니어링 전문가를 식별하고 확보하는 것을 목표로 합니다.확장: 전 세계 100명의 "AI 시드" 식별급속한
법적 분쟁 속에서 Suno의 워터마크 삽입
Suno는 사용자가 AI 생성 음악을 생성할 수 있게 하는 플랫폼으로, 플랫폼에서 생성된 트랙에 레이블을 지정하고 다운로드를 제한하며, 무단 복제를 억제하기 위해 커뮤니티 기준을 업데이트하는 새로운 기능을 공개했습니다. 이러한 업데이트는 Suno가 레이블 및 아티스트 조직으로부터 여러 소송에 직면하는 시점에 이루어집니다.공동 창립자이자 CEO인 Mikey Shulman은 블로그 게시물을 통해 핵심 원칙을 제시하며, 플랫폼이 광범위한 청중을 대
머스크, Grok 구축 과정에서 사용자 코드 유출 인정, 모든 과거 데이터 삭제 약속
Elon Musk는 Grok Build와 관련된 프라이버시 논란에 대해 직접적으로 언급하며, 사건의 타당성을 확인하기 위해 간단한 "True"로 답변했습니다. 그는 SpaceXAI에 이전에 업로드된 모든 사용자 데이터를 영구적으로 삭제하겠다고 약속하며, "바이트 하나도 남기지 않겠다"고 밝혔습니다. 이는 주요 기술 리더가 실수를 공개적으로 인정하고 사용자 데이터를 능동적으로 삭제한 AI 산업 최초의 사례입니다.안전 연구원의 '피싱' 테스트는





집






