옵션
뉴스
AI가 멈추지 않는다고 주장하고, 벤치 마크를 능가합니다

AI가 멈추지 않는다고 주장하고, 벤치 마크를 능가합니다

2025년 4월 17일
183

AI가 멈추지 않는다고 주장하고, 벤치 마크를 능가합니다

대형 언어 모델(LLMs) 및 기타 생성 AI 기술은 자체 수정 능력을 크게 향상시키고 있으며, 이는 Anthropic의 부사장인 Michael Gerstenhaber에 따르면 "에이전틱 AI"로 알려진 새로운 응용 프로그램의 길을 열고 있습니다. Anthropic은 선도적인 AI 모델 개발사입니다.

"자체 수정, 자체 추론에서 매우 뛰어난 성과를 내고 있습니다,"라고 Anthropic에서 API 기술을 이끄는 Gerstenhaber는 뉴욕에서 Bloomberg Intelligence의 Anurag Rana와의 인터뷰에서 밝혔습니다. Claude LLM 제품군을 만든 Anthropic은 OpenAI의 GPT 모델과 직접 경쟁합니다. 그는 "몇 달마다 새로운 모델을 출시하며 LLM의 기능을 확장하고 있습니다,"라고 덧붙이며, 각 모델 개정판이 새로운 잠재적 용도를 열어주는 산업의 역동적인 특성을 강조했습니다.

AI 모델의 새로운 기능

Anthropic의 최신 모델은 작업 계획과 같은 기능을 도입하여, 사람이 온라인으로 피자를 주문하는 것처럼 컴퓨터에서 작업을 수행할 수 있게 했습니다. Gerstenhaber는 단계별 작업 실행에 대해 "어제는 불가능했던 중간 단계 계획이 이제 가능해졌습니다,"라고 언급했습니다.

이 논의에는 AI 스타트업 Scale AI의 최고 기술 책임자인 Vijay Karunamurthy도 참여했으며, Bloomberg Intelligence가 주최한 "Gen AI: 생산성 약속을 실현할 수 있을까?"라는 제목의 하루 종일 컨퍼런스의 일부였습니다.

AI 회의론에 대한 도전

Gerstenhaber의 통찰은 생성 AI 및 더 넓은 AI 분야가 "한계에 부딪혔다"고 주장하며, 새로운 모델 반복마다 수익이 감소한다고 보는 AI 회의론자들의 견해에 도전합니다. 예를 들어, AI 학자 Gary Marcus는 2022년부터 AI 모델의 크기(더 많은 매개변수)를 단순히 늘리는 것만으로는 성능이 비례적으로 향상되지 않을 것이라고 경고해 왔습니다.

하지만 Gerstenhaber는 Anthropic이 현재 AI 벤치마크로 측정할 수 있는 것 이상으로 한계를 밀어붙이고 있다고 주장합니다. 그는 "일부 영역에서 진전이 느려 보일 수 있지만, 이는 우리가 완전히 새로운 기능을 열고 있기 때문이며, 벤치마크와 기존 작업 수행 능력은 포화 상태에 이르렀습니다,"라고 설명했습니다. 이로 인해 현재 생성 AI 모델이 달성할 수 있는 전체 범위를 측정하기가 점점 더 어려워지고 있습니다.

확장과 학습

Gerstenhaber와 Karunamurthy는 생성 AI 모델의 자체 수정 능력을 향상시키기 위해 모델을 확장하는 것의 중요성을 강조했습니다. Gerstenhaber는 "우리는 점점 더 많은 지능의 확장을 보고 있습니다,"라고 말했습니다. Karunamurthy는 "계획과 추론에서 한계에 부딪히지 않는다고 믿는 이유 중 하나는 우리가 이러한 작업을 구조화하는 방법을 여전히 배우고 있어 모델이 새롭고 다양한 환경에 적응할 수 있기 때문입니다,"라고 덧붙였습니다.

Gerstenhaber는 동의하며, "우리는 초기 단계에 있으며, 응용 프로그램 개발자들로부터 그들의 필요와 모델의 부족한 점을 배우고, 이를 다시 언어 모델에 통합할 수 있습니다,"라고 말했습니다.

실시간 학습과 적응

Gerstenhaber에 따르면 이러한 진전의 많은 부분은 Anthropic의 기초 연구의 빠른 속도와 산업 피드백으로부터의 실시간 학습에 의해 이루어지고 있습니다. 그는 "우리는 산업이 우리에게 필요하다고 말하는 것에 적응하며 실시간으로 배우고 있습니다,"라고 말했습니다.

고객은 종종 더 큰 모델부터 시작하여 특정 목적에 맞게 더 간단한 모델로 축소합니다. Gerstenhaber는 "처음에는 모델이 작업을 잘 수행할 만큼 충분히 지능적인지 평가하고, 그 다음에는 응용 프로그램 요구를 충족할 만큼 충분히 빠른지, 마지막으로 가능한 한 비용 효율적인지 평가합니다,"라고 설명했습니다.

관련 기사
미국의 주식 시장이 AI와 항공우주 거대 기업들의 1조 달러 데뷔를 앞두고 역사적 이정표에 도달 미국의 주식 시장이 AI와 항공우주 거대 기업들의 1조 달러 데뷔를 앞두고 역사적 이정표에 도달 엘론 머스크, 샘 알트만, 그리고 다리오 아모데이라는 기술 산업의 거인 세 명이 각자의 기업에 대해 공개 시장 상장(IPO)을 앞두고 있다. 스페이스X, 오픈AI, 앤트로픽이라는 세 산업의 거대 기업이 1조 달러 이상의 기업 가치를 달성하며 상장을 준비함에 따라, 2026년은 미국 역사상 신주 발행 측면에서 가장 중요한 해가 될 것으로 전망된다.이러한 역사적인 자본 증가는 전 세계 금융계의 주목을 받고 있으며, 공공 시장이 이러한 규모의 자금
스웨덴의 AI 스타트업 로버블 아이즈, 주요 자금 조달 라운드 이후 132억 달러의 기업 가치 달성 스웨덴의 AI 스타트업 로버블 아이즈, 주요 자금 조달 라운드 이후 132억 달러의 기업 가치 달성 AI 기반 코딩 도구가 인기를 얻으면서 스웨덴 스타트업 로버블(Lovable)이 주요 자금 조달 라운드를 성사시켰다. 이 회사는 30억 달러를 조달하여 지난 12월 기록된 66억 달러의 두 배인 132억 달러의 기업 가치를 달성할 수 있을 것으로 기대된다. 멘로 벤처스(Menlo Ventures)가 이 투자 라운드를 주도할 것으로 예상된다.로버블의 매력은 복잡한 코딩 기술이 필요하지 않은 소프트웨어 제작을 단순화하는 핵심 '바이브 코딩(vib
구글, 사용자 제어 강화에 맞춰 제미니용 레미 AI 에이전트 테스트 구글, 사용자 제어 강화에 맞춰 제미니용 레미 AI 에이전트 테스트 비즈니스 인사이더에 따르면, 구글은 제미나이를 위한 새로운 AI 개인 에이전트인 레미를 테스트하고 있습니다. 이 도구는 사용자를 대신하여 작업을 실행하여 전문적인 워크플로우와 일상적인 루틴을 모두 간소화하는 것을 목표로 합니다.현재 레미는 제미나이 애플리케이션의 내부 직원 전용 버전에서 테스트 중입니다. 이 보고서는 내부 문서와 프로젝트에 정통한 두 명의 인물과의 인터뷰를 인용합니다. 내부 자료는 레미를 “24/7 개인 에이전트”로 묘사하며,
관련 특별 주제 추천
데이터 분석 SaaS 및 이커머스 팀을 위한 KPI 모니터링용 최고의 AI 이상 감지 도구
SaaS 및 이커머스 팀을 위한 KPI 모니터링용 최고의 AI 이상 감지 도구

2026년 최신 최고의 KPI 모니터링용 AI 이상 탐지 도구 SaaS 및 이커머스 팀을 위한 상위 평가 도구! XIX.AI는 엄격한 실제 테스트와 매주 업데이트되는 순위를 기반으로 강력한 게임 체인저 컬렉션을 선별했습니다. 생산성을 높이고 AI 경쟁력을 발휘할 수 있는 필수 솔루션을 식별하는 데 도움이 되는 상세한 무료 대 유료 비교 인사이트를 찾을 수 있습니다. 지금 탐색하세요!

10 도구
xix.ai
글쓰기 장문 SEO 기사용 최고의 AI 개요 생성기
장문 SEO 기사용 최고의 AI 개요 생성기

XIX.AI가 꼼꼼하게 선별한 2026년 최신 최고 평점을 받은 장문 SEO 기사용 AI 개요 생성기. 이 강력한 도구들은 고품질 콘텐츠를 신속하게 제작하는 데 획기적인 도움을 제공하여 글쓰기 효율을 크게 높여줍니다. 무료 버전과 유료 버전의 비교 정보와 실제 테스트 결과, 상세한 순위 정보를 확인하여 여러분의 필요에 딱 맞는, 꼭 사용해 봐야 할 옵션을 찾아보세요. 지금 바로 살펴보고 AI를 활용한 경쟁력을 확보하세요.

8 도구
xix.ai
교육 및 학습 숙제 및 시험 준비를 위한 AI 학습 도구
숙제 및 시험 준비를 위한 AI 학습 도구

2026년 숙제 및 시험 준비를 위한 최신 최고의 AI 학습 도구! XIX.AI는 학생들이 생산성을 높이고, 숙제 완료 과정을 효율화하며, 실제 시험을 통해 우수한 성적을 거둘 수 있도록 돕는 강력하고 혁신적인 도구들의 최고 평점 목록을 엄선했습니다. 무료와 유료 버전의 비교 정보, 상세한 순위, 꼭 사용해 봐야 할 옵션을 확인하고 AI의 힘을 최대한 활용하세요. 지금 바로 살펴보세요!

10 도구
xix.ai
음악 작곡 songwriter, 후크, 탑라인 및 다국어 초안 세션을 위한 AI 보컬 데모 도구
songwriter, 후크, 탑라인 및 다국어 초안 세션을 위한 AI 보컬 데모 도구

2026년 최신 최고의 AI 보컬 데모 도구: 작곡가, 후크 제작자 및 다국어 콘텐츠 팀을 위한! XIX.AI는 엄격한 실전 테스트를 거친 강력한 혁신 도구의 최고 평점 목록을 선별했습니다. 여기서는 무료 대 유료 비교 데이터, 종합 순위, 그리고 필수 추천 옵션을 확인할 수 있어 작사 효율성을 높이고 창의적 잠재력을 발휘하는 데 도움이 됩니다. 지금 탐색하여 모든 콘텐츠 요구에 맞는 완벽한 도구를 발견하세요!

9 도구
xix.ai
사업 중소기업을 위한 최고의 AI 경쟁사 분석 도구
중소기업을 위한 최고의 AI 경쟁사 분석 도구

2026년 중소기업을 위한 최신 최고 평점의 AI 경쟁 분석 도구! XIX.AI는 매주 엄격한 실제 테스트와 상세한 순위를 바탕으로 업데이트되는, 업계 판도를 바꿀 만큼 강력한 도구 모음을 엄선했습니다. 생산성을 높이고 경쟁 우위를 확보할 수 있는 ‘꼭 사용해 봐야 할’ 도구를 찾아보실 수 있도록, 무료 버전과 유료 버전의 포괄적인 비교 정보를 제공합니다. 지금 바로 살펴보고 여러분에게 딱 맞는 도구를 찾아보세요!

9 도구
xix.ai
이미지 편집 이커머스 의류용 Photoshop AI 보정 도구, 피부 결 정리 및 색상 일관성
이커머스 의류용 Photoshop AI 보정 도구, 피부 결 정리 및 색상 일관성

2026년 최신 최고의 Photoshop AI 보정 도구: 이커머스 의류, 피부 클리닝, 색상 일관성을 위한! 이 상위 평가 큐레이션 목록은 글쓰기 효율성을 높이고 콘텐츠 제작을 간소화하며 완벽한 시각적 결과를 손쉽게 달성하는 데 도움이 되는 강력한 게임 체인저 솔루션을 특징으로 합니다. 각 도구는 매주 업데이트되는 랭킹을 통해 실제 테스트를 거쳤으며, 무료 대 유료 비교 세부 사항도 포함되어 있습니다. XIX.AI의 지원을 받아 AI 경쟁력을 발휘하고자 하는 모든 이들에게 필수 추천 가이드입니다. 지금 탐색하세요!

10 도구
xix.ai
의견 (8)
0/500
JoseRoberts
JoseRoberts 2025년 8월 13일 오전 12시 0분 59초 GMT+09:00

This self-correction stuff is wild! 😮 It's like AI is learning to double-check its own homework. Wonder how far this 'agentic AI' will go—could it outsmart us at our own jobs soon?

WalterAnderson
WalterAnderson 2025년 7월 31일 오후 8시 35분 39초 GMT+09:00

It's wild to think AI can now self-correct! 😮 Makes me wonder how soon we'll see these 'agentic AI' systems running our lives—hope they don’t outsmart us too much!

RonaldMartinez
RonaldMartinez 2025년 7월 22일 오후 4시 39분 52초 GMT+09:00

This article really opened my eyes to how fast AI is evolving! Self-correcting LLMs sound like a game-changer for agentic AI. Can’t wait to see what new apps come out of this! 😄

WillieJackson
WillieJackson 2025년 4월 18일 오후 4시 0분 28초 GMT+09:00

La perspectiva de Anthropic sobre que la IA no se estanca sino que supera los benchmarks es bastante genial. Es como si la IA estuviera jugando ajedrez mientras nosotros aún estamos tratando de entender las damas. Lo de la autocorrección suena prometedor, pero aún estoy un poco escéptico. 🤔

GeorgeWilson
GeorgeWilson 2025년 4월 18일 오전 2시 45분 24초 GMT+09:00

Anthropic의 AI가 정체되지 않고 벤치마크를 뛰어넘는다는 생각이 멋지네요. AI는 체스를 하고 있는데, 우리는 아직 체커를 이해하는 단계예요. 자기 교정 이야기는 유망하지만, 아직 조금 회의적이에요. 🤔

NicholasCarter
NicholasCarter 2025년 4월 17일 오후 8시 27분 31초 GMT+09:00

Anthropic's take on AI not stalling but outsmarting benchmarks is pretty cool. It's like AI is playing chess while we're still figuring out checkers. The self-correction stuff sounds promising, but I'm still a bit skeptical. 🤔

OR