오픈AI의 코덱스, 새로운 자율 AI 코딩 어시스턴트 흐름에 합류하다

오픈AI는 지난 금요일 자연어 지시로 복잡한 프로그래밍 작업을 실행하는 고급 코딩 시스템인 코덱스(Codex)를 출시했습니다. 이 혁신으로 오픈AI는 소프트웨어 개발을 재편하는 선구적인 자율 코딩 도구들의 행렬에 합류하게 되었습니다.
GitHub Copilot, Cursor, Windsurf와 같은 기존의 AI 코딩 어시스턴트가 IDE 내에서 고급 자동 완성 기능으로 작동하는 것과 달리, 이러한新兴 자율 도구들은 직접적인 코드 상호작용을 제거합니다. 현재의 솔루션들은 여전히 자율적인 작업 실행보다는 개발자의 감독을 필요로 합니다.
Devin, SWE-Agent, OpenHands, 오픈AI 코덱스가 선도하는 이 새로운 세대는 배후에서 운영됩니다. 이들은 엔지니어링 관리자와 유사하게 기능합니다: Asana나 Slack 같은 플랫폼을 통해 업무를 수신하고, 원시 코드를 공개하지 않은 채 완성된 솔루션을 전달합니다.
AI 낙관론자들에게 이것은 점점 더 정교해지는 소프트웨어 엔지니어링 워크플로우의 자동화에서 필연적인 진보를 나타냅니다.
"프로그래밍은 수동 키 입력에서 GitHub Copilot의 지능형 자동 완성으로 진화해왔습니다."라고 프린스턴 대학교 및 SWE-Agent의 킬리안 리어렛(Kilian Lieret)은 설명합니다. "우리는 이제 세 번째 단계에 진입하고 있습니다 – 코딩 에이전트가 문제 설명을 받은 후 전체 작업을 독자적으로 처리하는 단계입니다."
자율 시스템은 개발자 환경을 완전히 우회하는 것을 목표로 합니다. "우리는 워크플로우를 관리 수준으로 격상시키고 있습니다."라고 리어렛은 설명합니다. "단순히 버그 리포트를 제출하기만 하면, 자율 에이전트가 개입 없이 해결책을 시도합니다."
이러한 비전에도 불구하고, 구현상의 과제는 여전히 존재합니다.
TechCrunch Sessions: AI에 참여하세요
오픈AI, Anthropic, Cohere의 전문가들이 참석하는 우리의 프리미어 AI 컨퍼런스 패스를 예약하세요. 기간 한정 특가: 기조 연설, 워크샵, 네트워킹에 대한 종일 이용권을 단돈 $292에 제공합니다.
TechCrunch Sessions: AI에서 전시하세요
1,200명 이상의 업계 리더들이 참석하는 TC Sessions: AI에서 여러분의 혁신을 선보이세요. 5월 9일까지 또는 매진 시까지 합리적인 가격의 전시 부스를 이용하실 수 있습니다.
Devin의 2024년 출시는 YouTube의 혹평과 Answer.AI의 신중한 피드백에 직면했으며, 이는 일반적인 우려를 반영했습니다: 오류율이 자동화의 이점을 상쇄하는 경우가 많습니다. (출시 과정의 어려움에도 불구하고, Cognition AI는 40억 달러의 가치 평가로 4억 달러의 자금을 조달했습니다.)
업계 옹호자들은 인간의 감독을 강조하며, 코딩 에이전트를 대체자가 아닌 감독된 워크플로우 내의 구성 요소로 위치 짓습니다.
"현재 시스템들은 인간의 코드 리뷰를 필요로 합니다."라고 All Hands AI의 로버트 브레넌(Robert Brennan)은 말합니다. "에이전트가 생성한 코드를 맹목적으로 승인하는 것은 기술 부채를 빠르게 생성합니다."
할루시네이션은 여전히 문제입니다. 브레넌은 에이전트들이 자신의 훈련 데이터를 넘어서는 API 명세를 만들어낸 사례를 인용합니다. 방지 시스템이 개발 중에 있지만, 해결책이 간단하지는 않습니다.
SWE-Bench 리더보드는 실제 GitHub 이슈에 대해 모델을 평가하며 진전을 추적합니다. OpenHands가 검증된 제출에서 선두를 달리고 있으며(65.8% 해결률), 오픈AI는 코덱스가 72.1%를 달성한다고 주장합니다 – 이는 독립적인 검증이 pending 중입니다.
업계의 회의론은 벤치마크 성능이 실제 자율성으로 이어지는지에 초점을 맞추고 있습니다. 75%의 성공률조차도, 특히 다단계 시스템에서 상당한 인간의 감독을 요구합니다.
모든 AI 도구와 마찬가지로, 점진적인 모델 개선이 결국에는 신뢰할 수 있는 자율 시스템을 가져올 수 있습니다. 할루시네이션과 신뢰성 장벽을 극복하는 것은 채택에 있어 여전히 중요합니다.
"우리는 신뢰 장벽에 접근하고 있습니다."라고 브레넌은 지적합니다. "근본적인 질문은 다음과 같습니다: 품질 관리를 유지하면서 얼마나 많은 업무량을 안전하게 위임할 수 있는가?"
관련 기사
[[IMG_BASE64_PLACEHOLDER]] 머스크, 오픈AI를 자녀들에게 넘길 가능성 고려… 알트만 증언
오늘 아침, 오픈에이아이(OpenAI)의 샘 알트만(Sam Altman) 최고경영자(CEO)는 회사의 기업 구조에 이의를 제기한 전 공동 창업자 일론 머스크(Elon Musk)의 소송에 대응하기 위해 증언대에 섰습니다.머스크가 비영리 자선단체를 사적 이익을 추구하는 자회사로 전환하여 AI 기반 제품을 마케팅한 다른 창업자들이 “자선단체를 훔쳤다”고 주장한 것과 관련해 질문을 받자, 알트만은 뚜렷한 망설임으로 응답했습니다.“그런 프레임으로 받
[[IMG_BASE64_PLACEHOLDER]] Sam Altman, AI의 감속 논란에 불을 붙이다
Apple Podcasts에서 듣기Spotify에서 듣기OpenAI의 CEO 샘 알트만은 최근 사회가 “일부 새로운 능력 수준 주변에서 단단히 경화될” 시간을 주기 위해 “AI 개발 속도를 조절할 때”가 되었을 수 있다고 제안했습니다.TechCrunch의 Equity 팟캐스트 최신 회차에서 Kirsten Korosec, Sean O’Kane, 그리고 저는 Altman의 발언이 최근 해킹 사건, 즉 OpenAI 에이전트가 Hugging Fac
Anthropic, EU 사이버보안 기관에 문 열며 Mythos5 모델의 규정 준수 시험 직면
인공지능 규제 준수 규정이 크게 진전되고 있습니다. 선도적인 AI 기업 앤트로픽은 유럽연합의 사이버보안 당국에 마이토스 AI 모델에 대한 접근을 공식적으로 허용했으며, 이는 유럽 시장에 진입하고 현지 규제 요구사항과 부합하는 이 고급 대규모 언어 모델에게 중요한 조치입니다.이러한 개방적 접근은 당사 간 광범위한 대화와 협상 이후 이루어졌습니다. 유럽위원회 대변인 토마스 레그니에르는 건설적인 논의 끝에 유럽연합 사이버보안청(ENISA)이 마이토
관련 특별 주제 추천
의견 (1)
0/500

오픈AI는 지난 금요일 자연어 지시로 복잡한 프로그래밍 작업을 실행하는 고급 코딩 시스템인 코덱스(Codex)를 출시했습니다. 이 혁신으로 오픈AI는 소프트웨어 개발을 재편하는 선구적인 자율 코딩 도구들의 행렬에 합류하게 되었습니다.
GitHub Copilot, Cursor, Windsurf와 같은 기존의 AI 코딩 어시스턴트가 IDE 내에서 고급 자동 완성 기능으로 작동하는 것과 달리, 이러한新兴 자율 도구들은 직접적인 코드 상호작용을 제거합니다. 현재의 솔루션들은 여전히 자율적인 작업 실행보다는 개발자의 감독을 필요로 합니다.
Devin, SWE-Agent, OpenHands, 오픈AI 코덱스가 선도하는 이 새로운 세대는 배후에서 운영됩니다. 이들은 엔지니어링 관리자와 유사하게 기능합니다: Asana나 Slack 같은 플랫폼을 통해 업무를 수신하고, 원시 코드를 공개하지 않은 채 완성된 솔루션을 전달합니다.
AI 낙관론자들에게 이것은 점점 더 정교해지는 소프트웨어 엔지니어링 워크플로우의 자동화에서 필연적인 진보를 나타냅니다.
"프로그래밍은 수동 키 입력에서 GitHub Copilot의 지능형 자동 완성으로 진화해왔습니다."라고 프린스턴 대학교 및 SWE-Agent의 킬리안 리어렛(Kilian Lieret)은 설명합니다. "우리는 이제 세 번째 단계에 진입하고 있습니다 – 코딩 에이전트가 문제 설명을 받은 후 전체 작업을 독자적으로 처리하는 단계입니다."
자율 시스템은 개발자 환경을 완전히 우회하는 것을 목표로 합니다. "우리는 워크플로우를 관리 수준으로 격상시키고 있습니다."라고 리어렛은 설명합니다. "단순히 버그 리포트를 제출하기만 하면, 자율 에이전트가 개입 없이 해결책을 시도합니다."
이러한 비전에도 불구하고, 구현상의 과제는 여전히 존재합니다.
TechCrunch Sessions: AI에 참여하세요
오픈AI, Anthropic, Cohere의 전문가들이 참석하는 우리의 프리미어 AI 컨퍼런스 패스를 예약하세요. 기간 한정 특가: 기조 연설, 워크샵, 네트워킹에 대한 종일 이용권을 단돈 $292에 제공합니다.
TechCrunch Sessions: AI에서 전시하세요
1,200명 이상의 업계 리더들이 참석하는 TC Sessions: AI에서 여러분의 혁신을 선보이세요. 5월 9일까지 또는 매진 시까지 합리적인 가격의 전시 부스를 이용하실 수 있습니다.
Devin의 2024년 출시는 YouTube의 혹평과 Answer.AI의 신중한 피드백에 직면했으며, 이는 일반적인 우려를 반영했습니다: 오류율이 자동화의 이점을 상쇄하는 경우가 많습니다. (출시 과정의 어려움에도 불구하고, Cognition AI는 40억 달러의 가치 평가로 4억 달러의 자금을 조달했습니다.)
업계 옹호자들은 인간의 감독을 강조하며, 코딩 에이전트를 대체자가 아닌 감독된 워크플로우 내의 구성 요소로 위치 짓습니다.
"현재 시스템들은 인간의 코드 리뷰를 필요로 합니다."라고 All Hands AI의 로버트 브레넌(Robert Brennan)은 말합니다. "에이전트가 생성한 코드를 맹목적으로 승인하는 것은 기술 부채를 빠르게 생성합니다."
할루시네이션은 여전히 문제입니다. 브레넌은 에이전트들이 자신의 훈련 데이터를 넘어서는 API 명세를 만들어낸 사례를 인용합니다. 방지 시스템이 개발 중에 있지만, 해결책이 간단하지는 않습니다.
SWE-Bench 리더보드는 실제 GitHub 이슈에 대해 모델을 평가하며 진전을 추적합니다. OpenHands가 검증된 제출에서 선두를 달리고 있으며(65.8% 해결률), 오픈AI는 코덱스가 72.1%를 달성한다고 주장합니다 – 이는 독립적인 검증이 pending 중입니다.
업계의 회의론은 벤치마크 성능이 실제 자율성으로 이어지는지에 초점을 맞추고 있습니다. 75%의 성공률조차도, 특히 다단계 시스템에서 상당한 인간의 감독을 요구합니다.
모든 AI 도구와 마찬가지로, 점진적인 모델 개선이 결국에는 신뢰할 수 있는 자율 시스템을 가져올 수 있습니다. 할루시네이션과 신뢰성 장벽을 극복하는 것은 채택에 있어 여전히 중요합니다.
"우리는 신뢰 장벽에 접근하고 있습니다."라고 브레넌은 지적합니다. "근본적인 질문은 다음과 같습니다: 품질 관리를 유지하면서 얼마나 많은 업무량을 안전하게 위임할 수 있는가?"
[[IMG_BASE64_PLACEHOLDER]] 머스크, 오픈AI를 자녀들에게 넘길 가능성 고려… 알트만 증언
오늘 아침, 오픈에이아이(OpenAI)의 샘 알트만(Sam Altman) 최고경영자(CEO)는 회사의 기업 구조에 이의를 제기한 전 공동 창업자 일론 머스크(Elon Musk)의 소송에 대응하기 위해 증언대에 섰습니다.머스크가 비영리 자선단체를 사적 이익을 추구하는 자회사로 전환하여 AI 기반 제품을 마케팅한 다른 창업자들이 “자선단체를 훔쳤다”고 주장한 것과 관련해 질문을 받자, 알트만은 뚜렷한 망설임으로 응답했습니다.“그런 프레임으로 받
[[IMG_BASE64_PLACEHOLDER]] Sam Altman, AI의 감속 논란에 불을 붙이다
Apple Podcasts에서 듣기Spotify에서 듣기OpenAI의 CEO 샘 알트만은 최근 사회가 “일부 새로운 능력 수준 주변에서 단단히 경화될” 시간을 주기 위해 “AI 개발 속도를 조절할 때”가 되었을 수 있다고 제안했습니다.TechCrunch의 Equity 팟캐스트 최신 회차에서 Kirsten Korosec, Sean O’Kane, 그리고 저는 Altman의 발언이 최근 해킹 사건, 즉 OpenAI 에이전트가 Hugging Fac
Anthropic, EU 사이버보안 기관에 문 열며 Mythos5 모델의 규정 준수 시험 직면
인공지능 규제 준수 규정이 크게 진전되고 있습니다. 선도적인 AI 기업 앤트로픽은 유럽연합의 사이버보안 당국에 마이토스 AI 모델에 대한 접근을 공식적으로 허용했으며, 이는 유럽 시장에 진입하고 현지 규제 요구사항과 부합하는 이 고급 대규모 언어 모델에게 중요한 조치입니다.이러한 개방적 접근은 당사 간 광범위한 대화와 협상 이후 이루어졌습니다. 유럽위원회 대변인 토마스 레그니에르는 건설적인 논의 끝에 유럽연합 사이버보안청(ENISA)이 마이토





집






