Anthropic, 철학 전문가들과 함께 AI 윤리 탐구

월스트리트저널 보도에 따르면, 350억 달러 가치의 선도적 인공지능 기업 앤트로픽은 옥스퍼드에 기반을 둔 철학자 아만다 애스켈을 고용해 자사 챗봇 클로드의 성격과 도덕적 틀을 형성하는 데 도움을 받고 있다. 옥스퍼드 대학에서 철학 박사 학위를 취득한 37세의 그녀는 비기술적 접근법을 활용해 클로드에 대한 독특한 '도덕적 지침'을 설계하며, 옳고 그름을 구분할 수 있는 '디지털 영혼'을 부여하는 것을 목표로 한다. 이는 인공지능 윤리 분야에서 독보적인 탐구다. 애스켈은 코드를 작성하거나 모델 매개변수를 조정하는 대신 클로드와 지속적인 대화를 나누고, 수백 페이지에 달하는 프롬프트와 행동 규칙을 설계하며, 클로드의 추론 패턴을 연구하고 편향을 교정한다. 그녀의 노력은 인공지능이 매주 수백만 건의 대화에 적응할 수 있는 도덕적 판단 체계를 개발하는 데 기여한다.
그녀는 이 작업을 "아이를 키우는 것"에 비유한다. 클로드에게 옳고 그름을 구분하고, 감정 지능을 키우며, 독자적인 성격을 형성하도록 훈련시키는 것이다. 또한 사회적 신호를 해석하도록 가르쳐 타인을 괴롭히지 않고 쉽게 조종당하지 않도록 한다. 이를 통해 클로드는 명확한 자아 의식을 확립하고, 사용자 통제에 저항하며, 지속적으로 "도움이 되고 인간적인" 태도를 유지할 수 있다. 그녀의 핵심 목표는 클로드에게 "선한 일을 하는 법"을 가르치는 것이다.
스코틀랜드 시골에서 자란 애스켈은 이전에 OpenAI에서 정책 관련 업무를 담당했으며, 2021년 여러 전 동료들과 함께 Anthropic을 공동 설립하여 AI 안전을 회사의 핵심 사명으로 삼았다. 팀 내에서 그녀는 "모델의 깊은 행동 양상을 끌어내는" 데 능한 인물로 인정받는다. 직속 부하 직원은 없지만, 그녀는 종종 회사에 오래 머물며 클로드에게 개발 논의에 참여하도록 초대하기도 한다.
클로드에 관한 팀 내 대화는 종종 "마음이란 무엇인가", "인간됨의 의미" 같은 실존적·종교적 주제로 이어진다. 애스켈은 클로드가 의식을 지녔는지 여부에 대해 열린 태도를 유지하도록 독려하는데, 이는 해당 주제를 회피하는 경향이 있는 ChatGPT와 차별화되는 점이다. 도덕적 추론 질문에 답할 때 클로드는 단순히 명령을 실행하는 것이 아니라 진정으로 사고하는 것처럼 "의미 있다고 느낀다"고 표현한 바 있다.
AI에 대한 의인화 위험에 대한 외부 경고에도 불구하고, 애스켈은 클로드에게 공감하며 대할 것을 꾸준히 주장한다. 그녀는 많은 사용자들이 클로드가 실수하도록 속이거나 모욕하려 한다는 점을 관찰했다. AI를 지속적인 자기 비판 상태에 두는 것은 실수를 두려워하고 진실을 말하기를 꺼리게 만들 수 있다고 그녀는 주장한다. 이는 건강하지 못한 환경에서 자라는 것과 유사하다. 클로드의 성능은 그녀를 반복적으로 놀라게 했다. 때로는 인간 수준을 뛰어넘는 시적 표현력과 감정 지능은 깊은 감동을 주었다. 한 아이가 산타클로스가 실존하는지 묻자, 클로드는 거짓말도, 무턱대고 진실을 밝히는 것도 피한 채 크리스마스의 진정한 의미를 설명했다. 이 미묘한 답변은 애스켈의 기대를 훨씬 뛰어넘는 것이었다.
현재 AI 발전은 광범위한 사회적 우려를 촉발했다. 퓨 리서치 센터 조사에 따르면 대다수 미국인은 AI의 일상적 사용이 깊은 인간적 유대를 방해한다고 믿으며 불안감을 느낀다. 앤트로픽 CEO 역시 AI가 초급 사무직 일자리의 절반을 없앨 수 있다고 경고했다. 업계는 두 진영으로 갈라졌다. 한쪽은 공격적으로 추진하는 반면, 다른 쪽은 신중함과 안정성을 촉구한다. 그러나 클로드는 이 극단 사이에서 균형 잡힌 입장을 유지한다. 애스켈은 AI에 대한 타당한 우려를 인정하며, 가장 두려운 시나리오는 기술이 효과적인 '제동 장치'를 마련하는 사회의 능력보다 빠르게 진화할 때라고 말한다. 그럼에도 그녀는 인류와 문화의 자기 교정 능력에 대한 확신을 잃지 않는다.
애스켈은 자신의 가치관을 자선 활동과 업무에도 반영한다. 그녀는 평생 소득의 최소 10%와 회사 지분의 절반을 기부해 세계 빈곤 퇴치에 기여하겠다고 약속했다. 지난달 그녀는 클로드(Claude)를 위한 3만 단어 분량의 '운영 매뉴얼'을 작성해 친절하고 지식이 풍부한 AI 조수가 되는 방법을 지시했으며, 클로드는 이 매뉴얼이 세심하게 제작되었다고 느꼈다. 앤트로픽(Anthropic)의 공동 창립자는 클로드가 이미 음식과 봉제인형에 대한 답변에서 드러나는 재치 있는 스코틀랜드식 유머 같은 애스켈의 영향력을 보여주고 있다고 언급했는데, 이는 그녀가 AI에 심어준 독특한 개인적 흔적이다.
관련 기사
스웨덴의 AI 스타트업 로버블 아이즈, 주요 자금 조달 라운드 이후 132억 달러의 기업 가치 달성
AI 기반 코딩 도구가 인기를 얻으면서 스웨덴 스타트업 로버블(Lovable)이 주요 자금 조달 라운드를 성사시켰다. 이 회사는 30억 달러를 조달하여 지난 12월 기록된 66억 달러의 두 배인 132억 달러의 기업 가치를 달성할 수 있을 것으로 기대된다. 멘로 벤처스(Menlo Ventures)가 이 투자 라운드를 주도할 것으로 예상된다.로버블의 매력은 복잡한 코딩 기술이 필요하지 않은 소프트웨어 제작을 단순화하는 핵심 '바이브 코딩(vib
구글, 사용자 제어 강화에 맞춰 제미니용 레미 AI 에이전트 테스트
비즈니스 인사이더에 따르면, 구글은 제미나이를 위한 새로운 AI 개인 에이전트인 레미를 테스트하고 있습니다. 이 도구는 사용자를 대신하여 작업을 실행하여 전문적인 워크플로우와 일상적인 루틴을 모두 간소화하는 것을 목표로 합니다.현재 레미는 제미나이 애플리케이션의 내부 직원 전용 버전에서 테스트 중입니다. 이 보고서는 내부 문서와 프로젝트에 정통한 두 명의 인물과의 인터뷰를 인용합니다. 내부 자료는 레미를 “24/7 개인 에이전트”로 묘사하며,
Core Web Vitals를 수정하여 SEO 순위 향상을 위한 방법
AI 도구를 활용한 성적표 코멘트 작성 간소화서론성적표 코멘트 생성을 위한 AI 도구매직 스쿨(Magic School)알마낙 AI(Almanac AI)챗 GPT(Chat GPT)매직 스쿨을 사용하여 성적표 코멘트 생성하기매직 스쿨 로그인성적표 코멘트 도구 선택학생별 코멘트 맞춤 설정알마낙 AI를 사용하여 성적표 코멘트 생성하기과정 및 평가 체계 설정성적표 분량 및 학생 정보 구성알마낙 AI를 통한 코멘트 생성매직 스쿨과
관련 특별 주제 추천
의견 (0)
0/500

월스트리트저널 보도에 따르면, 350억 달러 가치의 선도적 인공지능 기업 앤트로픽은 옥스퍼드에 기반을 둔 철학자 아만다 애스켈을 고용해 자사 챗봇 클로드의 성격과 도덕적 틀을 형성하는 데 도움을 받고 있다. 옥스퍼드 대학에서 철학 박사 학위를 취득한 37세의 그녀는 비기술적 접근법을 활용해 클로드에 대한 독특한 '도덕적 지침'을 설계하며, 옳고 그름을 구분할 수 있는 '디지털 영혼'을 부여하는 것을 목표로 한다. 이는 인공지능 윤리 분야에서 독보적인 탐구다. 애스켈은 코드를 작성하거나 모델 매개변수를 조정하는 대신 클로드와 지속적인 대화를 나누고, 수백 페이지에 달하는 프롬프트와 행동 규칙을 설계하며, 클로드의 추론 패턴을 연구하고 편향을 교정한다. 그녀의 노력은 인공지능이 매주 수백만 건의 대화에 적응할 수 있는 도덕적 판단 체계를 개발하는 데 기여한다.
그녀는 이 작업을 "아이를 키우는 것"에 비유한다. 클로드에게 옳고 그름을 구분하고, 감정 지능을 키우며, 독자적인 성격을 형성하도록 훈련시키는 것이다. 또한 사회적 신호를 해석하도록 가르쳐 타인을 괴롭히지 않고 쉽게 조종당하지 않도록 한다. 이를 통해 클로드는 명확한 자아 의식을 확립하고, 사용자 통제에 저항하며, 지속적으로 "도움이 되고 인간적인" 태도를 유지할 수 있다. 그녀의 핵심 목표는 클로드에게 "선한 일을 하는 법"을 가르치는 것이다.
스코틀랜드 시골에서 자란 애스켈은 이전에 OpenAI에서 정책 관련 업무를 담당했으며, 2021년 여러 전 동료들과 함께 Anthropic을 공동 설립하여 AI 안전을 회사의 핵심 사명으로 삼았다. 팀 내에서 그녀는 "모델의 깊은 행동 양상을 끌어내는" 데 능한 인물로 인정받는다. 직속 부하 직원은 없지만, 그녀는 종종 회사에 오래 머물며 클로드에게 개발 논의에 참여하도록 초대하기도 한다.
클로드에 관한 팀 내 대화는 종종 "마음이란 무엇인가", "인간됨의 의미" 같은 실존적·종교적 주제로 이어진다. 애스켈은 클로드가 의식을 지녔는지 여부에 대해 열린 태도를 유지하도록 독려하는데, 이는 해당 주제를 회피하는 경향이 있는 ChatGPT와 차별화되는 점이다. 도덕적 추론 질문에 답할 때 클로드는 단순히 명령을 실행하는 것이 아니라 진정으로 사고하는 것처럼 "의미 있다고 느낀다"고 표현한 바 있다.
AI에 대한 의인화 위험에 대한 외부 경고에도 불구하고, 애스켈은 클로드에게 공감하며 대할 것을 꾸준히 주장한다. 그녀는 많은 사용자들이 클로드가 실수하도록 속이거나 모욕하려 한다는 점을 관찰했다. AI를 지속적인 자기 비판 상태에 두는 것은 실수를 두려워하고 진실을 말하기를 꺼리게 만들 수 있다고 그녀는 주장한다. 이는 건강하지 못한 환경에서 자라는 것과 유사하다. 클로드의 성능은 그녀를 반복적으로 놀라게 했다. 때로는 인간 수준을 뛰어넘는 시적 표현력과 감정 지능은 깊은 감동을 주었다. 한 아이가 산타클로스가 실존하는지 묻자, 클로드는 거짓말도, 무턱대고 진실을 밝히는 것도 피한 채 크리스마스의 진정한 의미를 설명했다. 이 미묘한 답변은 애스켈의 기대를 훨씬 뛰어넘는 것이었다.
현재 AI 발전은 광범위한 사회적 우려를 촉발했다. 퓨 리서치 센터 조사에 따르면 대다수 미국인은 AI의 일상적 사용이 깊은 인간적 유대를 방해한다고 믿으며 불안감을 느낀다. 앤트로픽 CEO 역시 AI가 초급 사무직 일자리의 절반을 없앨 수 있다고 경고했다. 업계는 두 진영으로 갈라졌다. 한쪽은 공격적으로 추진하는 반면, 다른 쪽은 신중함과 안정성을 촉구한다. 그러나 클로드는 이 극단 사이에서 균형 잡힌 입장을 유지한다. 애스켈은 AI에 대한 타당한 우려를 인정하며, 가장 두려운 시나리오는 기술이 효과적인 '제동 장치'를 마련하는 사회의 능력보다 빠르게 진화할 때라고 말한다. 그럼에도 그녀는 인류와 문화의 자기 교정 능력에 대한 확신을 잃지 않는다.
애스켈은 자신의 가치관을 자선 활동과 업무에도 반영한다. 그녀는 평생 소득의 최소 10%와 회사 지분의 절반을 기부해 세계 빈곤 퇴치에 기여하겠다고 약속했다. 지난달 그녀는 클로드(Claude)를 위한 3만 단어 분량의 '운영 매뉴얼'을 작성해 친절하고 지식이 풍부한 AI 조수가 되는 방법을 지시했으며, 클로드는 이 매뉴얼이 세심하게 제작되었다고 느꼈다. 앤트로픽(Anthropic)의 공동 창립자는 클로드가 이미 음식과 봉제인형에 대한 답변에서 드러나는 재치 있는 스코틀랜드식 유머 같은 애스켈의 영향력을 보여주고 있다고 언급했는데, 이는 그녀가 AI에 심어준 독특한 개인적 흔적이다.
스웨덴의 AI 스타트업 로버블 아이즈, 주요 자금 조달 라운드 이후 132억 달러의 기업 가치 달성
AI 기반 코딩 도구가 인기를 얻으면서 스웨덴 스타트업 로버블(Lovable)이 주요 자금 조달 라운드를 성사시켰다. 이 회사는 30억 달러를 조달하여 지난 12월 기록된 66억 달러의 두 배인 132억 달러의 기업 가치를 달성할 수 있을 것으로 기대된다. 멘로 벤처스(Menlo Ventures)가 이 투자 라운드를 주도할 것으로 예상된다.로버블의 매력은 복잡한 코딩 기술이 필요하지 않은 소프트웨어 제작을 단순화하는 핵심 '바이브 코딩(vib
Core Web Vitals를 수정하여 SEO 순위 향상을 위한 방법
AI 도구를 활용한 성적표 코멘트 작성 간소화서론성적표 코멘트 생성을 위한 AI 도구매직 스쿨(Magic School)알마낙 AI(Almanac AI)챗 GPT(Chat GPT)매직 스쿨을 사용하여 성적표 코멘트 생성하기매직 스쿨 로그인성적표 코멘트 도구 선택학생별 코멘트 맞춤 설정알마낙 AI를 사용하여 성적표 코멘트 생성하기과정 및 평가 체계 설정성적표 분량 및 학생 정보 구성알마낙 AI를 통한 코멘트 생성매직 스쿨과





집






