구글은 기본적인 컴퓨터 작업 기능을 Gemini 3.5 Flash에 통합함으로써 멀티모달 전환의 장벽을 허물었습니다.

Google DeepMind 팀은 Gemini 3.5 Flash 모델에 원생적인 컴퓨터 사용 기능을 직접 통합하는 중대한 돌파구를 발표했습니다. 이제 개발자들은 단일 모델만을 활용해 브라우저, 모바일 기기, 데스크톱에 있는 화면을 자동으로 확인하고 조작할 수 있는 AI 에이전트를 구축할 수 있습니다.
이전에는 이러한 기능이 별도의 모델로만 제공되어, 개발자들은 서로 다른 모델 간의 복잡한 전환 과정과 컨텍스트 이관 작업을 처리해야 했습니다. 하지만 원생적인 통합 덕분에 AI는 장시간에 걸친 크로스플랫폼 작업을 수행할 때 더 이상 정보를 수동으로 전달할 필요가 없어져 개발 과정이 훨씬 간소화되었습니다.
컨텍스트 손실 제거로 에이전트의 신뢰성 향상
Google 팀은 AI 에이전트의 핵심 병목 현상이 개별 도구의 한계가 아니라, 여러 도구 간 전환 시 발생하는 컨텍스트 정보의 손실에 있다고 보고 있습니다. 검색, 지도, 컴퓨터 작업을 단일 모델 아키텍처 내에서 통합함으로써 컨텍스트가 연속적으로 유지되어, 복잡한 작업에서 발생할 수 있는 실패 가능성이 크게 줄어듭니다.
이러한 “멀티 도구 통합” 설계는 내부 연결 구조를 갖춘 단일 건물을 짓는 것과 유사하여, 별도의 건물들 간에 발생하던 길고 오류가 잦은 커뮤니케이션을 없애줍니다. 이러한 아키텍처 변화는 에이전트 기반 작업의 신뢰성과 응답 지연 시간을 상당히 개선할 잠재력을 가지고 있습니다.
다층적 보안 방어 체계로 세 가지 핵심 시나리오에 집중
이 원생적인 기능은 주로 세 가지 핵심 시나리오에 적용될 예정입니다. 바로 수시간 또는 수일 동안 지속적으로 작동해야 하는 자동화된 작업, UI 일관성을 자동으로 검증하기 위한 지속적인 소프트웨어 테스트, 그리고 여러 애플리케이션에 걸쳐 이루어지는 지식 집약적인 작업들입니다. 이러한 시나리오들은 작업 간의 컨텍스트 연속성에 크게 의존하며, 반복적이고 에너지 소모가 많은 작업을 수행하는 데 있어 인간을 효과적으로 대체할 수 있습니다.
보안 측면에서 Google은 목표 지향형 적대적 학습, 민감한 작업을 위한 기업용 보안 장치, 간접적인 프롬프트 주입 탐지 등 다층적인 방어 전략을 도입했습니다. 이러한 메커니즘들은 공개되고 통제가 되지 않는 컴퓨터 환경에서 기업 사용자들이 비교적 완전한 보안 경계를 구축하는 데 도움을 줍니다.
관련 기사
스웨덴의 AI 스타트업 로버블 아이즈, 주요 자금 조달 라운드 이후 132억 달러의 기업 가치 달성
AI 기반 코딩 도구가 인기를 얻으면서 스웨덴 스타트업 로버블(Lovable)이 주요 자금 조달 라운드를 성사시켰다. 이 회사는 30억 달러를 조달하여 지난 12월 기록된 66억 달러의 두 배인 132억 달러의 기업 가치를 달성할 수 있을 것으로 기대된다. 멘로 벤처스(Menlo Ventures)가 이 투자 라운드를 주도할 것으로 예상된다.로버블의 매력은 복잡한 코딩 기술이 필요하지 않은 소프트웨어 제작을 단순화하는 핵심 '바이브 코딩(vib
구글, 사용자 제어 강화에 맞춰 제미니용 레미 AI 에이전트 테스트
비즈니스 인사이더에 따르면, 구글은 제미나이를 위한 새로운 AI 개인 에이전트인 레미를 테스트하고 있습니다. 이 도구는 사용자를 대신하여 작업을 실행하여 전문적인 워크플로우와 일상적인 루틴을 모두 간소화하는 것을 목표로 합니다.현재 레미는 제미나이 애플리케이션의 내부 직원 전용 버전에서 테스트 중입니다. 이 보고서는 내부 문서와 프로젝트에 정통한 두 명의 인물과의 인터뷰를 인용합니다. 내부 자료는 레미를 “24/7 개인 에이전트”로 묘사하며,
Core Web Vitals를 수정하여 SEO 순위 향상을 위한 방법
AI 도구를 활용한 성적표 코멘트 작성 간소화서론성적표 코멘트 생성을 위한 AI 도구매직 스쿨(Magic School)알마낙 AI(Almanac AI)챗 GPT(Chat GPT)매직 스쿨을 사용하여 성적표 코멘트 생성하기매직 스쿨 로그인성적표 코멘트 도구 선택학생별 코멘트 맞춤 설정알마낙 AI를 사용하여 성적표 코멘트 생성하기과정 및 평가 체계 설정성적표 분량 및 학생 정보 구성알마낙 AI를 통한 코멘트 생성매직 스쿨과
관련 특별 주제 추천
의견 (0)
0/500

Google DeepMind 팀은 Gemini 3.5 Flash 모델에 원생적인 컴퓨터 사용 기능을 직접 통합하는 중대한 돌파구를 발표했습니다. 이제 개발자들은 단일 모델만을 활용해 브라우저, 모바일 기기, 데스크톱에 있는 화면을 자동으로 확인하고 조작할 수 있는 AI 에이전트를 구축할 수 있습니다.
이전에는 이러한 기능이 별도의 모델로만 제공되어, 개발자들은 서로 다른 모델 간의 복잡한 전환 과정과 컨텍스트 이관 작업을 처리해야 했습니다. 하지만 원생적인 통합 덕분에 AI는 장시간에 걸친 크로스플랫폼 작업을 수행할 때 더 이상 정보를 수동으로 전달할 필요가 없어져 개발 과정이 훨씬 간소화되었습니다.
컨텍스트 손실 제거로 에이전트의 신뢰성 향상
Google 팀은 AI 에이전트의 핵심 병목 현상이 개별 도구의 한계가 아니라, 여러 도구 간 전환 시 발생하는 컨텍스트 정보의 손실에 있다고 보고 있습니다. 검색, 지도, 컴퓨터 작업을 단일 모델 아키텍처 내에서 통합함으로써 컨텍스트가 연속적으로 유지되어, 복잡한 작업에서 발생할 수 있는 실패 가능성이 크게 줄어듭니다.
이러한 “멀티 도구 통합” 설계는 내부 연결 구조를 갖춘 단일 건물을 짓는 것과 유사하여, 별도의 건물들 간에 발생하던 길고 오류가 잦은 커뮤니케이션을 없애줍니다. 이러한 아키텍처 변화는 에이전트 기반 작업의 신뢰성과 응답 지연 시간을 상당히 개선할 잠재력을 가지고 있습니다.
다층적 보안 방어 체계로 세 가지 핵심 시나리오에 집중
이 원생적인 기능은 주로 세 가지 핵심 시나리오에 적용될 예정입니다. 바로 수시간 또는 수일 동안 지속적으로 작동해야 하는 자동화된 작업, UI 일관성을 자동으로 검증하기 위한 지속적인 소프트웨어 테스트, 그리고 여러 애플리케이션에 걸쳐 이루어지는 지식 집약적인 작업들입니다. 이러한 시나리오들은 작업 간의 컨텍스트 연속성에 크게 의존하며, 반복적이고 에너지 소모가 많은 작업을 수행하는 데 있어 인간을 효과적으로 대체할 수 있습니다.
보안 측면에서 Google은 목표 지향형 적대적 학습, 민감한 작업을 위한 기업용 보안 장치, 간접적인 프롬프트 주입 탐지 등 다층적인 방어 전략을 도입했습니다. 이러한 메커니즘들은 공개되고 통제가 되지 않는 컴퓨터 환경에서 기업 사용자들이 비교적 완전한 보안 경계를 구축하는 데 도움을 줍니다.
스웨덴의 AI 스타트업 로버블 아이즈, 주요 자금 조달 라운드 이후 132억 달러의 기업 가치 달성
AI 기반 코딩 도구가 인기를 얻으면서 스웨덴 스타트업 로버블(Lovable)이 주요 자금 조달 라운드를 성사시켰다. 이 회사는 30억 달러를 조달하여 지난 12월 기록된 66억 달러의 두 배인 132억 달러의 기업 가치를 달성할 수 있을 것으로 기대된다. 멘로 벤처스(Menlo Ventures)가 이 투자 라운드를 주도할 것으로 예상된다.로버블의 매력은 복잡한 코딩 기술이 필요하지 않은 소프트웨어 제작을 단순화하는 핵심 '바이브 코딩(vib
Core Web Vitals를 수정하여 SEO 순위 향상을 위한 방법
AI 도구를 활용한 성적표 코멘트 작성 간소화서론성적표 코멘트 생성을 위한 AI 도구매직 스쿨(Magic School)알마낙 AI(Almanac AI)챗 GPT(Chat GPT)매직 스쿨을 사용하여 성적표 코멘트 생성하기매직 스쿨 로그인성적표 코멘트 도구 선택학생별 코멘트 맞춤 설정알마낙 AI를 사용하여 성적표 코멘트 생성하기과정 및 평가 체계 설정성적표 분량 및 학생 정보 구성알마낙 AI를 통한 코멘트 생성매직 스쿨과





집






