본문으로 건너뛰기
기술 소식을 빠르게 전달드립니다
HYUKHO

AI

AI가 컴퓨터를 직접 조작하는 시대, 어디까지 맡길 수 있을까요?

AI 컴퓨터 사용은 AI가 화면을 읽고 행동을 선택하면 연결된 소프트웨어가 클릭과 입력을 실행하는 방식입니다. 작동 순서부터 위임 범위, 사람의 확인 절차, 도입 전 점검 항목까지 살펴봅니다.

· · 3 · AI

AI 컴퓨터 사용은 AI가 화면 이미지에서 버튼과 입력란을 파악해 다음 행동을 고르고, 연결된 소프트웨어가 클릭과 입력을 실행하는 방식입니다. 물리적으로 마우스를 움직일 필요는 없어요. 모델이 선택한 위치를 도구가 클릭하고 지정한 글자를 입력합니다. Google 공식 문서에서 이 구조를 설명합니다.

조작 범위는 제공된 환경과 권한에 따라 달라집니다. 별도 가상 환경에서 브라우저를 쓰는 경우도 있으므로, 내 컴퓨터 전체에 접근한다고 이해해서는 안 됩니다.

AI 컴퓨터 사용은 어떤 순서로 진행되나요?

“세 행사 페이지에서 날짜와 참가비를 찾아 표로 정리해 주세요”라고 요청했다고 가정해 보겠습니다. 작동 원리를 설명하기 위한 가상 사례이며, 특정 제품의 실제 성공 사례는 아닙니다.

  1. 화면 확인: 첫 행사 페이지를 열고 날짜와 참가비가 표시된 영역을 살펴봅니다.
  2. 행동 선택: 정보가 보이지 않으면 아래로 스크롤하거나 상세 안내를 열기로 결정합니다.
  3. 도구 실행: 연결된 소프트웨어가 스크롤이나 클릭을 실행합니다.
  4. 결과 확인: 바뀐 화면에 원하는 정보가 나타났는지 확인하고 다음 행동을 고릅니다.

나머지 페이지에서도 이 과정을 반복한 뒤, 수집한 내용을 표로 옮기고 원문과 대조합니다. 화면을 다시 확인하며 다음 행동을 선택하는 방식은 Google의 실행 과정 설명에 나옵니다.

AI가 사용법 안내를 넘어 도구로 작업을 진행하지만, 요청 한마디가 정확한 완료를 보장하지는 않습니다. 참가비에 조건이 붙거나 날짜가 여러 개라면 이를 구분해야 해요. 확인하지 못한 값은 추측해서 채우지 않도록 지시하는 편이 좋습니다.

어디까지 맡기고, 언제 사람이 확인해야 할까요?

위임 범위는 단계별로 정하는 편이 실용적입니다. 결과를 쉽게 고칠 수 있는 자료 수집과 초안 작성부터 맡기고, 외부에 영향을 주는 행동에는 사람의 확인 절차를 두세요.

작업맡길 범위사람이 확인할 내용
자료 수집지정한 페이지에서 정보 추출출처, 누락, 날짜·금액 조건
표 초안 작성항목 정리와 형식 통일원문 일치 여부, 잘못 합친 항목
외부 제출입력 준비와 제출 전 검토 화면까지수신 대상, 첨부 자료, 최종 내용

접근 권한도 작업에 필요한 사이트·폴더·계정으로 제한하는 것이 좋습니다. 중요한 작업을 감독하고 실행 환경을 분리하라는 권고는 Google 공식 지침에서도 확인할 수 있습니다.

구매·전송·삭제 전에는 사람이 확인하는 절차를 마련하세요. 지시문에 적었더라도 실제로 실행을 멈추고 승인을 받는 기능이 있는지는 따로 확인해야 합니다.

완료 여부는 AI의 답변만으로 판단하지 말고 최종 화면에서 반영 상태를 확인하세요. 파일을 저장했다면 지정한 위치에서 실제 파일을 열어 내용까지 검증합니다.

실제로 맡기기 전에 무엇을 점검해야 할까요?

예상하지 못한 팝업이나 화면 배치 변화는 버튼 인식과 작업 흐름을 방해할 수 있습니다. 웹페이지의 악성 문구가 AI를 사용자 의도와 다른 행동으로 유도하는 프롬프트 인젝션 위험도 있습니다. 읽어야 할 자료를 따라야 할 명령으로 잘못 받아들이는 문제예요. Anthropic의 위험 설명에서 관련 내용을 확인할 수 있습니다.

실제 도입 전에는 짧은 작업으로 다음 항목을 점검해 보세요.

  • 지원 환경: 필요한 브라우저·데스크톱 앱을 지원하는지, 국내 이용 조건에 맞는지 확인합니다.
  • 로그인 개입: 로그인과 추가 인증에서 사람이 언제 개입해야 하는지 살펴봅니다.
  • 중단 방법: 오작동할 때 즉시 멈추고 통제권을 되찾을 수 있는지 확인합니다.
  • 한국어 정확도: 한글 입력과 날짜·금액 추출 결과를 원문과 대조합니다.
  • 시간과 비용: 실행뿐 아니라 검수, 사람의 개입, 재시도에 든 시간과 비용도 합산합니다.

여러 단계를 거치면서 지연과 비용이 늘어날 수 있다는 점은 Anthropic의 설계 설명에서도 짚습니다. 같은 작업을 직접 처리했을 때와 비교해, 요구한 정확도를 유지하면서 총시간과 비용이 줄었는지를 기준으로 위임 범위를 넓히는 것이 좋습니다.

  1. AI 에이전트가 통제를 벗어나면? 실제 사고와 안전 실험으로 본 위험
  2. AI로 쓴 블로그 글, 저작권은 누구에게 있을까요?
  3. AI도 CAPTCHA를 통과할 수 있나요? ‘100% 성공’의 조건과 최신 연구

댓글

Giscus를 연결하면 댓글이 열립니다.