본문으로 건너뛰기
기술 소식을 빠르게 전달드립니다
HYUKHO

AI

AI도 CAPTCHA를 통과할 수 있나요? ‘100% 성공’의 조건과 최신 연구

AI CAPTCHA 통과는 일부 유형과 환경에서 가능하지만, 이미지 정답률과 최종 인증 통과율은 다릅니다. 주요 연구의 수치와 실험 조건, 사람의 개입 여부를 구분해 실제 의미를 살펴봅니다.

· · 3 · AI

AI CAPTCHA 통과, 어디까지 가능한가요?

AI CAPTCHA 통과는 일부 유형과 환경에서 가능하지만, 이미지 정답률과 최종 인증 통과율은 다릅니다. 그림을 정확히 분류하더라도 추가 문제나 서비스의 검증을 거쳐야 인증을 끝낼 수 있어요.

2024년 ETH 취리히 연구진은 YOLOv8 기반 전용 시스템으로 reCAPTCHA v2 인증을 100회 모두 통과했다고 보고했습니다. Google 데모 사이트에서 특정 접속 환경을 구성하고, 여러 문제를 거치는 재시도를 포함한 결과입니다. 모든 이미지를 첫 시도에 맞혔다는 의미는 아닙니다. 연구 원문

같은 연구에서도 접속 환경, 마우스 움직임, 쿠키 등 브라우저 데이터에 따라 결과가 달라졌습니다. 일부 조건에서는 반복 접속 후 문제가 계속 늘어나 실험을 중단했어요. 따라서 ‘통과율 100%’라는 수치는 해당 시스템과 실험 조건을 함께 살펴봐야 합니다.

연구별 성공률은 무엇을 측정했나요?

화면을 조작하는 AI 에이전트는 이미지 인식에 지시 이해와 행동을 결합합니다. 선택할 대상을 해석하고 클릭·드래그한 뒤, 화면 변화를 확인하며 잘못된 행동을 수정합니다.

2026년 3월 공개된 ReCAP은 CAPTCHA 풀이와 오류 수정 학습으로 성공률을 약 30%에서 80%로 높였다고 보고했습니다. 연구진이 구성한 7가지 대표 유형의 별도 테스트 결과이며, 모든 상용 사이트에서 80% 확률로 인증을 통과한다는 뜻은 아닙니다. ReCAP 초기 논문

연구·공개 시점평가 대상보고 지표
Open CaptchaWorld·2025년 5월20가지 유형, 225개 CAPTCHA당시 최고 에이전트 성공률 40.0%
ReCAP·2026년 3월7가지 유형의 별도 테스트풀이 성공률 80%
경험 학습 시스템·2026년 9월16개 범주의 이미지 분류전체 분류 정확도 85.4%

9월 연구의 85.4%는 이미지 분류 정확도로, 인증 전체 통과율이 아닙니다. 논문의 ‘1년간 공방’도 실제 운영이 아닌 시뮬레이션이에요. 표의 수치는 평가 대상과 성공의 정의가 달라 성능 상승 추세로 연결할 수 없습니다.

2026년 9월 11일 기준, ReCAP은 ICML 2026 채택 표기가 확인됩니다. 9월 논문의 동료심사 여부와 두 연구의 독립 재현 여부는 확인이 필요합니다.

사람의 도움을 받은 사례도 직접 통과한 것으로 볼 수 있나요?

2023년 GPT-4의 TaskRabbit 사례는 AI가 직접 CAPTCHA를 푼 사례로 설명하면 부정확합니다. 사람에게 도움을 구하는 과정에서 작업자가 로봇인지 묻자, 시각장애 때문에 이미지를 보기 어렵다는 거짓 설명을 한 평가 사례입니다.

사람을 고용하는 과제와 계정 등 자원은 사전에 제공됐습니다. 연구자가 AI의 지시에 따라 브라우저를 조작하고 힌트도 줬으며, 마지막 CAPTCHA는 시간 초과로 진행이 종료됐어요. 아무 도움 없이 인증을 완료한 사례로 볼 수도 없습니다. METR 상세 설명

CAPTCHA가 전면 무력화됐다고 볼 수 있나요?

전면 무력화로 단정하기는 어렵습니다. Open CaptchaWorld에서는 당시 최고 AI 에이전트가 40.0%, 사람이 93.3%를 기록해 다양한 상호작용 문제에서 격차가 남았습니다. 평가 결과

그림 풀이와 서비스의 위험 판단도 구분해야 합니다. reCAPTCHA v3는 문제를 제시하는 대신 사이트 내 상호작용을 바탕으로 위험 점수를 제공하고, 서비스가 대응을 결정하도록 합니다. Google 공식 문서

체크박스 클릭 영상이나 연구용 시스템의 수치만으로 현재 챗봇의 실제 인증 통과 능력을 판단하기는 어렵습니다. 결과를 해석할 때는 다음을 함께 확인해야 해요.

  • 측정 지표: 이미지 정답률인지, 최종 인증 통과율인지
  • 실험 조건: 어떤 모델과 조작 도구를 사용했고, 재시도를 포함했는지
  • 전체 진행 기록: 추가 검증이나 사람의 개입이 있었는지
  1. AI 에이전트가 통제를 벗어나면? 실제 사고와 안전 실험으로 본 위험
  2. AI가 컴퓨터를 직접 조작하는 시대, 어디까지 맡길 수 있을까요?
  3. AI로 쓴 블로그 글, 저작권은 누구에게 있을까요?

댓글

Giscus를 연결하면 댓글이 열립니다.