인사이트

클로드식 컴퓨터 조작의 승부처는 학습 데이터다

인공지능신문 ·

사진:본지, 배경:앤트로픽 클로드 3.5 소넷 이미지

✦ AI 요약

멀티모달 데이터와 에이전틱 궤적으로 배우는 AI의 컴퓨터 사용법

인공지능신문에 따르면 2026년 3월 24일 등록된 미국 특허 제12585862호는 클로드의 'Computer Use'와 맞닿은 방식으로, AI가 사람처럼 컴퓨터를 다루려면 무엇을 학습해야 하는지를 보여준다. 기사는 이 특허가 텍스트만이 아니라 화면 이미지와 소프트웨어 사용 장면, 실제 작업 과정 같은 데이터를 함께 묶어 AI 에이전트를 훈련하는 구상을 담았다고 짚는다. 핵심은 최종 결과만이 아니라 화면 상태와 그때그때의 클릭, 입력, 스크롤 같은 행동을 연결해 다음 조작을 배우게 하는 데 있다. 이렇게 쌓인 경험은 AI가 화면을 다시 해석하고 계획을 고치며 작업을 이어가는 반복 구조의 바탕이 된다고 설명한다. 기사에서는 이 접근이 고정된 규칙에 의존하던 자동화와 달리, 예상 밖 화면 변화에도 대응하는 방향이라는 점에 주목한다. 다만 특허 문헌의 내용이 현재 제품에 그대로 구현됐다고 단정할 수는 없으며, 기술적으로는 '답하는 AI'에서 '행동하는 AI'로 넘어가는 흐름을 읽을 수 있다고 풀이한다.

관점

이 사안의 의미는 모델 성능 경쟁의 초점이 점점 학습 데이터와 실제 작업 경험의 축적으로 옮겨가고 있다는 데 있다. 화면을 이해하고 다음 행동을 고르는 능력이 중요해질수록, 누가 더 많은 업무 맥락과 시행착오를 체계적으로 쌓았는지가 경쟁력을 가를 가능성이 크다. 결국 생성형 AI는 설명을 잘하는 도구를 넘어 여러 프로그램 사이를 오가며 일을 처리하는 체계로 확장될 수 있고, 그 변화의 문턱이 어디에 있는지 이번 분석이 보여준다.

이 관점은 비즈크러시가 작성한 자체 의견이며, 인공지능신문의 보도 내용과 무관합니다.

이 기사는 자동생성 알고리즘의 도움을 받아 작성되었습니다.


출처 인공지능신문

원문 확인

이 기사는 인공지능신문 원문을 바탕으로 비즈크러시가 요약 정리했습니다. 정확한 인용과 세부 내용은 원문을 확인해 주세요.