
Callstack의 공식 GitHub 릴리스에 따르면 오픈소스 앱 자동화 CLI ‘agent-device’ 0.20 계열이 공개됐다. 이 도구는 AI 코딩 에이전트가 실행 중인 애플리케이션을 직접 살펴보고 조작한 뒤 결과를 검증하도록 설계됐다.
agent-device는 iOS와 Android를 비롯해 tvOS, Android TV, macOS, Linux, 웹 환경을 지원한다. 에이전트는 접근성 트리 기반 스냅샷에서 화면 요소를 찾고, 탭·입력·스크롤 같은 동작을 실행하며, 화면 캡처와 로그를 검토해 다음 행동을 결정할 수 있다. 테스트 절차를 미리 고정하는 기존 자동화 도구와 달리 에이전트가 현재 화면 상태를 읽고 명령을 선택하는 방식에 초점을 맞췄다.
0.20 릴리스의 핵심은 반복 가능한 작업 흐름이다. 탐색 과정에서 실행한 단계를 `.ad` 스크립트로 저장하고 이후 같은 흐름을 재생할 수 있다. 앱 화면이 바뀌어 재생이 어긋나면 현재 화면 정보와 선택자 후보, 다시 시작할 지점을 제공해 에이전트가 작업 흐름을 고치고 이어가도록 했다.
Maestro 워크플로 호환 범위도 넓어졌다. 환경 변수 보간, 조건부 실행, 반복과 재시도, 일부 화면 표시 조건과 스크롤 동작을 자체 인터프리터에서 처리한다. 지원하지 않는 구문은 명시적으로 실패하도록 해 일부 단계만 실행된 결과가 성공으로 오인되는 상황을 줄였다.
최신 0.20.2는 세션 정리와 오류 진단을 보강했다. 스크립트 저장이 실패한 뒤에도 기기 점유 상태가 남지 않도록 처리했고, Maestro 실행 실패 시 대상과 경로를 더 분명히 표시한다. 민감한 입력값은 진단 정보에서 가리며, 잘못된 추가 인수를 조용히 무시하지 않고 오류로 반환한다. 외부 통합을 위한 Limrun 런타임과 Node.js SDK 예제도 공개했다.
공식 문서 기준 설치에는 Node.js 22.12 이상이 필요하며, 웹 자동화 기능은 Node.js 24 이상을 요구한다. iOS는 XCTest, Android는 ADB 계열 인터페이스를 사용하고, 실행 결과는 스크린샷·영상·로그·추적 자료로 남길 수 있다. 패키지는 MIT 라이선스로 배포된다.
이번 릴리스는 AI 코딩 도구의 역할이 코드 작성에서 실행 결과 검증으로 확장되는 흐름을 보여준다. 특히 모바일 앱은 시뮬레이터와 기기 상태, 접근성 정보, 네이티브 자동화 계층이 얽혀 있어 에이전트가 실제 화면을 확인할 수단이 중요하다. 다만 지원 범위와 동작은 플랫폼별로 다르므로 도입 전 공식 문서와 설치된 CLI 도움말을 확인해야 한다.
출처: Callstack agent-device 공식 GitHub 저장소 https://github.com/callstack/agent-device
출처: agent-device v0.20.0 공식 릴리스 https://github.com/callstack/agent-device/releases/tag/v0.20.0
출처: agent-device v0.20.2 공식 릴리스 https://github.com/callstack/agent-device/releases/tag/v0.20.2









