让 AI Agent 替你做 iOS、Android 自动化测试,能平替 Appium?

发布时间:2026/7/22 15:24:08
让 AI Agent 替你做 iOS、Android 自动化测试,能平替 Appium? 它叫 agent-deviceCallstack 出品MIT 开源JPMorgan Chase、Expensify、Shopify 的团队都在用。一句话介绍它是一款开源给 AI Agent 用的设备自动化 CLIiOS、Android、TV、桌面全覆盖目前在Github上该项目star数接近4k。安装方式Node.js 版本需大于22.12npm install -g agent-devicelatestagent-device doctoragent-device --versionagent-device help workflow注意——它不是另一个 Appium。Appium 的逻辑你写脚本一步步告诉它怎么点、怎么填。agent-device 的逻辑完全不同你把它交给 AI AgentCodex、Claude CodeAgent 自己看屏幕、找按钮、做操作。agent-device 只干一件事——当 Agent 的眼睛和手。为什么我觉得它可能改变格局先说我的判断不是技术比 Appium 更强是思路根本不一样。Appium 时代测试的核心能力是写脚本——你得会 XPath、懂定位策略、处理等待逻辑。agent-device 时代测试的核心能力变成描述意图——你说验证登录功能正常Agent 自己看屏幕、找元素、点按钮、判断结果。这不是优化是范式转移。就像从手写汇编到用高级语言——不是汇编不好是抽象层变了。三个我觉得很聪明的设计第一语义化引用。agent-device 截取屏幕快照后给每个可交互元素分配一个引用——e1、e2、e3。Agent 不需要写 XPath只需要说点击 e3。agent-device snapshot -ie1 [heading] “Settings”e2 [button] “Sign In”e3 [text-field] “Email”agent-device fill e3 “testexample.com”XPath 会因为 UI 改版而失效。但基于无障碍树的引用稳定性高一个量级。第二证据收集不只是截图。日志、网络流量、性能采样、崩溃上下文、React 渲染 profile——全自动收集。这意味着 Agent 不只是操作完了还能自证清白。出了 bug 要复盘证据链一条不少。第三探索变回放。Agent 探索完一遍操作流程自动录制成 .ad 脚本之后 CI 反复跑。探索时靠 AI回归时靠脚本——两个阶段各取所长。但别急着吹它也有短板第一需要 AI Agent 驱动。你得有 Codex 或 Claude Code。没有 Agent它就是一个 CLI价值砍半。第二吃 App 的无障碍标签。它依赖 accessibility tree。如果 App 没做无障碍适配元素全标buttonAgent 也抓瞎。第三生态还处在早期。虽然已经有大厂在用但文档、教程、社区最佳实践还在积累。碰到坑你得自己趟。我的判断它不会立刻替代 Appium——但代表了 Appium 之后的方向。Appium 解决的问题是怎么让机器按步骤操作手机。agent-device 解决的问题是怎么让 AI 像人一样看屏幕、理解界面、自主操作。这两件事根本不在一个层面上。未来两三年移动端测试的核心能力会从写自动化脚本转向编排 AI Agent 做验证。agent-device 不是终局但它可能是推倒多米诺骨牌的那只手。如果你在做移动端测试建议现在就去 GitHub 看看跑一遍 Demo。别等到所有人都在用的时候你才反应过来。