先分清两类东西
搜「AI 操作手机」时,结果里经常混着两类方案:
- 开源 Agent 框架:Open-AutoGLM、DroidRun、Mobile-Agent 等。偏研究与二次开发,要自己搭 Python / 模型 / 设备环境。
- 可直接用的工作站:以 iDeviceFarm 为代表。装在自己电脑上,对接真机,面向运营、工作室和少写代码的团队。
两者都能「让模型看屏幕再点」,但交付形态差很多。选错类型,会浪费大量时间在环境上,而不是业务上。
一张表看懂四家
| 维度 | Open-AutoGLM | DroidRun | Mobile-Agent | iDeviceFarm |
|---|---|---|---|---|
| 上手门槛 | 高:环境、模型、兼容 | 高:框架与设备链路 | 高:Agent 流水线自建 | 低:下载器安装即可 |
| 是否写代码 | 通常需要 | 通常需要 | 通常需要 | 业务侧可不写;MCP / 对话即可 |
| 运行方式 | 开源仓库 + 自建运行时 | 开源框架 + 自建 | 开源框架 + 自建 | 本地 Windows 工作站 |
| 平台重心 | 多偏安卓实验 | 多偏安卓 | 多偏安卓研究 | 安卓 / iOS / 鸿蒙 |
| 多机与业务 | 要自己扩 | 要自己扩 | 要自己扩 | 多机管理、短视频等工作流 |
| AI 助手对接 | 自接模型 API | 自接 | 自接 | 内置 MCP,可接 Claude / WorkBuddy 等 |
| 数据与部署 | 自建链路 | 自建链路 | 自建链路 | 数据留本地,不用服务器 |
| 适合谁 | 研究、二次开发 | 开发者折腾真机 Agent | 算法 / Agent 研究 | 业务团队、工作室、要先跑通 |
表内「开源三家」能力边界会随社区版本变化;上表描述的是典型用法与交付形态,不是否定开源本身。
开源三家各自是什么
Open-AutoGLM(常被叫 AutoGLM)
思路接近「截图 / 界面理解 → 大模型决策 → 点击执行」。对想复现论文、改 Agent 策略的开发者友好;对只想批量发视频、管多台手机的运营同学,环境成本往往偏高。
深挖见:AutoGLM 和 iDeviceFarm 有什么区别。
DroidRun
同样走「模型驱动真机操作」路线,社区里多用于安卓侧实验与自动化探索。强项是灵活;弱项是工程化(多机、账号隔离、业务工作流)要自己补齐。
深挖见:DroidRun 和 iDeviceFarm 对比。
Mobile-Agent
名字就说明定位:手机端 Agent 框架。适合研究感知—规划—执行闭环;落地成「工作室每天稳定跑」的流水线,仍要大量工程工作。
深挖见:Mobile-Agent 和 iDeviceFarm。
iDeviceFarm 站在哪一侧
iDeviceFarm 不替代你做算法论文,而是把「装好、接手机、对话派活、工作流、MCP」收成可运行产品:
- 完全免费,装在自己电脑;
- 安卓 / iOS / 鸿蒙真机接入;
- 自然语言与工作流;也可 MCP 对接 AI 助手;
- 名单与任务记录留本地。
安装见 下载安装教程。
怎么选(一句话)
- 要改 Agent、跑实验、写代码很开心 → 开源框架(AutoGLM / DroidRun / Mobile-Agent)。
- 要业务结果、多台手机、少搭环境 → 先试 iDeviceFarm。
- 还在看豆包硬件要不要买 → 可先读 豆包手机助手免费替代盘点,再回到这篇定开源还是工作站。
先定「研究」还是「干活」,比纠结参数更重要。