可搭载 AI 模型的安卓自动化工具

可搭载 AI 模型的安卓自动化工具

无需编程,拖拽节点即可创建安卓自动化流程。流程可以搭载视觉识别、OCR、LLM 等 AI 模型,也可使用 AI Planner 或 MCP 快速完成配置。

无需编程拖拽连接节点可搭载 AI 模型AI Planner 与 MCP可复用 Flow Profile

工作流程

清晰易懂的安卓自动化场景

匹配图片,自动点击

在屏幕中找到指定按钮、图标或图片,匹配成功后自动点击。即使目标位置改变,也能继续按匹配结果执行。

识别并分析屏幕文字

读取页面提示、订单状态、表单内容或搜索结果,再根据文字内容进行判断、分类,或继续执行下一步。

重复执行固定动作

把打开应用、点击、输入、滑动和等待等固定步骤连接成流程,保存后即可按照需要重复运行。

安卓 App 自动化测试

自动执行页面操作并检查按钮、文字和结果是否正确,保留截图与运行记录,帮助开发和测试人员完成 UI 自动化测试与回归测试。

自动化方式对比

它和常见安卓自动化方式有什么不同

比较项目莱彩 Flow一次性 AI Agent录制宏或固定脚本通用 RPA 或测试框架
创建方式拖拽并连接节点;也可用 AI Planner 或 MCP 协助配置流程。用自然语言描述临时任务,让 Agent 尝试完成。录制操作步骤,或编写固定脚本。配置并维护较完整的自动化工程。
AI 能力可按需搭载视觉识别、OCR、LLM 等 AI 模型。由 Agent 在执行任务时临时判断。通常按照预设动作和条件执行。取决于框架能力和自行集成。
复用与调整保存为可复用的 Profile;节点、参数、输入和输出都可调整。通常用于一次性尝试。页面或坐标变化后,可能需要重新录制或修改脚本。可以复用,但通常需要更多工程配置与维护。
适合场景无需编程、需要稳定复用的安卓自动化流程。临时探索或单次操作。步骤固定、变化较少的简单重复操作。由开发者主导的自动化或测试项目。

常见问题

莱彩 Flow 常见问题

莱彩 Flow 是什么?

莱彩 Flow 是可搭载 AI 模型的安卓自动化工具。无需编程,拖拽并连接节点即可创建自动化流程;流程可以搭载视觉识别、OCR、LLM 等 AI 模型,也可以通过 AI Planner 或 MCP 快速完成配置。

可以独立在安卓手机上运行,不连接电脑吗?

莱彩 Flow 需要连接电脑,由电脑读取投屏画面、执行图片分析和 Flow 逻辑,再把操作发送到安卓手机。如果希望脱离电脑独立运行,可以使用莱彩 Flow Inside:把兼容的同一个 Flow Profile 部署到莱彩安卓 Agent 后,识别、判断和操作都由安卓手机本地完成,无需 USB 线,也无需通过 Wi-Fi 连着电脑。

查看莱彩 Flow Inside 使用教程

莱彩 Flow 支持 YOLO 或目标检测吗?

支持。vision.detect 可以使用本地 YOLO/ONNX 目标检测模型,按模型和类别输出目标框、中心点、置信度和检测列表,后续点击节点可以直接使用这些坐标。

莱彩 Flow 支持 LLM 文本和图片分析吗?

支持。llm.textAnalyze 可分析 OCR、API、文件或其他节点输出的文本;llm.imageAnalyze 可分析截图或图片 artifact,并要求模型返回稳定的结构化 JSON 字段,供后续分支和数据节点使用。

可以识别屏幕上的文字、按钮或图片吗?

可以。Flow 支持 vision.ocr 读取指定区域文字,vision.match 做模板图像匹配,ui.find 从 Android UIAutomator 层级里查找控件,也可以用 vision.capture 截图给 LLM 或后续节点分析。

Flow 能执行哪些手机操作?

Flow 可以点击、滑动、长按、拖拽、输入文本、发送按键、设置或读取剪贴板、打开或强停 App、返回主页或上一级,并用等待、分支、重复、遍历数组和子 Flow 组织复杂流程。

Flow 可以发音或播放语音提醒吗?

可以,但 audio.speak 是让桌面端莱彩电脑通过本机 text-to-speech 发音,用于播报 OCR、API、存储或 Flow 输入结果;它不是 Android 手机端 TTS,也不会替代手机上的音频播放。

可以接 HTTP、ADB、AutoJS 或宏吗?

可以。Flow 支持 http.request 调用外部 API,adb.shell 执行 Android shell 子命令,autojs.run 调用已有 AutoJS 脚本,macro.play 运行已有宏,也支持本地文件、模板图片和存储数据节点。