Ui.Vision V10 的 AI 宏助手如何工作?

Ui.Vision V10 的 AI 宏助手让你用自然语言描述要自动化的任务,助手会检查当前页面、生成可复用的宏、运行它,并在失败时协助修复。生成的宏可以保留下来继续编辑和重复运行。根据网站资料,Ui.Vision AI 在免费计划中即可使用,无需注册或 API 密钥。它适合想快速把重复性浏览器操作变成宏、但不熟悉 Selenium 命令或 JavaScript 的用户。

核心工作流程

AI 宏助手的工作可以拆成四步:

  1. 描述任务:用自然语言说明你想自动化什么,例如“在这个页面填写表单并提交”。
  2. 检查页面:助手会查看当前页面的结构,理解可操作的元素。
  3. 编写并运行宏:助手生成宏并直接执行。
  4. 修复失败:如果运行出错,助手会帮助排查和修正。

完成后,这个宏就是你自己的资产——可以保存、手动编辑,也可以随时再次运行。

三种创建宏的方式

V10 提供三条路径,AI 只是其中之一:

方式 适合谁 特点
AI 宏助手 想快速起步、不写代码的用户 描述任务即可生成宏,自动运行并协助修复
连接自己的 AI(MCP) 已有 AI 助手的用户 通过 MCP 桥接,让你自己的 AI 助手创建、运行、调试 Ui.Vision 宏
录制或编码 需要精细控制的用户 可视化录制、Selenium 风格命令、v10 新增的 JavaScript 自动化 API

三种方式产出的都是可复用的宏,可以互相配合。例如先用 AI 生成初版,再手动编辑细节。

免费计划与 AI 提供方选择

网站资料明确说明:Ui.Vision AI 在免费计划中可用,无需注册或 API 密钥。这降低了试用门槛。

在 AI 提供方上,你有三种选择:

  • 托管的 Ui.Vision AI:开箱即用。
  • 自己的 AI 提供方:接入你已有的服务。
  • 本地模型:数据留在本地。

需要注意数据流向:使用托管 AI 时,聊天内容以及包含的页面数据或截图会发送到所选服务进行处理。如果你的页面涉及敏感信息,应优先考虑本地模型或自备提供方。宏本身在本地运行。

浏览器与桌面自动化的边界

  • 浏览器自动化:支持 Chrome、Edge、Firefox,可在 Windows、macOS、Linux 上运行。
  • 桌面自动化与本地文件访问:需要额外安装 Desktop Automation 应用(XModules)。
  • Browser Vision:在 Chrome 和 Edge 上,V10 的 Browser Vision 无需 XModules 即可工作,即使浏览器窗口在后台也能运行。

如果你只做网页操作,装浏览器扩展就够了;一旦涉及桌面应用或本地文件,才需要补上 XModules。

上手步骤

  1. 安装 Ui.Vision 浏览器扩展(Chrome、Edge 或 Firefox 商店一键安装)。
  2. 打开 AI 宏助手,用自然语言描述你的任务。
  3. 让助手检查页面、生成并运行宏。
  4. 运行失败时,根据助手的提示修正。
  5. 保存宏,之后可编辑或重复运行。
  6. 如需桌面自动化或本地文件访问,再安装 Desktop Automation 应用(XModules)。

常见卡点

  • 任务描述太笼统:描述越具体,助手越容易定位到正确的页面元素。
  • 页面数据敏感:托管 AI 会发送页面数据和截图,此时改用本地模型或自备提供方。
  • 需要桌面操作却只装了扩展:桌面应用和本地文件访问依赖 XModules,需单独安装。
  • 想深度定制:AI 生成的宏可以继续用 Selenium 风格命令或 JavaScript API 手动编辑,不必从零重写。

想了解 AI 提供方选择和自动化安全的更多细节,可查阅官网的对应说明页面。

ui.vision
Build reusable browser and desktop macros with Ui.Vision V10. Use AI, connect an assistant through MCP, or record classic workflows with vision and...