网站资料 · 技术情报 · 相似站点

ui.vision 有付费内容

分类: AI工具

Build reusable browser and desktop macros with Ui.Vision V10. Use AI, connect an assistant through MCP, or record classic workflows with vision and OCR.

访问网站

更新时间:2026-09-28 02:27 语言:未知(默认) 网站访问:正常

站内浏览 2 次 访问跳转 1 次
Ui.Vision V10 首页完整截图
编辑评测

网站深度测评

Ui.Vision是什么网站?

Ui.Vision 是一个开源的浏览器与桌面自动化工具网站,核心产品是 Ui.Vision V10 浏览器扩展和配套桌面应用。它让用户用“宏”(macro)来自动完成网页操作、桌面操作、网页抓取和 UI 测试。

主要用途

  • 浏览器自动化:在 Chrome、Edge、Firefox 中录制或编写操作流程。
  • 桌面自动化:配合桌面应用(XModules)操作本地应用和文件。
  • 网页抓取与 UI 测试:结合计算机视觉和 OCR 处理页面元素。
  • AI 生成宏:在 v10 的 AI 宏助手中描述任务,助手会检查页面、写出宏、运行并帮助修复失败,生成的宏可保留下来反复编辑运行。

典型使用场景

  • 需要重复填表、点击、抓取数据的运营或数据人员。
  • 做 Web UI 自动化测试的开发者,可用 Selenium 风格命令或 v10 新增的 JavaScript 自动化 API。
  • 已有自己的 AI 助手,想让它直接创建、运行、调试浏览器宏的用户,可通过 MCP 桥接实现。

选择条件

  • 想零成本试用:AI 功能在免费计划中可用,无需注册或 API key。
  • 在意数据流向:宏在本地运行;托管 AI 会把聊天内容、页面数据或截图发送到所选服务,也可改用自备 AI 提供商或本地模型。
  • 需要桌面级操作:要额外安装 Desktop Automation 应用(XModules);v10 中 Chrome 和 Edge 的 Browser Vision 已无需 XModules,浏览器窗口在后台也能工作。

与其他方案的区别侧重

  • 相比纯代码测试框架,它更强调可视化录制、视觉和 OCR,适合不便只靠选择器的页面。
  • 相比只做浏览器的扩展,它多了桌面自动化和 MCP/AI 集成这条线。
  • 相比纯 AI 代理工具,它保留了可编辑、可复用的宏,便于稳定重跑。

想开始的话,先装对应浏览器的扩展,再按需决定是否加装桌面应用;要 AI 辅助就选托管 AI、自备提供商或本地模型中的一种。

如何用AI描述任务自动生成可复用的浏览器或桌面自动化宏?

用 Ui.Vision V10 的 AI 宏助手,你可以直接用自然语言描述任务,助手会检查页面、写出宏、运行并帮你修复失败,生成的宏可以保存下来反复编辑和运行。按资料,AI 宏助手在免费计划上就能用,无需注册或 API Key。

具体操作路径

  1. 安装浏览器扩展(Chrome、Edge 或 Firefox 均可),或另外安装桌面自动化应用(XModules)以覆盖桌面应用和本地文件。
  2. 在 v10 的 AI 宏助手里用一句话描述你想自动化的任务,例如“登录后台,导出本月订单表格”。
  3. 助手会检查页面、生成宏并试运行;如果失败,它会协助定位和修复。
  4. 把结果宏保留下来,之后可再次编辑和运行,形成可复用资产。

适合谁、什么场景

  • 想快速把重复的网页操作(填表、抓取、UI 测试)变成可复用宏,但不想从零写脚本的人。
  • 需要同时覆盖浏览器和桌面应用、本地文件访问的流程,可配合桌面自动化应用。
  • 已有自己的 AI 助手:可用 MCP 桥接,让你的助手直接创建、运行和调试 Ui.Vision 宏。

选择条件

  • 只想跑浏览器流程:装扩展即可。资料提到 v10 中 Chrome 和 Edge 的 Browser Vision 无需 XModules,浏览器窗口在后台也能工作。
  • 涉及桌面软件或本地文件:需要桌面自动化应用(XModules)。
  • AI 运行方式:可选托管 Ui.Vision AI、自备 AI 提供商或本地模型;托管 AI 会把聊天内容及包含的页面数据或截图发送给所选服务处理。
  • 除 AI 生成外,也可用可视化录制、Selenium 风格命令或 v10 新的 JavaScript 自动化 API 来构建或微调宏。

如果你本来就在用 Selenium IDE,Ui.Vision 支持导入/导出,迁移成本较低。想先试水,从免费扩展加 AI 宏助手开始即可;需要企业级功能再考虑 RPA PRO 或 AI PRO。

怎样通过MCP把外部AI助手接入Ui.Vision来创建和调试宏?

通过 MCP 把外部 AI 助手接入 Ui.Vision V10,本质是让助手通过 MCP bridge 直接创建、运行和调试宏,而不是只在聊天窗口里给建议。

接入方式

  • 在 Ui.Vision V10 中启用 MCP 集成,用 MCP bridge 连接兼容 MCP 的 AI 助手。
  • 接入后,助手可以调用 Ui.Vision 的宏能力:创建宏、运行宏、在失败时协助修复。
  • 宏仍保存在 Ui.Vision 中,可继续编辑和重复运行,不是一次性对话产物。

典型使用场景

  • 已有自己的 AI 助手,希望它直接操作浏览器完成重复流程。
  • 让助手根据页面实际情况生成宏,并在运行失败时迭代调整。
  • 需要把 AI 生成的自动化流程沉淀为可复用宏,而不是每次重新描述。

与内置 AI 宏助手的区别

  • 内置 AI 宏助手:在 v10 里直接描述任务,助手检查页面、写宏、运行并帮助修复;免费计划可用,无需注册或 API key。
  • MCP 接入:用你自己的 AI 助手来创建、运行和调试宏,适合已习惯某个助手的用户。

选择条件

  • 想快速上手、不配置外部工具:用内置 AI 宏助手。
  • 已有惯用的 MCP 兼容助手、希望统一工作流:走 MCP bridge。
  • 关注数据流向:托管 AI 会把聊天内容及包含的页面数据或截图发送到所选服务处理;也可选择自己的 AI provider 或本地模型。

Ui.Vision V10的浏览器视觉功能在Chrome和Edge上是否还需要安装XModules?

不需要。按 Ui.Vision V10 的资料,Browser Vision 在 Chrome 和 Edge 上无需 XModules 即可工作,而且浏览器窗口即使在后台也能运行。

具体使用情境:

  • 只做浏览器内的视觉自动化:在 Chrome 或 Edge 安装 Ui.Vision 扩展后,直接用 Browser Vision,不必再装 Desktop Automation 应用(XModules)。
  • 需要操作桌面软件或访问本地文件:这时才需要另外安装 Desktop Automation 应用(XModules Version 2)。
  • 使用 Firefox:资料只说明 Chrome 和 Edge 的 Browser Vision 免 XModules,Firefox 未在这一点上被提及,建议按官方安装说明确认。

如果你已经在用 V10,下一步可以检查是否已装 Desktop Automation 应用;若你的宏只涉及网页,就不必安装。

Ui.Vision的宏在本地运行还是会上传数据,AI处理时如何选择托管、自有或本地模型?

宏本身在本地运行;只有你选择使用托管 AI 功能时,聊天内容及随附的页面数据或截图才会发送到所选服务处理。

本地与上传的边界

  • 宏执行:Ui.Vision 的宏在你的机器上本地运行,浏览器自动化支持 Windows、macOS 和 Linux。
  • 托管 AI:使用 Ui.Vision 托管 AI 时,聊天内容、包含的页面数据或截图会发送到所选服务处理。
  • 自有模型/本地模型:可以选择自己的 AI 提供商,或使用本地模型,把处理留在你可控的环境里。

AI 处理的三条路径

  • 托管 Ui.Vision AI:最省事。资料显示 AI 功能在免费计划中可用,无需注册或 API key。
  • 自有 AI 提供商:接入你已有的模型服务,适合已有账号或合规要求明确的团队。
  • 本地模型:数据不出本机,适合处理敏感页面或内网系统。

AI 在流程里做什么 V10 的 AI 宏助手可以:你描述任务 → 助手检查页面 → 写出宏 → 运行 → 帮助修复失败,最后保留宏供反复编辑和运行。也可以用 MCP 桥接,让你自己的 AI 助手创建、运行和调试宏。

怎么选

  • 只是试用、跑公开网页:托管 AI 起步最快。
  • 页面含账号、客户数据或内部系统:优先本地模型,或至少用自有提供商并确认数据流向。
  • 团队已有模型服务:接自有提供商,便于统一计费和审计。

相关入口

  • 免费浏览器扩展与桌面应用:Ui.Vision
  • 定价与 AI PRO:Pricing

例如需要抓取登录后的后台数据,可先用录制或 Selenium 风格命令搭好宏骨架,再把 AI 仅用于生成和调试选择器,避免把整页内容交给托管服务。

Ui.Vision免费版和AI PRO、RPA PRO在功能和价格上有什么区别?

Ui.Vision 的免费版能用 AI 宏助手,但 AI 相关的高级能力和企业级 RPA 功能需要付费版本。资料只明确给出了 AI PRO 和 RPA PRO & Enterprise 两个付费入口,具体价格需在 Ui.Vision 的定价页查看。

各版本功能差异

版本 主要能力 适用场景
免费版 浏览器扩展(Chrome/Edge/Firefox)、可视化录制、Selenium 风格命令、JavaScript API、计算机视觉与 OCR;AI 宏助手可用,无需注册或 API Key 个人做网页自动化、网页抓取、UI 测试的入门
AI PRO 面向 AI 能力升级的付费方案,页面将“AI & MCP”“AI Providers”“AI PRO”单列 需要接入自己的 AI 助手、通过 MCP 桥接创建和调试宏的用户
RPA PRO & Enterprise 面向 RPA 的付费与商业方案,与 AI PRO 并列在定价导航中 企业级桌面自动化、需要本地文件访问和桌面应用控制的团队

关键区别点

  • AI 宏助手:免费版即可用,描述任务后助手会检查页面、写宏、运行并帮忙修复失败,宏可保存复用。
  • MCP 桥接:让外部 AI 助手创建、运行、调试 Ui.Vision 宏,属于 V10 的 AI 集成能力,页面归在 AI & MCP 板块。
  • 桌面自动化:需要额外安装 Desktop Automation 应用(XModules),用于桌面应用和本地文件访问。V10 中 Chrome/Edge 的 Browser Vision 不装 XModules 也能用,且浏览器窗口可在后台运行。
  • AI 运行方式:可选托管 Ui.Vision AI、自带 AI 提供商或本地模型。托管 AI 会把聊天内容、页面数据或截图发送到所选服务。

选择建议

  • 只做浏览器自动化、想先试 AI 写宏:先用免费版。
  • 想把自己常用的 AI 助手接进来批量创建/调试宏:看 AI PRO。
  • 要控制桌面软件、访问本地文件,或团队商用:看 RPA PRO & Enterprise。

具体价格和额度差异,以 Ui.Vision 定价页为准。

开源软件是什么?普通人该怎么选和用

开源软件指源代码公开、允许他人查看、修改和再分发的软件。它不等于免费,也不等于没有版权——是否收费、能否商用、二次发布要满足什么条件,取决于具体的开源许可证。对普通人来说,判断一款开源软件值不值得用,关键看三点:许可证是否匹配你的用途、项目是否仍在活跃维护、以及它能否解决你的具体任务。下面按这三个维度展开。

开源软件和"免费软件"不是一回事

很多人把开源等同于免费,这是最常见的误区。开源描述的是源代码的获取与使用权利,免费描述的是价格。两者可以重合,也可以分离:

  • 有的开源软件完全免费,靠社区或捐赠维护;
  • 有的开源软件本身免费,但官方提供付费的技术支持、托管或企业版;
  • 也有软件免费但不开源(只给可执行文件,不给源代码)。

所以看到"开源"两个字,不要直接推断"免费"或"可以随便用"。真正决定你能怎么用的,是它附带的许可证。

常见许可证决定你能做什么

许可证是开源软件的使用规则。同样是开源,不同许可证对"修改后要不要也开源""能不能闭源商用"的要求差别很大。下面是最常见的几类:

许可证 大致类型 修改后必须开源吗 典型场景
MIT 宽松型 不要求 想自由使用、闭源集成
Apache 2.0 宽松型 不要求 商用、需专利授权条款
GPL 传染型(Copyleft) 分发修改版时要求 希望衍生作品也保持开源
LGPL 弱传染型 有限要求 库文件被闭源软件调用

对普通用户来说,日常使用(自己装来用、不修改不分发)几乎不受许可证限制。真正需要留意许可证的是两类人:把开源代码嵌进自己产品再发布的开发者,以及想基于开源项目做二次分发的人。如果你属于这两类,务必先读项目根目录下的 LICENSE 文件,而不是凭印象判断。

开源不等于安全,也不等于好用

"源代码公开所以更安全"是一种想当然。公开确实让更多人能审查代码,但有没有人真的去审查、发现问题后有没有人及时修,才是安全的关键。判断一个开源项目是否可靠,可以看这些信号:

  • 最近提交时间:仓库几个月甚至几年没更新,遇到漏洞可能没人修;
  • issue 和 PR 的响应:大量长期未处理的 issue,说明维护者精力有限或已放弃;
  • 发布节奏:是否有稳定的版本发布,还是长期停在某个旧版本;
  • 社区规模:文档、论坛、问答是否活跃,出问题能不能找到人。

反过来,一个更新频繁、社区活跃的小众开源工具,往往比一个多年不更新的大牌项目更值得信任。

按用途挑选开源替代品

选开源软件,先明确你要完成的任务,再看有没有成熟替代品。以图像处理为例,ImageOptim 就是一类面向"压缩图片、减小文件体积"任务的开源工具,它的定位是替代"导出为 Web 格式"这类操作,而不是替代完整的图像编辑软件。这说明一个重要思路:开源替代品常常只覆盖某个具体环节,而不是一比一替换整个商业软件。

按用途大致可以这样找:

  • 图像/媒体处理:先想清楚是"编辑"还是"压缩/转换",前者找编辑器,后者找专用工具;
  • 办公文档:找能读写通用格式(如 docx、xlsx)的套件,注意复杂排版可能走样;
  • 开发工具:这类开源生态最成熟,编辑器、版本控制、包管理基本都有开源方案;
  • 系统工具:压缩、清理、格式转换等小工具,开源选择非常多。

挑选时的通用检查清单:

  1. 它能不能完成你的核心任务(先看功能,不看名气);
  2. 最近一次更新是什么时候;
  3. 有没有清晰的安装说明和文档;
  4. 出问题时去哪里求助(issue 区、论坛、聊天群)。

安装和使用中的常见卡点

开源软件的安装方式比商业软件更杂,遇到问题先分清是哪一类:

  • 来源不明:只从项目官网或官方代码仓库下载,不要用来路不明的第三方打包版本;
  • 依赖缺失:部分工具需要先装运行环境或其他组件,报错信息通常会指出缺什么;
  • 权限与系统限制:某些系统会拦截未签名应用,需要手动允许,操作前确认来源可信;
  • 版本混乱:同一工具有稳定版和开发版,日常使用优先选稳定版。

遇到问题时的求助顺序

  1. 先查官方文档:多数基础问题文档里就有答案;
  2. 搜 issue 区:你的问题很可能别人已经提过,看有没有解决方案或临时绕过办法;
  3. 看社区论坛/聊天群:适合文档没覆盖的使用经验类问题;
  4. 自己提 issue:写清版本、系统、复现步骤和报错信息,越具体越容易被回应。

提 issue 时不要只写"用不了",而要写"在什么系统、什么版本、执行了什么操作、期望什么结果、实际报了什么错"。这几乎决定了你能不能得到有效帮助。

一句话决策

日常自己用、不修改不分发,选开源软件主要看功能是否够用 + 项目是否还在维护;要把代码嵌进自己的产品再发布,才需要认真读许可证。开源是权利和协作方式,不是质量或免费的保证——把它当成一个需要核实的选项,而不是一个可以放心的标签。

Ui.Vision V10 是什么?浏览器与桌面自动化工具的能力与使用方式

Ui.Vision V10 是一款开源的浏览器与桌面自动化工具,核心用途是让你用可复用的“宏”自动完成网页操作、桌面操作、网页抓取和 UI 测试。它提供三种上手路径:用 AI 宏助手描述任务自动生成宏、通过 MCP 连接你自己的 AI 助手、或者用可视化录制和 Selenium 风格命令自己搭建。浏览器自动化在 Windows、macOS、Linux 上都可用;涉及桌面应用和本地文件访问时,需要额外安装 Desktop Automation 应用(XModules)。

它能做什么

根据官网说明,Ui.Vision 覆盖以下几类任务:

  • 网页自动化:在浏览器中重复执行点击、输入、跳转等操作。
  • 桌面自动化:操作本地桌面应用、访问本地文件(需装 XModules)。
  • 网页抓取:从页面提取数据。
  • UI 测试与测试自动化:用宏验证界面行为。
  • 视觉与 OCR 结合:把浏览器命令与计算机视觉、OCR 组合使用,应对难以用选择器定位的元素。

宏是这里的核心单位——你描述或录制一次,就能保存下来反复编辑和运行。

三种创建宏的方式

1. 用 AI 宏助手描述任务

在 V10 的 AI 宏助手里描述你想自动化的内容,助手会检查页面、编写宏、运行它,并在失败时帮助修复。生成的宏可以保留下来继续编辑和复用。

官网明确写到:Ui.Vision AI 在免费方案上可用,无需注册、无需 API key。

2. 通过 MCP 连接你自己的 AI 助手

如果你已经在用支持 MCP 的 AI 助手,可以通过 MCP bridge 让它创建、运行和调试浏览器中的 Ui.Vision 宏。相当于给你的 AI 助手一套浏览器自动化工具。

3. 自己录制或写代码

  • 可视化录制:像录制操作一样生成宏。
  • Selenium 风格命令:支持 Selenium IDE 的导入/导出。
  • V10 新增的 JavaScript 自动化 API:适合需要更复杂逻辑的场景。

安装与运行环境

项目 说明
浏览器扩展 支持 Chrome、Edge、Firefox,均为一键安装
操作系统 Windows、macOS、Linux
桌面自动化 需安装 Desktop Automation 应用(XModules Version 2)
浏览器视觉 V10 中 Chrome 和 Edge 的 Browser Vision 无需 XModules,即使浏览器窗口在后台也能工作
运行位置 宏在本地运行

如果你是从旧版本升级,官网提示:使用 Ui.Vision Version 10 的话,需要下载新的 Desktop Automation 应用(XModules Version 2)。

AI 与数据流向:需要先想清楚的一点

Ui.Vision 允许你选择 AI 的处理方式:

  • 托管版 Ui.Vision AI:由官方服务处理。
  • 你自己的 AI 提供商:接入你选择的第三方服务。
  • 本地模型:在本地运行。

官网特别说明:使用托管 AI 时,聊天内容以及其中包含的页面数据或截图,会被发送到所选服务进行处理。也就是说,如果你处理的是敏感页面,选择本地模型或自建提供商是更可控的路径。官网另有关于 AI 提供商选择和自动化安全的说明可供参考。

适合谁用

  • 需要重复操作网页、又不想写完整脚本的人:从 AI 宏助手或可视化录制入手。
  • 已经在用 AI 助手、想让它直接操作浏览器的开发者:走 MCP 连接。
  • 需要兼顾桌面应用和本地文件的自动化场景:加装 XModules。
  • 做 UI 测试、需要视觉和 OCR 兜底的团队:把浏览器命令与视觉能力组合使用。

从哪里开始

  1. 安装浏览器扩展(Chrome、Edge 或 Firefox)。
  2. 先用 AI 宏助手描述一个简单任务,看它生成的宏是否符合预期。
  3. 需要桌面或本地文件操作时,再安装 Desktop Automation 应用。
  4. 想接入自己的 AI 助手,配置 MCP bridge。

价格方面,官网提供了 Pricing 和 AI PRO 两个入口页面,具体方案与费用需以这些页面为准;免费方案可用 AI 宏助手这一点已在官网说明中明确。

如何通过 MCP 将 AI 助手连接到 Ui.Vision

Ui.Vision V10 提供 MCP 桥接(MCP bridge),让兼容 MCP 的 AI 助手直接创建、运行和调试浏览器中的 Ui.Vision 宏。前提是你已经安装 Ui.Vision 浏览器扩展(Chrome、Edge 或 Firefox),并使用一个支持 MCP 的 AI 助手。连接后,宏的编写和执行由助手在浏览器内驱动,你负责描述任务和检查结果。

MCP 桥接解决什么问题

传统做法是自己在 Ui.Vision 里逐条写命令或录制操作。MCP 桥接把这件事交给 AI 助手:助手可以生成宏、触发运行、在失败时读取反馈并调整。适合以下场景:

  • 任务描述清楚,但你不熟悉 Selenium 风格命令或 JavaScript API
  • 页面结构会变,希望助手在运行失败后自动修正定位方式
  • 已有自己的 AI 助手,想让它直接操作浏览器而不是只给建议

不适合的场景:需要严格审计每一步、不允许页面数据离开本机的流程——这取决于你选择的 AI 提供商。

连接前的准备

  1. 安装浏览器扩展:从 Chrome Web Store、Edge Add-ons 或 Firefox Add-on Gallery 安装 Ui.Vision。浏览器自动化在 Windows、macOS、Linux 上均可运行。
  2. 确认助手兼容 MCP:只有支持 MCP 的 AI 助手才能通过桥接与 Ui.Vision 通信。
  3. 决定 AI 提供商:Ui.Vision 支持托管 AI、你自己的 AI 提供商,或本地模型三种方式。
  4. 桌面自动化(可选):如果宏需要操作桌面应用或访问本地文件,需额外安装 Desktop Automation 应用(XModules)。注意 V10 中 Chrome 和 Edge 的 Browser Vision 无需 XModules,即使浏览器窗口在后台也能工作。

连接与使用流程

  1. 建立 MCP 连接:在 Ui.Vision 侧启用 MCP 桥接,让你的 AI 助手接入。连接建立后,助手获得创建、运行、调试宏的能力。
  2. 描述任务:用自然语言说明要自动化的内容。助手会检查页面、写出宏、运行它,并在失败时协助修复。
  3. 保留并复用宏:生成的宏可以保存下来,之后继续编辑和重复运行,不必每次重新描述。
  4. 验证结果:宏在本地运行,检查输出是否符合预期;失败时让助手读取错误并调整。

除了 MCP 和 AI 助手,V10 也保留了两条传统路径:可视化录制,以及 Selenium 风格命令加新的 JavaScript 自动化 API。你可以混合使用——例如让助手生成初版宏,再手动微调。

AI 提供商与数据流向

方式 数据流向 适用考虑
托管 Ui.Vision AI 聊天内容及附带的页面数据或截图发送到所选服务处理 上手快,无需自备模型
自己的 AI 提供商 发送到你指定的提供商 可对接已有账号与模型
本地模型 数据留在本地 对数据外发敏感时优先

Ui.Vision 的 AI 功能在免费计划中可用,无需注册或 API key。但“免费可用”不等于所有提供商组合都免费,具体以你选择的提供商为准。

安全上需要明确一点:使用托管 AI 时,聊天内容以及宏中包含的页面数据或截图会被发送到所选服务处理。如果页面含敏感信息,应选择本地模型,或在描述任务时避免让助手读取这些页面。

常见卡点

  • 助手不支持 MCP:桥接无法建立,只能退回手动录制或自己写宏。
  • 需要桌面操作却没装 XModules:浏览器内的自动化不需要它,但桌面应用和本地文件访问需要。
  • 以为宏在云端跑:宏在本地运行,但托管 AI 模式下页面数据会外发,这两件事要分开理解。
  • 浏览器窗口在后台:V10 中 Chrome 和 Edge 的 Browser Vision 在后台也能工作,不必把窗口置前。

如果你的目标是让 AI 直接动手操作浏览器,MCP 桥接是 V10 的主要路径;如果只是想让 AI 帮你写一段宏再自己跑,AI 宏助手就够了。

Ui.Vision 有哪些版本和定价选项?

Ui.Vision 的版本可以按两层来理解:一层是自动化运行环境(免费浏览器扩展 + 桌面应用 XModules),另一层是 AI 与商业授权(AI PRO、RPA PRO & Enterprise)。官网明确提到 AI 功能在免费计划上可用,且无需注册或 API Key;同时站内存在 Pricing 与 AI PRO 两个独立入口,说明 AI 能力与 RPA 商业版是分开计价的。具体金额官网页面未在资料中给出,需要点进对应链接确认。

免费能用什么

免费部分覆盖了大多数个人自动化的起点:

  • 浏览器扩展:支持 Chrome、Edge、Firefox,一键安装,可运行在 Windows、macOS、Linux。
  • AI 宏助手:在 v10 中描述任务,助手会检查页面、编写宏、运行并帮助修复失败,生成的宏可保留下来反复编辑运行。官网说明它在免费计划上可用,无需注册或 API Key。
  • 经典自动化方式:可视化录制、Selenium 风格命令、v10 新增的 JavaScript 自动化 API,可结合计算机视觉与 OCR。
  • Browser Vision:在 Chrome 和 Edge 上无需 XModules 即可工作,即使浏览器窗口在后台也能运行。

如果你的需求只是浏览器内的重复操作、网页抓取或 UI 测试,免费扩展通常已经够用。

什么时候需要桌面应用(XModules)

浏览器扩展管不到浏览器之外的东西。要自动化桌面应用程序或访问本地文件,需要额外安装 Desktop Automation 应用(XModules)。官网对 v10 用户的提示是:如果已有 Ui.Vision V10,应下载新的 Desktop Automation 应用(XModules Version 2)。

判断标准很简单:

你的任务 需要什么
网页点击、填表、抓取、UI 测试 浏览器扩展即可
操作本地软件、读写本地文件 浏览器扩展 + XModules

AI 部分:托管、自有提供商还是本地模型

Ui.Vision 允许三种 AI 接入方式,这是选型时最需要权衡的一点:

  • 托管 Ui.Vision AI:开箱即用,免费计划可用。代价是聊天内容以及包含的页面数据或截图会被发送到所选服务处理。
  • 自有 AI 提供商:接入你自己的模型服务,适合对数据流向有要求、或已有模型额度的用户。
  • 本地模型:数据不出本机,适合处理敏感页面,但需要自己准备运行环境。

官网特别说明宏是本地运行的,AI 部分才涉及数据外发。所以如果页面含敏感信息,优先考虑本地模型或自有提供商。

MCP:把 Ui.Vision 交给你的 AI 助手

v10 的另一条路径是通过 MCP bridge,让兼容 MCP 的 AI 助手直接创建、运行和调试 Ui.Vision 宏。这适合已经在用某个 AI 助手、希望它具备浏览器操作能力的场景,而不是在 Ui.Vision 内部描述任务。

商业版本怎么选

官网列出了 RPA PRO & Enterprise 和 AI PRO 两个付费方向,并有独立定价页。资料中没有给出具体价格、功能配额或授权条款,因此无法在这里比较金额。可核对的做法是:

  1. 打开 https://ui.vision/rpa/x/pricing 查看 RPA PRO & Enterprise 的授权与价格。
  2. 打开 https://ui.vision/ai/pro 查看 AI PRO 的权益范围。
  3. 先跑免费版验证流程可行性,再决定是否为团队授权或更高 AI 配额付费。

决策建议

  • 个人、浏览器内任务:免费扩展起步,AI 宏助手直接试,不需要付费。
  • 涉及本地软件或文件:加装 XModules,仍可停留在免费层。
  • 数据敏感:选本地模型或自有 AI 提供商,避开托管 AI 的数据外发。
  • 团队协作、企业授权或更高 AI 用量:到 Pricing 与 AI PRO 页面确认具体条款后再选,不要仅凭版本名称推断包含内容。
Ui.Vision V10 的浏览器视觉功能需要安装 XModules 吗?

不需要。在 Ui.Vision V10 中,Chrome 和 Edge 上的浏览器视觉(Browser Vision)无需安装 XModules 即可使用,即使浏览器窗口处于后台也能正常工作。但如果你要自动化桌面应用或访问本地文件,仍然需要额外安装 Desktop Automation 应用(XModules)。

浏览器视觉与 XModules 的关系

Ui.Vision 的能力可以分成两层,是否需要 XModules 取决于你要操作的对象:

能力 作用范围 是否需要 XModules
浏览器视觉(Browser Vision) Chrome、Edge 中的网页 不需要
桌面自动化 本地桌面应用 需要 Desktop Automation 应用
本地文件访问 本机文件系统 需要 Desktop Automation 应用

也就是说,只要你的任务停留在网页层面——点击、填表、抓取、UI 测试——在 Chrome 或 Edge 上直接装浏览器扩展就能跑视觉相关功能,不必先装 XModules。

支持哪些浏览器

Ui.Vision 提供三个浏览器扩展入口:

  • Chrome:通过 Chrome 应用商店一键安装
  • Edge:通过 Edge 加载项商店一键安装
  • Firefox:通过 Firefox 附加组件库一键安装

浏览器自动化可在 Windows、macOS 和 Linux 上运行。需要注意的是,V10 中「浏览器视觉无需 XModules」这一说明明确指向 Chrome 和 Edge;Firefox 扩展本身可用,但资料未把 Firefox 列入免 XModules 的浏览器视觉范围,涉及视觉能力时以 Chrome、Edge 为准更稳妥。

什么时候必须装 XModules

出现下面这类需求时,浏览器扩展不够用,需要补装 Desktop Automation 应用(XModules Version 2):

  • 操作浏览器之外的桌面软件,比如本地客户端、系统弹窗
  • 读写本地文件,让宏与磁盘上的数据交互

如果你已经是 Ui.Vision V10 用户,官方给出的路径是下载新的 Desktop Automation 应用(XModules Version 2)。

安装与验证步骤

  1. 装浏览器扩展:按你使用的浏览器,从 Chrome 应用商店、Edge 加载项商店或 Firefox 附加组件库安装 Ui.Vision。
  2. 跑一个网页视觉任务:在 Chrome 或 Edge 中创建一个包含视觉/OCR 命令的宏并运行。
  3. 验证是否免 XModules:把浏览器窗口切到后台再运行一次,若视觉命令仍能定位并执行,说明当前环境不需要 XModules。
  4. 按需补装 XModules:只有当任务涉及桌面应用或本地文件时,再安装 Desktop Automation 应用。

常见卡点

  • 把桌面任务当成网页任务:宏里一旦要操作本地应用或文件,就必须有 XModules,否则会失败。
  • 误以为所有浏览器都一样:免 XModules 的浏览器视觉说明针对 Chrome 和 Edge,Firefox 场景建议先实测确认。
  • 忽略后台运行的前提:V10 的浏览器视觉支持窗口在后台工作,这是它相对旧方式的便利点,但前提仍是在 Chrome/Edge 上。

关于 AI 与运行方式

V10 的 AI 宏助手可以在免费计划上使用,无需注册或 API key;你也可以通过 MCP 桥接让自己的 AI 助手创建、运行和调试宏。宏在本地运行,AI 提供方可以选择托管版 Ui.Vision AI、你自己的 AI 提供方或本地模型——使用托管 AI 时,聊天内容及随附的页面数据或截图会发送到所选服务处理。这些选择不影响「浏览器视觉是否需要 XModules」的结论,但会影响数据流向,配置前值得一并考虑。

网站信息概览

综合当前可观察字段,站点的域名资历和网络配置都体现出一定运营沉淀,这有助于建立连续性判断,但仍需结合主体身份和具体业务。从公开技术信号来看,邮件系统可用却没有形成完整认证闭环,这可能同时带来品牌仿冒和正常邮件进入垃圾箱的风险。

域名与注册信息

该域名注册于 2019 年,已有约 7 年历史。域名处于正常锁定状态,可降低未经授权转移的风险。依据当前可见线索,当前登记的注册商是 NameCheap, Inc.,市场使用较为普遍。该网站采用常见域名后缀 .vision。

DNS 与邮件配置

邮件认证尚不完整,当前缺少 DMARC。综合当前可观察字段,NS 记录显示该域名接入了 Cloudflare。依据当前可见线索,该域名的收件服务由 Google Workspace 提供。DNS 中没有 CNAME 记录,这是常见的直接解析方式。从当前可见信息判断,域名已通过 TXT 记录验证 Google 等外部服务。

TLS 与证书

TLS 使用现代椭圆曲线公钥 EC。服务器返回了完整证书链。证书未包含组织名称,按现有字段归为 DV 域名验证证书。现有迹象表明,HTTPS 证书由 Google Trust Services 托管体系提供。TLS 证书采用约 90 天的短有效期。

HTTP 响应

常用安全响应头尚缺少 HSTS、CSP、Permissions-Policy、点击劫持防护。CORS 允许任意来源读取该响应。HTTP 头没有直接暴露后端框架。从公开技术信号来看,检测到 cf-ray,前端存在代理或边缘网络。HTTP 字段未显示敏感内部网络标识。

技术栈分析

综合当前可观察字段,站点可见的技术栈为 Google Analytics、Cloudflare,精确版本未知。技术名称本身提供了架构线索,但目前没有证据表明某个具体版本存在问题。

SEO 与社交分享

页面未检测到 Open Graph 元数据。页面标题长度为 56 个字符,处于常用展示范围。Meta Description 信息完整且长度适中。当前首页面向常规搜索抓取开放。未检测到页面生成系统标识。

主机和电子邮件

DNSCloudflare
主机Cloudflare
电子邮件Google Workspace
位置 位置未知 104.21.12.8

用户评价(0)

  • 暂无评价。

页面、搜索与分享信息

页面描述Build reusable browser and desktop macros with Ui.Vision V10. Use AI, connect an assistant through MCP, or record classic workflows with vision and OCR.
规范链接https://ui.vision/
语言未知(默认)
Twitter Card未检测到

未知

所有爬虫 1 条允许 · 0 条禁止
  • 允许/

域名登记事实 RDAP / WHOIS

注册商NameCheap, Inc.
注册时间2019-05-06
到期时间2036-05-06
域名状态client transfer prohibited
名称服务器jonah.ns.cloudflare.com、sara.ns.cloudflare.com
DNSSECunsigned

DNS 记录

类型名称值TTL优先级
Aui.vision104.21.12.8300—
Aui.vision172.67.151.2300—
AAAAui.vision2606:4700:3034::6815:c08300—
AAAAui.vision2606:4700:3034::ac43:9702300—
MXui.visionaspmx.l.google.com3001
MXui.visionalt1.aspmx.l.google.com3005
MXui.visionalt2.aspmx.l.google.com3005
MXui.visionaspmx2.googlemail.com30010
MXui.visionaspmx3.googlemail.com30010
NSui.visionjonah.ns.cloudflare.com86400—
NSui.visionsara.ns.cloudflare.com86400—
TXTui.visiongoogle-site-verification=aUKvCbFBVBUIF0jSInyuG72iTeyJWmuhg49FaCrgOQw300—
TXTui.visionv=spf1 include:servers.mcsv.net ?all300—

TLS 与证书

定性结果配置正常
支持协议TLSv1.2、TLSv1.3
协商协议TLSv1.3
证书主题ui.vision
颁发者Google Trust Services
有效期至2026-12-11T23:46 · 记录时剩余 74 天
验证事实证书信任:通过 · 域名匹配:通过

HTTP 响应标头

标头值
content-typetext/html; charset=utf-8
cache-controlpublic, max-age=0, must-revalidate
servercloudflare
x-content-type-optionsnosniff
referrer-policystrict-origin-when-cross-origin
access-control-allow-origin*

已识别技术

Google AnalyticsCloudflare

最近更新

  • 网站图像资源
  • 页面截图