开源的 Selenium IDE, 现代的网页自动化工具 (支持行为录制和回放)。适用于网页自动化测试,表单填写以及网页内容抓取。
开源的 Chrome 浏览器自动化与 RPA 工具:录制宏、抓取数据、填写表单,并借助 OCR、图像识别和 AI 实现自动化。 Ui.Vision 是一款免费的宏录制器和网页自动化工具,将经典的浏览器自动化与现代计算机视觉、OCR 以及内置 AI 助手相结合。宏只需录制一次,即可随意重复回放 - 本地运行、结果确定、无需编程。 **版本 10 新功能:** ★ AI 助手:用日常语言描述您的需求(例如"创建一个填写此表单的宏"),内置 AI 就会为您构建、运行并修复宏 - 它会读取页面、编写自动化流程、进行测试,并修复失败的部分。与每次运行都要重新"思考"的 AI 智能体不同,您得到的是一个普通的宏:完全属于您,可以随时编辑,并可上千次回放而无需支付 AI 费用。内置免费 AI 额度 - 无需 API 密钥,无需注册账号。也可以使用您自己的密钥(Anthropic、OpenRouter)或本地 LLM。 ★ JavaScript 宏:宏现在可以直接用现代 JavaScript 编写,配有简洁的 uiv.* API - 真正的循环、真正的 if/else、真正的错误处理,以及断点和单步调试。非常适合 CSV 驱动的任务、网页抓取和条件逻辑。您现有的命令表格式宏将完全照常工作,不会被转换。 ★ 支持 Claude Code 和 MCP:Ui.Vision 现已支持 MCP 协议,Claude Code 和其他 AI 编程工具可以在您的浏览器中构建、运行和调试宏,全程可见。一切都在本地完成。 ★ Browser Vision(浏览器视觉):新命令能像真实用户一样点击和输入 - 通过图像或文本(OCR)进行视觉定位 - 直接在 Chrome 和 Edge 中运行,且宏运行时浏览器窗口可以保持在后台。 ★ 更快:脚本宏在循环中的运行速度提升 50-300 倍,侧边栏的启动时间也大幅缩短。 (1) 浏览器自动化与网页宏录制器 Ui.Vision 的可视化宏录制器和计算机视觉命令让浏览器内的任务自动化变得简单:表单填写、网页抓取、数据提取、UI 测试和截图。在浏览器侧边栏中直接录制、编辑和运行宏,就在您要自动化的页面旁边 - 完整的 IDE 窗口只需一次点击即可打开。可导入现有的 Selenium IDE 脚本,并提供 iMacros 脚本的转换帮助。 (2) 基于图像识别和 OCR 的视觉自动化 自动化您所"看到"的内容,而不仅仅是 HTML 中的内容:通过截图点击按钮、用 OCR 在屏幕上查找文本、以可视化方式验证页面布局。图像识别和 OCR 现在直接在扩展内运行 - 无需任何额外安装。 (3) 适用于 Windows、Mac 和 Linux 的桌面自动化 除了网页浏览器自动化,Ui.Vision 还能识别桌面上的图像和文本,并执行各种操作,如鼠标点击、移动、拖放,以及模拟键盘输入。 桌面自动化需要安装免费的 Ui.Vision XModules,支持 Windows、Mac 和 Linux。这些模块为 Ui.Vision 提供与桌面交互所需的能力。 (4) AI 命令与 Anthropic Claude 集成 借助 AI 命令,只需一行代码就能自动化传统上需要数百行经典命令才能完成的复杂任务。例如,只需一句简短的"玩这个游戏..."提示,就能教会 Ui.Vision 玩井字棋。侧边栏中全新的 AI 聊天助手还能根据日常语言描述创建并修复完整的宏。 (5) 命令行 API Ui.Vision 可以通过命令行控制,因此可以在任何编程或脚本语言中调用和组合使用,例如 Windows 批处理文件、Linux/Mac Shell 脚本、Python 或 PowerShell。 (6) 开源 Ui.Vision 是开源软件,源代码托管在 GitHub 上。 (7) 100% 本地软件 - 您的数据由您掌控 本软件不会向我们或任何其他地方发送任何数据。所有处理,包括图像识别和 OCR,都在您的本地计算机上完成。 "所有数据均在本地处理"这一原则的唯一例外是可选的 AI 功能。所有云功能默认均为关闭状态 - 即使使用 AI,您也可以通过将 Ui.Vision 连接到本地 LLM 来保持完全本地化。默认的计算机视觉功能(图像识别和 OCR)始终 100% 在本地计算机上运行。 无论您称它为 RPA、宏录制器、任务自动化、网页抓取、屏幕抓取、表单填写器还是 UI 测试 - 只要是重复性的工作,Ui.Vision 都能帮您自动化。 **祝您自动化愉快!** 如有问题或建议,欢迎访问 Ui.Vision 社区论坛:https://forum.ui.vision 欢迎用中文发帖