UI.Vision RPA 入门指南:免费开源的浏览器自动化工具,录一次操作让它替你跑一百遍

发布时间:2026/8/14 8:33:31
UI.Vision RPA 入门指南:免费开源的浏览器自动化工具,录一次操作让它替你跑一百遍 UI.Vision RPA 入门指南免费开源的浏览器自动化工具录一次操作让它替你跑一百遍【免费下载链接】RPAUi.Vision Open-Source RPA Software with Computer Vision, OCR, Anthropic Computer Use/LLM. Selenium IDE import/export.项目地址: https://gitcode.com/gh_mirrors/rp/RPA周五下午运营小林对着订单系统第 47 次把同一批数据从后台复制进 Excel。她忍不住想能不能有个工具把我这套操作录下来自动重复一百遍这正是 RPA 自动化要解决的问题。而今天要介绍的 UI.Vision RPA就是这样一个免费开源的自动化工具。一句话定位免费、开源、跨平台还能开箱即用说白了UI.Vision RPA 就是一个装在浏览器里的自动化机器人。它支持 Chrome、Edge、Firefox 这些主流浏览器在 Windows、macOS、Linux 上都能跑你不用安装一堆依赖装上扩展就能干活。很多人一听到开源就担心免费的东西靠得住吗这里有三点可以帮你打消顾虑项目采用 AGPL-3.0 许可证个人用、商用都不收费没有隐藏订阅。源码完全公开谁都可以查看和审计代码里有什么小动作一目了然。它内置了 Selenium IDE 兼容能力以前用 Selenium 写过的东西可以导入进来复用迁移成本很低。再叠加它自带的计算机视觉和 OCR 识别能力UI.Vision RPA 不只是点按钮的工具更像一个长了眼睛的操作员。这也是它和其他网页自动填表工具拉开差距的地方——视觉识别意味着即使按钮位置变了它也能凭长相找到目标。五分钟跑通第一个自动化装扩展、录一遍、看它自己演新手完全不用先学编程。整个上手过程可以压缩成三步第一步装扩展。去浏览器商店搜UI.Vision RPA点添加工具栏就会多出一个小图标。愿意折腾的话也可以从源码自己构建git clone https://gitcode.com/gh_mirrors/rp/RPA cd RPA npm install npm run build第二步录一遍。点图标 → 新建宏 → 开始录制。接下来你在网页上的每一步操作比如填账号、点按钮、翻页都会被记下来就像给操作录像一样。第三步回放。点运行浏览器会自动重演你刚才的整套动作。一个最简单的录制结果翻译成脚本大概长这样open | https://example.com type | idusername | 你的账号 click | idsubmit waitForPageToLoad | 5000你不用理解每一行是什么意思只要知道录下来的操作会变成可编辑的指令清单就够了。以后想改账号、换网址直接在列表里改两个字比重新录一遍快得多。实战演示用 RPA 自动化抢下热门课程名额光说不练假把式我们拿抢课报名这个场景完整走一遍——每年选课季热门课程的名额三五分钟就被抢光手速再快也拼不过脚本。思路很简单把打开选课页 → 输入学号密码 → 找到目标课程 → 点报名 → 确认这套动作录成宏然后让它以最快的速度循环执行。在录制时你可能会遇到两个坎坎一登录弹窗或验证码。常规的 click / type 指令处理不了动态验证码这时候可以让脚本配合 OCR 识别去读取图片里的字符再交给输入指令填进去。坎二按钮位置会变。网页刷新后按钮可能挪了位置纯靠 CSS 选择器容易扑空。解决办法是改用视觉定位——先截一张目标区域的图告诉工具在这个范围内找这个按钮。参考上面的配置界面在指令里选 visionLimitSearchArea 这类视觉相关命令指定模板图和搜索范围脚本就不再依赖元素的固定坐标而是像人一样用眼睛找按钮。为了让抢课脚本更稳还可以在关键步骤之间加几秒等待并把整个流程放进一个 while 循环里反复尝试直到报名成功才退出。进阶玩法速览手写脚本、扩展模块与视觉参数微调录制只是入口真正玩得转 RPA 自动化还得靠这几样进阶能力每样一句话就能讲清楚手写脚本宏文件本质是文本你可以直接手写。判断用if循环用while中间穿插storeEval做变量运算逻辑和普通编程几乎一样。扩展模块XModule觉得内置能力不够可以装额外的模块来打通文件系统、桌面应用等外部资源。安装方式是改几个 JSON 配置文件里的扩展 ID再跑一下批处理脚本整个过程可视化照着提示点就行。视觉参数微调匹配不上的时候调整相似度阈值、缩小搜索区域、或者给同一个目标准备多张模板图命中率立刻不一样。![XModule 扩展模块安装在 JSON 配置文件中填入扩展 ID](https://raw.gitcode.com/gh_mirrors/rp/RPA/raw/06e44ecb5c1b72906789c2e1985ef7f3f611710e/xmodule install new ID in 4 json files.png?utm_sourcegitcode_repo_files)新手避坑清单四个常见错误和对应解法用浏览器自动化工具踩坑很正常下面这四个是最典型的提前知道能省不少时间等待时间设太短。页面还没加载完脚本就急着点按钮必然失败。对策关键操作前多留等待或者用 waitForPageToLoad 这类显式等待。死记硬套固定坐标。元素一动就失灵。对策优先用 id、name 这类稳定属性界面经常变的地方改用视觉定位。脚本越写越长、一错全崩。对策把大流程拆成多个小宏单独调试通过再拼起来出问题也好定位。忽略日志和截图。跑挂了不知道挂在哪。对策在关键步骤加截图和日志输出排查时一目了然。下一步行动文档、社区与你的第一个脚本看到这里你其实已经具备了开始动手的全部信息。接下来按这个顺序走打开浏览器装上 UI.Vision RPA 扩展录一个最简单的打开网页 点一下的宏先跑通一次。挑一个你每周都要重复做的任务填表、整理报表、比价监控都行当成第一个正式项目来做。遇到问题先翻官方文档再去社区论坛搜一搜基本都能找到答案发现 bug 也欢迎提 issue开源项目最需要的就是大家的反馈。免费的网页自动填表工具很多但把录制、视觉识别、OCR 和脚本能力捏在一起的免费浏览器自动化工具并不多见。UI.Vision RPA 的价值不在功能列表有多长而在于它把从 0 到 1的门槛压到了最低——哪怕你一行代码都不会今天下班前也能拥有一个替你干活的机器人。少熬夜多陪陪自己。常见问题问UI.Vision RPA 真的完全免费吗商用会不会收费答是真的免费。项目采用 AGPL-3.0 开源许可证个人和商业用途都不需要付费源码在仓库里随便看。问完全不会编程能上手吗答能。核心流程是录制 → 回放全程不需要写代码。脚本里的指令最多改改网址、账号这类参数等你熟悉了再慢慢接触 if、while 这些进阶写法。问它和 Selenium 是什么关系答UI.Vision RPA 兼容 Selenium IDE 的脚本格式之前用 Selenium 录过的东西可以直接导入继续用两者不是竞争关系而是互补——前者更偏日常自动化后者更偏专业测试框架。【免费下载链接】RPAUi.Vision Open-Source RPA Software with Computer Vision, OCR, Anthropic Computer Use/LLM. Selenium IDE import/export.项目地址: https://gitcode.com/gh_mirrors/rp/RPA创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考