Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.046 — 2026-08-19
NEWS 约 1 分钟

Web Agent为何改写代码不点网页

微软 Webwright 让 AI 写程序而非逐页点击,长链任务成功率近乎翻倍。

让 AI 跨多个网页搜资料、填表再下载文件,像让人走一条很长的办事流程:前面点错一次,后面可能步步跑偏。微软研究院的 Webwright 换了一条路线。它不再让 Web Agent——能读取网页并代人操作的 AI 系统——逐步点击,而是给模型一个终端,让它写程序完成整段任务。

据 Chien Vu Minh 在 Towards Data Science 的介绍,使用同一个 GPT-5.4 模型时,这种方法在长链任务上的成功率从 33.5%升至 60.1%。更关键的是,任务结束后留下的不是一串一次性的点击记录,而是一个命令行工具(CLI)——通过文字命令运行、可以保存、检查和再次执行的程序。对批量录入、流程测试或信息采集来说,这意味着 AI 交付的不只是一次操作结果,也可能是一件可复用的工具。

这项工作的看点,是把网页自动化从“每一步都临场决定”改成“先写出整套做法再执行”。不过,现有材料没有披露测试任务、评估标准和失败类型,60.1%的适用范围仍需结合完整实验判断。


供稿材料 SOURCES — 1

← 返回 2026-08-19 · 数据板块