Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.052 — 2026-08-25
NEWS 约 4 分钟

OpenAI要把Agent推向所有人

OpenAI把Codex改造成白领Agent,真正的竞争从聊天能力转向软件入口与权限边界。

IMAGE — TechCrunch · AI

你让 AI 整理一份项目报告,它不只需要会写,还得翻邮件、查 Slack、读取 Notion,最后把内容放进文档。问题也随之改变:它会不会把私人消息写进去?你又愿意把多少账户权限交给它?据 TechCrunch 报道,OpenAI 正试图用 ChatGPT Work,把程序员已经在用的 Agent 带给更多电脑办公者。

Agent 是一种能围绕目标规划步骤、调用应用,并根据结果继续行动的 AI。它不只回答问题,还会改变外部世界。现有信息全部来自 TechCrunch 一篇报道,产品名称、价格和发布时间等核心信息仍待 OpenAI 官方公告复核;文中的能力与安全说法也尚无独立测试支持。

从写代码,走向处理工作

TechCrunch 称,ChatGPT Work 于 2026 年 7 月推出,可在 OpenAI 每月 20 美元的最低价订阅档使用。它由编程工具 Codex 修改而来,目标用户不再只是工程师,也包括会计、投资、医疗等电脑密集型职业。

这一步的关键不是换一个聊天界面,而是重新包装模型周围的“harness”——也就是决定模型能看什么信息、能调用哪些工具、怎样把结果交还给用户的一层软件。程序员可以接受命令行、代码差异之类的界面,普通职员通常不行。报道提到,OpenAI 的非工程团队早期使用 Codex 时,甚至会看到“空的代码差异”这类与工作无关的提示。团队因此从今年 2 月起把产品改得更通用。

差距很明显。TechCrunch 援引一项 OpenAI 支持的研究称,今年 6 月,98% 的 OpenAI 员工使用 Codex;但组织订阅者中的使用率只有 17%,个人订阅者更不足 1%。这组数字不是独立验证的普及率,却解释了 OpenAI 面前的机会:Agent 在公司内部接近常用工具,在外部仍远未进入主流。

真正难的是把“钥匙”交出去

OpenAI 桌面应用首席工程师 Andrew Ambrosino 告诉 TechCrunch,他已经允许应用访问并控制邮箱、Slack、手机,以及 Notion、Figma 等软件。他也承认,系统可能在写文档时误用私人私信中的信息。这个个人案例不能证明普遍能力,反而点出了大众化最棘手的问题。

这里涉及“上下文边界”:Agent 完成任务时究竟能看到哪些邮件、私信和文件。某条信息对用户本人可见,不等于适合被复制进另一份文档。另一个风险是“提示注入”——攻击者把恶意指令藏进网页、邮件或文件,诱使 Agent 偏离用户原本的要求。当 AI 只有聊天能力时,结果可能是答错;当它能读写账户时,结果可能变成发错消息或公开错误文件。

因此,人工确认会成为产品设计的核心关口:发送消息、付款或公开文件前,让用户再次批准。OpenAI 高管向 TechCrunch 宣称产品可以自主完成“完整、复杂”的任务,并兼顾愉悦和安全,但这属于公司表述,不等于效果与安全已经得到验证。

下一轮竞争,是模型还是入口?

OpenAI 想把 Agent 能力从软件工程扩展到更多职业,也是在争夺日常工作的入口。报道提到,法律行业的 Harvey、销售行业的 Clay 采取“model-agnostic”路线——不绑定单一模型,而是接入当时更合适的 AI。换句话说,价值未必只留在模型公司,也可能落到更懂行业流程、掌握客户入口的应用手中。

TechCrunch 还推断,长时间运行的 Agent 会消耗更多 token——模型处理文字时使用的计量单位——因此可能提高 OpenAI 的单用户收入。不过报道没有给出用量、定价结构或收入数据,这仍只是商业推断。

局限与未知

  • 目前只有 TechCrunch 单一信源,ChatGPT Work 的发布信息、覆盖范围和价格仍需官方材料确认。
  • 外部采用率数据来自 OpenAI 支持的研究,报道没有提供更完整的方法与样本细节。
  • 产品能否可靠完成复杂任务,以及权限、上下文隔离和提示注入防护是否足够,现有材料没有独立测试结果。

供稿材料 SOURCES — 1

← 返回 2026-08-25 · 科技板块