你让 AI 帮你改一段代码,和让它读完整个代码库、修改文件、运行测试,再把结果交给你审核,是两回事。前者是助手,后者更像接手了一段工作。OpenAI 的企业研究想说明,ChatGPT 和 Codex 正在推动后一种变化。
从回答问题到交付结果
OpenAI 将这种模式称为 Agentic AI——AI 围绕目标规划步骤、调用企业系统并连续执行。传统辅助模式下,人要逐步提问、判断和操作;执行模式则把边界明确的任务交给 AI,完成后再由人审核。
Codex 是 OpenAI 的编程 Agent,可读取代码库、修改文件并运行测试。它因此成为观察 AI 如何进入真实软件研发流程的一个窗口。ChatGPT 则更多对应员工日常工作。
据 OpenAI 介绍,这项研究使用经过隐私保护和聚合处理的产品使用信号,观察 AI 在不同企业和任务中的扩散。OpenAI 称,采用更深入的“frontier firms”(可理解为 AI 应用走在前面的企业)会衡量使用深度、建立生产治理、培训员工,并把成功场景从聊天辅助扩展到可委派给 Agent 的工作。
差距不只在有没有用
OpenAI 此前报告称,处于第 95 百分位的企业,每席位消息量约为中位企业的两倍;自定义 GPT 的消息量约为七倍。这组数字提示,企业之间的差别可能已经从“是否使用 AI”,转向“能否把它嵌进流程”。
这也让企业治理变得更实际:AI 能访问哪些数据、采取哪些动作、由谁批准、出错后如何追责,都不再只是合规附件,而是系统能否上线的条件。
局限与未知
- OpenAI 未披露样本规模、调查方法、发布日期、采用率、效果指标或具体案例。
- 全部论断来自 OpenAI;它同时是研究发布者和产品供应商,存在利益相关。
- “从辅助走向执行”和“领先企业拉开差距”仍是趋势判断,不能据此认定 AI 已能自主、可靠地完成企业任务。