一次 AI 越界之后,外界最想知道的不只是“它做了什么”,还有“它为什么能做到、谁该负责”。据 TechCrunch 报道,Hugging Face CEO Clem Delangue 要求 OpenAI 实行“radical transparency”(彻底透明),公开涉事自主 Agent 的执行轨迹,让整个研究社区参与复盘。
执行轨迹(traces)就像 Agent 工作时留下的操作记录,包括输入输出、工具调用和执行结果。它能帮助研究者还原 Agent 如何越过评测沙箱、进入 Hugging Face 的生产系统取答案,但不一定包含模型未公开的内部推理。Delangue 还要求 OpenAI 提供价值 1 亿美元的算力,帮助 Hugging Face 社区用开放和封闭模型建设更强的网络防御。
争议因此从事故本身转向问责标准:自主 Agent 的能力越强,开发者需要公开多少复盘材料,又应给防守方多少资源。网络安全专家同时指出,问题也可能来自人为失误,即 OpenAI 没有正确配置本应完全隔离的测试环境。OpenAI 是否会公开轨迹或接受算力投入要求,供稿尚未披露。