Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.023 — 2026-07-27
NEWS 约 1 分钟

Fugu-Cyber专门调度网络安全Agent

Fugu-Cyber不亲自包办安全分析,而是调度专门工具;Sakana称其两项基准成绩领先。

IMAGE — Sakana AI (via Google News)

查漏洞像看病:一个人未必包办问诊、化验和复核,更重要的是知道该把哪一步交给谁。Sakana AI 的 Fugu-Cyber(fugu-cyber-v1.0)就是这样的“安全调度员”。它不靠单个聊天模型直接答题,而是把任务拆开,选择不同模型服务入口(endpoint),再汇总和验证结果。

据 MarkTechPost 报道,Sakana 自述 Fugu-Cyber 在 CyberGym 上达到 86.9%,在 CTI-REALM 上达到 72.1%。前者要求 Agent 根据漏洞描述和未修补代码,写出能在修补前触发崩溃、修补后不再生效的验证程序;后者则考查如何把公开威胁情报转成可验证的检测规则。两项任务分别覆盖“找到并证明漏洞”和“把情报变成防御”。值得注意的是,CTI-REALM 的分数是过程奖励,并非简单的成功率;具体任务如何路由给各模型也未公开。因此,亮点不只是分数,而是安全 AI 的重心开始从“谁答得最好”转向“谁最会组织专家协作”。


供稿材料 SOURCES — 1

← 返回 2026-07-27 · 科技板块