一家新 AI 到底有多会黑客攻击,不能只靠传闻判断。年初,美国公司 Anthropic 向少数企业开放模型 Mythos 后,外界很快担忧其网络安全威胁;据《Nature》报道,直到英国政府支持的 AI Security Institute(AISI)完成评测,模型能力才有了更清晰的依据。模型评测就像给 AI 做体检:用一组测试观察它的能力与风险,但结论也受测试范围限制。
这件事折射出英国正在形成的定位:不与美国、中国比拼更大模型,而是集中研究如何测试和约束前沿模型。伦敦尤其是 King’s Cross,已聚集 Anthropic、OpenAI 的重要办公室,附近还有 University College London、Alan Turing Institute 和 University of Oxford 等研究机构。AISI 则评测企业自愿提交的前沿模型。人才、企业、政府与评测能力由此连成一套“研究与治理生态”,让英国有机会把本地测试方法变成国际合作中的事实标准。
不过,AISI 并不是监管机构。部分研究者也担心,当前讨论过度聚焦模型失控与攻击风险,反而淡化透明度及大规模应用的社会影响。英国能否成为 AI 安全重镇,不只看机构数量,也要看这套生态最终把“安全”定义得多宽。