AI网络武器能力评估:中美哪家大模型遥遥领先?
博思艾伦(Booz Allen)近期测试显示,目前仅 Anthropic 的 Claude Mythos 一个模型能完全自主打通网络杀伤链。在《网络武器指数》报告中,该模型以 80 分位居 18 个参测模型榜首,是唯一能在无凭据情况下独立完成端到端入侵并获取域级控制的模型。测试涵盖漏洞研究得分与杀伤链完成度,其中 Mythos 能自主判断提升权限而非执行预设方案;其余 17 个中美模型虽在基准测试中表现优异,但在真实世界漏洞利用方面得分普遍为零或较低。报告指出,尽管现实攻击能力尚弱于测试表现,但具备完整攻击能力的“模型 +Harness"组合已存在,且中国及开放权重模型网络攻击潜力不容忽视。