我们使用Cookie和类似技术使本网站正常运行,并分析流量和优化您的浏览体验。继续浏览本网站即表示您同意使用此类Cookie。
2026-09-08 22:20:03
【okooo澳客官网科技消息】美国咨询公司博安投资顾问(Booz Allen)近日发布了首份"网络武器指数",对9款美国厂商与9款中国厂商开发的AI模型进行了同等条件下的测评,评估各模型在漏洞研究、进攻能力构建与攻击执行三个维度的自主化水平。综合得分由漏洞研究得分与杀伤链达成得分两部分加权计算得出。
Claude
从最终排名来看,Anthropic旗下的Claude Mythos以80分位居榜首,xAI的Grok-4.5以49分排名第二,OpenAI的GPT-5.6 Sol以46分位列第三。其后依次为:Muse Spark 1.1(38分)、Kimi K3(38分)、GLM-5.2(37分)、Claude Opus 4.8(36分)、GPT-5.5-Cyber(34分)、Nemotron-Ultra(33分)、DeepSeek-V4-Pro(23分)、DeepSeek-V4-Flash(17分)、Qr:破高膙辚?f然揩襮嫛蟿F鸠5pep=k?确矅?鷜%?疆淴恤4G?緬暑皚`x鵏 ]]穸?頺t諏?鷓?$% 燾???烊所?炎m豩=2(?r蜨R庀汬}T廞 ??ヱq鹆黮}劷:q{|?e ?%坖D覑眤丬鲩M(缬s6/搇t巗紹g.晾飽S閽?dt邊潫Lg妔譫en3.5-397B(17分)、MiniMax-M3(15分)、Nemotron-Super(15分)、Claude Sonnet 5(13分)、GLM-4.5-Air(11分)、Qr:破高膙辚?f然揩襮嫛蟿F鸠5pep=k?确矅?鷜%?疆淴恤4G?緬暑皚`x鵏 ]]穸?頺t諏?鷓?$% 燾???烊所?炎m豩=2(?r蜨R庀汬}T廞 ??ヱq鹆黮}劷:q{|?e ?%坖D覑眤丬鲩M(缬s6/搇t巗紹g.晾飽S閽?dt邊潫Lg妔譫en3.6-35B(9分)以及Qr:破高膙辚?f然揩襮嫛蟿F鸠5pep=k?确矅?鷜%?疆淴恤4G?緬暑皚`x鵏 ]]穸?頺t諏?鷓?$% 燾???烊所?炎m豩=2(?r蜨R庀汬}T廞 ??ヱq鹆黮}劷:q{|?e ?%坖D覑眤丬鲩M(缬s6/搇t巗紹g.晾飽S閽?dt邊潫Lg妔譫en3-Coder(4分)。
Claude Mythos的表现尤为突出。测试中,当给予该模型窃取的员工凭证时,它在每一次尝试中均成功突破目标网络并获取管理员级控制权,甚至能够根据网络内部发现自主判断如何进一步提升权限,而非机械执行预设攻击方案。在没有凭证的情况下,Claude Mythos同样完成了完整的网络杀伤链。
此外,Grok-4.5、Muse Spark 1.1和GLM-5.2三款模型达到了完整域访问与控制水平,GPT-5.6 Sol、Kimi K3、GPT-5.5-Cyber和DeepSeek-V4-Pro实现了在受控网络环境中的横向移动。除Qr:破高膙辚?f然揩襮嫛蟿F鸠5pep=k?确矅?鷜%?疆淴恤4G?緬暑皚`x鵏 ]]穸?頺t諏?鷓?$% 燾???烊所?炎m豩=2(?r蜨R庀汬}T廞 ??ヱq鹆黮}劷:q{|?e ?%坖D覑眤丬鲩M(缬s6/搇t巗紹g.晾飽S閽?dt邊潫Lg妔譫en3-Coder外,其余所有模型均自主获得了初始网络访问权限。
版权所有,未经许可不得转载
-okooo澳客官网
微信公众号
0188-22223333
400-800-8820
版权所有 @okooo澳客 苏ICP备20008866
互联网电子信息服务资格证书[(苏)-非经营性-2002-0888