美国商务部测评 Kimi K3 网络攻击能力,结果存争议
By: x.com|2026/07/24 11:38:06
0
分享
美国商务部旗下 AI 标准与创新中心与英国 AI 安全研究所对 Kimi K3 的网络攻击能力进行测试,结果显示美国仍然领先。然而,测试因范围限制而存在争议。Kimi K3 仅参与部分测试,其整体网络能力估算主要基于 41 项漏洞利用基准,而其他模型接受了更全面的测试,导致 Kimi K3 的结果存在更大误差范围。在漏洞利用测试中,Kimi K3 得分约 32%,高于 GLM-5.2 的 24%,但低于美国领先模型约 76% 的平均水平。在模拟攻击链测试中,Kimi K3 平均完成 32 步攻击链中的 17 步,并在 10 次尝试中成功攻破网络 1 次,而美国前沿模型平均完成 28.5 步。报告指出,Kimi K3 已具备一定自主攻击能力,其安全护栏未能阻止模型开发漏洞或执行攻击,但测试范围有限。
-- 价格
--
--
--
本内容仅供参考,不构成任何金融、投资、法律或税务建议。文中提及的任何活动、奖励、线上活动或相关信息,不应被视为对购买、出售或交易任何加密资产的推荐、招揽或邀请。加密资产具有高波动性,存在价值损失风险。WEEX服务、产品及相关活动的可用性可能因地区而异。用户在参与前有责任确保符合当地适用法律法规。
猜你喜欢

Hermes Bot Mode 正式内置,支持 AI 群组协作

人工智能竞赛:美国要求选择阵营 - 法国Mistral转向中国

GPT-5.6,工作成本降低三分之一
OpenAI与Anthropic最新AI模型之间的成本竞争正从按令牌价格转向按每项工作的总成本进行比较。中国AI模型在公开价格表中...

ZCode 免费送 1 亿 GLM-5.3 Token 活动上线一小时暂停

web3: Z.ai发布GLM-5.3 编程模型瞄准开源权重市场

比特币红队在Kimi K3扫描后发现7,958个问题

智谱唐杰预告 GLM-5.3 上线在即

GPT-5.6 解决方案,成本比 K3 低 13%
中国人工智能(AI)模型在实际工作成本比较中低于美国模型的观念受到挑战。虽然中国模型的令牌单价较低,但在生成回答时使用的令牌数量和质量也需考虑。

Writer发布新模型Palmyra X6主打降本

Mistral 开始托管智谱 GLM-5.2 模型

克劳德代码在28个模型比较中超越17个代码伙伴
在腾讯发布的AI编码代理基准测试中,安斯罗皮克的克劳德代码在28个模型比较中超越了17个代码伙伴。

智谱ZCode升级,Goal+子Agent功能上线

智谱用户接近700万,启用超5万块国产AI芯片

GLM-5.2暴跌95%,威胁DeepSeek的价格战
Zhipu将其GLM-5.2模型的价格降低了95%,使其比DeepSeek V4 Flash更便宜,并引发了与代理平台的价格战。第三方如OpenRouter和StreamLake现在以每百万个代币0.07美元的入场价和0.22美元的出场价提供代币,而官方价格为1.4美元和4.4美元。此消息在社交媒体上迅速传播,并引发了紧急警报,以利用这些折扣。

比特币的人工智能安全冲刺在55小时内发现6700个问题,但没人知道其中有多少是真实的
比特币红队在55小时内生成了6700个发现,展示了人工智能如何迅速向安全团队涌现出需要验证和修复的问题。

Pally 完成 520 万美元融资,Cyber Fund 和 Y Combinator 领投

AMD推出企业级AI编程平台AMD Instinct Coder













