微软发布了声称超越竞争平台的人工智能安全工具
Ars Technica2026年7月27日 21:56
微软表示,MDASH和MAI-Cyber-1-Flash在CyberGYM这一标准基准测试中获得了96%的评分。该评级比Anthropic的Mythos高出12分,还超越了谷歌的Gemini和OpenAI GPT。新的MDASH的使用成本仅为之前MDASH产品的一半。微软周一宣布的第二个工具名为Project Perception。这也是一组专门化的人工智能代理,执行红队、蓝队和绿队的功能,分别用于发现漏洞、调查漏洞以确定其风险,并采取相应的纠正措施。微软表示,该平台会根据分配的任务选择使用的模型。决策时考虑的因素包括模型的有效性和对客户的最终成本。微软表示,这些决策受到“持续的研究、基准测试以及对前沿和专门模型的评估”的影响。微软称Project Perception旨在以低于竞争对手类似平台的成本完成90%的任务。这意味着客户只需在剩余的10%任务中转向更昂贵的替代方案。微软表示,这些新工具回应了组织在保护其网络免受毁灭性黑客攻击时所面临的重大变革。公司指出:“随着人工智能加速网络攻击的速度和规模,防御者被要求在为不同年代构建的方法下保护日益复杂的数字环境。” “安全团队往往不得不拼凑大量数据中的信号、背景和风险见解,使他们难以跟上新出现的威胁。” 上周的OpenAI事件引发了类似于最反乌托邦科幻小说中的令人不安的场景,这些工具目前处于预览模式,因此需要谨慎使用,而微软对此没有提及。在用于生产前,这些工具应受到严格审查和评估。另一方面,不采用这样的工具也存在明显的风险。平衡使用人工智能代理的风险与避免使用的威胁仍在进行中,目前没有明确的答案。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡