刀能救人也能杀人

CN
1 小時前

刀能救人也能杀人

AI 赋能好人,同样赋能恶人

当朝鲜黑客组织 Lazarus 将 AI 系统性嵌入攻击链,AI 自动扫描零日漏洞、批量生成漏洞利用;当暗网 WormGPT 明码标价,月付 60 美元就能批量生成钓鱼邮件与恶意脚本。

我们不得不承认,坏人已经把 AI 变成了低成本、大规模的杀伤性武器。

面对武装到牙齿的 AI 攻击,唯一的办法是以魔法打败魔法。

1/ 一个好消息

全球网络安全联盟(GCSA)刚刚宣布,其 GCSA Agent 在 CyberGym 基准测试中取得了 91.3% 的成功率。

对比之前的 CyberGym 排行榜:

第一名: GPT-5.5-Cyber + OpenAI Agent —— 85.6%

第六名: Grok 4.6 + Grok Build —— 79.7%

第七名: Grok 4.5 + Grok Build —— 79.0%

GCSA Agent 基于 Grok 4.5 和 4.6。同样的底层模型,却多拿了 12 个百分点,不仅超过了 Grok 原厂方案,还击败了 OpenAI 专门微调的 GPT-5.5-Cyber。

这说明在安全任务中,智能体框架的设计和底层模型同样重要,甚至更重要。

2/ GCSA Agent 做对了什么?

GCSA 并没有简单地把漏洞描述丢给大模型,而是构建了一个自主闭环的漏洞挖掘流程:

从数千文件、百万行代码中检索相关代码

识别攻击面

提出漏洞假设

生成测试输入(PoC 候选)

在真实环境中执行

分析崩溃或执行反馈

根据反馈迭代优化 PoC

验证:补丁前能触发,补丁后不触发

它的突破不在模型(用的还是 Grok),而在框架:如何检索代码、提出假设、解析崩溃日志、控制迭代节奏,以及何时果断放弃当前思路。

模型是引擎,框架是驾驶系统。

GCSA 没有造一台更强的引擎,但造了一套更好的驾驶系统。

3/ 然后呢?

成绩只是起点,真实世界的安全工作远不止于此。GCSA 真正想做的,是让 AI 智能体参与完整的安全生命周期:

在没人告诉它哪里有漏洞的情况下,自主发现漏洞

不只是生成 PoC,还能分析影响范围

不只是报告问题,还能建议甚至生成修复方案

不只是单点作战,还能持续监控代码变更带来的新风险

当攻击者已经用 AI 把犯罪成本降到接近零的时候,防御端唯一可行的出路,就是让 AI 替你 24 小时不间断地巡逻。


免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。

分享至:
APP下載

X

Telegram

Facebook

Reddit

複製鏈接