问题
安全团队日常的漏洞管理流程以“找到修复该漏洞的 commit”为基础,但 arXiv 论文指出主要漏洞公告库中 60% 到 63% 的 CVE 缺少补丁链接,安全工程师只能人工在仓库和公告间来回比对。同一批信号显示,模型自主利用漏洞的能力已就绪(如 GLM-5.3 可在约 8 小时内自主搭建绕过防护的攻击链,且“防滥用限制容易被绕过”),防御方在补丁检索上的速度劣势被放大。
目标用户
企业软件与浏览器厂商的安全团队、安全研究员与漏洞管理(VM)团队,以及为这类团队提供情报服务的乙方。市场为专业细分:人员规模不大但客单价潜力高;信号中未提供市场规模数据。
解决方案
基于信号中验证过的技术路线构建:
- 两阶段补丁检索:混合第一阶段检索器粗筛候选 commit,agentic 第二阶段做 listwise 精排,复现论文方案。
- 本地运行:在用户的本地 Git 仓库上执行,使用冻结的开源权重模型(如 Qwen、gpt-oss),无需微调或外部搜索 API。
- CVE 工作流入口:输入 CVE 编号或导入公告库,自动对齐到仓库分支与 commit。
- 结果可解释输出:给出候选 commit 的 diff 摘要与置信度,供安全工程师复核。
AI 的角色是理解漏洞描述与代码变更的语义匹配,并在 agentic 循环中自主筛选候选,替代人工翻找。
为什么是现在
GLM-5.3 等开源模型已具备自主端到端漏洞利用能力,且“防滥用限制容易被绕过”,攻防时间差在拉大,防御方的检索效率成为瓶颈;同时补丁检索所需的模型能力刚好成熟——论文证明在冻结开源模型上无需微调即可完成两阶段 agentic 检索,小团队首次具备低成本构建此类工具的条件。
MVP 范围
第一版只做一件事:输入一个 CVE 编号,在给定的本地 Git 仓库中定位对应的修复 commit,输出候选补丁链接及置信度。不做漏洞自主挖掘、不做攻击链构建、不做自动修补代码的合入。支持用户自带仓库和自带模型(Qwen、gpt-oss 等开源权重模型),全程本地运行。
风险
技术风险:补丁检索在缺乏明确修复 commit 的 CVE 上准确率可能不可控,检索错误会直接误导修复决策。合规风险:漏洞相关数据集与工具属双用途技术,产品边界(只做防御性补丁检索、不生成漏洞利用代码)必须在产品层面严格约束,否则有滥用与法律风险。平台依赖风险:能力建立在冻结开源模型之上,若厂商模型(如 Gemini 4 Argon)免费向受信任防御方开放补丁相关能力,独立产品的价值空间会被压缩。证据风险:本卡主要由模型能力发布与一篇论文支撑,缺少真实用户痛点的一手讨论。
已有产品
| 产品 | 定位 | 价格 |
|---|---|---|
| Favia | 论文中提出的两阶段补丁检索系统(混合检索器 + agentic listwise 检查),直接对应本机会,但只是研究原型。 | — |
| Gemini 4 Argon | 无网络护栏、面向受信任防御方的自主漏洞发现/验证/修补模型,能力覆盖面更广,是最大威胁。 | — |
信号证据
这张卡片依据的原始讨论。摘录保持原文,点“原文”查看上下文。
量子位10月1日新能力
“它能够自主发现、验证并修补20多种语言的关键软件漏洞,在Wiz内部黑箱渗透测试中,模型可以在无源代码下实时分析网络系统,高效发现攻击面、识别漏洞以及生成概念验证证据。”
Argon可自主发现、验证并修补20多种语言的关键软件漏洞,并在Wiz内部黑箱渗透测试中实时分析网络系统。原文
arXiv cs.IR10月1日新能力
“Patch retrieval, the task of finding the commit that fixes a known vulnerability, is the foundation of vulnerability management workflows, yet 60% to 63% of CVEs in the major advisory databases lack a patch link.”
60% to 63% of CVEs in the major advisory databases lack a patch link, and patch retrieval is the foundation of vulnerability management workflows.原文
Google DeepMind Blog9月30日新能力
“Argon can autonomously find, validate, and patch critical software vulnerabilities.”
Cyber defenders struggle to find, validate, and patch critical software vulnerabilities at scale.原文
量子位9月30日新能力隐含付费意愿
“给它一个刚公开的Chrome漏洞(CVE-2026-11645)和另一个已知漏洞的公开资料,人工只花了约20分钟,模型自己跑了约8小时,就在ARM64平台上搭出一条稳定的攻击链”
小参数开源模型可在约8小时内低成本自主搭建绕过防护的攻击链原文
量子位9月30日新能力隐含付费意愿
“GLM-5.3这个模型啊,它已经很会找软件漏洞、编写攻击程序,而且防滥用限制容易被绕过。”
开源模型 GLM-5.3 已具备自主完成复杂端到端漏洞利用的网络安全能力原文