AI导航

GitHub 上线 LLM 驱动模糊测试流水线:C/C++ 项目自动找漏洞

AI资讯
3 min read
0 次阅读

GitHub 安全实验室在 2026 年 9 月 24 日的官方博客中,公开了一条由大模型智能体驱动的模糊测试流水线 Fuzzing Taskflow。只要把 GitHub 仓库地址丢给它,智能体就会自己分析构建系统、编写测试 harness、运行 AFL++、读覆盖率报告、改进测试用例,最后逐个研判崩溃并输出漏洞报告,全程不需要人工盯着。

一条命令开测,智能体包办全流程

跑起来很简单:打开项目仓库启动一个 codespace,执行 ./scripts/fuzzing/run_fuzzing.sh tukaani-project/xz 即可,参数就是目标仓库的 owner/repo。之后智能体自动完成装 AFL、克隆仓库、找入口函数、写 fuzz target 等准备工作。

这条流水线建立在 GitHub 安全实验室的 Taskflow Agent 框架上:流水线被表达成一组 taskflow YAML(告诉智能体每一步做什么的提示词),真正干活的是 MCP 工具——跑 AFL、编译 harness、存 crash、读覆盖率报告。设计上刻意分开:智能体只做判断,工具只做执行,状态都存在 SQLite 数据库里。

覆盖率反馈循环是核心

模糊测试最吃人工的环节,是"看覆盖率报告找盲区、补测试用例"。这条流水线把这两步交给了智能体:每轮先跑一阵 AFL,再把输入队列拿到专门编译的覆盖率二进制上重放,得到真实的行覆盖、分支覆盖报告,然后智能体读未覆盖分支做决策——定制新种子、改 harness 多调一个 API、往字典里加魔法常量,或判定冷门路径直接跳过。

时间预算每轮翻倍,从 30 秒一路加到 960 秒;连续两轮行覆盖率增长都不到 1% 就停,换下一个目标,不烧算力去挤最后零点几个百分点。针对 JSON、XML 等结构化输入,流水线还自带格式字典、自定义变异器和随覆盖率动态增长的词典;每个 harness 的语料跨轮次保留,中断重跑不丢进度。

从"一堆 crash"到"漏洞报告"

找到 crash 只算完成一半。流水线收尾会自动精简每个 crash、在 ASan 下重放抓堆栈、按"栈顶哈希"去重,再把历史已知 crash 在新版本上重放一遍看修没修;然后智能体沿调用链回溯到公开 API,为每个独立 crash 写一份 markdown 报告:定级(真正的漏洞、harness 自身 bug、OOM、超时等)、根因分析(精确到文件行号)、可达性论证、利用评估、一份 diff 格式的修复建议和回归测试草图。官方提醒:建议补丁都标了"需人工复核",是准备充分的起点,不是最终判决。

警告:别在主力机上直接跑

流水线会在宿主机上直接运行 afl-fuzz、clang 和大模型自己选的任意构建命令,中间没有容器隔离。官方明确要求:只在一次性环境里跑(codespace 或用完即扔的虚拟机),不要给高权限。默认用 Claude Sonnet 5,可在配置文件里换模型。跑起来后还有实时 HTML 仪表盘(8765 端口),能看到覆盖率趋势和 crash 热力图。

谁最用得上

C/C++ 开源项目维护者是第一批受益者:没做过模糊测试的项目可以零起步搭起第一轮;已在 OSS-Fuzz 跑多年的项目,也可能靠它挖出覆盖率盲区里的新 bug。项目源码已开源。对国内开发者来说,"智能体做判断、MCP 工具做执行"的分层设计,本身也是写安全自动化智能体时值得参考的架构样本。

推荐工具

NVIDIA Chat with RTX AI聊天 Chat with RTX 是 NVIDIA 面向 RTX 电脑的本地 AI 聊天工具,可围绕本地文档和视频资料做问答,适合重视隐私、离线检索并具备硬件条件的用户更适合资料不便上传云 HuggingChat AI聊天 HuggingChat 是 Hugging Face 的开源模型聊天应用,支持 Omni 自动选模型,也可手动选社区开放模型对话。它适合体验开源模型、技术探索和问答,结果可能不稳定,重要内容需复核。 纳米AI搜索 AI搜索 纳米AI 是 360 旗下 AI 搜索和智能体入口,支持文字、语音、拍照提问、多模型协作与内容创作,适合中文用户做日常搜索、学习问答、移动查询、热点追踪、生活决策、知识整理和轻量创作。 Qwen Chat(通义千问) AI聊天 Qwen Chat 是Qwen 大模型聊天助手,支持Qwen 模型聊天、写作和编程问答,适合中文用户和开发者完成 AI 对话、资料问答和任务协作,适合上线前核对权限、成本和资料质量。 DuckDuckGo AI Chat AI聊天 DuckDuckGo AI Chat 适合重视隐私的普通用户使用,围绕隐私 AI 聊天、免账户使用和多模型问答提供对话式 AI 支持和任务协作能力,适合上线前核对权限、成本和资料质量。 Goody-2 AI聊天 Goody-2 是以极端安全和伦理对齐为特色的 AI 聊天助手,常用于观察模型拒答边界、内容安全策略、保守输出体验和 AI 风险讨论,更适合作为安全边界样本使用前应理解它偏实验性质,不适合。