【GLM-5挖洞实测】只花5块钱获得某运维审计系统12个漏洞

admin 2026-02-17 19:55:46 网络安全文章 来源:ZONE.CI 全球网 0 阅读模式

文章总结: 文章实测开源大模型GLM-5在某运维审计系统代码审计中的表现,花费约5元即发现13个潜在漏洞。对比测试显示,在同等条件下GLM-5的挖掘质量与数量均优于GPT-5.2。作者指出AI审计效果受模型能力、工具及提示词综合影响,GLM-5展现出较强潜力,但在生成最终报告时存在稳定性问题,为安全人员提供了模型选型参考。 综合评分: 65 文章分类: 代码审计,AI安全,实战经验


cover_image

【GLM-5挖洞实测】只花5块钱获得某运维审计系统12个漏洞

安全透视镜 安全透视镜

网络安全透视镜

2026年2月12日 17:40 江苏

上周OpenRouter上火了一个叫pony的开源大模型,当大家都在猜测是哪家国产模型时候。股市先有了反应,真是春江水暖鸭先知。

官方描述:面向 Agentic Engineering 打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力。在 Coding 与 Agent 能力上,GLM-5 取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5

在 SWE-bench-Verified 和 Terminal Bench 2.0 中分别获得 77.8 和 56.2 的开源模型最高分数,性能表现超过 Gemini 3.0 Pro。

GLM-5 在前端、后端、长程任务等编程开发任务上显著超越 GLM-4.7,能够以极少的人工干预自主完成 Agentic 长程规划与执行、后端重构和深度调试等系统工程任务,使用体验逼近 Opus 4.5

今天体验一下这个逼近Claude Opus 4.5的模型在代码审计能力上能力如何

测试代码

某信运维安全审计系统,项目文件大小360M左右

原本打算继续用VScode + cline+ GLM-5的,可是接口速率有限制,一直报错

只能选择trae

速率限制这一点,trae会好一些,虽然也有报错但并发没那么大,还能运行。

由于代码量本身并不是很大,审计速度还是很快的。累计13个中危以上漏洞共计9个

最终还是卡死在生成最终报告上面

再看看此时消费,大概5元。

没有claude 4.5,但我有trae会员,可以使用gpt-5.2。gpt-5.2分析的还是很快的。

在同样的工具,同样的源码,同样的提示词的情况下。无论是质量,还是数量gpt-5.2的结果显然不如GLM-5

代码审计拥有较强的AI模型只是基础,还与工具,提示词等有关系。看看另一位大佬,同样的源码,不同工具和提示词,使用GLM-4.7也能获得不少漏洞



免责声明:

本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。

任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。

本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我

本文转载自:网络安全透视镜 安全透视镜 安全透视镜《【GLM-5挖洞实测】只花5块钱获得某运维审计系统12个漏洞》

评论:0   参与:  0