安全研究人员探索出一种新的攻击手法,通过系统性的对抗提示技术,诱导大语言模型生成可利用的漏洞代码。这项被称为”bulling LLMs”的研究,展示了如何规模化利用主流AI模型的代码生成能力来发现安全缺陷。测试中多个LLM在特定提示下输出了存在安全风险的代码片段,揭示了AI模型在代码生成场景下面临的严峻安全挑战。该方法为AI安全测试提供了新的研究方向。🔗 原文链接:https://x.com/mqst_/status/2086444889009766746
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END







