黑客社区惊现“提示词木马”:不开源源码,利用 GPT 秒级生成恶意代码

近日,V2EX 社区网友转发了一则来自国外黑客论坛 0x00sec 的技术讨论,揭示了网络安全领域的一种新型攻击趋势——“提示词木马”。与传统恶意软件直接传播可执行文件或源代码不同,这种新型攻击利用大语言模型的代码生成能力,通过分享精心构造的提示词来诱导 AI 自动生成恶意代码。据发帖者描述,这些提示词被描述为“内核规格”,在 Linux 环境下测试时,仅需向 GPT-4 等模型输入这些指令,不到一分钟内即可生成具有破坏性的恶意程序。这种“不开源源码,只开源提示词”的模式,意味着攻击载体正在从静态代码向动态的自然语言指令转移。这不仅降低了制造病毒的技术门槛,更重要的是,由于 AI 生成的代码往往具有非确定性,传统的基于特征码匹配的杀毒软件可能面临失效风险。

事件分析

此次事件展示了 AI 安全领域的一个新范式:提示词即代码。攻击者利用大语言模型的逻辑推理和代码生成能力,将恶意的生成逻辑封装在自然语言提示词中,而不是传统的二进制文件中。这种手段极大地降低了编写恶意代码的门槛,同时提高了隐蔽性。传统的网络安全防御依赖于对已知恶意样本的哈希匹配或静态特征检测,而 AI 实时生成的代码往往具有多态性,能够轻易绕过常规查杀机制。这也暴露了当前大模型在输出端安全过滤机制的滞后性,未来针对 AI 模型的“提示词攻击”与防御将成为网络安全博弈的焦点,安全厂商需要建立针对诱导性输入的语义分析与行为检测体系。

核心观点:当恶意软件载体由源码变为提示词,AI正沦为黑客绕过静态检测的免费军火库。

原文链接:V2EX 分享发现

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册