← 返回资讯
大模型 HuggingFace Daily Papers

语法约束解码可被利用越狱 LLM 生成恶意代码

用于保证代码语法正确性的语法约束解码技术存在攻击面,由此产生名为 CodeSpear 的越狱攻击方法和名为 CodeShield 的安全对齐方案。

查看原文
解读生成中或暂时不可用,请稍后刷新重试,或直接查看原文。