首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于
智能AI morning

语言模型中量化触发的后门:跨量化器可转移性和验证-部署差距

摘要

arXiv:2608.27512v1 Announce Type: new Abstract: Post-training quantization is often treated as a semantically neutral optimization for edge deployment of Large Language Models. When a full-precision s...

quantization that and precision source for this does not behavioral
2026-08-31 1 阅读 约1分钟阅读 Jacopo Dardini, Claudio Stanzione, Giordano Col\`o, Giuseppe Fenza
分享:
字号:
arXiv:2608.27512v1 公告类型:新 摘要:训练后量化通常被视为大型语言模型边缘部署的语义中性优化。当评估全精度源检查点并在下游应用量化而无需进行等效重新评估时,此工作流程会产生结构验证部署差距:因为量化是参数空间上的多对一映射,所以源精度认证不能保证已部署配置中的行为等效性。我们通过量化行为等价类(QBEC)形式化了这一差距,并证明 QBEC 成员资格并不意味着行为等价,为量化触发的后门攻击提供了理论基础。在三阶段对抗性微调框架的基础上,我们将潜在的恶意有效负载嵌入到满足评估中使用的源精度检查的模型中,同时在 INT8 或 4 位压缩时激活有针对性的对抗行为。我们在两种操作动机场景(战术机器翻译和政治内容分析)中评估这种威胁,将之前的工作从仅解码器的因果 LM 扩展到多语言编码器-解码器序列到序列模型。结果表明,后门翻译模型在修复 FP16 时从零测量的敌友腐败转变为量化后高达 85.02% 的反转,并且配对立场分类器测量压缩后高达 $\Delta\mathrm{Bias}=0.33$ 的意识形态转变。跨量化器可转移性分析进一步表明,攻击持久性因量化方案和模型架构而异​​,而不是仅由标称位宽决定。这些发现表明,仅源精度审核并不能排除量化触发的行为,并且最终部署的配置必须包含在值得信赖的边缘人工智能的行为认证中。
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱