后门攻击深度实战:从触发器植入、BadNets 到干净标签后门与谱防御的工程全解
后门攻击(Neural Backdoor Attack,亦常称 Trojan Attack)是机器学习安全中一类与数据投毒高度相关却目标迥异的攻击:攻击者在模型**训练阶段**(或预训练权重、第三方供应链环节)植入一个隐藏的「触发器(trigger)」映射,使得模型在面对正常输入时保持高精度,而一旦输入携带特定触发器,模型便按攻击者预设的目标标签输出。它不追求在干净样本上降低整体准确率,而是追求「…
