ReCAST: Restoration-aware Cascaded Stage-wise Training for Obfuscated SMS Risk Classification
ReCAST 框架通过监督去混淆跨度检测、去混淆类型预测及文本恢复,将大模型的去混淆能力蒸馏至小型学生模型,并用于下游风险分类。实验在内部构建的真实世界中文短信基准上显示,该方法相比直接训练基线显著提升了抗干扰分类性能。研究结果表明,这种感知恢复的蒸馏方法为生产环境下部署的小型化、鲁棒性短信风险分类提供了可行路径。