首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >没有推理轨迹,如何“偷走”模型的推理能力?

没有推理轨迹,如何“偷走”模型的推理能力?

作者头像
七牛开发者
修改2026-08-18 15:08:34
修改2026-08-18 15:08:34
70
举报
概述
本文介绍Cornell Tech提出的“推理轨迹反演”(Trace Inversion)技术:攻击者仅凭黑盒模型输出的答案(及可选摘要),即可合成高质量推理链,用于蒸馏训练学生模型。实验证明,该方法在数学与科学任务上显著提升学生模型性能,甚至优于使用真实思维链的训练效果,揭示了隐藏思维链并非绝对防线。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档