DCAI
DC AI 热点

精选

当前热点完整榜单 →
1马斯克披露AI算力布局:Colossus集群拟部署超百万张英伟达GB300芯片85 热度 ⌁2试图入侵政府与高校网站:OpenAI 智能体4次“失控”行为细节曝光82 热度 ⌁3针对长上下文编程优化,Claude Opus 5.5 正式发布77 热度 ⌁4OpenAI升级ChatGPT语音功能,支持通过语音指令执行复杂工作任务77 热度 ⌁5甲骨文为旗舰AI数据中心发不可抗力通知引市场延期担忧77 热度 ⌁
9月25日2026-09-25
arXiv 机器学习✦ 精选AI 评分 78/10012:00

混合推理模型中的“思考泄漏”:NoThink后训练机制因果审计

针对混合推理模型在无显式思考(NoThink)模式下的后训练机制,本研究探讨了其性能提升是否源于基座模型“思考(Think)”模式能力的潜在迁移。作者将这种“思考泄漏”纳入因果中介分析框架,并基于激活方向的双向干预进行审计。在3个模型、3种后训练方法及竞赛数学基准上的实验表明,“思考泄漏”在行为和表征层面均真实存在、具备因果性且影响显著,揭示了快推理模式下的内在表征机制。

阅读原文 ↗推荐理由:该研究通过因果干预实验深入揭示了混合推理模型在快速推理模式下性能提升的本质来源。# 推理# 因果分析# 可解释性# 模型后训练# 推理机制