模型蒸馏 LLM-DailyDigest 2026-08-14 2026-08-14 约 100 字 预计阅读 1 分钟 模型蒸馏 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 两阶段蒸馏 1 GEAR:表格基础模型的生成扩增与真实锚定两阶段蒸馏 08-20 交互式评测 1 OmniAssistBench:全模态助手交互评测基准 08-24 人群仿真 1 聚合移动统计蒸馏为大型活动后人群仿真策略 08-22 动态调度 1 D³-MOPD:面向多教师蒸馏的自适应领域调度 08-28 排序蒸馏 1 TUP:基于排名分类的 Best-of-N 蒸馏 08-21 无教师蒸馏 1 Self-OPD:无需教师的流匹配模型在策蒸馏 08-29 本地智能体 1 Meta 开源本地多模态智能体模型 Muse Glimmer 30B 08-25 泛化机制 1 同策略蒸馏泛化的双重效应:行为迁移与能力跷跷板 08-18 特质迁移 1 扩大量化生成蒸馏数据使教师潜在特质更易显现 08-29 策略发现 1 ATLAS:从智能体轨迹中发现可解释策略 08-17 策略蒸馏 1 SimpleOPD:分词器无关的长上下文同策略蒸馏 08-17 能力迁移 1 AI4AI 测试时强弱模型能力迁移:用 Harness 提升小模型表现 08-14 自我改进 1 在策略蒸馏真的在蒸馏吗?从噪声教师到自我改进 09-01 选择性蒸馏 1 CROP:基于反事实任务相关性的选择性在线策略蒸馏 08-16