多目标优化 LLM-DailyDigest 2026-08-30 2026-08-30 约 100 字 预计阅读 1 分钟 多目标优化 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 奖励优化 1 SA-MRPO:面向多奖励策略优化的饱和感知优势重加权 08-19 开放式搜索 1 Large Discovery Models:基于实证的开放式科学搜索 08-19 无教师蒸馏 1 Self-OPD:无需教师的流匹配模型在策蒸馏 08-29 鲁棒性测试 1 TESTNAV:Pareto 引导的组合鲁棒性测试 08-22