样本调度 LLM-DailyDigest 2026-08-19 2026-08-19 约 100 字 预计阅读 1 分钟 样本调度 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 任务采样 1 Task-CoEvolve:自适应验证任务驱动的高效 Harness 优化 08-21 动态调度 1 D³-MOPD:面向多教师蒸馏的自适应领域调度 08-28 地理课程 1 基于地理隔离的可扩展遥感自监督学习 08-22 强化学习后训练 1 OraRL:将标注作为视频 MLLM 的神谕轨迹 08-27 离策略强化学习 1 WarpSAC:面向不同数据规模的可扩展离策略强化学习 08-28 联邦样本选择 1 低标注预算下的联邦主动学习协调 08-20 脚手架演化 1 StarHarness:以分层搜索演化企业智能体脚手架 08-26 课程学习 1 PAC:面向大模型多任务强化学习的进度增强优势课程 09-01 过滤式微调 1 TailSFT:过滤式微调提升强化学习后训练性能 08-27 间隔重复调度 1 SRT:面向语言模型持续预训练的间隔复习 08-19 难度增强 1 DASA:面向语义分割的难度感知自适应数据增强 08-27