训练轨迹 LLM-DailyDigest 2026-08-16 2026-08-16 约 100 字 预计阅读 1 分钟 训练轨迹 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 信用分配 1 CrEST:面向多轮多步 LLM 智能体的验证器约束信用分配 08-16 单例归因 1 单个预训练样本的影响:学会后又遗忘 08-20 数据归因 1 语言模型预训练中的任务无关数据影响度量 08-16 经验授权 1 BCIT:自主后训练中的条件化经验迁移 08-29 论文轨迹 1 将科学论文展开为多轮生成轨迹以持续预训练 08-27 黑箱训练 1 ClawGym II:面向 Agent Harness 的黑箱强化学习 08-18