任务生成 LLM-DailyDigest 2026-08-07 2026-08-07 约 100 字 预计阅读 1 分钟 任务生成 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 任务生成 2 FACET:保留源意图与可执行状态的终端任务合成框架 08-20 从 CNF 实例生成多样化可满足性逻辑推理问题 12-31 协同演化 2 J-Zero:零数据下挑战者、求解器与评判者统一协同进化 09-01 清华 CPMöbius:Coach-Player 协作共演化实现自主出题训练 08-12 合成数据训练 1 Synthetic Data RL:仅凭任务定义生成数据并强化学习 12-31 奖励机制 1 RLSVR:面向开放式任务的自验证奖励框架 08-11 工作流进化 1 具备自进化能力的智能体工作流系统 12-31 工具使用训练 1 MCP·RL:用强化学习训练智能体自主发现并调用工具 12-31 工程进化 1 腾讯混元两项工作:Harness Handbook 与 RST 递归任务合成 08-20 技能演化 1 Socratic-SWE:基于轨迹技能的自进化编程智能体 08-14 技能自博弈 1 阿里 Skill-SP:以自进化技能库实现高质量自博弈 08-12 技能迁移 1 拆解再传递:LLM 智能体的跨任务技能迁移 08-21 提示合成 2 PromptCoT 2.0:面向大语言模型推理的可扩展提示合成 12-31 PromptCoT 2.0:以 EM 循环合成高难度推理任务 12-31 数据合成 2 什么是优质智能体数据?基于 ACE 视角的数据生成框架 08-28 SWE-Flow:以测试驱动方式合成软件工程数据 12-31 数据自演化 1 BigBang-V1:35B 模型用自演化合成数据挑战万亿参数模型 08-07 游戏生成 1 ViGaL:以游戏化合成任务培养通用多模态推理能力 12-31 环境自博弈 1 SPADE:自适应可执行环境中的自博弈 08-20 科研智能体 1 PaperGym:以评分准则驱动科研计划生成与训练 09-01 科研项目 1 ScienceClaw AutoProject推动AI4S从Task走向Project 08-25 自我提问 1 SQLM:无需外部数据的自我提问模型框架 12-31 自进化 1 DiagEvo:基于层次化错误记忆的诊断引导自进化 09-03 课程生成 1 Ornith-1.5自生成任务闭环提升编码智能体 08-27 题目生成 1 Ornith-1.5 自出题强化学习闭环,两月自测提升 11% 08-28