自我改进 LLM-DailyDigest 2026-08-20 2026-08-20 约 100 字 预计阅读 1 分钟 自我改进 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 产业知识图谱 1 RSI产业图谱:围绕智能进化速度的新竞赛 08-28 任务采样 1 Task-CoEvolve:自适应验证任务驱动的高效 Harness 优化 08-21 反馈协同演化 1 CAFE:搜索智能体与反馈批评器协同进化 08-26 在线演化 1 Continual Harness:智能体脚手架的在线持续进化 08-25 在线自我改进 1 PILOT:长时域智能体的实时闭环自我改进 08-29 基础设施评测 1 Φ-Bench:大模型基础设施工程能力评测 08-24 容量配置 1 自我精炼流水线中的非对称模型容量分配 08-24 技能演化 1 SkillEvo:以多轮交互反馈持续演化智能体技能 08-16 提示优化 1 朴素提示优化:复杂 Prompt 搜索并非必要 08-28 数据合成 1 DataFoundry:递归自改进的数据生产流程 09-02 智能体应用 1 从 OpenClaw 迁移到 Hermes Agent:安装与自进化机制指南 08-25 智能体框架 1 Prime Agent 开源自我改进智能体框架 08-11 框架演化 1 Evo-Bench:首个 Agent Harness 进化能力评测 08-24 演化能力评测 2 ASPIRE:模型能否从模糊目标中自我演化? 09-01 S3Gym:LLM 能否通过自测试与自评判实现自我改进 09-01 环境自博弈 1 SPADE:自适应可执行环境中的自博弈 08-20 科研自进化 1 Jeff Dean谈递归自我改进与Discovery Loop科研自动化 08-22 科研评测 1 AutoSciRub:先评估后改进的科研智能体自动准则归纳 09-01 程序修复 1 WebWorld:以浏览器世界模型驱动 Web 代码自我改进 09-01 策略固化 1 AI 后训练缺少什么:智能体策略重估能力的实证分析 08-20 算法设计 1 AI4AI-Bench:评测 LLM 智能体的递归自改进算法设计能力 08-21 经验学习 1 经验链:通过测试时交互持续改进 LLM 08-19 脚手架演化 5 HarnessDev:LLM 自主创建与演化 Agent Harness 09-03 AI4AI:强模型自动构建 Harness 向弱模型迁移能力 08-31 Harness 自进化全景:三种范式与六个系统 08-28 Self-Harness 更新并开源:Agent 自主改进执行框架 08-26 HSI:面向任务专属可进化智能体脚手架的层级自我改进 08-22 自动化对齐 1 Claude 自动训练 Claude:AAR 低成本跑赢人类安全研究员 08-30 自我改进 2 在策略蒸馏真的在蒸馏吗?从噪声教师到自我改进 09-01 现代智能体自我改进:从模型更新到脚手架演化 08-20 记忆演化 1 Recuris:面向长程智能体脚手架的递归经验—工作记忆演化 08-26 评测审计 1 Phantom Gains:用实测零基线审计模型自我改进 08-21 课程发布 1 斯坦福 CS329A:自改进 AI Agent 课程公开 08-26 课程学习研究综述 1 斯坦福新课 CS329A:Self-Improving AI Agents 08-21 课程生成 1 Ornith-1.5自生成任务闭环提升编码智能体 08-27 递归自我改进 2 Meta^n:通过涌现深度实现递归自我改进 08-31 Meta^n:以涌现深度实现递归式自我改进 08-27 金融问答 1 Self-Improving RAG:面向专家级金融问答的自纠错框架 08-29