智能体脚手架 LLM-DailyDigest 2026-08-30 2026-08-30 约 100 字 预计阅读 1 分钟 智能体脚手架 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 严谨推理 1 Brain Researcher:以分析严谨性约束神经影像科研智能体 08-21 任务采样 1 Task-CoEvolve:自适应验证任务驱动的高效 Harness 优化 08-21 工程框架 1 Harness成为AI规模化落地新战场 08-23 工程进化 1 腾讯混元两项工作:Harness Handbook 与 RST 递归任务合成 08-20 技术生态 1 OpenClaw热潮退去,Agent竞争转向Harness 08-30 智能体强化学习 1 Agent Lightning v1.0:面向脚手架式智能体强化学习 08-19 智能体框架 3 OpenClaw 2.0 发布:最大规模更新与 Agent Harness 赛道反思 09-02 Harness-of-Harness:持续改进的多日自主软件开发框架 09-02 Prime Agent 开源自我改进智能体框架 08-11 智能体生态 1 DeepSeek Harness 发布后,Agent 商业格局生变 08-20 智能体评测 1 CordisBench:动态智能体脚手架的组件生命周期推理评测 09-02 架构研究综述 1 长程智能体综述:Harness 与模型协同优化 08-22 框架拆解 1 DeepSeek V4 Pro 与 Harness:后训练、缓存经济学及代理自进化 08-23 框架演化 1 SHAPER:通过技能与执行框架演化实现具身智能体自进化 08-14 概念研究综述 1 什么是 Self-evolving、Self-improving 与 RSI? 08-12 状态运行时 1 StateM:以状态化 Harness Scaling 提升长程智能体执行 08-19 环境协同演化 1 EnvHarness:让静态环境适应智能体学习 08-21 科学仿真 1 KI 为科学 Agent 注入可执行常识,仿真成功率升至 84% 08-28 科研工作流编排 1 18个Agent自主科研:Kimi K3借Harness逼近Opus 5 08-21 科研评测基准 1 DeltaML-Bench:真实科研仓库中的机器学习智能体评测 08-21 能力迁移 1 AI4AI 测试时强弱模型能力迁移:用 Harness 提升小模型表现 08-14 脚手架 1 Opus 5借助极简Harness在ARC-AGI-3取得96.2%通关率 08-14 脚手架优化 2 AutoDesign:面向长程智能体设计的元脚手架优化 08-15 自动优化 Agent Harness 的三条路径:Meta-Harness、AHE 与 Self-Harness 08-14 脚手架学习 1 Harness 持续学习:超越模型参数的持续适应 08-20 脚手架演化 8 HarnessDev:LLM 自主创建与演化 Agent Harness 09-03 JIT-Agent:按任务即时生成并演化智能体 Harness 09-02 AI4AI:强模型自动构建 Harness 向弱模型迁移能力 08-31 Harness 自进化全景:三种范式与六个系统 08-28 JIT-Agent:通过即时脚手演化扩展智能体能力 08-27 Harness Continual Learning:让冻结模型通过脚手架持续学习 08-23 HSI:面向任务专属可进化智能体脚手架的层级自我改进 08-22 DarwinX:通过自然选择演化智能体脚手架 08-15 自我改进 1 现代智能体自我改进:从模型更新到脚手架演化 08-20 自进化闭环 1 Agent 自进化飞轮:评测、记忆、落地与控制 08-26 训练-推理对齐 1 LEGO-RL:面向编程智能体原生 Harness 的强化学习框架 08-19 记忆演化 1 Recuris:面向长程智能体脚手架的递归经验—工作记忆演化 08-26 评测复现 1 J-Space Skill 提升 DeepSeek V4 Pro 的评测争议 08-20 过程评测 1 超越最终得分:长程 AI 研发智能体的系统评估 08-16 进化研究综述 1 97页综述:现代 AI Agent 的自我进化体系 08-12 长程任务研究综述 1 长程智能体综述:Harness 工程与模型优化协同演化 08-14 黑箱训练 1 ClawGym II:面向 Agent Harness 的黑箱强化学习 08-18