经验学习 LLM-DailyDigest 2026-08-12 2026-08-12 约 100 字 预计阅读 1 分钟 经验学习 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 内生记忆 1 MemoraX以可学习记忆推动AI进入经验时代 08-22 协同演化 1 SafeEvolve:基于智能体经验的脚手架—策略协同演化安全对齐 09-03 技术生态 1 AI4AI 从自进化、元进化迈向递归自我改进 08-12 技能优化 1 WER:通过执行反馈强化学习实现技能优化 08-19 技能安全 1 Practice Makes Unsafe:自改进 LLM 智能体的技能误演化 08-16 技能演化 3 WikiSkill:将智能体经验编译为持久知识以持续演化技能 09-03 PRACTICE:具身智能体从经验到专长的自进化 09-01 CODESKILL:编码智能体的自进化技能学习 08-14 智能体框架 1 OpenClaw 2.0 发布:最大规模更新与 Agent Harness 赛道反思 09-02 核心演化 1 Ouroboros:可自我演化的前沿编程智能体 08-12 模型量化 1 AQuA:递归自我改进的量化交易研究智能体 08-16 演化能力评测 1 S3Gym:LLM 能否通过自测试与自评判实现自我改进 09-01 空间记忆 1 Spatial Memory Agent:基于经验程序记忆的空间智能 08-15 经验学习 1 经验链:通过测试时交互持续改进 LLM 08-19 经验进化 1 经验时代的自改进智能体:从自我进化到元进化综述 08-12 自蒸馏 1 LOPD:潜在同策略自蒸馏 08-16 自进化 2 DiagEvo:基于层次化错误记忆的诊断引导自进化 09-03 Zeva:冻结参数实现具身上下文因果自进化 09-01 自进化闭环 1 EvoMap:以经验流转构建系统级 RSI 闭环 09-03 记忆蒸馏 1 Agent Memory Distillation:用分层教师记忆增强小模型智能体 08-12 过程评测 1 超越最终得分:长程 AI 研发智能体的系统评估 08-16 长程智能体 1 英伟达 AVO 在 ARC-AGI-3 通关 183 关并获满分 08-23