智能体记忆 LLM-DailyDigest 2026-08-30 2026-08-30 约 100 字 预计阅读 1 分钟 智能体记忆 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 上下文压缩 1 LatentPress:超越文本与视觉的上下文压缩 09-02 上下文管理 1 Sculptor:通过主动上下文管理赋能 LLM 认知代理能力 08-07 上下文进化 1 ACE:无需微调的语言模型自我进化范式 12-31 代码世界模型 1 Code World Model:以编码代理充当世界大脑 08-28 会话交接 1 跨会话边界的上下文学习状态交接 08-17 具身导航 1 Embodied-Navigator:定位、思考、记忆与对齐的高效具身导航 08-20 内生记忆 1 MemoraX以可学习记忆推动AI进入经验时代 08-22 前沿挑战 1 大模型强化学习的关键挑战与下一代范式 12-31 办公智能体 1 豆包工作正式发布:深度融合飞书的办公智能体 08-25 医疗问答 1 自适应记忆与反思的医疗问答多智能体系统 08-20 双脑记忆 1 VoiceMem:面向实时语音交互的流式双脑记忆 08-28 多智能体系统 3 双层协调反思:多智能体 LLM 系统的博弈论方法 09-03 Xolver:基于整体经验学习的多智能体推理框架 06-19 多智能体正在“燃烧”Token:Anthropic 公开研究系统构建经验 06-14 安全评测 1 PRISK:评估大语言模型个性化的隐性成本 09-02 工具使用元学习 1 MetaAgent:通过元工具学习实现持续自我进化 12-31 幻觉检测 1 HARP:通过推理子空间投影进行幻觉检测 09-15 开放式搜索 1 Large Discovery Models:基于实证的开放式科学搜索 08-19 技能迁移 1 拆解再传递:LLM 智能体的跨任务技能迁移 08-21 持续学习 3 JitRL:免梯度实现 LLM Agent 测试时持续学习 08-22 持续学习向系统级适应的范式转型 08-07 GeRe:通过通用样本重放缓解大模型持续学习中的灾难性遗忘 08-06 推理记忆 1 ReasoningBank:通过推理记忆扩展智能体自我进化 09-30 插件生态 1 DeepSeek Harness 插件生态爆发:长期记忆、多智能体与小游戏齐上阵 08-15 数学研究 1 AIM:面向数学理论研究的自动化智能体 12-31 时域控制 1 LocalLSTC:本地 GUI 智能体的长短期控制架构 08-27 时序问答 1 SABET-QA:时序知识图谱多步问答 08-21 智能体应用 1 从 OpenClaw 迁移到 Hermes Agent:安装与自进化机制指南 08-25 智能体自进化 2 斯坦福 AgentFlow:智能体在交互中实时进化 10-14 普林斯顿王梦迪团队综述:自我进化智能体的持续学习与适应 08-01 智能体训练 1 L0:面向通用智能体的可扩展端到端强化学习训练系统 07-01 智能体记忆 1 Memory+Agent:人大高瓴与华为诺亚构建大模型智能体记忆研究体系 08-08 智能体评测 3 MNIST-PRO:面向部分可观测智能体的感知状态评测 09-01 AI Agent 评测基准的“环境—能力”分类框架 12-31 AI Agent 评测的四大演进趋势 12-31 机制研究综述 1 大语言模型智能体记忆机制综述 12-31 极化攻击 1 GraphWake:利用记忆级联诱导 LLM 智能体社区群体极化 08-19 架构研究综述 1 长程智能体综述:Harness 与模型协同优化 08-22 模型可靠性 1 自改进智能体的脆弱性:方差、任务顺序与规格不足 08-19 模型架构创新 1 Intern-S2-Mobius:知识与推理解耦的基础模型 08-17 泛化机制 1 同策略蒸馏泛化的双重效应:行为迁移与能力跷跷板 08-18 游戏评测 1 LMGame-Bench:用经典游戏评测大模型感知、记忆与推理能力 07-02 潜空间推理 1 BDH-CQ:基于循环潜在推理的上下文学习 08-12 状态追踪 1 StateMemBench:智能体记忆能否追踪演化状态? 08-22 科研智能体 1 Intern-S2-Preview:科学智能体基础模型 08-15 程序修复 1 ExpeRepair:双重记忆驱动的仓库级缺陷修复系统 06-12 空间记忆 1 Spatial Memory Agent:基于经验程序记忆的空间智能 08-15 端侧记忆 1 MobileMem:从一年移动端经历中学习长期记忆 08-17 纵向记忆 1 LifeMem:用纵向生命轨迹缓解 LLM 智能体身份本质主义 08-22 经验学习 1 MemoHarness:从执行经验中学习的自适应智能体框架 08-07 经验进化 1 经验时代的自改进智能体:从自我进化到元进化综述 08-12 脚手架学习 1 Harness 持续学习:超越模型参数的持续适应 08-20 自进化 5 DiagEvo:基于层次化错误记忆的诊断引导自进化 09-03 Zeva:具身模型通过上下文因果学习实现部署时自进化 09-02 Zeva:冻结参数实现具身上下文因果自进化 09-01 浙大开源 HugAgentOS:三引擎驱动可控自进化 08-12 上交大推出机器学习智能体 ML-Master,登顶 OpenAI MLE-bench 07-02 自进化框架 1 HarnessBank:面向 Agent-Harness 自进化的语义基因库 08-11 自进化闭环 1 Agent 自进化飞轮:评测、记忆、落地与控制 08-26 自适应防御 1 自进化多智能体框架防御 LLM 越狱攻击 08-27 视频生成 1 LayerRecall:提升视频生成长时域一致性的状态条件记忆路由器 09-01 记忆产品 1 EverMind以EverOS与EverMe推动AI自进化产品化 08-11 记忆仲裁 1 超越记忆多数票:多智能体记忆仲裁的潜在来源推理 08-21 记忆合并 1 MELD:分布式智能体记忆的知识合并协议 08-18 记忆增强 1 记忆增强解锁高效思维链推理 08-24 记忆机制 1 通过电路发现理解 LLM 中的逐字记忆 06-30 记忆能力评测 4 编码智能体工作记忆的语义化评估 09-01 MemBench:全面评估基于 LLM 的智能体记忆能力 06-30 MemBench:面向大语言模型智能体记忆能力的综合评估 06-26 MemSim:用于评估大模型个人助理记忆能力的贝叶斯模拟器 09-30 记忆蒸馏 1 Agent Memory Distillation:用分层教师记忆增强小模型智能体 08-12 记忆诊断 1 D²ACCI:证据保留的智能体记忆双循环诊断协议 08-19 记忆陷阱 1 MemTrapBench:评测 LLM 记忆使用中的认知陷阱 08-22 资源研究综述 1 Awesome Self-Improving Agents:自改进智能体资源库 08-12 进化研究综述 1 97页综述:现代 AI Agent 的自我进化体系 08-12 长期记忆 8 Safin-1:以记忆原生状态演化实现内生安全 09-03 ContextPilot:用细粒度强化学习实现主动上下文管理 09-01 预计算记忆的组合、重建与纠错成本 09-01 Claude Chat与Cowork打通共享记忆 08-31 ReWorld:具备长时记忆的交互式世界模型 08-26 MemoraX Code:让 Coding Agent 拥有长期记忆 08-18 EgoMonth:月级第一视角视频长期时空记忆基准 08-16 M+:以协同检索器扩展 MemoryLLM 的可扩展长期记忆 08-08 长程任务研究综述 1 长程智能体综述:Harness 工程与模型优化协同演化 08-14 隐私风险 1 微调方法对大型语言模型中记忆的影响 06-30