多智能体系统 LLM-DailyDigest 2026-08-30 2026-08-30 约 100 字 预计阅读 1 分钟 多智能体系统 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 世界模型 2 通用决策大模型 Decitron:开放世界推演与求解闭环 09-03 NashDreamer:面向零和不完美信息博弈的模型式强化学习 09-02 世界模型评测 1 HarnessEval-W:智能体化视觉世界模型评测 08-19 临床协作 1 MARC v1:面向临床推理与协作的开源多智能体框架 08-16 云端智能体 1 Grok Bot以零配置云端多智能体打造“一人公司” 08-21 交互成本 1 交互税:通信如何抹平多智能体团队的多样性 08-25 价值估计 1 错误但有用:多智能体消息的轨迹价值超越答案正确性 08-17 元编排 1 Omnigent 开源多 Agent 元编排层 08-28 决策协商 1 BoardroomAI:基于演化决策图的人类可操控多智能体协商 08-16 出行预测 1 多智能体主动采集与天气敏感出行需求预测 08-21 分解粒度 1 VAT 判定中的 LLM 智能体分解粒度控制实验 08-25 创意重建 1 Reconstruction:从发表前参考文献盲重建研究创意 08-18 医疗问答 1 自适应记忆与反思的医疗问答多智能体系统 08-20 协同测量 1 AI 编程智能体团队的协调测量 08-18 协同演化 1 智能体系统协同演化:迈向超越人工设计的自主进化 08-13 协同规划 1 集体反事实规划:表征约束下的协调、同意与验证 08-19 协同追捕 1 OGR-MARL:受约束港区异构无人艇协同追捕 08-16 协同驾驶 1 G-MARK:基于知识图谱的协同驾驶多智能体推理 08-21 可信执行 1 面向可信智能体执行的策略代数 08-18 可见性约束 1 受限证据可见性促进共享基因组语言模型社会的组合泛化 08-21 可靠性认证 1 智能体行为契约 II:无独立性假设的组合可靠性认证 08-16 图工程 1 Graph Engineering:从个体智能迈向多智能体系统智能 08-24 基站部署 1 多智能体离策略深度强化学习优化智慧校园覆盖 08-20 多智能体协作框架 2 HiRS-Agent:面向长程遥感任务的分层多智能体系统 09-01 蚂蚁集团开源多智能体协作基础设施 Avernet 08-11 多智能体协作风险 2 Anthropic 揭示多智能体系统三类系统性失效 08-30 Anthropic揭示多智能体协作与冲突隐患 08-15 多智能体系统 4 EvoX 蜂群智能体让 AI 自主寻找研究方向 09-03 双层协调反思:多智能体 LLM 系统的博弈论方法 09-03 GlossoGen:复杂多智能体交互中的涌现语言 09-02 Hermon Moment:AI 自我超越与人类叙事 09-01 失败归因 1 超越 LLM 推理:轻量 GNN 实现智能体失败归因 08-20 安全沙箱 1 WorkSwarm 多智能体协作与 JiuwenBox 安全沙箱 08-21 并行路径规划 1 群组去中心化规划实现并行终身多智能体寻路 08-19 形式化证明 1 AxiomProver用Lean 4完成“246定理”形式化验证 08-23 形式化验证 1 AI 证明泛滥后,可信验证成为最昂贵的智能 08-19 性能优化 1 ChatGPT长对话提速与Codex多智能体v2上线 08-16 技能演化 1 清华推出 Ctx2Skill:通过多智能体自博弈实现 Skill 自主进化 08-12 拓扑优化 1 RGA-Designer:奖励引导的多智能体通信拓扑生成 08-21 拓扑解释 1 E2-Explainer:用因果推断解析多智能体通信拓扑 08-16 插件架构 1 DeepSeek Harness 开源:以插件化框架组装智能体 08-14 插件生态 1 DeepSeek Harness 插件生态爆发:长期记忆、多智能体与小游戏齐上阵 08-15 故障调试 1 修复还是重采样?重新审视 LLM 多智能体故障调试 08-27 数学发现 1 Claude辅助构造S⁶复结构,挑战78年数学悬案 08-26 时间序列预测 1 MetaCaster:多智能体驱动的轻量时序预测器少样本训练 08-25 智能体应用 1 从 OpenClaw 迁移到 Hermes Agent:安装与自进化机制指南 08-25 智能体框架 1 Prime Agent 开源自我改进智能体框架 08-11 智能体规模扩展 1 Apodex 1.1:面向复杂工作的智能体能力扩展 08-25 智能体评测 1 SwarmBench:评测大模型的智能体集群编排能力 09-01 极化攻击 1 GraphWake:利用记忆级联诱导 LLM 智能体社区群体极化 08-19 架构研究综述 1 长程智能体综述:Harness 与模型协同优化 08-22 模型发布 1 DeepSeek Harness v0.1.0-rc.8 增强多模态与子代理能力 08-21 模型量化 1 AQuA:递归自我改进的量化交易研究智能体 08-16 模型量化评测 1 Seed-Evolving 量化策略研发与自迭代能力评测 08-14 混合控制 1 LLM 常识推理驱动的自动驾驶多智能体编排 08-21 游戏生成 3 VibeGame:可试玩、自反思、自进化的多智能体游戏开发框架 09-01 Spellcaster:15分钟生成并验证可玩游戏 08-20 Spellcaster:6个Agent协作生成、试玩并修复游戏 08-18 用户仿真 1 LiveSim:环境塑形用户的多智能体直播生态仿真 08-29 科研工作流编排 2 18个Agent自主科研:Kimi K3借Harness逼近Opus 5 08-21 多智能体Harness加速自主科研:Kimi K3逼近Opus 5 08-18 科研平台 1 ScienceDiscovery:可溯源的一站式 AI 科研工作台 08-17 科研智能体 1 OmniScientist:全模态跨学科 AI 科学家 08-16 科研自进化 1 Jeff Dean谈递归自我改进与Discovery Loop科研自动化 08-22 科研项目 1 ScienceClaw AutoProject推动AI4S从Task走向Project 08-25 科研预评审 1 磐石上线“创新评价”AI评审智能体 08-20 答案选择 1 候选供给与答案选择决定多智能体 LLM 裁判价值 08-27 群体动力学 1 智能体物理学:统计力学预测 AI 群体行为 08-18 群体安全 1 Anthropic:单体安全不等于多智能体系统安全 08-16 群体探索 1 SwarmResearch:编排 Coding Agents 实现开放式发现 08-14 群体推理 1 Co-RL:多样化智能体群体涌现无监督推理 08-21 群体演化 1 SwarmWorld:语言模型智能体社会的痕迹式技术演化 08-27 群体风险 1 Anthropic揭示多智能体协作、合谋与冲突隐患 08-16 脚手架演化 1 OpenClacky:用自然语言让 Agent 自我改造 08-24 自动化对齐 1 Claude 自动化对齐研究:单卡 48 小时迭代 1601 种方案 08-30 自动化科研 1 OpenAI Astra突破自动化科研基准,瞄准年底AGI 08-28 自进化系统 1 Mobius:可自进化的开源 Agent OS 08-30 自进化闭环 1 EvoMap:以经验流转构建系统级 RSI 闭环 09-03 自适应聚合 1 pFedMARL:多智能体强化学习自适应聚合非 IID 联邦数据 08-27 自适应防御 1 自进化多智能体框架防御 LLM 越狱攻击 08-27 规格迁移 1 LLM 开发代理间的规格可移植性与兼容性 08-24 记忆仲裁 1 超越记忆多数票:多智能体记忆仲裁的潜在来源推理 08-21 记忆合并 1 MELD:分布式智能体记忆的知识合并协议 08-18 评测编排 1 HarnessEval:以可执行 Harness 重构 Benchmark 08-19 轨迹推断 1 SpaCellAgent:自进化多智能体自动完成单细胞轨迹推断 08-22 辩论式对齐 1 辩论训练减少 RLAIF 奖励作弊 08-19 辩论评判 1 事后辩论裁判理论 08-20 进度感知路由 1 ProgRouter:面向质量—成本权衡的多智能体在线进度路由 08-27 金融问答 1 Self-Improving RAG:面向专家级金融问答的自纠错框架 08-29 闭环科学发现 1 Gemini Co-Scientist 加速真实世界闭环科研 08-29 鲁棒协作 1 SIGMA:面向结构化噪声效应的分组多智能体聚合 08-29 默契合谋 1 AI 智能体在算法化电力市场中涌现默契合谋 08-29