人在回路 LLM-DailyDigest 2026-08-16 2026-08-16 约 100 字 预计阅读 1 分钟 人在回路 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 交互监督 1 AdaLens:长时智能体数据分析的交互式监控与引导 08-19 决策协商 1 BoardroomAI:基于演化决策图的人类可操控多智能体协商 08-16 医疗问答 1 自适应记忆与反思的医疗问答多智能体系统 08-20 反馈起草 1 Claude Code 自动起草用户反馈报告 08-27 开源框架 1 OpenAI开源Codex Harness智能体执行框架 08-21 强化学习 1 言语强化学习的兴起:自然语言反馈统一框架 09-02 形式化证明 1 AI 辅助攻克森多夫猜想,陶哲轩推导出更强结果 08-16 技能演化 1 Warp 用双 Skill 构建 Claude 自我改进 Agent 09-01 接待智能体 1 硅星人推出 Demo Agent,让 Agent 自主完成项目自荐 08-21 模型可靠性 1 自改进智能体的脆弱性:方差、任务顺序与规格不足 08-19 科研实践 1 Claude Code 与 Codex 协作完成医学影像竞赛论文并获 Accept 08-24 科研智能体 1 浙大开源 AI 科研智能体 Polaris 08-16 科研项目 1 ScienceClaw AutoProject推动AI4S从Task走向Project 08-25 科研预评审 1 磐石上线“创新评价”AI评审智能体 08-20 策略迭代 1 PIHF:以人类反馈将后训练强化学习引入上下文学习 08-18 自动化对齐 1 Claude 自动训练 Claude:AAR 低成本跑赢人类安全研究员 08-30 自进化闭环 2 Agent 自进化飞轮:评测、记忆、落地与控制 08-26 AI4AI:AI训练、优化与评测AI的新范式 08-20 评测审计 1 用户反馈提供 LLM 无法自行识别的独特改进信号 09-03 验证器开发 1 AI 权威执行:从应用到芯片的机器验证 08-24