自动化科学研究 LLM-DailyDigest 2026-08-30 2026-08-30 约 100 字 预计阅读 1 分钟 自动化科学研究 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 三层框架 1 自进化(Self-evolving/RSI)三层框架与实践路径 08-30 世界模型 1 AutoWorldModel-Bench:自动化世界模型研究的状态中心基准 08-14 产业知识图谱 1 RSI产业图谱:围绕智能进化速度的新竞赛 08-28 元智能体编排 1 Eureka:面向科学发现的任务条件元代理编排 08-20 反例搜索 1 Gowers:AI数学突破更擅长搜索反例与特殊构造 08-17 因果推理 1 EvoSCM:通过因果模型演化与实验实现科学信念修正 09-02 多智能体系统 1 EvoX 蜂群智能体让 AI 自主寻找研究方向 09-03 学术搜索 1 百度“伐谋”自演化智能体:56分钟破解亿级特征组合搜索 08-14 实验设计 1 MDA:大模型与贝叶斯推断协同设计关键实验 08-15 形式化评测 1 FormalTCS:端到端前沿理论计算机科研评测 08-21 技术生态 1 AI4AI 从自进化、元进化迈向递归自我改进 08-12 技能生成 1 Repo-To-Skill:将 GitHub 仓库蒸馏为 AI4AI 技能 09-03 数学发现 1 Claude辅助构造S⁶复结构,挑战78年数学悬案 08-26 机制发现 1 Mechanist:自主发现 AI 智能机制的科学智能体 08-14 模型路由 1 英伟达开源 Nemotron 3.5 Lightning 与 NeMo Switchyard 08-13 模型量化 1 AQuA:递归自我改进的量化交易研究智能体 08-16 模型量化评测 1 Seed-Evolving 量化策略研发与自迭代能力评测 08-14 科研实践 1 Claude Code 与 Codex 协作完成医学影像竞赛论文并获 Accept 08-24 科研工作流编排 2 18个Agent自主科研:Kimi K3借Harness逼近Opus 5 08-21 多智能体Harness加速自主科研:Kimi K3逼近Opus 5 08-18 科研平台 2 深势科技发布玻尔·科学空间,AI贯通科研全流程 08-23 ScienceDiscovery:可溯源的一站式 AI 科研工作台 08-17 科研智能体 6 RPM 用研究偏好提升科研智能体算力分配效率 09-02 PaperGym:以评分准则驱动科研计划生成与训练 09-01 OmniScientist:全模态跨学科 AI 科学家 08-16 浙大开源 AI 科研智能体 Polaris 08-16 Intern-S2-Preview:科学智能体基础模型 08-15 AIBuildAI Science Agent:4小时自主完成顶刊级模型研发 08-13 科研桌面 1 玻尔·科学空间发布:桌面端 AI 接管科研全流程“体力活” 08-22 科研自进化 1 Jeff Dean谈递归自我改进与Discovery Loop科研自动化 08-22 科研评测 4 SCILAWS-BENCH:评测 LLM 在真实与平行世界中发现科学定律 09-02 AutoSciRub:先评估后改进的科研智能体自动准则归纳 09-01 ASI-Bench:评测 AI 自主科研与创新探索能力 08-20 MLS-Bench:140道真实任务检验AI方法创新能力 08-13 科研项目 1 ScienceClaw AutoProject推动AI4S从Task走向Project 08-25 程序进化 1 AlphaEvolve 将矩阵乘法指数上界降至 2.371177 09-01 算法设计 1 AI4AI-Bench:评测 LLM 智能体的递归自改进算法设计能力 08-21 自动化对齐 2 Claude 自动化对齐研究:单卡 48 小时迭代 1601 种方案 08-30 Claude 自动训练 Claude:AAR 低成本跑赢人类安全研究员 08-30 自动化科研 2 OpenAI Astra突破自动化科研基准,瞄准年底AGI 08-28 最大规模AI自主科研测试:Fable 5断层领先 08-17 自进化 1 专访胡梦康:Agent 之后,下一站是 AI 自我进化 08-18 自进化闭环 1 AI4AI:AI训练、优化与评测AI的新范式 08-20 蛋白质设计 1 Claude自主设计蛋白质结合剂,14个靶标实验命中 08-20 论文写作 1 1947篇AI顶会论文揭示高质量论文写作法则 08-14 论文生成 1 Spark-to-Paper:以可组合技能端到端生成研究论文 08-14 课程学习研究综述 1 斯坦福新课 CS329A:Self-Improving AI Agents 08-21 过程评测 1 超越最终得分:长程 AI 研发智能体的系统评估 08-16 递归自我改进 1 综述:递归自我改进(RSI)的能力边界与关键瓶颈 08-13 长程科研 1 ScienceFlow:面向长程科研的自主智能体框架 08-17 闭环科学发现 1 Gemini Co-Scientist 加速真实世界闭环科研 08-29