系统优化 LLM-DailyDigest 2026-08-07 2026-08-07 约 100 字 预计阅读 1 分钟 系统优化 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) AI辅助编程 1 LLM 能否设计视频编码工具?Planar 模式案例研究 09-02 三维重建 2 ABot-Recon:以局部上下文实现长时域流式三维重建 09-01 CVPR 2025 Award Candidate:Difix3D+ 用单步扩散模型修复 3D 重建伪影 06-23 上下文压缩 1 LatentPress:超越文本与视觉的上下文压缩 09-02 下游任务适配 1 为下游任务优化语言模型:训练后视角 06-27 代码评测 1 Φ-Bench:大模型基础设施工程能力评测基准 09-01 低成本训练 1 游戏玩家可以训练数学推理模型吗? 06-12 元进化 1 OpenMLE:单卡运行的 AI 自进化全栈系统 08-12 分布式训练 1 并行与分布式推理语言模型的性能基础 08-28 参数高效微调 1 Progtuning:基于 Transformer 语言模型的渐进式微调框架 06-27 反馈规划 1 按需激活反馈接收的正向规划机制 12-31 基础设施评测 1 Φ-Bench:大模型基础设施工程能力评测 08-24 多智能体系统 1 多智能体正在“燃烧”Token:Anthropic 公开研究系统构建经验 06-14 多模态训练 1 CPGD:仅用数学训练,跨学科推理超越 o1并缓解强化学习训练崩溃 06-24 工作流进化 1 具备自进化能力的智能体工作流系统 12-31 开源模型 2 OpenAI 开源推理模型 gpt-oss-120b 与 gpt-oss-20b 08-05 华为开源盘古 Embedded 7B 与盘古 Pro MoE 72B 模型 07-01 性能优化 1 ChatGPT长对话提速与Codex多智能体v2上线 08-16 成本优化 1 DynScaling:基于动态集成采样的无验证器高效推理扩展 06-24 扩散模型 1 Mercury:首个扩散式 LLM,推理速度超过主流模型 7 倍 06-28 批评微调 1 通过单问题批评微调释放预训练大模型的推理潜力 06-09 技能优化 1 SkillOpt:冻结模型权重,优化智能体技能文档 08-11 技能压缩 2 SkillZip:面向可扩展智能体技能库的契约保持图压缩 08-14 SkillZip:无需评估的自进化智能体技能压缩 08-13 持续集成 1 持续集成:频繁合并代码并自动构建测试 12-31 指令优化 1 教学学习范式:融合白盒与黑盒 LLM 的指令优化框架 06-30 推测解码 1 S⁴C:利用语法与语义一致性加速大模型推理 06-19 推理优化 2 马尔可夫思考机将 LLM 推理成本降至线性 12-31 NoWait:移除“等待”等思考标记可提升推理效率 06-12 推理扩展 1 推理时扩展的概率最优性:OptScale 动态确定最佳采样数 06-27 推理效率 6 扩散语言模型让端侧 Agent 推理提速约 5 倍 09-02 无 LM Head 的软潜空间思考 09-01 Long-to-Short 是免费的午餐吗?研究大型推理模型的一致性与推理效率 06-25 PREMISE:面向大模型高效数学推理的可扩展战略提示优化 06-13 简单问题快速答,困难问题深入想:基于幂次长度惩罚的高效推理 06-13 Bingo:通过动态与显著性强化学习提升大模型推理效率 06-12 推理早停 1 答案收敛可作为推理早停信号 06-04 推理系统 1 Frontier:模拟下一代大语言模型推理系统 08-05 推理调控 1 AlphaOne:大模型先慢后快的测试时推理调控框架 06-23 推理预算 1 通过预算引导控制大模型思维长度 06-18 提示优化 1 RiOT:基于残差优化树的高效提示词优化 06-24 插件架构 1 DeepSeek Harness 开源:以插件化框架组装智能体 08-14 效率评测 1 我们离最佳推理效率还有多远? 06-11 数据效能 1 语言模型训练的数据效能:DELT 数据组织范式 06-27 数据混合 2 AutoMixer:利用训练检查点自动优化数据混合 06-30 Domain2Vec:向量化数据集,无需训练寻找最优数据混合 06-13 数据策展 1 蚂蚁OmniTable统一宽表管理35PB大模型训练数据 09-02 智能体框架 1 首个开源多模态 Deep Research 智能体,超越多个闭源方案 12-31 智能体自进化 1 斯坦福 AgentFlow:智能体在交互中实时进化 10-14 架构发现 1 AI 架构发现呈现“科学发现的规模法则” 12-31 架构搜索 1 ASI-ARCH 自主发现 106 种线性注意力架构 12-31 框架演化 1 AIDE²:零权重更新实现一阶递归自我改进 08-12 模型发布 3 GLM-5.3:后训练扩展强化编程与网络攻防能力 08-14 DeepSeek V4 Pro 正式版上线,主打 Agent 与 Coding 08-13 Kimi K3:开放前沿智能模型 08-07 模型可靠性 1 多组件系统的整体成功率会快速下降 12-31 模型定制 1 DnD:仅靠提示词数秒生成任务专属 LoRA 权重 06-25 模型微调 1 在不损害能力的前提下精简大语言模型 06-13 模型架构 1 GPT-5:基础模型、深度推理与实时路由一体化系统 12-31 模型架构创新 3 Qwen3.8-Next 架构设计:效率、能力与训练稳定性的联合优化 09-02 Intern-S2-Mobius:知识与推理解耦的基础模型 08-17 ASI-ARCH:从神经架构搜索迈向自主架构创新 12-31 模型编辑 1 SMEdit:面向低数据场景的高效元学习模型编辑方法 12-31 模型路由 2 英伟达开源 Nemotron 3.5 Lightning 与 NeMo Switchyard 08-13 Router-R1:通过强化学习实现多轮大模型路由与聚合 06-12 模型选型 1 LensLLM:以低成本预测微调表现的LLM选型框架 06-19 测试时优化 1 MEMETRON:大型语言模型测试时响应优化的元启发式机制 06-12 神经符号人工智能 1 大型语言模型模仿逻辑推理,但代价是什么? 09-16 科研复现 1 自动化 LLM 速通基准:评估 NanoGPT 改进复现能力 06-30 科研工作流编排 1 多智能体Harness加速自主科研:Kimi K3逼近Opus 5 08-18 程序修复 1 不靠 Agent,四步修复真实 Bug:蚂蚁 CGM 登顶 SWE-Bench 开源榜 06-28 程序进化 2 AlphaEvolve 将矩阵乘法指数上界降至 2.371177 09-01 AlphaEvolve:利用大语言模型实现程序自动进化 12-31 端侧推理 1 FreeToken:单卡消费级 GPU 高效运行满血 MoE 大模型 08-23 端侧模型 1 谷歌开源端侧多模态模型 Gemma 3n,最低仅需 2GB 显存 06-28 答案聚合 1 表示一致性:聚合准确且连贯的 LLM 候选答案 06-30 算力进化 1 清昴智能以AI自进化打造国产万亿Token工厂 08-18 算法发现 1 AlphaEvolve:结合大语言模型与自动评估实现算法自我进化 12-31 系统优化 2 华为 CloudMatrix 384 超节点很强,但它的“灵魂”在云上 07-03 华为 CloudMatrix 论文披露 AI 数据中心新范式,推理效率超越英伟达 H100 06-30 经验学习 1 MemoHarness:从执行经验中学习的自适应智能体框架 08-07 统一框架 1 多模态统一框架的设计与规模化训练挑战 12-31 脚手架 1 Opus 5借助极简Harness在ARC-AGI-3取得96.2%通关率 08-14 自动化优化 1 面壁智能发布 ForgeStencil:自动研究与部署闭环 AI 系统 08-07 芯片设计 1 Redwood:AI 两周自动设计、验证并部署大模型加速芯片 09-01 蛋白质建模 1 AMix-1:基于贝叶斯流网络的蛋白质基座模型新范式 12-31 表征对齐 1 何恺明改进 REPA:大幅简化方法并保持强劲性能 06-13 规模扩展瓶颈 1 Orion性能未达预期,三大瓶颈制约模型扩展 12-31 视觉生成 1 清华、字节提出 PAROAttention:Token 重排实现 5 倍稀疏与 4 比特量化 07-01 视频生成 3 DraftAttention:无需训练的视频扩散模型动态稀疏注意力加速方法 06-30 向量化时间步:极低成本微调大规模预训练视频扩散模型 06-20 稀疏蒸馏实现 H200 单卡 5 秒生成视频,去噪提速 70 倍 05-19 训练系统 1 Rollplex:VLM 后训练的跨阶段 GPU 空间共享 08-17 资源调度 1 Libra:Agentic RL 后训练动态资源管理系统 08-14 趋势预测 1 2026—2027年大模型行业两大里程碑 08-12 跨模态对齐 1 LIFT:冻结LLM文本编码器,准确率超CLIP 11% 07-03 软件开发流程 2 精益软件开发与持续集成/持续交付实践 12-31 软件开发方法论:瀑布模型与混合实践 12-31 轻量化模型 1 Google 发布 Gemma 3 270M 超紧凑模型 08-14 轻量化模型架构 1 轻量化新模型仅采用4个注意力头 12-31 进化建模 1 AI可高效建模由进化形成的复杂系统 12-31 连续推理 1 SynAdapt:利用合成连续思维链实现高效自适应推理 08-05 量化感知训练 1 SageAttention3:FP4 量化加速注意力并探索 8 比特训练 06-19 长期记忆 1 预计算记忆的组合、重建与纠错成本 09-01 长视频理解 1 HoPE 混合位置编码提升视觉语言模型的长度泛化能力 06-30 首步纠错 1 在推理的开始迷失:首个推理步骤对长链推理的关键影响 06-30