长上下文 LLM-DailyDigest 2026-08-07 2026-08-07 约 100 字 预计阅读 1 分钟 长上下文 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 上下文压缩 1 LatentPress:超越文本与视觉的上下文压缩 09-02 交互式评测 1 OmniAssistBench:全模态助手交互评测基准 08-24 交互成本 1 上下文压缩会增加智能体的隐性交互成本 08-18 会话交接 1 跨会话边界的上下文学习状态交接 08-17 前缀滑动窗口 1 Prefix Sliding:高效扩展测试时推理 08-27 动态审查 1 MCR-Bench:真实多轮代码审查动态基准 08-28 开源模型 1 千问、智谱开源低价新模型,Qwen4 架构提前亮相 08-27 性能优化 1 ChatGPT长对话提速与Codex多智能体v2上线 08-16 技能压缩 1 SkillZip:面向可扩展智能体技能库的契约保持图压缩 08-14 技能演化 1 清华推出 Ctx2Skill:通过多智能体自博弈实现 Skill 自主进化 08-12 拓扑压缩 1 LLM 长上下文流形的拓扑压缩与六度分隔 08-19 持续学习 1 Fast Weight Attention:面向持续学习的快速权重注意力 09-01 持续适应 1 Macaron-V1:基于自我改进与 Mixture-of-LoRA 的开放持续学习 08-12 文献工具 1 Paper Burner X:开源 AI 文献阅读与翻译工作站 08-15 智能体框架 1 Prime Agent 开源自我改进智能体框架 08-11 架构研究综述 1 长程智能体综述:Harness 与模型协同优化 08-22 框架拆解 1 DeepSeek V4 Pro 与 Harness:后训练、缓存经济学及代理自进化 08-23 模型发布 5 腾讯发布 Hy4 preview:770B 参数、1M 上下文 08-30 智谱开源原生多模态模型 GLM-5.3 Flash 08-27 GLM-5.3-Flash 开源:低成本原生多模态前沿模型 08-26 Qwen3.8-27B开源:消费级显卡可运行“Opus级”Agent 08-16 Kimi K3:开放前沿智能模型 08-07 模型架构演进 1 DeepSeek、Llama、GLM、Qwen 底层架构演进详解 08-22 状态追踪 1 StateMemBench:智能体记忆能否追踪演化状态? 08-22 盲测 1 匿名模型 Ox Alpha 刷屏,代码能力逼近头部模型 08-23 策略蒸馏 1 SimpleOPD:分词器无关的长上下文同策略蒸馏 08-17 视频生成 1 LayerRecall:提升视频生成长时域一致性的状态条件记忆路由器 09-01 诊疗核查 1 MedGuard:嵌入诊疗流程的医学事实核查守门人 08-25 长度泛化 1 Transformer 长度泛化的代数分解理论 08-16 长期记忆 4 Safin-1:以记忆原生状态演化实现内生安全 09-03 ContextPilot:用细粒度强化学习实现主动上下文管理 09-01 预计算记忆的组合、重建与纠错成本 09-01 EgoMonth:月级第一视角视频长期时空记忆基准 08-16 额度异常检测 1 Codex 额度异常查明:自动标题等三处 Bug 导致超额消耗 08-24 高效测试时训练 1 E²-TTT:兼顾表达力与效率的测试时训练 08-24