推理预算 LLM-DailyDigest 2026-08-21 2026-08-21 约 100 字 预计阅读 1 分钟 推理预算 本主题由提交工具自动创建,可在此补充洞察与资料。 相关消息(按子主题自动聚合) 反思早停 1 EvoResearcher:免训练的推理时自我反思与成本约束早停 08-20 定价机制 1 LLM 推理服务的默认设计与 Token 定价 08-16 弱模型探索 1 弱模型引导提升 RLVR 推理探索能力 08-28 推理扩展 1 小模型语法约束 Text-to-SQL 的推理时扩展极限 08-27 模型发布 1 Qwen3.8-27B开源:消费级显卡可运行“Opus级”Agent 08-16 测试扩展 1 真实开放任务中的测试时扩展:瓶颈在利用而非探索 08-20 算力分配 1 Learning When to Think:自适应分配测试时推理算力 08-21 算法设计 1 AI4AI-Bench:评测 LLM 智能体的递归自改进算法设计能力 08-21 自我验证 1 LLM-as-a-Verifier:自验证让 DeepSeek V4 Flash 低成本反超闭源模型 08-21 自适应想象 1 RISE:世界动作模型的自适应想象与选择性推演 08-26 顶级学术会议成果 1 小米 8 篇大模型与智能体论文入选 EMNLP 2026 08-29 预算分配 1 轻量多模态模型估计 LLM 推理表现,实现文档推理预算优化 08-20