推理

推理

历史条目已迁入对应日报,本页「相关消息」自动聚合。

相关消息(按子主题自动聚合)

一致性评测 1

上下文进化 1

不确定性量化 1

专家智能 1

世界模型 2

中期训练 2

主动推理 1

事实一致性 1

事实核查 2

人工监督 1

代码评测 3

价值估计 1

价值权衡 1

低成本训练 1

低资源学习 1

偏好优化 1

偏好推理 1

元推理 1

元认知 6

内在奖励 1

决策解释 1

决策说服 1

分层推理 2

分层验证 1

分布式训练 1

创造力评测 1

前沿挑战 1

动作推理 1

动机推理 1

医学影像分析 1

医疗人工智能 1

协作博弈 1

协同演化 2

博弈推理 1

博弈评测 2

原型推理 1

反例推理 1

反思回溯 1

反思早停 1

反馈优化 1

反馈规划 2

句子简化 1

可信推理 2

可扩展推理 1

可解释性 1

可靠性训练 1

可验证奖励 1

因果推理 2

图像评测 1

图形用户界面纠错 1

图逻辑 1

基础模型 1

多元推理 1

多智能体系统 5

多模态学习 2

多模态推理 5

多模态训练 1

多模态证明 1

多维推理 1

多路径推理 1

多跳推理 5

多跳问答 1

多轮验证 1

奖励建模 7

奖励机制 1

奖励蒸馏 2

奖励黑客 1

对齐失配 1

工具使用元学习 1

工具推理 1

工具调用 1

并行推理 3

幻觉检测 1

开放式推理 1

开源模型 2

弱点合成 1

强化学习 3

形式化推理 1

形式化证明 8

循环推理 1

循环深度 1

心智理论 2

忠实性验证 1

思维框架 1

思维链 5

思维链泄露 1

思维链监测 1

意识表征 1

成本优化 1

扩散模型 2

扰动推理 1

批评微调 1

技能演化 1

指令优化 1

指令数据合成 1

探索推理 1

推测解码 1

推理优化 4

推理安全 1

推理异常 1

推理强化 1

推理归因 1

推理扩展 2

推理效率 6

推理早停 1

推理模型 2

推理研究综述 2

推理系统 1

推理范式 1

推理蒸馏 1

推理训练 1

推理记忆 1

推理评测 15

推理调控 1

推理迁移 1

推理预算 1

提示优化 1

提示合成 2

搜索推理 1

搜索能力评测 1

效度审计 1

效率评测 1

数值推理 1

数学合成 1

数学推理 12

数学数据 1

数学研究 1

数学评测 1

数据合成 2

数据混合 1

数理语言 1

文本扩散模型 1

旗舰模型 1

无监督训练 1

时序问答 1

智能体 2

智能体工作流 1

智能体推理 1

智能体自进化 1

智能体评测 6

检索停止 1

概率推理 1

模型发布 5

模型安全 1

模型对抗 1

模型微调 1

模型架构 1

模型架构创新 1

模型评测 7

模型路由 1

模型验证 1

泛化 1

泛化推理 1

泛化迁移 1

测试时优化 2

测试时计算 1

涌现机制 1

涌现能力 1

深度研究智能体 2

混合微调 2

混合规划 1

游戏推理 3

游戏生成 1

游戏评测 1

溯因推理 1

潜空间推理 1

理解能力评测 1

真值表征 1

知识库问答 1

知识推理 1

研究方向 2

研究综述 1

神经符号人工智能 2

科学发现 1

科学推理 1

科学数据 1

科学检索增强生成 1

科研评测 2

空间推理 1

空间认知 1

空间记忆 1

端侧模型 1

答案聚合 1

策略蒸馏 1

系统优化 1

组合推理 1

结构推理 1

缩放定律 1

缺失前提识别 1

置信度评估 1

能力提升 1

能力评测基准 1

能力迁移 2

脚手架演化 1

自主智能体 1

自博弈 6

自我反思 1

自我奖励 1

自我批判 1

自我改进 1

自我确定 1

自我纠错 1

自我训练 1

自蒸馏 1

自进化 6

自进化框架 1

自适应引导 1

自适应推理 1

蛋白质建模 1

裁判模型评测 1

规划评测 1

规则推理 2

规则评测 1

视觉推理 5

视觉生成 2

视频理解 1

视频生成 1

计算复杂度 1

认知习惯 1

认知工具 1

认知推理 2

认知链 1

训练策略 1

训练配方 1

记忆陷阱 1

评测偏差 1

评测基准 2

评测审计 1

评论器训练 1

课程学习 2

负向微调 1

趋势预测 1

跨域经验迁移 1

轻量化模型 1

过程奖励模型 4

过程评测 1

进化搜索 1

进化策略 1

连续推理 3

通用推理 1

逻辑增强 1

逻辑推理 2

逻辑生成 1

采样校准 1

量化感知训练 1

金融推理 1

错误共识 1

错误反思 1

音频生成 1

领域泛化 1

题目生成 1

首步纠错 1

验证器模型 1

高效探索 1

0%