2025-09-28 科研追新
当日精选(由提交工具自动创建)。
上交大新范式:78条高质量样本胜过万条数据
上交大提出重视策略密度的数据范式,仅用78条高质量样本取得优于万条数据训练的效果,表明智能体训练应从追求数量转向提升数据质量。
相关报道介绍了上交大面向智能体训练的新范式:仅使用78条精心构造的样本,效果便超过依赖约1万条数据的方案。其核心观点是,训练价值不只取决于数据规模,更取决于每条样本能够承载多少有效策略与决策经验。这意味着数据设计可从简单扩量转向提高策略密度、任务覆盖度和反馈质量。该结果也为降低智能体训练成本提供了新的思路。
用途与启示
- 将训练数据的评估重点从样本数量转向策略密度与信息含量
- 通过少量高质量轨迹降低智能体的数据收集和训练成本
- 启发研究者改进样本筛选、任务设计及训练数据构造方法
📝 原始笔记(逐字保留)
7. 🌈 [AI烧钱时代要结束了?78个样本打败大厂](https://www.xiaohongshu.com/explore/68d89704000000001201fab2?app_platform=ios&app_version=9.2&share_from_user_hidden=true&xsec_source=app_share&type=normal&xsec_token=CB-Gumy8Cd-2u99Q5_Msihcpsae6ar6BEQdx6bevE19BQ=&author_share=1&xhsshare=WeixinSession&shareRedId=ODZFOTRHNU02NzUyOTgwNjY0OTc0Oko7&apptime=1759028066&share_id=240619ec11874f3db5beb3cb102eaa1d&wechatWid=e071d48db6d5ec0f08890ce3658fa485&wechatOrigin=menu)、[78条打穿1万条!上交大新范式告诉你:智能体训练靠“质”,不是靠“量”](https://mp.weixin.qq.com/s/V3WnBxCz50a8nRb0rapcgA)
1. **与其问“我们需要多少数据”,不如问“每条数据里能装下多少策略”。**
# 新闻