教AI做题,为什么"抄近路"的老师反而带不出好学生?
这篇论文系统研究了在线策略蒸馏(OPD)在大语言模型训练中的泛化规律,发现OPD传递的是教师的推理方式而非具体答案,训练难度影响很小;师生模型是否同源决定了迁移能力能否跨语言、跨领域延伸;多教师蒸馏中因教师影响力无法被路...
这篇论文系统研究了在线策略蒸馏(OPD)在大语言模型训练中的泛化规律,发现OPD传递的是教师的推理方式而非具体答案,训练难度影响很小;师生模型是否同源决定了迁移能力能否跨语言、跨领域延伸;多教师蒸馏中因教师影响力无法被路...
制造业正在成为人工智能规模化应用的主战场。近期工信部发布的数据显示,2026年上半年,我国规模以上制造业企业人工智能技术应用普及率超过30%。
这篇论文提出RecVerse,一款模拟真实电商购物行为的AI智能体,通过分层记忆系统解决长会话记忆难题,借助轨迹级强化学习让模拟行为在宏观频率和微观意图上都更贴近真实用户,并配套发布了首个支持多轮交互训练的电商基准数据集...
这篇论文提出AGENTMERCURY框架,让AI从高层业务场景出发自主合成可执行的虚拟世界,用于训练智能体。实验显示,用这些环境训练出的模型不仅在企业业务测试上表现更好,还在数学、编程等完全不相关的领域取得显著提升,同时...
这篇论文提出了一套两步超参数迁移框架,帮助研究者在不做昂贵试错搜索的情况下,为大规模混合专家(MoE)模型预测最优学习率。通过μP实现模型宽度间的学习率迁移,再结合小规模代理实验外推至万亿级token训练场景,研究团队成...
这篇论文提出行为提升度这一指标,用来分离AI推理模型中"频繁出现的行为"与"真正决定答案对错的行为"。通过对15个模型、15282条推理轨迹的分析,发现思考型模型放大的自我修正、假设检验、不确定性表达并非高提升度行为,而...
8月21日,2026成都国际车展开幕,鸿蒙智行尚界 Z7与尚界 Z7T 重磅亮相,现场人气爆棚,吸引观众驻足打卡,争相上车体验全新的鸿蒙智行专属座舱带来的出行新体验
这篇论文提出了一种不依赖任何标注信息或更强教师模型的视觉训练方法,核心思路是让教师模型看原始清晰图片,学生模型看故意降质的模糊图片,用两者预测结果的差异作为训练信号。该方法在多个精细感知和数学推理基准上,让一个40亿参数...
这篇论文提出了一套系统评价框架,从方案构思、执行落地、反馈控制三个维度拆解AI agent的科研过程,并通过对照实验衡量经验复用与脚手架系统对表现的影响,发现当前顶尖AI模型更像工程优化师而非自主研究者,真正的方法论创新...
上海AI实验室提出Mobius架构,将大模型中负责知识存储的FFN模块解耦为全局共享数据库,供各层Self-Attention共同调用,配合动态潜在推理机制。7B模型用62.6%训练数据达到同等效果,35B模型继续预训练...
AI模型平台Hugging Face正探索出售事宜,估值或超130亿美元。据报道,公司已聘请银行寻访潜在买家,谈判尚处早期阶段。Hugging Face上次融资为三年前的2.35亿美元C轮,估值45亿美元,由Salesf...
据Synergy Research Group数据,全球前20大超大规模数据中心市场中,美国占据15席。北弗吉尼亚仍是最大单一市场,承载全球近12%的超大规模算力,仅劳登县就有约250座数据中心。过去两年美国优势进一步扩...
OpenAI首席执行官Sam Altman近日表示,他担忧AI技术未来将被少数公司或个人掌控,导致大多数人对AI影响社会的方式失去话语权。他强调AI发展方向应由社会选择主导,而非由少数企业决定。Altman同时承认,此前...
2014年,Simonyan和Zisserman提出双流卷积网络,把视频拆成静态画面和光流运动两条独立网络分别处理再融合判断,首次让深度学习在动作识别任务上超越统治多年的手工特征方法密集轨迹,成为视频理解领域深度学习崛起...
这篇论文提出SimpleOPD,一种跨分词器的在线策略蒸馏方法,把长上下文数学推理模型SU-01的证明能力迁移到多个短上下文学生模型上。通过文本层面的token对齐、终止符屏蔽和学生参考KL约束解决训练不稳定问题,Int...