ForgeWM:如何让游戏世界模型在一步之内学会"听懂"你的操作
ForgeWM是一套四阶段渐进式训练框架,能把双向视频生成器改造成支持一到四步实时推理的游戏世界模型,兼顾低延迟、画质与键鼠手柄操作的精确响应,并提供回放精修功能提升离线画质。
ForgeWM是一套四阶段渐进式训练框架,能把双向视频生成器改造成支持一到四步实时推理的游戏世界模型,兼顾低延迟、画质与键鼠手柄操作的精确响应,并提供回放精修功能提升离线画质。
这篇论文提出MuseCPEval,首个系统评估AI音乐编辑系统"上下文保持能力"的框架,覆盖和声、节奏、结构、旋律四大维度共十项指标,通过客观实验与人类听觉测试验证有效性,并对四个代表性音乐编辑系统进行诊断分析,揭示各自...
本文介绍RapidLiDAR,一种激光雷达场景补全新方法。它用可学习的自适应初始化模块替代固定噪声扰动,并以体素和鸟瞰图特征取代传统近邻搜索,在保持业内领先精度的同时,将单次场景补全速度提升至0.1秒,比此前最快方法快2...
VA-Judger是一个通过学习人类偏好训练出的AI评审模型,用于评估联合视频音频生成的质量,解决了现有自动化指标各自为战、无法捕捉跨模态整体协调性的问题。研究团队构建了VAPref-10K人类偏好数据集,通过三阶段训练...
这篇论文提出HOTFIXR方法,通过让语言模型的"出题助手"探测学生模型在不同语言下的推理弱点(包括无法回答和跨语言表征错位两类问题),生成针对性合成数据进行训练。实验显示该方法在提升多语言领域内表现的同时,显著减少了灾...
这篇论文提出APC架构,把AI智能体的权限管理设计成一条随任务委托不断收紧的链条,通过组合闭包和爆炸半径收缩机制,从系统架构层面而非依赖模型自身抵抗提示词注入攻击,实测数据泄露类攻击成功率降至0%。
这篇论文提出SPK框架,通过挖掘预训练目标检测器内部已隐含的语义、几何、上下文知识,构建五维结构化表示,在不修改检测器参数的前提下实现了跨架构、跨数据集的最先进分布外幻觉检测效果,并提供可解释的判断依据。
随着企业AI从单次模型调用转向长期运行的Agent,推理基础设施的关注点也在变化:除GPU算力外,上下文能否持续保存、跨实例复用,并在Agent暂停和再次唤醒时低成本恢复,正越来越直接地影响实际运行效率
麻省理工学院量子计划(QMIT)在戈登与贝蒂·摩尔基金会的资助下,正式启动博士后奖学金项目,旨在加速跨学科量子研究,培育下一代量子科学领袖。该项目面向物理、化学、材料科学及生物、地球科学等领域的优秀量子研究人员,鼓励其将...
Instagram宣布更新AI账号标注政策,将原有"AI创作者"标签改为"AI生成档案",并对未主动标注AI生成人物的账号实施限流处罚。新规旨在回应用户对AI虚拟人物冒充真实用户的不满。使用AI编辑图片或润色文案的普通用...
MIT地球、大气与行星科学系首席研究科学家Sai Ravela带领团队,通过"蛇梯棋"到手机App的三阶段游戏模型,帮助印度和孟加拉国沿海村庄应对盐碱化、洪涝等气候风险。该项目由J-WAFS资助,结合气候降尺度建模与社区...
麻省理工学院研究人员发现,短肽不仅能在接近纯硫酸的金星云层环境中保持稳定长达数周,还能折叠成特定的三维结构——类似于天然蛋白质中的"ω环"。研究表明,高浓度硫酸中水分子极少,使得通常破坏肽键的水解反应无法发生,从而保护了...
菲律宾籍MIT数据、经济与政策设计硕士生Lyonel Tanganco,致力于将数据分析与政策实践结合,改善中等收入国家的民众生活。他曾在菲律宾财政部推动烟酒税改革,使医疗预算增长六倍,并主导惠及19万户家庭的有条件现金...
随着AI智能体技术的发展,企业软件供应商正从传统按席位定价转向基于结果的定价模式。Zendesk按问题解决次数收费,Pegasystems按完成案例收取固定费用,HP也在其企业IT管理平台中引入结果承诺机制。该模式理论上...