当AI审核员遇到"灰色地带"
上海交大团队构建150万条五级安全标注的多模态数据集SafeAtlas-VL,训练出能同时判断图像、请求、回答风险等级并输出连续分数的SafeAtlas Guard模型,8B版本F1超越现有最强基线约4个百分点。
上海交大团队构建150万条五级安全标注的多模态数据集SafeAtlas-VL,训练出能同时判断图像、请求、回答风险等级并输出连续分数的SafeAtlas Guard模型,8B版本F1超越现有最强基线约4个百分点。
论文提出SHAPE框架,借数学教育学的语义空间与启发式概念,拆解AI解题的思维轨迹,发现策略比表面特征更能预测答案对错,且RL后训练会让策略使用趋于收窄,启发式提示可提升训练效果。
论文提出图像捆绑组合IBC新范式,突破传统逐张打分检索局限,构建IBCBench基准数据集,并提出BundleWeaver智能体框架实现动态照片组合检索,精确匹配率大幅超越现有方法。
研究者搭建3D游戏环境MineAmongUs,让AI在《among us》中同时展现语言和肢体欺骗行为,归纳出23种骗术并验证:非语言的伪装与杀人时机把控,比编造谎言更能决定胜负。
论文提出VAT训练框架,通过模拟验证过程和动态权重分配,让投机解码的草稿模型学会预判自身是否会被目标模型拒绝,在EAGLE-3和DFlash上实现最高11.4%接受长度提升和8.7%推理加速,且无需改动模型架构。
NVIDIA发布CUDA Toolkit 13.4,新增Windows on Arm支持、Rubin架构预览、MPS V3及CCCL 3.4等多项GPU开发与性能优化功能。
NVIDIA介绍Dynamo框架的Encode-Prefill-Decode解耦技术,在图像密集、短中等输出及量化MoE模型场景下可将首token延迟降低最高5倍,端到端响应提速最高7倍。
初创公司Cymphony完成2500万美元A轮融资,由Sequoia等领投,估值超1亿美元,专注解决AI代理带来的企业身份与数据安全风险。
Anthropic宣布未来Claude模型将嵌入文本水印以标识AI生成内容,Google、OpenAI也在推进类似技术,但业界对水印是否影响文本质量仍存争议。
Suno发布新模型系列Suno v6,改用华纳、BMG等授权音乐数据训练,此前该公司因版权问题遭多家唱片公司起诉,且承认曾用YouTube视频训练模型。
初创公司Besxar利用SpaceX猎鹰9号火箭在轨道试验半导体制造,已完成首批晶圆样本测试,未来计划借Starship扩大生产规模。
Instacart推出AI助手Clementine,可将对话、清单或食谱自动转化为购物车,并支持个性化推荐与手写清单识别。
e-con Systems详解ToF相机时域滤波原理,对比IIR、中值均值与自适应均值滤波算法,探讨降噪效果与运动模糊间的权衡及应用场景选择。
美国数据中心2025年用电量同比增长25.5%至312.6太瓦时,远超全美发电量3.2%的增速,电力可用性已成为数据中心选址的首要因素,开发商开始转向自备电力等混合供电方案。
随着AI辅助芯片设计普及,企业开始关注token使用效率与成本控制,推动开源模型、模型路由及流程封装等技术发展,以替代无限制使用前沿大模型。