近日,OPPO安第斯大模型 (AndesGPT)登上SuperCLUE的9月排行榜,在十大基础能力排行榜的“知识与百科”能力中仅次于GPT4排名国内大模型第一,“角色扮演能力”中排名前三。
SuperCLUE是针对中文可用的通用大模型的一个测评基准,它着眼于综合评价大模型的能力,使其能全面的测试大模型的效果,又能考察模型在中文上特有任务的理解和积累。SuperCLUE从三个不同的维度评价模型的能力:基础能力、专业能力和中文特性能力,其中基础能力包括了常见的有代表性的模型能力,如语义理解、对话、知识与百科、逻辑推理、角色扮演、代码、生成与创作等10项能力。
安第斯大模型 (AndesGPT)作为OPPO自主训练的生成式大语言模型,在8月初就开始随着OPPO智能助理小布启动对外邀测,旨在对传统语音助手进行内核级升级,9月初行业发现OPPO也在申请“AndesGPT”相关的商标。
此次在SuperCLUE十大基础能力排行榜上,“知识与百科”能力AndesGPT测试得分高达98.33,大幅度领先其他大模型,仅次于GPT4排名国内第一,这与知识与百科问答是智能助手最刚需应用场景息息相关。早在2020年,OPPO就已启动相关技术的探索与实践,曾获得大规模知识图谱问答KgCLUE行业评测的第一名,此次曝光的AndesGPT也是主打知识与问答能力,通过引入高质量的知识图谱、QA问答数据,并结合对预训练和指令精调技术的优化,显著提升了大语言模型知识与百科能力的覆盖面和准确性。
好文章,需要你的鼓励
购买笔记本电脑时,用户现在需要了解Copilot+ PC、NPU和本地AI处理等新概念。搭载专用神经处理单元(NPU)的Copilot+ PC能提供至少40 TOPS的AI算力,支持实时字幕翻译、视频通话优化、AI图像编辑等功能,同时提升续航表现。戴尔最新产品线涵盖多种选择:Dell 14 Plus适合学生和通勤族,Dell 16 Plus适合多任务办公用户,XPS 14面向轻度创作者,XPS 16则以31小时超长续航和3.6磅轻薄机身成为内容创作者的旗舰之选。
上交大与爱丁堡大学提出InfoKV,将信息熵与注意力权重结合用于KV缓存压缩,让大模型在仅保留12.5%缓存的条件下实现接近甚至超越完整缓存的长推理性能。
圣安德鲁斯大学博士Henry Legg在《自然》杂志发表同行评审论文,对微软拓扑间隙协议(TGP)框架提出质疑,认为该框架在推断Majorana粒子量子态存在方面存在缺陷,且实验数据分析结论可能有误。微软此前宣称将于2029年实现可扩展量子计算机,并推出Majorana 2芯片。对此,微软坚持立场,表示已发表正式反驳并获《自然》收录,对研发路线图充满信心。
强化学习训练AI时悄悄留下的"进展优势"信号,可作为免费的步骤级评分器,无需额外训练,在多个智能体任务上超越专用奖励模型。