近日,OPPO安第斯大模型 (AndesGPT)登上SuperCLUE的9月排行榜,在十大基础能力排行榜的“知识与百科”能力中仅次于GPT4排名国内大模型第一,“角色扮演能力”中排名前三。
SuperCLUE是针对中文可用的通用大模型的一个测评基准,它着眼于综合评价大模型的能力,使其能全面的测试大模型的效果,又能考察模型在中文上特有任务的理解和积累。SuperCLUE从三个不同的维度评价模型的能力:基础能力、专业能力和中文特性能力,其中基础能力包括了常见的有代表性的模型能力,如语义理解、对话、知识与百科、逻辑推理、角色扮演、代码、生成与创作等10项能力。
安第斯大模型 (AndesGPT)作为OPPO自主训练的生成式大语言模型,在8月初就开始随着OPPO智能助理小布启动对外邀测,旨在对传统语音助手进行内核级升级,9月初行业发现OPPO也在申请“AndesGPT”相关的商标。
此次在SuperCLUE十大基础能力排行榜上,“知识与百科”能力AndesGPT测试得分高达98.33,大幅度领先其他大模型,仅次于GPT4排名国内第一,这与知识与百科问答是智能助手最刚需应用场景息息相关。早在2020年,OPPO就已启动相关技术的探索与实践,曾获得大规模知识图谱问答KgCLUE行业评测的第一名,此次曝光的AndesGPT也是主打知识与问答能力,通过引入高质量的知识图谱、QA问答数据,并结合对预训练和指令精调技术的优化,显著提升了大语言模型知识与百科能力的覆盖面和准确性。
好文章,需要你的鼓励
DeepSeek 发布了新的大语言模型系列 R1,专为推理任务优化。该系列包括两个主要模型 R1 和 R1-Zero,采用混合专家架构,拥有 6710 亿参数。R1 在多项推理基准测试中超越了 OpenAI 的 o1 模型,而 R1-Zero 则代表了机器学习研究的重大进展。DeepSeek 已在 Hugging Face 上开源了这些模型的源代码。
国家机器人研究中心与 Freshwave 公司合作,利用私有 5G 网络测试农业机器人。这项合作旨在提升农业生产力,预计到 2026 年农业科技产业规模将达到 156 亿英镑。私有 5G 网络将为农业机器人提供高速、低延迟的连接,实现实时数据分析和精准农业操作,有望彻底改变农业生产方式。
Cognizant 推出了神经 AI 多代理加速器和服务套件,旨在帮助企业快速开发和部署 AI 代理。该技术通过预构建的代理网络模板和无代码框架,实现了跨职能的可扩展性和自主决策能力。这一创新有望推动 AI 代理在企业工作流程中的广泛应用,促进人机协作,提升业务效率和适应性。
西部数据公司财务总监Wissam Jabre将于2月28日辞职,恰逢公司分拆为硬盘和固态硬盘两个独立业务。公司正在寻找新的财务总监。尽管面临闪存业务定价环境更具挑战性,公司第二财季收入预计仍将达到43亿美元,同比增长42%。分析师认为硬盘业务表现强劲,可能抵消了闪存业务的部分疲软。