戴尔利用面向人工智能工厂工作负载的全栈组件增强了PowerScale横向扩展集群文件系统阵列。
我们曾报道过VAST Data的人工智能堆栈方法和NetApp针对ONTAP的人工智能架构开发项目。现在,戴尔正在推出自己的全面人工智能堆栈产品,从PowerScale硬件和软件到具有大规模数据源摄取、矢量化和元数据处理功能的Data Lakehouse。这伴随着其PowerEdge XE9712(Nvidia GB200)和 M7725(水冷式 AMD Epyc)服务器以及基于 OCP 的水冷式集成机架 IR7000 系统,它们为这些人工智能工厂产品提供了计算能力和机架外壳。
戴尔基础架构解决方案集团总裁Arthur Lewis表示: “当今的数据中心无法满足人工智能的需求,这就需要采用模块化、灵活高效设计的高密度计算和液体冷却创新技术。这些新系统可提供企业所需的性能,使其在快速发展的人工智能领域保持竞争力。
PowerScale系统实际上是直接连接存储的PowerEdge服务器,使用OneFS操作系统。这些系统可以由3到252个节点组成集群。PowerScale现在支持200 Gbps以太网和InfiniBand前端网络,将以前的网络速度提高了一倍,吞吐量增加了63%。
OneFS现在支持61TB QLC(4bits/cell)固态硬盘来提高容量,比以前最大30.72 TB的硬盘容量提高了近一倍。此外,OneFS还为Data Lakehouse提供了元数据导出功能,并增强了软件功能,简化了向 Elasticsearch 数据库导出元数据的过程,从而提高了查询效率。跨地理分布集群的元数据可以组合起来,提供全局视图。
Data Lakehouse可以将这些元数据与从其他联合来源获取的其他数据结合起来。它将支持Iceberg等开放式表格格式,并将扩展到支持矢量数据库。此外,它还能从文件中提取内容元数据,增强其文件级元数据,并实现全上下文搜索。
Data Lakehouse可对Elasticsearch和开放格式扫描进行本地查询。其目的是通过使用SQL、矢量、词法和语义搜索数据使查询响应更加准确。
即将推出的戴尔文档加载器适用于Nvidia NeMo服务和检索增强生成(RAG)框架,旨在帮助客户缩短数据湖摄取数据的时间,降低计算和GPU成本。
戴尔表示,戴尔Data Lakehouse数据管理平台的增强功能可节省客户的时间,并通过灾难恢复、自动模式发现、全面的管理API和自助式全栈升级改善运营。
该公司宣布推出新服务,帮助PowerScale-Data Lakehouse客户,包括数据编目优化服务(Optimization Services for Data Cataloging)和数据管道实施服务(Implementation Services for Data Pipelines)。
戴尔生成式人工智能解决方案与英特尔合作,为人工智能部署提供联合设计、测试、验证、预配置和灵活的平台。这些解决方案采用配备英特尔Gaudi 3 AI加速器的PowerEdge XE9680 服务器,以及戴尔存储、网络、服务和开源软件栈。这些平台面向内容创建、数字助理、设计和数据创建、代码生成以及其他的生成式人工智能工作负载。
上市时间
好文章,需要你的鼓励
在“PEC 2025 AI创新者大会暨第二届提示工程峰会”上,一场以“AIGC创作新范式——双脑智能时代:心智驱动的生产力变革”为主题的分论坛,成为现场最具张力的对话空间。
人民大学团队开发了Search-o1框架,让AI在推理时能像侦探一样边查资料边思考。系统通过检测不确定性词汇自动触发搜索,并用知识精炼模块从海量资料中提取关键信息无缝融入推理过程。在博士级科学问题测试中,该系统整体准确率达63.6%,在物理和生物领域甚至超越人类专家水平,为AI推理能力带来突破性提升。
Linux Mint团队计划加快发布周期,在未来几个月推出两个新版本。LMDE 7代号"Gigi"基于Debian 13开发,将包含libAdapta库以支持Gtk4应用的主题功能。新版本将停止提供32位版本支持。同时Cinnamon桌面的Wayland支持持续改进,在菜单、状态小程序和键盘输入处理方面表现更佳,有望成为完整支持Wayland的重要桌面环境之一。
Anthropic研究团队开发的REINFORCE++算法通过采用全局优势标准化解决了AI训练中的"过度拟合"问题。该算法摒弃了传统PPO方法中昂贵的价值网络组件,用统一评价标准替代针对单个问题的局部基准,有效避免了"奖励破解"现象。实验显示,REINFORCE++在处理新问题时表现更稳定,特别是在长文本推理和工具集成场景中展现出优异的泛化能力,为开发更实用可靠的AI系统提供了新思路。