IBM正着手扩展Ceph的块和文件存储功能,希望将其定位为Storage Scale并行文件系统之下面向AI工作负载的后端数据存储。
Ceph是一款开源横向扩展存储软件,在底层对象存储之上提供文件、块和对象存储接口,拥有自修复与自托管等特性。IBM于2019年以340亿美元收购红帽时,顺带将Ceph纳入囊中。就在一年多之前,IBM决定将Ceph产品从红帽业务部门转移至存储部门,并将其更名为Storage Ceph。IBM Storage Ceph技术产品经理Gerald Sternagl刚刚在上个月的博文中公布了关于Ceph的后续开发计划,如今IBM存储业务总经理Denis Kennelly又通过简报进一步透露了更多信息。
Denis Kennelly
作为IBM存储业务(包括硬件与软件产品)负责人,Kennelly表示IBM存储收入中约有三分之二来自硬件,三分之一由软件贡献。Kennelly表示,IBM将在2023年扩大了其硬件存储市场份额,特别是高端DS8000阵列和FlashSystem全闪存阵列。那么Ceph销量有没有相应增长?他的回答很简单,“有,当然有。”
IBM Storage目前关注三大重点领域:混合云、AI以及数据恢复/弹性。Ceph在混合云和AI领域均发挥着重要作用,有助于在将非结构化数据引入大语言模型处理系统之前,提供对这些非结构化数据的访问。
IBM的Storage Defender产品与Cohesity长期保持合作关系,得益于对Cohesity-Veritas的收购,蓝色巨人在数据恢复与弹性领域的市场地位也有所增强。从原则上讲,这笔交易将帮助IBM在原本的Veritas客户群体中打开销路。在Kennelly看来,“备份市场显然正迎来一波兼并浪潮。”
回到Ceph,Kennelly认为Ceph充分满足了软件定义存储市场的需求。他表示,“红帽将Ceph、OpenShift与容器技术紧密结合在一起。我们希望通过在商用硬件上运行的完整软件定义存储技术栈来加速这一过程,并考虑采用来自戴尔、HPE、联想、Supermicro等厂商的服务器/存储硬件。”
在过去一年里,IBM通过添加对NVMe/TCP的支持扩展了Ceph的块存储功能,同时提高了产品可用性。Kennelly解释称,对于存储容量需求往往高达100 TB的AI项目,传统SAN方案往往显得捉襟见肘,相应扩展规划可能需要20到30个独立步骤。
他补充道,“在Ceph环境下,用户可以直接将100 TB容量放入单一设备,将其添加至集群当中,而后即可直接使用。”Ceph能够顺利兼容一切。“WatsonX团队也在与Ceph密切合作”,这里的WatsonX是IBM打造的生成式AI平台。
IBM有没有考虑过为Ceph添加GPUDirect支持能力?Kennelly坦言“我们正在考虑这方面需求”,而且IBM Storage已经提供出色的软件,即带有并行文件系统的Storage Scale,能够通过GPUDirect将数据快速传输至GPU服务器。
Kennelly还提到,“Storage Scale支持GPUDirect,我们可以将Scale与运行在底层的Ceph匹配起来。”
Scale还提供AFM(主动文件管理)可扩展、高性能文件系统缓存层,能够链接至Ceph后端。AFM使用户能够创建从本地Scale集群到独立存储/远程集群间的关联,并定义文件数据位置/流以实现数据自动化管理。用户能够跨全球各地的站点建立起拥有单一命名空间的数据存储视图。
IBM一直在进行Storage Scale基准测试,Kennelly也对测试结果表示满意,强调预计将在今年晚些时候公布结果。Scale-Ceph的基本思路,就是将数据存放在原本的位置,再由IBM对内容进行查询。这与Snowflake和Databricks等厂商“将数据交给我们,再由我们进行查询”的方法有所不同。
Kennelly补充道,“随着市场对于快速查询的需求日益提升,Storage Scale的优势也得到进一步凸显。用户当然可以直接选择NFS,但却永远得不到能够与Scale比肩的性能表现。”
在他看来,“AI即将迎来重大变革,面对这个激动人心的时刻,我们还有很多工作要做。”
而Ceph将在其中发挥强大的基础平台作用。通过作为底层数据存储方案的Storage,Ceph将把自己管理之下的数据交付给运行在GPU服务器当中的大语言模型。
好文章,需要你的鼓励
法国人工智能公司Mistral AI宣布完成17亿欧元(约20亿美元)C轮融资,由荷兰半导体设备制造商ASML领投。此轮融资使Mistral估值从去年的60亿美元翻倍至137亿美元。英伟达、DST Global等知名投资机构参投。作为欧洲领先的AI开发商,Mistral凭借先进的多语言大模型与OpenAI等美国公司竞争,其聊天机器人Le Chat具备语音模式等功能。
腾讯ARC实验室推出AudioStory系统,首次实现AI根据复杂指令创作完整长篇音频故事。该系统结合大语言模型的叙事推理能力与音频生成技术,通过交错式推理生成、解耦桥接机制和渐进式训练,能够将复杂指令分解为连续音频场景并保持整体连贯性。在AudioStory-10K基准测试中表现优异,为AI音频创作开辟新方向。
VAST Data收购了成立仅数月的初创公司Red Stapler,该公司由NetApp资深团队创立。Red Stapler创始人兼CEO Jonsi Stefansson将担任VAST云解决方案总经理,负责超大规模云战略。Red Stapler拥有6名开发人员,开发了跨SaaS交付、API集成、监控等功能的云控制平面和服务交付平台,将加速VAST AI OS在超大规模和多云环境中的部署,深化与全球领先超大规模云服务商的合作关系。
Meta与特拉维夫大学联合研发的VideoJAM技术,通过让AI同时学习外观和运动信息,显著解决了当前视频生成模型中动作不连贯、违反物理定律的核心问题。该技术仅需添加两个线性层就能大幅提升运动质量,在多项测试中超越包括Sora在内的商业模型,为AI视频生成的实用化应用奠定了重要基础。