HPC供应商DDN加入小型的、但不断增长逐渐进入企业AI主流市场的公司,DDN旗下的存储产品可与Nvidia的DGX-1 GPU服务器结合在一起。
DDN最近出台了一系列举措以扩展旗下企业存储公信力,上个月收购了Tintri(https://www.theregister.co.uk/2018/09/05/ddn_buys_tintri_biz_remains_for_60mn/)后有了出售企业存储阵列的能力,现在又凭借旗下A3I品牌的可扩展参考架构产品进入人工智能(AI)系统领域。
企业AI系统市场最初由Pure建立,Pure将AIRI(https://www.theregister.co.uk/2018/03/27/pure_nvidia_ai_airi/)的FlashBlade阵列与DGC-1双响炮结合在一起。后来NetApp携其A700全闪存阵列/ FGX-1组合加入该市场,后来又推出更快的A800/ DGX-1装置(https://www.theregister.co.uk/2018/08/03/netapp_a800_pure_airi_flashblade/)。戴尔EMC则推出人工智能完备解决方案(Ready Solution for AI):深度学习(https://www.theregister.co.uk/2018/08/07/dell_emc_ai_deep_learning/ ),思科也推出了C480 AI /机器学习服务器(https://www.theregister.co.uk/2018/09/10/cisco_ai_server_nvlinked_tesla_gpu/)。
所有这些系统都涉及到全闪存,DDN则拥有AI200和AI400全闪存系统以及混合闪存/磁盘AI7990。二者都运行DDN的Exascaler软件,Exascaler是个基于Lustre的并行文件系统。
AI200是个容量高达360TB的24倍双端口NVMe闪存驱动器,置于2U机箱内,以4 x EDR InfiniBand(EDR IB)或100Gbit / s以太网(100 GbitE)连接到DGX-1。AI200可提供高达20GB/秒的文件系统顺序读取吞吐量和超过100万IOPS。
AI400使用相同的机箱,可提供高达40GB/秒的顺序读取吞吐量和高达300万IOPS。AI400具有8个EDR InfiniBand端口或100GbitE端口,闪存容量与AI200相同。
而较大的AI7990则置于4U机箱内,回归20Gb /秒的顺序读取性能,可提供高达700,000的IOPS。AI7990支持90 x 3.5英寸的插槽,可用于SSD和磁盘驱动器。最多可以有4个扩展机座,每机座有90个架,可提供高达5.6PB的容量。
DDN 的A3I解决方案简介可从网上下载(https://www.ddn.com/?wpdmdl=42534&ind=1538608827207),简介里提供了使用A3I软件的示例,例如Resnet-50和Resnet-152,Caffe GoogleNet,Inception V3 。
A3I解决方案指南(http://www.ddn.com/?wpdmdl=42573&ind=1538599065785)提供了Tensorflow,Horovod,TensorRT,Torch,PyTorch提供具有9 x DGX-1服务器和系统性能的AI200及其他AI框架的配置示例。
在Resnet-152和Resnet-50测试中,AI200的测试速度比竞争对手Pure、NetApp和Dell EMC的系统更快。思科未提供旗下AI系统性能的任何公开信息。
AI200和AI7990数据表可从此处获取:https://www.ddn.com/products/a3i-accelerated-any-scale-ai/。
好文章,需要你的鼓励
数据分析平台公司Databricks完成10亿美元K轮融资,公司估值超过1000亿美元,累计融资总额超过200亿美元。公司第二季度收入运营率达到40亿美元,同比增长50%,AI产品收入运营率超过10亿美元。超过650家客户年消费超过100万美元,净收入留存率超过140%。资金将用于扩展Agent Bricks和Lakebase业务及全球扩张。
Meta与特拉维夫大学联合研发的VideoJAM技术,通过让AI同时学习外观和运动信息,显著解决了当前视频生成模型中动作不连贯、违反物理定律的核心问题。该技术仅需添加两个线性层就能大幅提升运动质量,在多项测试中超越包括Sora在内的商业模型,为AI视频生成的实用化应用奠定了重要基础。
医疗信息管理平台Predoc宣布获得3000万美元新融资,用于扩大运营规模并在肿瘤科、研究网络和虚拟医疗提供商中推广应用。该公司成立于2022年,利用人工智能技术提供端到端平台服务,自动化病历检索并整合为可操作的临床洞察。平台可实现病历检索速度提升75%,临床审查时间减少70%,旨在增强而非替代临床判断。
上海AI实验室发布OmniAlign-V研究,首次系统性解决多模态大语言模型人性化对话问题。该研究创建了包含20万高质量样本的训练数据集和MM-AlignBench评测基准,通过创新的数据生成和质量管控方法,让AI在保持技术能力的同时显著提升人性化交互水平,为AI价值观对齐提供了可行技术路径。