本周,Kioxia 将旨在减少生成式 AI 系统中 DRAM 需求的 AiSAQ 技术作为开源软件发布。
AiSAQ(全称为"基于乘积量化的全存储式 ANNS")提供了一种针对 SSD 优化的"近似最近邻搜索" (ANNS) 算法。Kioxia AiSAQ 软件无需将索引数据存储在 DRAM 中,而是直接在 SSD 上进行搜索,从而为检索增强生成 (RAG) 提供可扩展的性能。
生成式 AI 系统需要大量的计算、内存和存储资源。Kioxia 表示:"虽然这些系统有潜力在各个行业推动变革性突破,但其部署通常成本高昂。" RAG 是 AI 的关键阶段,它通过公司或应用程序特定的数据来完善大语言模型 (LLM)。
RAG 的核心组件是一个向量数据库,它将特定数据累积并转换为用于检索的特征向量。RAG 还使用 ANNS 算法,该算法基于累积向量和目标向量之间的相似性来识别可改进模型的向量。Kioxia 表示:"为了使 RAG 有效,它必须能够快速检索与查询最相关的信息。"
传统上,ANNS 算法部署在 DRAM 中以实现这些搜索所需的高速性能。但 Kioxia 表示,AiSAQ 技术为十亿级数据集提供了一个"可扩展且高效"的 ANNS 解决方案,具有"可忽略的"内存使用量和"快速"的索引切换能力。
AiSAQ 的主要优势包括允许大规模数据库在不依赖有限 DRAM 资源的情况下运行,从而提高 RAG 系统的性能。它还消除了将索引数据加载到 DRAM 的需求,使向量数据库能够立即启动。这支持在同一服务器上在用户特定或应用程序特定的数据库之间切换,以实现高效的 RAG 服务交付。
它通过将索引存储在分布式存储中以实现多服务器共享,从而针对云系统进行了优化。这种方法可以针对特定用户或应用程序调整向量数据库搜索性能,并有助于在物理服务器之间迁移搜索实例。
Kioxia 欧洲首席技术官兼副总裁 Axel Stoermann 表示:"我们的 AiSAQ 解决方案为基于闪存 SSD 的生成式 AI 系统中的 RAG 应用提供了几乎无限的扩展可能。通过使用基于 SSD 的 ANNS,我们减少了对昂贵 DRAM 的依赖,同时满足了领先内存解决方案的性能需求,显著提升了大规模 RAG 应用的性能范围。"
好文章,需要你的鼓励
国产游戏正在迈向3A新时代,国内游戏市场迎来新的增长高峰,这背后除了开发者的创意与努力,先进的游戏开发技术和硬件设备同样功不可没。
据报道,Meta 正在加速其 AI 开发,测试首款自家设计的 AI 训练芯片。此举旨在降低庞大的基础设施成本,并减少对 NVIDIA 的依赖。Meta 希望在 2026 年之前能够使用该芯片进行训练。该专用加速器芯片专注于 AI 任务,能效高于通用的 NVIDIA GPU。Meta 的 MTIA 系列芯片专注于生成式 AI、推荐系统和高级研究,计划将其用于 Facebook 和 Instagram 的推荐系统,并最终应用于生成产品,如 Meta AI 聊天机器人。
金融服务业正面临数据爆炸式增长,预计到2026年将达到221,000艾字节。为应对这一挑战,行业正加速采用AI技术,以提高运营效率、生产力和降低成本。然而,AI的部署也带来了数据中心基础设施方面的新需求。本文探讨了金融服务业如何通过AI就绪的数据中心战略来应对数据重力挑战,实现数据本地化,并加速AI部署。
诺基亚在美国光纤网络市场取得重要进展,与两家互联网服务提供商签署合作协议。Outer Reach Broadband将在缅因州农村地区部署下一代光纤网络,BerryComm则将在印第安纳州中部为数千家企业提供高速互联网连接。这些项目旨在缩小数字鸿沟,促进当地经济发展,并为用户提供更快速、可靠的互联网服务。