本周,Kioxia 将旨在减少生成式 AI 系统中 DRAM 需求的 AiSAQ 技术作为开源软件发布。
AiSAQ(全称为"基于乘积量化的全存储式 ANNS")提供了一种针对 SSD 优化的"近似最近邻搜索" (ANNS) 算法。Kioxia AiSAQ 软件无需将索引数据存储在 DRAM 中,而是直接在 SSD 上进行搜索,从而为检索增强生成 (RAG) 提供可扩展的性能。
生成式 AI 系统需要大量的计算、内存和存储资源。Kioxia 表示:"虽然这些系统有潜力在各个行业推动变革性突破,但其部署通常成本高昂。" RAG 是 AI 的关键阶段,它通过公司或应用程序特定的数据来完善大语言模型 (LLM)。
RAG 的核心组件是一个向量数据库,它将特定数据累积并转换为用于检索的特征向量。RAG 还使用 ANNS 算法,该算法基于累积向量和目标向量之间的相似性来识别可改进模型的向量。Kioxia 表示:"为了使 RAG 有效,它必须能够快速检索与查询最相关的信息。"
传统上,ANNS 算法部署在 DRAM 中以实现这些搜索所需的高速性能。但 Kioxia 表示,AiSAQ 技术为十亿级数据集提供了一个"可扩展且高效"的 ANNS 解决方案,具有"可忽略的"内存使用量和"快速"的索引切换能力。
AiSAQ 的主要优势包括允许大规模数据库在不依赖有限 DRAM 资源的情况下运行,从而提高 RAG 系统的性能。它还消除了将索引数据加载到 DRAM 的需求,使向量数据库能够立即启动。这支持在同一服务器上在用户特定或应用程序特定的数据库之间切换,以实现高效的 RAG 服务交付。
它通过将索引存储在分布式存储中以实现多服务器共享,从而针对云系统进行了优化。这种方法可以针对特定用户或应用程序调整向量数据库搜索性能,并有助于在物理服务器之间迁移搜索实例。
Kioxia 欧洲首席技术官兼副总裁 Axel Stoermann 表示:"我们的 AiSAQ 解决方案为基于闪存 SSD 的生成式 AI 系统中的 RAG 应用提供了几乎无限的扩展可能。通过使用基于 SSD 的 ANNS,我们减少了对昂贵 DRAM 的依赖,同时满足了领先内存解决方案的性能需求,显著提升了大规模 RAG 应用的性能范围。"
好文章,需要你的鼓励
美国连锁超市巨头Albertsons正在基于Databricks构建商品智能平台,整合产品、定价、促销与陈列等决策功能,目标是在2026年底前全面向门店运营商落地。该平台以Databricks Lakehouse存储零售数据,通过Unity Catalog与AI Gateway实现数据治理,并借助AI智能体Genie支持自然语言查询,帮助商家洞察销售趋势,提升决策效率。此举是Albertsons今年四项AI核心战略投资之一。
阿里Qwen团队通过引入强化学习和在线策略蒸馏,将Qwen-Image-2.0升级为Qwen-Image-2.0-RL,让图像生成模型真正学会人类审美,文生图Elo评分提升78分,图像编辑提升93分。
微软正将Windows 11打造成真正的AI操作系统。在Build大会上,微软展示了AI模型与智能代理如何深度融合进Windows 11,让用户通过自然语言完成系统操作。借助Windows ML框架,超过5亿台PC已可在本地离线运行AI任务,无需联网、无token费用、数据不离设备。Office、Photos、Teams等应用已支持本地AI能力,Adobe、WhatsApp、Canva等第三方也在积极跟进,企业级AI PC采购需求有望加速。
港科大与快手联合提出NormGuard,针对流匹配模型强化学习训练中速度范数膨胀问题,通过训练时单向惩罚约束,在保留奖励的同时改善图像真实感。