12月18日,由中国信息通信研究院、中国通信标准化协会、北京市大数据中心联合主办的“2020数据资产管理大会”在北京拉开帷幕,会上信通院为通过大数据、数据库等能力评测的产品颁发证书。华为云GaussDB(DWS)数据仓库以单集群2048节点的超大规模,满分通过测试认证,是迄今为止信通院认证的最大规模分布式数据库集群,刷新了历史纪录,树立了业界新标杆。
随着移动互联网、IoT、人工智能等技术的迅速发展,数据产生的规模空前增长,据知名咨询机构统计,预计未来5年数据规模年均增速达30%,面对快速膨胀的数据规模,各类企业、机构需要更快、更全面的掌握分析数据,挖掘内在价值,支撑经营决策和优化管理,数据仓库作为核心查询分析平台,必须要具备大规模集群能力,也是数据库厂商需要突破的核心技术点之一。
华为云GaussDB(DWS)为各企业用户提供最佳性能、按需扩展、稳定可靠的企业级数据仓库,满足客户超大规模数据的高性能查询分析诉求。在本次大规模集群测试评估中,华为云GaussDB(DWS)一次性通过50项测试用例,包括27项必选用例和23项可选用例,交出了完美的答卷。
大规模数据仓库集群不仅仅是将众多服务器“攒”起来,更需要解决大并发复杂查询下的通信连接风暴问题。并且在数千节点的集群中,平均每天都会有硬件故障发生,如何应对“硬件不可靠”带来的问题?如何在硬件亚健康情况下数据仓仍能提供稳定的性能,如何在操作系统“软死”情况下数据仓库不出现卡顿、无响应等问题,是技术面临的极大挑战。在2048节点大规模集群认证的背后,是华为云GaussDB(DWS)强大“硬核科技”的表现。
一、Multi-Streams多流通信技术
在2048节点规模下,集群进行全并行数据交换时,集群内可达百亿级的并行连接,出现通信连接风暴,已远远超出TCP连接端口号和socket文件句柄上限。
GaussDB(DWS)自研的Multi-Streams多流通信技术,将连接数提升5个数量级,突破物理机TCP连接端口限制,能够支持集群内百亿级通信连接,并且理论支持节点数无上限。
Multi-Streams多流通信采用逻辑连接技术,避免了TCP物理连接的三次握手的机制,单数据节点建连性能达到100万次/s,提升20倍。
该技术基于全异步无阻塞代理通信架构,支持跨逻辑连接的socket合并,将网络吞吐能力提升3倍。
二、高可用设计及集群管理技术
GaussDB(DWS)设计之初,即充分考虑高可用性,其具备多层级高可用及容灾能力,在进程级、节点级、集群级出现软硬件异常的情况下具备平滑处理能力。
在棘手的硬件亚健康、“软死”问题上,GaussDB(DWS)具备完善的智能检测和处理机制,能够实时监测任意节点状态,包括服务器亚健康状态、磁盘慢盘、静默损坏等等场景,通过自动感知、剔除、平滑切换等高可用策略,提高业务的连续性。
并且,在物理组件发生故障的情况下,Server端Multi-Retries技术能够大幅减少故障失败的业务感知,保障业务持续运行。
在集群管理上,针对超大节点数场景,通过逻辑重构,实现集群起停的全并行处理,2048节点规模下具备分钟级起停能力。
三、大规模场景下的并行数据备份恢复技术
完全在线:数据备份期间,采用全程无加锁技术,任何业务SQL、包括DDL均不受影响
多层级并行极速备份:每节点独立多并发、多通道备份,提供10PB级数据快速备份恢复性能
全局一致性快照:集群级全局一致性快照,数据强一致性保证
细粒度数据恢复:支持多粒度数据恢复,满足客户误删、个别表损坏等紧急恢复需求。
得益于包括以上三点在内的一系列核心技术,华为云GaussDB(DWS)一举通过信通院2048节点大规模分布式分析型数据库评测,成为国内首个单集群突破两千的商用数据仓库产品。
华为云GaussDB(DWS)数据仓库已广泛应用于金融、政府、运营商、交通、物流、互联网等领域,服务于全球1000+客户。GaussDB(DWS)践行"平台+生态"战略,联合500+合作伙伴,为各行业提供竞争力的数据仓库解决方案。
好文章,需要你的鼓励
IBM Spyre加速器将于本月晚些时候正式推出,为z17大型机、LinuxONE 5和Power11系统等企业级硬件的AI能力提供显著提升。该加速器基于定制芯片的PCIe卡,配备32个独立加速器核心,专为处理AI工作负载需求而设计。系统最多可配置48张Spyre卡,支持多模型AI处理,包括生成式AI和大语言模型,主要应用于金融交易欺诈检测等关键业务场景。
加拿大女王大学研究团队首次对开源AI生态系统进行端到端许可证合规审计,发现35.5%的AI模型在集成到应用时存在许可证违规。他们开发的LicenseRec系统能自动检测冲突并修复86.4%的违规问题,揭示了AI供应链中系统性的"许可证漂移"现象及其法律风险。
意大利初创公司Ganiga开发了AI驱动的智能垃圾分拣机器人Hoooly,能自动识别并分类垃圾和可回收物。该公司产品包括机器人垃圾桶、智能盖子和废物追踪软件,旨在解决全球塑料回收率不足10%的问题。2024年公司收入50万美元,已向谷歌和多个机场销售超120台设备,计划融资300万美元并拓展美国市场。
这项由剑桥大学、清华大学和伊利诺伊大学合作的研究首次将扩散大语言模型引入语音识别领域,开发出Whisper-LLaDA系统。该系统具备双向理解能力,能够同时考虑语音的前后文信息,在LibriSpeech数据集上实现了12.3%的错误率相对改进,同时在大多数配置下提供了更快的推理速度,为语音识别技术开辟了新的发展方向。