苹果据悉正打造搭载M系列Ultra芯片的AI服务器
据报道,苹果正开发搭载M8 Ultra芯片的企业级AI服务器,预计2029年发布,或与英伟达NVLink技术互联,为近20年来首款苹果服务器产品。
AI基础设施成本飙升,云游戏未来蒙阴影
AI算力需求推高数据中心成本,GeForce Now设100小时月上限,微软Xbox云游戏11月起按会员分档限5至15小时,亚马逊称Luna仍将长期投入。
机器人正等待"ChatGPT时刻":英伟达高管解读症结所在
英伟达Inception物理AI全球负责人Les Karpas将在TechCrunch Disrupt 2026大会上探讨机器人技术尚未迎来爆发式突破的核心原因——缺乏互联网级规模的物理AI数据集,以及仿真、合成数据等潜...
Apple可能重返服务器市场,借AI热潮东山再起
据The Information报道,苹果考虑重启服务器业务,产品或于2029年推出,搭载M8 Ultra芯片,并可能采用Nvidia NVLink Fusion互联技术。
Jensen Huang在Dreamforce:如今我们能知晓一切、做到一切
NVIDIA黄仁勋在Salesforce Dreamforce大会宣布,双方合作推出基于NVIDIA Nemotron 3 Super的CRM推理模型Koa,已在Slack内部使用,10月起进入客户试点。
AI进展与责任:英伟达、Anthropic、OpenAI CEO齐聚Dreamforce
Salesforce Dreamforce大会上,英伟达黄仁勋、Anthropic的Amodei与OpenAI的Altman同台,讨论Koa模型发布、Claude深化合作及AI安全责任议题。
Nvidia推出PAIR工具支持本地搭建AI集群
Nvidia发布免费测试版工具PAIR,可连接同一网络下运行Windows、macOS或Linux的多台设备,组成AI推理集群,通过单一界面统一调用本地闲置算力。
NVLink 6如何为AI工厂提供多层容错保障
NVIDIA详解NVLink 6如何通过物理层、链路层、软件与系统层的多层容错设计,实现无丢包、快速故障恢复与高可用性,支撑大规模AI训练与推理集群不间断运行。
Agility新款人形机器人:靠近员工会自动下蹲避让
Agility Robotics推出Digit 5人形机器人,可自主检测人类并采取避让、静止或下蹲等动作,减少工作场所伤害风险,预计2027年上半年提供早期试用。
Salesforce发布Koa模型 专攻CRM数据推理
Salesforce与Nvidia合作,基于Nemotron架构训练发布Koa模型,专用于Agentforce平台中CRM多步骤任务推理,使用合成数据训练,预计冬季正式上线。
Salesforce与英伟达联手推出的推理模型让AI巨头们该警惕了
Salesforce与英伟达合作推出首款推理模型Koa,基于Nemotron开放权重模型训练,专为销售与客服场景优化,未使用客户真实数据,可降低企业AI使用成本。
AI推理革命已至:硬件厂商加速转型应对海量查询
LLM推理需求激增推动Nvidia、Amazon等联手Cerebras、Groq等公司,通过堆叠内存、DRAM互联、SRAM芯片等新架构突破内存带宽瓶颈。
Splunk重构平台架构,全面拥抱AI智能体时代
思科旗下Splunk推出Cisco Data Fabric等新架构,联合Nvidia、AWS拓展安全与可观测性能力,助力企业管理AI代理产生的海量数据。
英伟达与Palantir联合优化300亿参数模型,性能超18倍规模大模型
英伟达与Palantir合作,用微调后的Nemotron 3.5 Lightning(300亿参数)处理供应链分配任务,准确率达86.7%,超越550亿参数18倍的Nemotron 3 Ultra模型(55.5%)。双方...
英伟达扩展CUDA-Q平台以支持容错量子处理器
英伟达发布CUDA-Q Logical编排层,帮助开发者应对容错量子系统开发难题,费米实验室借此将算法开发周期从五个月缩短至三周。
OpenAI如何用自家大语言模型设计辣椒芯片
OpenAI首款AI加速芯片Jalapeno历时不到20个月完成流片,团队借助内部LLM大幅缩短设计周期,并计划在下一代芯片中进一步扩大AI应用范围。
Arm推出Neoverse CSS N4与AGI CPU,加码AI芯片布局
Arm发布新款Neoverse CSS N4计算子系统及AGI CPU,面向AI数据中心与自主代理型AI工作负载,已获OpenAI、Meta、Oracle等企业支持。
AI基础设施公司Cornelis完成2.05亿美元融资,剑指英伟达市场垄断
AI基础设施公司Cornelis完成2.05亿美元融资,并推出Active Compute Fabric网络技术,通过开放架构降低GPU等待数据的时间损耗,对标英伟达生态。




















