AMD推出面向AI推理的PCIe加速卡,兼容现有服务器基础设施
AMD发布Instinct MI350P PCIe加速卡,专为企业现有数据中心基础设施设计。该卡为双槽标准PCIe形态,支持风冷服务器,无需额外改造即可部署AI推理任务。MI350P配备144GB HBM3E显存,带宽高...
AMD发布Instinct MI350P PCIe加速卡,专为企业现有数据中心基础设施设计。该卡为双槽标准PCIe形态,支持风冷服务器,无需额外改造即可部署AI推理任务。MI350P配备144GB HBM3E显存,带宽高...
Cato Networks发布两项SASE平台新功能:Cato Neural Edge在全球85+节点部署英伟达GPU,实现实时流量检测、威胁识别和策略执行;Cato AI Security提供AI治理和运行时保护能力。...
在AWS re:Invent大会上,NVIDIA与亚马逊云科技宣布扩大战略合作,涵盖互联技术、云基础设施、开放模型和物理AI等领域。AWS将支持NVIDIA NVLink Fusion平台,整合其定制芯片包括Traini...
目前英伟达营收主要来自硬件销售,但当AI泡沫破裂时,这家GPU巨头将转型为全球最重要的软件公司。自2007年推出CUDA以来,英伟达已构建数百个软件库和框架,覆盖计算流体动力学、药物发现、量子计算等领域。当GPU价格下跌...
英伟达SCADA技术是一种新型存储数据IO方案,GPU可直接启动和控制存储IO操作。与现有GPUDirect协议不同,SCADA不仅接管数据路径,还控制IO控制路径。该技术特别适用于AI推理工作负载中小于4KB的小块数据...
Pure Storage发布Data Stream,这是一个以GPU为中心的AI数据管道集成硬件软件堆栈。该解决方案运行在FlashBlade//S和英伟达Blackwell GPU硬件上,可自动化加速企业AI管道的数据...
英伟达推出售价3000-4000美元的DGX Spark,号称"全球最小AI超算"。该设备搭载128GB内存,基于Blackwell架构的GB10芯片,虽然速度不及RTX 5090,但能运行消费级显卡无法处理的大模型。支...
OpenSearch 3.0发布,性能提升9.5倍,新增GPU加速向量搜索、生成式AI等功能,并优化数据传输和索引构建,助力AI应用发展。
VAST Data 开源其 VUA KVCache 软件,通过在 NVMe SSD 上存储 AI 模型推理过程中生成的令牌,避免重复计算,加快多步生成和对话续接。
Supermicro 执行长暨总裁 Charles Liang 表示:“我们的全新 2U 2 节点多 GPU 服务器是适用于视频直播、高阶云端游戏和无数社交网络应用的理想平台。