VMware Cloud Foundation 9.1发布:AI工作负载支持与硬件优化升级
VMware发布Cloud Foundation(VCF)9.1更新,重点优化内存分层技术,将冷数据迁移至NVMe存储,降低对高容量RAM服务器的依赖。新版本还新增面向AI数据管道的下一代存储压缩功能、轻量级Kubern...
VMware发布Cloud Foundation(VCF)9.1更新,重点优化内存分层技术,将冷数据迁移至NVMe存储,降低对高容量RAM服务器的依赖。新版本还新增面向AI数据管道的下一代存储压缩功能、轻量级Kubern...
生成式AI的兴起推动了本地AI工作站的需求,但传统PC难以胜任。Tenstorrent的QuietBox 2配备四个定制Blackhole AI加速器和384GB内存,可运行OpenAI GPT-OSS-120B等大模型...
英伟达宣布向荷兰AI云服务提供商Nebius集团投资20亿美元,用于扩展其数据中心基础设施。Nebius将部署配备英伟达最新Rubin GPU和Vera CPU的服务器,以及BlueField芯片系列。新一代Rubin ...
OpenAI推出GPT-5.3-Codex-Spark模型,这是首个运行在Cerebras Systems AI加速器上的模型。该轻量级模型利用Cerebras的SRAM芯片内存技术,响应速度超过每秒1000个token...
d-Matrix通过其数字内存计算技术解决AI推理中的内存瓶颈问题,将矩阵乘法运算直接在内存单元内执行。该公司最近完成2.75亿美元融资,其Corsair平台采用异构架构,利用芯片组方法实现可扩展性。与传统GPU分离计算...
微软宣布其美国中央数据中心率先部署新型AI推理加速器Maia 200。该产品采用台积电3nm工艺,配备FP8/FP4张量核心和216GB HBM3e高速内存,数据传输速度达7TB/秒。相比竞品,Maia 200的FP4性...
树莓派发布售价130美元的AI HAT+ 2扩展板,配备8GB内存和Hailo 10H芯片,可提供40 TOPS AI性能。该扩展板专为树莓派5设计,能够本地运行Llama 3.2等小型生成式AI模型,处理AI工作负载的...
基于与英伟达的持续合作,红帽承诺为英伟达新发布的Vera Rubin平台提供"零日"支持。该企业开源软件公司旨在缩小英伟达硬件平台发布与其支持软件堆栈正式发布之间的时间差。Vera Rubin平台专为降低AI推理成本而设...
Apple TV在企业和零售环境中被严重低估。虽然它易于远程管理、稳定性强,能完美融入现有的设备管理流程,但仍未发挥全部潜力。主要障碍是缺少以太网供电(PoE)功能,导致大规模部署复杂化。目前需要两根线缆连接,增加了安装...
初创公司Positron获得5160万美元A轮融资,推出专门针对AI推理的Atlas芯片。该公司声称其芯片在性能功耗比和成本效益方面比英伟达H100高出2-5倍,并已获得Cloudflare等企业客户采用。Positro...
专家小组讨论了AI加速发展的关键要素,包括硬件芯片设计、量子计算作用和技术扩展。Cerebras展示了餐盘大小的WSE超级芯片,被称为"推理界的鱼子酱"。专家们探讨了从单原子量子比特到高精度计算的创新方法,预测量子计算将...
联想集团推出专为人工智能工作负载优化的数据中心系统产品组合。主打产品ThinkSystem SR680a V4计算设备集成近二十个处理器,推理工作负载运行速度比上一代硬件快11倍。该系统配备8块英伟达Blackwell ...
人工智能能耗问题引发关注,量子计算或成解决方案。量子硬件在某些方面更适合AI底层数学运算,但目前错误率仍偏高。研究人员正着手准备,以便在硬件就绪时运行AI模型。本文探讨了量子AI的潜力,包括量子电路在机器学习中的应用、将...
亚马逊云服务在获取高质量服务器以构建 AI 基础设施方面面临挑战。公司缩短了部分服务器和网络设备的使用寿命,以腾出空间部署加速计算机。这些问题影响了亚马逊近 1000 亿美元的 AI 基础设施投资计划。尽管如此,亚马逊仍...