人工智能正在颠覆企业虚拟化架构的深层原因
过去十年企业虚拟化基础设施运行稳定,但AI工作负载的兴起暴露了传统虚拟化架构的局限性。AI需要裸机级性能、高密度计算和低延迟互连,而传统虚拟机管理程序无法满足这些要求。虽然VMware许可费用上涨引发关注,但真正问题在于...
过去十年企业虚拟化基础设施运行稳定,但AI工作负载的兴起暴露了传统虚拟化架构的局限性。AI需要裸机级性能、高密度计算和低延迟互连,而传统虚拟机管理程序无法满足这些要求。虽然VMware许可费用上涨引发关注,但真正问题在于...
英伟达在GTC大会上宣布,将使用价值200亿美元收购的Groq语言处理单元(LPU)技术,来提升新发布的Vera Rubin机架系统的AI推理性能。这项技术使英伟达能够以每用户每秒数百至数千个token的速度服务大型语言...
在智能自动化大会上,行业领袖探讨了为何许多自动化项目在试点阶段后停滞不前。皇家邮政流程自动化分析师Promise Akwaowo与NatWest集团、液化空气、AXA XL代表共同强调,扩展自动化的关键在于架构弹性而非简...
Anthropic推出Agent Skills后,引发了架构设计的根本问题:什么时候该用智能体,什么时候该用技能模块?智能体是具备完整决策能力的实体,而技能模块是可重用的专业知识包。早期智能体系统面临上下文窗口臃肿、能力...
Databricks发布新的"指令检索器"架构,结合传统数据库查询与RAG相似性搜索,提供更精准的AI响应。该技术将用户请求分解为具体搜索词和过滤指令,确保检索文档符合时间、元数据等约束条件。相比传统RAG仅依赖文本相似...
微软最新调研显示,超过半数企业在AI规模化部署时面临基础设施不足问题。传统架构难以支撑AI工作负载需求,企业需要采用混合云原生设计、高带宽低延迟连接、零信任安全等现代化架构。GPU基础设施建设复杂,需要专门的网络优化和负...
分布式计算初创公司Taho完成350万美元种子轮融资,目标是替代Kubernetes成为人工智能工作负载的主要编排和调度层。该公司由来自Meta、谷歌和Snap的基础设施资深人员创建,声称其计算框架可将工作负载处理时间提...
谷歌宣布为云客户推出定制Ironwood芯片,这款张量处理单元可在单个pod中扩展至9216个芯片,成为该公司迄今最强大的AI加速器架构。新芯片将在未来几周内向客户提供,同时推出基于Arm的新Axion实例,承诺提供比当...
谷歌云推出开放湖仓架构,解决企业数据孤岛问题,统一结构化与非结构化数据管理。该平台基于BigLake存储引擎构建,采用Apache Iceberg开放格式,支持多模态数据处理。通过Dataplex通用目录实现数据治理,提...
随着VMware推进基于核心虚拟化技术的私有云愿景,竞争对手正加速开发替代方案。OpenNebula发布7.0版本,新增ARM处理器支持和增强的PCI直通功能,可部署在AI工厂中。红帽OpenShift Virtuali...
随着AI模型参数达到数十亿甚至万亿级别,工程团队面临内存约束和计算负担等共同挑战。新兴技术正在帮助解决这些问题:输入和数据压缩技术可将模型压缩50-60%;稀疏性方法通过关注重要区域节省资源;调整上下文窗口减少系统资源消...
英伟达发布了基于 Meta 旧版 Llama-3.1 的全新开源大语言模型 Llama-3.1-Nemotron-Ultra-253B。该模型在多项第三方基准测试中表现出色,尽管参数量仅为 DeepSeek R1 的一半...