CUDA Toolkit 13.4发布:新增Arm版Windows支持
NVIDIA发布CUDA Toolkit 13.4,新增Windows on Arm支持、Rubin架构预览、MPS V3及CCCL 3.4等多项GPU开发与性能优化功能。
NVIDIA发布CUDA Toolkit 13.4,新增Windows on Arm支持、Rubin架构预览、MPS V3及CCCL 3.4等多项GPU开发与性能优化功能。
NVIDIA介绍Dynamo框架的Encode-Prefill-Decode解耦技术,在图像密集、短中等输出及量化MoE模型场景下可将首token延迟降低最高5倍,端到端响应提速最高7倍。
e-con Systems详解ToF相机时域滤波原理,对比IIR、中值均值与自适应均值滤波算法,探讨降噪效果与运动模糊间的权衡及应用场景选择。
随着AI辅助芯片设计普及,企业开始关注token使用效率与成本控制,推动开源模型、模型路由及流程封装等技术发展,以替代无限制使用前沿大模型。
欧洲初创公司The Exploration Company完成4.5亿美元C轮融资,创欧洲太空公司最大C轮纪录,将用于开发可重复使用航天器Nyx及Storm火箭发动机,目标2028年前实现与国际空间站对接。
随着技术栈日益分布化,可观测性从DevOps工具演变为CIO管理工具。Riverbed与PagerDuty高管指出,AI正提升可观测性能力,同时为AI代理监控带来新挑战,未来将更趋主动预防。
OpenAI、Anthropic、SpaceXAI三大AI服务周四几乎同时出现数小时故障,暴露企业过度依赖AI自动化而缺乏应急预案的风险。
NVIDIA发布CUDA Rust,提供cuda-oxide(SIMT)与cutile-rs(Tile)两条技术路线,支持原生Rust编写GPU内核并编译至PTX,两项目均处早期阶段。
llm-d在544块H100 GPU上部署7530亿参数的GLM-5.2模型,通过前缀感知路由、KV缓存分层等技术,支持3000个并发编码智能体零抢占运行,成本较商业API低5-10倍。
Google将Chrome发布周期从四周缩短为两周,以应对AI时代安全补丁增多及浏览器竞争加剧,Chrome 153已在桌面端、iOS和Android上线。
Trench Group首席执行官巴斯德尔详解高压电网设备供应现状:套管交付周期长达两年,公司通过在北卡罗来纳州建厂、扩产及并购整合等举措应对超大规模数据中心与765千伏输电线路建设带来的需求激增。
9月2日-2026开放数据中心大会暨首届算博会正式开幕,F5围绕“AI赋能交付,共塑Token未来”主题亮相大会,集中展示了以F5应用交付与安全平台(ADSP)为核心的平台能力,以及面向AI推理与Token效率的中国本地...
GoPro宣布与光学光电子公司Starman Optical合并,公司维持上市地位,同时进军AI基础设施、政府、国防、机器人和航空航天等新领域。此次交易将带来2.85亿美元现金及清偿约9200万美元债务,但GoPro表示...
Flex将以44亿美元收购电力转换公司EPC Power,将800V直流、电网构建等技术纳入其数据中心基础设施业务。该业务计划于2027年第一季度分拆独立上市。交易预计2026年第四季度完成,旨在应对AI数据中心日益增长...
Apache Fory社区发布1.7.0版本,为多语言序列化框架新增Scala 2.13/3及Kotlin(涵盖Android、JVM、GraalVM Native Image)的JSON支持模块。该版本还增强了Graa...
Nvidia发布免费测试版工具PAIR,可将同一网络内不同的PC设备连接组成AI推理集群,支持Windows、macOS和Linux系统。该工具主要面向家庭用户,但也可用于企业闲置桌面算力,兼容DGX Spark超级计算...
Citrix周二宣布已完成对长期合作伙伴Numecent的收购,后者的Cloudpaging和Cloudpager技术可将Windows应用容器化并独立于操作系统进行流式部署与管理。分析师认为此举能提升企业IT效率、降低...
随着AI模型训练所需的巨大吞吐量和推理所需的超低时延要求,物理网络升级(包括地面光纤和空中6G基础设施)受到广泛关注。电信运营商正投入数十亿美元建设暗光纤连接超大规模数据中心,同时AI原生6G技术也在加速发展,以优化AI...
NVIDIA推出PAIR虚拟推理路由器,可将本地网络中多台设备的算力聚合调用,缓解多智能体并发推理瓶颈。无需修改现有Agent框架,兼容Ollama和LM Studio,支持RTX GPU、DGX Spark及苹果M4+...