2026-05-29
Gemma 4携手Arm:优化端侧AI,加速移动应用体验
谷歌发布的Gemma 4模型与Arm计算平台深度协同,推动端侧AI从云端依赖转向本地推理。基于Armv9架构的SME2指令集,Gemma 4在预填充阶段实现平均5.5倍加速,解码速度提升最高1.6倍。通过Arm Klei...
谷歌发布的Gemma 4模型与Arm计算平台深度协同,推动端侧AI从云端依赖转向本地推理。基于Armv9架构的SME2指令集,Gemma 4在预填充阶段实现平均5.5倍加速,解码速度提升最高1.6倍。通过Arm Klei...
谷歌基于TensorFlow Lite演进的设备端推理框架LiteRT引入先进加速功能,基于下一代GPU引擎ML Drift。LiteRT的GPU性能比TFLite快1.4倍,提供GPU和NPU跨边缘平台的统一加速工作流...