2026-06-11
NVIDIA加速Google DeepMind的DiffusionGemma本地AI推理
谷歌DeepMind发布了实验性开源模型DiffusionGemma,采用并行扩散方式生成文本,每步可同时处理最多256个token,而非逐词生成。NVIDIA对其进行了深度优化,使其在GeForce RTX GPU、R...
谷歌DeepMind发布了实验性开源模型DiffusionGemma,采用并行扩散方式生成文本,每步可同时处理最多256个token,而非逐词生成。NVIDIA对其进行了深度优化,使其在GeForce RTX GPU、R...