2026-08-27
阿里巴巴Qwen3.8-Flash-Next模型登陆NVIDIA GB300 NVL72,专为智能体编程优化
阿里巴巴发布Qwen3.8-Flash-Next模型权重,作为Qwen4架构预览版,该模型为多模态混合专家架构,拥有176B总参数,每个Token激活6B参数,原生支持262K token上下文窗口,可扩展至1M tok...
阿里巴巴发布Qwen3.8-Flash-Next模型权重,作为Qwen4架构预览版,该模型为多模态混合专家架构,拥有176B总参数,每个Token激活6B参数,原生支持262K token上下文窗口,可扩展至1M tok...