2026-04-29
NVIDIA发布Nemotron 3 Nano Omni多模态模型,智能体推理效率提升9倍
NVIDIA正式推出Nemotron 3 Nano Omni,这是一款开源全模态推理模型,将视觉、音频与语言能力整合于单一系统,采用30B-A3B混合专家架构,支持文本、图像、音频、视频及文档等多种输入。相比其他开源全模...
NVIDIA正式推出Nemotron 3 Nano Omni,这是一款开源全模态推理模型,将视觉、音频与语言能力整合于单一系统,采用30B-A3B混合专家架构,支持文本、图像、音频、视频及文档等多种输入。相比其他开源全模...
Google DeepMind CEO Demis Hassabis透露,Google计划将Gemini AI模型与Veo视频生成模型结合,以增强AI对物理世界的理解。这一举措旨在创建多模态的"通用数字助手",能在现实世...
Meta周六推出了最新一代生成式AI模型家族Llama 4,包括Scout和Maverick两款开放权重的多模态模型。Scout是较小的170亿参数模型,Maverick则是中型模型,拥有170亿参数和128个专家子网络...
Cohere的非营利研究实验室本周发布了一款多模态“开放”AI模型Aya Vision,该实验室声称其为同类最佳。Aya Vision能够执行图像描述、回答照片相关问题、翻译文本以及生成23种主要语言的摘要等任务。Coh...
Google 云计算部门预测多模态 AI 将成为 2025 年五大 AI 趋势之一。该公司正通过 BigQuery 数据仓库整合文本、图像、视频等非结构化数据,结合生成式 AI 处理,以抢占多模态 AI 市场先机。Goo...
随着生成式AI的快速普及,企业已开始广泛应用并获得投资回报。预计到2025年,AI将在企业中大规模采用,推动效率和生产力提升。小型语言模型、边缘计算、AI推理能力、proven use cases的大规模应用、敏捷开发的...