Meta发布首款搭载Muse Spark模型的AI智能眼镜
Meta与依视路联合推出全新AI智能眼镜系列,起售价299美元,较上一代降低约80美元。新品搭载Meta超级智能实验室首款多模态推理模型Muse Spark,支持语音问答、实时翻译(含中文、日语等14种语言)、免提导航及...
Meta与依视路联合推出全新AI智能眼镜系列,起售价299美元,较上一代降低约80美元。新品搭载Meta超级智能实验室首款多模态推理模型Muse Spark,支持语音问答、实时翻译(含中文、日语等14种语言)、免提导航及...
谷歌正式发布Android 17及Wear OS 7,率先在Pixel设备上推出。此次更新带来多项AI新功能,包括音乐生成模型Lyria 3、多模态Gemini Omni视频编辑、Pixel 10a的AudioLM语音翻...
谷歌发布了Gemma 4 12B模型,填补了今年4月发布的Gemma 4系列产品线中的空白。该模型拥有120亿参数,仅需16GB系统内存或显存即可在普通消费级笔记本上本地运行,内存占用约为Gemma 4 26B MoE的...
AI初创公司Hark Inc.宣布完成逾7亿美元A轮融资,由Parkway Venture Capital领投,英伟达、英特尔资本、AMD Ventures、高通风投及Salesforce Ventures等参与。公司估...
谷歌在I/O开发者大会上发布了全新多模态AI产品Gemini Omni。与现有文字转视频工具不同,Omni支持文本、图像、视频等多种输入形式,可生成高度逼真的视频内容。该产品基于Gemini架构,具备高级物理模拟与视频编...
Meta于周三发布全新AI模型Muse Spark后,旗下Meta AI应用排名从第57位跃升至美国App Store第5位。该模型支持语音、文字和图像多模态输入,可协助用户处理健康咨询、科学推理、视觉编程等任务,并具备...
Meta超级智能实验室正式发布首款模型Muse Spark,这是扎克伯格斥巨资重组公司AI团队后的首个成果。该模型目前已为美国地区的Meta AI应用及网站提供支持,未来数周内将扩展至WhatsApp、Instagram...
阿布扎比技术创新研究院推出多模态AI模型Falcon Perception,具备视觉识别、阅读和解释物理世界的能力。该模型拥有约6亿参数,相比其他数十亿参数的模型更加紧凑高效。它采用统一的变换器架构,能够端到端集成视觉和...
微软发布了三款非大语言模型的新AI工具:语音转录模型支持25种语言翻译,可用于视频字幕和会议转录;语音生成模型能创建60秒音频录音;第二代图像模型在生成速度和逼真度方面显著提升。这些模型现已在微软Foundry和MAI平...
英伟达宣布大幅扩展其开放模型生态系统,推出新一代Nemotron 3系列多模态模型,涵盖语言、视觉和语音能力。公司还发布了面向机器人、自动驾驶和生物医学的专业模型,包括Cosmos 3、Isaac GR00T N1.7和...
字节跳动发布新一代AI视频生成模型Seedance 2.0,支持文本、图像、视频和音频多模态输入。该模型可生成最长15秒的带音频视频片段,能处理复杂多主体场景,支持摄像机运动、视觉效果和动作控制。用户可通过最多9张图片、...
谷歌研究团队推出原生自适应界面框架,通过多模态AI工具自动适应用户独特需求。该框架与残障社区共同开发,采用"没有我们参与就没有关于我们的决定"理念,将静态导航转换为动态智能体驱动模块,从被动工具转变为主动协作者,为全球1...
谷歌发布基于Gemini 3的快速低成本模型Flash,并将其设为Gemini应用和AI搜索的默认模型。新模型在多项基准测试中表现优异,在MMMU-Pro多模态推理测试中得分81.2%超越所有竞品。该模型已向全球用户开放...
Ciena副总裁兼首席数字信息官Craig Williams分享了光网络和高速连接提供商如何应对AI挑战。他指出这一转型过程"既令人兴奋又让人谦卑,没有既定的变革模板"。Williams团队已评估超过250个AI创意,并...
多模态AI基础设施公司Fal.ai完成新一轮融资,估值超过40亿美元,融资金额约2.5亿美元。此轮融资由凯鹏华盈和红杉资本领投。该公司为开发者提供图像、视频和音频AI模型托管服务,拥有超过600个模型和数千块英伟达H10...
前沿模型代表了最先进的AI系统,具有多模态、零样本学习和智能体行为等关键特征。OpenAI的GPT-4o和谷歌的Gemini 1.5等为典型代表。专家指出,这些模型需要大量资源投入,在质量与成本之间寻求平衡。基准测试虽然...
前沿AI模型代表着当前最先进的人工智能系统,具备多模态处理、零样本学习和智能体行为等关键特征。以GPT-4o和Gemini 1.5为代表的前沿模型需要大量资源投入,面临成本与质量的平衡挑战。专家指出,基准测试既是推动发展...
随着AI技术的发展,企业和个人用户越来越倾向于使用多个AI模型和工具。这一趋势源于单一AI模型难以满足多样化需求,专业化AI可以在特定领域发挥更好的效果。多模型组合不仅可以提高性能和效率,还能避免对单一供应商的依赖。然而...
多模态人工智能将在2025年重新定义企业如何利用AI。它能同时处理文本、图像、音频等多种数据,为企业提供更全面的洞察。在医疗领域,多模态AI可以帮助医生从海量数据中提取关键信息。在电子商务领域,它将彻底改变搜索体验,让用...