Grok 4.6正式发布,推理能力媲美GPT-5.6 Sol
SpaceXAI(前身为xAI)发布新旗舰大语言模型Grok 4.6,距上一版本仅一个月。该模型通过AI生成数据集延长训练周期,并引入监督微调与强化学习两阶段优化,重点提升推理、科学及编程能力。在Artificial A...
SpaceXAI(前身为xAI)发布新旗舰大语言模型Grok 4.6,距上一版本仅一个月。该模型通过AI生成数据集延长训练周期,并引入监督微调与强化学习两阶段优化,重点提升推理、科学及编程能力。在Artificial A...
阿里巴巴发布了开源旗舰模型Qwen3.8-2.4T-A95B,总参数量达2.4万亿,每次推理激活参数约950亿。该模型采用细粒度MoE架构与全注意力/线性注意力混合机制,支持最长100万token上下文。在NVIDIA ...
OpenAI于7月初向全球用户开放GPT-5.6系列模型,包含Sol(旗舰版)、Terra(主流版)和Luna(轻量版)三个版本。开发者实测反馈呈现两极:有用户称Sol在数据库生成与错误纠错上表现优于Claude Opu...
NVIDIA发布Nemotron 3.5 Lightning,这是一款300亿参数的混合专家模型,专为长时运行的智能体AI工作负载设计,输出速度提升4倍,任务完成速度提升30%。同步推出的开源库NeMo Switchya...
Meta宣布发布开源大语言模型Muse Glimmer,这是一款拥有300亿参数、支持12.8万token上下文窗口的模型,可在本地设备运行,采用Apache 2.0协议开源。同时,Meta承诺在未来几周内开放更强大的M...
Meta今日发布开源语言模型Muse Glimmer,拥有300亿参数,经量化等优化后内存占用压缩至20GB以下,可在消费级显卡的个人电脑上运行。该模型采用"推测解码"两步生成机制,提升响应速度,并针对长提示词、推理任务...
Meta发布名为Glimmer的300亿参数开源权重模型,专为AI智能体任务设计,可在单块GPU上运行,支持MacBook等消费级设备。该模型旨在帮助用户调度多个AI智能体协同工作。与此同时,Meta还计划发布Spark...
阿里巴巴正式推出迄今最大AI模型Qwen3.8-Max,参数规模达2.4万亿,采用混合专家架构(MoE),推理时仅激活约950亿参数。该模型支持软件工程、多模态推理等企业级任务,开放权重版本将于下周通过阿里云Model ...
阿里巴巴发布迄今最大AI模型Qwen3.8-Max,参数规模达2.4万亿,采用混合专家架构,推理时仅激活约950亿参数。该模型专为软件工程、多模态推理等企业场景设计,开放权重版本将于下周通过阿里云模型工作室发布。阿里巴巴...
他说"你绝对是对的"的时候,你正在被奖励劫持 一个宗教系学生和一个自学程序员,怎么做出了估值15亿美元的开源AI 用Hermes改造了童年游戏的地图,他说这比写代码更让他兴奋。
阿里巴巴正式推出Qwen系列最新旗舰模型Qwen3.8-Max,参数总量达2.4万亿,约为2月发布的Qwen3.5的7倍,每次推理激活950亿参数。该模型支持最高100万token的上下文输入,可处理逾200页文本或约1...
研究人员提出Chain-of-Evidence(CoE)框架及Science One原型系统,旨在解决AI自主科研中的幻觉问题。该框架要求每项研究声明必须附有可追溯的证据链,并通过CoE Audit协议自动审核AI生成论...
Anthropic于7月24日发布Claude Opus 5,该模型在编程、知识任务及智能体能力方面大幅提升,性能接近Claude Fable 5,但价格仅为其一半。在Frontier-Bench v0.1基准测试中,O...
谷歌CEO桑达尔·皮查伊在季度财报电话会议上回避了Gemini 3.5 Pro延迟发布的问题,转而宣布Gemini 4的开发计划及近乎每月一次的模型发布节奏。分析人士指出,虽然延迟尚未引发客户大规模流失,但已令企业CIO...
AI模型压缩初创公司Multiverse Computing宣布完成5.7亿美元C轮融资,估值达17亿美元,较今年6月B轮融资时的2.15亿美元估值增长近五倍。本轮融资由Forgepoint Capital Intern...
Anthropic正式推出Opus 5模型,输入价格为每百万token 5美元,输出25美元,仅为Fable 5的三分之一。Opus 5在编程和知识工作基准测试中表现领先,在OSWorld 2.0和ARC-AGI 3评测...
谷歌发布Gemini 3.6 Flash、3.5 Flash-Lite及3.5 Flash Cyber三款新模型。3.6 Flash在编码和知识工作上表现更优,输出Token用量较3.5 Flash减少17%,定价为每百...
阿里巴巴近日发布最新大语言模型Qwen3.8,宣称"仅次于Anthropic旗舰模型Claude",却未提供任何模型卡、基准测试或技术细节,仅凭一条存在语法错误的X平台帖子造势。与此同时,竞争对手月之暗面发布的Kimi ...
Anthropic正式推出Opus 5模型,该模型在多项基准测试中超越Fable 5,且价格更低、限制更少,适用场景更广。Opus 5距上一版本Opus 4.8发布仅两个月,强调具备更强的自我验证与迭代能力。在隐私方面,...
Anthropic正式发布Claude Opus 5,性能接近旗舰模型Fable 5,但价格仅为其一半。新模型在知识工作和复杂编程任务上表现显著提升,同时具备更强自主性、更少交互反复和更好的错误恢复能力。在法律、生物学等...