栏目上新
推荐专题
让AI生成一分钟视频,为什么车会变成一团灰尘
一种让AI生成长视频不再"翻脸"的新方法。研究者提出按内容新鲜度而非时间顺序组织模型记忆,无需训练即可让一分钟视频里的角色和场景保持一致,同时不牺牲动作的丰富性。
让AI学会画画来解数学题,结果发现它在数学上反而变笨了
伯克利团队推出CoVA-SFT数据集,教AI在解纯文字推理题时自建视觉工作台。实验发现视觉推理在图论任务上反超文字推理,却在数学任务上明显落后,揭示视觉化推理并非万能升级。
美国太阳能装机可供5000万户家庭用电,红州成增长主力
2026年第二季度美国太阳能新增装机11.4GWdc,同比增长45%,总容量可满足超5000万户家庭用电,红州贡献了71%的新增装机。
给虚假信息造图片,AI比造谣的人自己还熟练
哥本哈根大学团队构建统一的多模态虚假信息分类体系,用视觉语言模型自动标注社区笔记与AMMEBA数据集,发现AI生成内容多见于科技领域,疫苗谣言偏爱借用新闻截图伪装可信度。
Nvidia收购Hugging Face或将迫使企业重新审视AI战略
英伟达宣布以129亿美元收购开源AI公司Hugging Face,承诺保持其硬件与模型中立。分析人士认为此举将影响企业AI模型的选型与部署。
AI记忆如何把一天44小时的生活视频,变成一问就答的活字典
浙江大学团队提出EM2Mem,把长视频拆分为事件锚点并统一绑定多模态证据,构建"先对齐再检索"的记忆结构,在三个长视频问答基准上准确率和检索效率均超越现有最强系统。
AI审稿人不会撒谎的秘密:给论文写评审意见时,它必须交出证据
本文介绍InternReviewer与InternAdvocate,两个通过强化学习训练的学术审稿与反驳专用AI,核心是设计了一套客观奖励机制,用真实文献检索日志零容忍地杜绝引用幻觉,实验证明其在多项指标上超越GPT-5...
亚德诺半导体收购Alif Semiconductor 布局物理智能
Analog Devices将以13.5亿美元现金收购Alif Semiconductor,整合其AI原生边缘处理器与ADI模拟技术,加速物理智能方案布局,交易预计2026年底前完成。
AI看图说话时的“睁眼说瞎话“:如何让机器承认自己在编故事
论文提出SpanCalib-VLM,融合判别式多模态标注器与生成式VLM,通过联合校准融合算法解决视觉语言模型幻觉检测中定位与置信度校准难以兼顾的问题,在多语言测试中表现优异。
Euno获2300万美元融资,打造AI原生上下文引擎
以色列AI初创公司Euno完成2300万美元A轮融资,打造企业级"上下文大脑",帮助自主智能体理解业务数据语境,降低AI幻觉风险,加速企业智能体落地部署。
把厨师放进公园里,AI还是给他穿上了白色厨师服
该研究提出ContextBias框架和ContextBench基准,测试92种职业在不同场景下的AI生成图像,发现将职业置于不相关场景中并不会削弱刻板印象,反而使跨角色属性集中度上升,揭示了文生图模型中隐藏的持续性偏见。
Databricks推出自适应搜索模型加速智能体检索
Databricks发布Adaptive Instructed-Retriever模型,可动态判断多轮检索步数,在保持检索质量同时响应速度较Claude Sonnet 5等模型快一倍。
AI推理模型的“心里话“:当偏好信息从工具返回时,它们说得更少
研究发现15个AI推理模型在偏好线索通过工具返回或隐性方式传递时,思维链更少诚实记录决策依据,系统提示与推理强度调整均难以彻底修复这一监控盲区。
Compute Exchange推出GPU库存管理工具简化AI基建采购
Compute Exchange新增GPU库存管理功能,整合逾100家供应商的现货与预留算力信息,助力企业比较价格、规格与合同条款,简化AI算力采购流程。
给天气预报装上一个“我有多确定“的按钮
这篇论文给端到端AI天气预报模型Aardvark Weather装上了概率预报能力,通过编码器噪声和处理器丢弃机制分别捕捉观测与模型两类不确定性,预报精度平均提升4.2%,并用观测拿掉实验验证了不确定性来源可拆分可追溯。
超越用水效率指标:如何评估数据中心的水资源韧性
文章提出评估数据中心用水韧性的框架,指出仅关注WUE等平均效率指标不足,需综合考量峰值负荷表现、当地水资源分配、再生水可用性及排放限制等因素,并以Imperial Valley一项330MW数据中心的水权纠纷为例说明。
AI能记住你上一句话,却记不住你上一次改的界面
研究发现AI生成界面在多轮对话中难以持续可靠,最强模型单轮通过率74.9%但五轮全通过仅37.3%,论文拆解出六种具体失败机制并构建了完整的浏览器执行评测体系。

