QOBLIB:追踪量子优化领域的进展
IBM联合多家机构推出量子优化基准测试库QOBLIB,涵盖十类具有挑战性的优化问题,已吸引逾2000条结果提交。该项目近日在《自然·计算科学》发表论文,并上线专属网站,支持社区用户探索基准、对比方法与贡献成果。QOBLI...
IBM联合多家机构推出量子优化基准测试库QOBLIB,涵盖十类具有挑战性的优化问题,已吸引逾2000条结果提交。该项目近日在《自然·计算科学》发表论文,并上线专属网站,支持社区用户探索基准、对比方法与贡献成果。QOBLI...
GDPevo是首个评估AI智能体在真实经济型工作任务上自我进化能力的基准,覆盖六大行业领域,包含240道题目,通过"规则杂交"机制确保学习迁移的可溯源性。
Oracle宣布与Quantinuum达成多年合作,将Quantinuum的Helios量子计算机部署于美国OCI AI数据中心,并计划推出OCI量子服务,为企业客户提供混合量子-AI工作负载的云端访问。Helios基于...
南京大学等机构提出AVE-Compass评测体系和AVE-Agent编辑框架,系统揭示当前AI视频编辑在音画协同修改方面的核心缺陷与改进路径。
全球约1300亿至1700亿美元的数据中心项目因社区反对而暂停或终止。公众反对已从最初对资源消耗、电费上涨的担忧,扩展至对税收豁免、NDA不透明协议以及就业数据虚报等问题的强烈不满。研究显示,数据中心创造就业的投资比率远...
Meta、牛津等机构系统研究多模态预训练规律,揭示语言、视觉理解与生成三者间的知识流动不对称性,发现早期联合训练与分模态前馈网络的关键作用,并推导出高效训练配方。
谷歌发布Pixel 11 Pro Fold,售价1899美元,较上代上涨100美元,原因是行业性内存短缺推高成本。新机最大亮点是耐用性提升至上代三倍,外屏采用玻璃陶瓷盖板,内屏配备抗冲击膜,铰链经重新设计,机身减重近10...
SA-OPD是浙江大学与字节跳动提出的知识蒸馏框架,通过识别教师模型中与任务输入无关的"伪信号"并将其过滤,显著提升了学生模型在数学推理和视觉理解任务中的表现。
澳大利亚生物科技正加速拥抱AI与数字化基础设施。Autolomous CEO Alexander Seyf指出,澳大利亚凭借风险比例原则的监管框架(非EU式单一AI法案路径)、SMART CRC等国家战略,正成为面向大洋...
普林斯顿等高校研究发现AI在需要连续切换思维技能时准确率大幅下滑,提出技能熵量化方法与Skill-Entropy RL训练框架,将模型跨技能任务得分从34%提升至68%。
科技服务公司Apexon扩展其智能体AI平台AgentRise,新增Polaris、Lodestone和Harness三个组件。Polaris帮助企业筛选值得投资的AI项目并制定路线图;Lodestone构建企业知识层,...
研究发现AI智能体在持有过时空间记忆时,死亡率是无记忆状态的2.7倍,揭示了记忆陈旧性对安全行动的直接威胁,并验证了读时过滤策略的有效边界。
谷歌DeepMind推出手语转文字模型SL2T,面向全球约7000万聋哑及听障用户。该模型首发于Pixel 11手机,支持Gboard和Live Transcribe应用中的手语输入功能,初期可将美国手语(ASL)实时转...
ARCHead是一种专门压缩大语言模型输出层的方法,通过量化低秩核心与激活度量修正,将LM-head存储压缩至BF16的约25%,质量损失极小。
CodeRabbit宣布完成1.43亿美元C轮融资,由Atomico和Smash Capital领投,BMW i Ventures、Datadog等跟投。融资同期,公司推出Agentic变更管理层,帮助企业治理和优先处理...
这项研究发现AI投票推理在多答案问题上会系统性失效,提出用因果数学规则直接验证候选答案的CALVER方法,准确率比投票提升约11至19个百分点,且差距随尝试次数持续扩大。
北弗吉尼亚州约3800兆瓦的数据中心负荷在7月22日输电故障后切换至自备发电,创PJM历史最大单次负荷转移纪录。此事件暴露出大型数据中心已成为电网可靠性的主动变量——其保护系统在感知电压频率波动时会自动转为离网运行,引发...
这项来自港科大与腾讯视频的研究提出WorldCycle框架,通过可逆动作循环构造无标注自验证奖励,将视频世界模型的长程漂移误差降低最高44%,复合动作准确率提升约四倍。
由丝绸之路创新中心联合TechCrunch等机构举办的"Road to Battlefield"创业大赛今年收到来自39个国家的726份申请,较上届增长近50%。其中约84%的参赛项目聚焦AI领域。22个入围团队将于8月...
哥本哈根大学团队构建了首个同时覆盖三种引用粒度、屏蔽信息泄露、包含全量段落候选库的法律信息检索数据集LegalPincite,用于评估法律判决段落精确检索任务。