LLM情境调节与持续工作流程提示:革新化学分子式的多模态验证技术
这项研究探索了如何通过"LLM情境调节"和"持续工作流程提示"技术来提高大型语言模型在验证化学分子式时的准确性。研究者发现,普通提示方法往往不可靠,因为LLM倾向于自动"纠正"错误而非指出它们。然而,通过精心设计的情境调...
微生物显微图像分割新突破:复旦大学研究团队借助多模态大语言模型统一显微镜下的"万物分割"
复旦大学研究团队开发的uLLSAM模型成功将多模态大语言模型(MLLMs)与分割一切模型(SAM)结合,解决了显微镜图像分析的跨域泛化难题。通过创新的视觉-语言语义对齐模块(VLSA)和语义边界正则化(SBR)技术,该模...
用强化学习让大语言模型为汇编代码提速:斯坦福团队的优化探索
斯坦福大学等机构研究团队利用强化学习训练大语言模型,使其能够优化汇编代码性能。研究构建了8,072个程序的数据集,并通过近端策略优化(PPO)训练模型生成既正确又高效的汇编代码。实验表明,训练后的Qwen2.5-Code...
播放师傅变声魔术:让你的录音遵循参考风格的推理时间优化新方法
这项研究提出了一种改进的声乐效果风格迁移方法,通过在推理时间优化过程中引入高斯先验知识,解决了传统ST-ITO方法忽视参数合理性的问题。研究团队基于DiffVox数据集构建了专业效果器参数分布模型,将风格迁移转化为最大后...
MatTools:香港大学研究团队打造全新材料科学大模型基准测试工具
香港大学研究团队开发的MatTools是首个全面评估大语言模型在材料科学工具应用能力的基准测试框架。研究发现通用型大模型(如GPT-4o)显著优于专业材料科学模型;AI生成的文档作为检索源比原始代码或官方文档更有效;简单...
CheXGenBench:一个全面评估合成胸部X光片保真度、隐私性和实用性的统一基准框架
CheXGenBench是爱丁堡大学和三星AI中心研究团队开发的首个全面评估合成胸部X光片的基准框架,从保真度、隐私风险和临床实用性三方面对11种文本到图像生成模型进行评估。研究发现现有评估方法存在重大缺陷,特别是在衡量...
从对抗到协同:一种结合逻辑和采样的全新大语言模型水印框架
这篇论文提出了一种名为SymMark的多功能共生水印框架,打破了传统大语言模型水印技术中鲁棒性、文本质量和安全性之间的权衡困境。研究者通过创新性地结合逻辑基础和采样基础水印方法,提出了串行、并行和混合三种协同策略。其中,...
双头优化:一种简单高效的半监督式视觉-语言模型知识蒸馏方法
本研究提出了双头优化(DHO)框架,一种解决视觉-语言模型知识蒸馏中梯度冲突问题的创新方法。通过设计两个独立的预测头分别学习标记数据和教师信号,DHO有效缓解了传统单头方法中的梯度冲突,提升了特征学习质量。实验结果显示,...
Group Think:多个并行推理智能体如何在标记级别协同合作
这篇研究论文介绍了一种名为"Group Think"的创新方法,让单个大型语言模型能够同时扮演多个并行推理智能体,这些"思考者"能在标记级别相互协作。传统多智能体系统通常采用轮流推理方式,而Group Think实现了实...
Mergenetic:一款简单易用的进化式模型合并工具库|让普通GPU也能创造顶尖语言模型
Mergenetic是一个开源工具库,让研究人员能在普通GPU上进行进化式模型合并。由罗马萨皮恩扎大学和洛桑联邦理工学院研究者开发,它集成了19种进化算法和6种合并策略,支持数据集抽样以减少计算负担,并提供Python ...
MuToR:为什么大语言模型在学习时需要"寄存器"?雅典娜研究中心突破性发现
本研究提出了MuToR,一种通过在输入序列中插入"寄存器令牌"来改进大语言模型训练的创新方法。与传统的"下一个词预测"方法相比,MuToR使模型能够同时预测多个未来词,从而提供更丰富的学习信号。这种方法不需要改变模型架构...
视觉守门员:新加坡国立大学团队推出具有推理能力的AI内容安全模型
新加坡国立大学和南洋理工大学联合研究团队开发的GuardReasoner-VL是一种具备推理能力的视觉-语言模型安全守门员,能有效防护AI系统免受有害内容影响。该模型通过先推理再决策的方式,不仅能判断内容是否有害,还能提...
图像思维:用纯视觉规划替代语言推理的全新范式
剑桥大学和伦敦大学学院的研究团队提出了一种名为"视觉规划"的全新范式,让人工智能系统能够完全通过图像序列而非文本进行推理。与传统依赖语言的方法不同,这种方法模仿人类在解决空间问题时直接在"心眼"中想象解决方案的能力。研究...
MPS-Prover:多视角搜索和数据精选让自动定理证明更上一层楼
腾讯AI实验室和腾讯LLM部门研究人员开发的MPS-Prover是一种创新的逐步自动定理证明系统,通过两大关键创新解决了现有方法的局限:一个高效的训练后数据精选策略,剔除约40%冗余训练数据;以及一个多视角树搜索机制,整...
如何教会AI理解手部接触:首尔国立大学研究者解决手部接触检测中的数据不平衡问题
韩国首尔国立大学研究者提出HACO框架,解决手部接触估计中的数据不平衡问题。论文《Learning Dense Hand Contact Estimation from Imbalanced Data》针对手部接触数据中...
OpenAI星际之门施工现场揭秘:40万颗芯片,1.2吉瓦电力,全球最大算力集群,奥特曼、孙正义解释为何5000亿美金豪赌AI?
今年开年,在AI领域就发生了两起轰动性事件:一个是DeepSeek R1的发布,完全颠覆了全世界对AI格局的认知,另外一个则是只隔了几天发布的“星际之门”(Stargate)计划。
并联扩展:在不增加参数的情况下提升大模型能力的全新方法 - 阿里巴巴钱文团队揭示并联计算缩放定律
由阿里巴巴钱文团队与浙江大学合作的研究提出了"并联缩放"(ParScale)方法,一种全新的大语言模型能力提升策略。不同于增加参数或延长推理时间的传统方法,ParScale通过多路并行计算来提升模型性能:它使模型同时从多...
QuXAI:揭开量子机器学习黑箱的神秘面纱——北南大学研究团队打造全新可解释框架
QuXAI是北南大学研究团队开发的首个专为混合量子-经典机器学习模型设计的可解释框架。这项创新通过结合量子特征映射和经典学习算法,解决了量子机器学习"黑箱"不透明的关键挑战。框架核心是Q-MEDLEY解释器,它能精确追踪...
AI智能体与智能主体AI:揭秘人工智能新时代的两种角色、工作方式与未来发展
这篇论文由康奈尔大学和希腊伯罗奔尼撒大学的研究者合作完成,系统性地区分了AI智能体和智能主体AI这两种新兴技术范式。研究通过深入分析架构差异、运行机制和应用场景,揭示了AI智能体作为单一执行特定任务的系统,与智能主体AI...




















