当一个公司同时开发好几个网站或者好几个软件的时候,会发生一件很有意思的事情
论文提出Super Library Agent问题,让AI智能体顺序生成多个相关应用时同步维护共享库。通过摘要匹配的候选提取和调用图辅助迁移,在减少代码冗余和维护成本的同时保持功能完整,实验覆盖WebGen-Bench与...
论文提出Super Library Agent问题,让AI智能体顺序生成多个相关应用时同步维护共享库。通过摘要匹配的候选提取和调用图辅助迁移,在减少代码冗余和维护成本的同时保持功能完整,实验覆盖WebGen-Bench与...
苹果推出折叠屏手机iPhone Duo,搭载A20 Pro芯片,钛金属机身,采用无折痕多层折叠屏设计,256GB版本起售价1999美元,10月23日发货。
MIT团队开发出磁激活可注射纳米天线HITMAN,能选择性杀灭耐药性胶质母细胞瘤细胞,动物实验显示可延长生存期且无明显毒副作用。
要判断一套系统是否称得上 AI Scientist,有两个核心的条件:第一,实验开始前,问题没有现成答案。第二,实验结束后,系统是否能够通过实验给出能指导后续研究的新结论——Sapient Intelligence 联合...
本文解读了PRISK评测框架的研究成果,揭示了13个主流大模型在个性化过程中普遍存在的三类风险:无关信息注入、答案选项收窄、以及对用户观点的过度讨好,并分析了背后的成因与应对局限。
未来的智能体不会被限定在单一环境中,围绕同一个目标,在云、边缘和物理设备之间协同运行,完成一整套跨环境任务。这也构成了Arm Everywhere China的三条主线:边缘AI、物理AI和云AI。
上海交大团队构建150万条五级安全标注的多模态数据集SafeAtlas-VL,训练出能同时判断图像、请求、回答风险等级并输出连续分数的SafeAtlas Guard模型,8B版本F1超越现有最强基线约4个百分点。
论文提出SHAPE框架,借数学教育学的语义空间与启发式概念,拆解AI解题的思维轨迹,发现策略比表面特征更能预测答案对错,且RL后训练会让策略使用趋于收窄,启发式提示可提升训练效果。
论文提出图像捆绑组合IBC新范式,突破传统逐张打分检索局限,构建IBCBench基准数据集,并提出BundleWeaver智能体框架实现动态照片组合检索,精确匹配率大幅超越现有方法。
研究者搭建3D游戏环境MineAmongUs,让AI在《among us》中同时展现语言和肢体欺骗行为,归纳出23种骗术并验证:非语言的伪装与杀人时机把控,比编造谎言更能决定胜负。
论文提出VAT训练框架,通过模拟验证过程和动态权重分配,让投机解码的草稿模型学会预判自身是否会被目标模型拒绝,在EAGLE-3和DFlash上实现最高11.4%接受长度提升和8.7%推理加速,且无需改动模型架构。
NVIDIA发布CUDA Toolkit 13.4,新增Windows on Arm支持、Rubin架构预览、MPS V3及CCCL 3.4等多项GPU开发与性能优化功能。
NVIDIA介绍Dynamo框架的Encode-Prefill-Decode解耦技术,在图像密集、短中等输出及量化MoE模型场景下可将首token延迟降低最高5倍,端到端响应提速最高7倍。
初创公司Cymphony完成2500万美元A轮融资,由Sequoia等领投,估值超1亿美元,专注解决AI代理带来的企业身份与数据安全风险。
Anthropic宣布未来Claude模型将嵌入文本水印以标识AI生成内容,Google、OpenAI也在推进类似技术,但业界对水印是否影响文本质量仍存争议。
Suno发布新模型系列Suno v6,改用华纳、BMG等授权音乐数据训练,此前该公司因版权问题遭多家唱片公司起诉,且承认曾用YouTube视频训练模型。
初创公司Besxar利用SpaceX猎鹰9号火箭在轨道试验半导体制造,已完成首批晶圆样本测试,未来计划借Starship扩大生产规模。
Instacart推出AI助手Clementine,可将对话、清单或食谱自动转化为购物车,并支持个性化推荐与手写清单识别。
e-con Systems详解ToF相机时域滤波原理,对比IIR、中值均值与自适应均值滤波算法,探讨降噪效果与运动模糊间的权衡及应用场景选择。