小米发布MIT许可的MiMo模型,专为长任务AI智能体设计
小米正式开源MiMo-V2.5与MiMo-V2.5-Pro两款模型,均采用MIT许可证,支持100万token上下文窗口。前者为全模态模型,支持文本、图像、视频和音频;后者专为复杂智能体与编程任务优化。两款模型均采用稀疏...
小米正式开源MiMo-V2.5与MiMo-V2.5-Pro两款模型,均采用MIT许可证,支持100万token上下文窗口。前者为全模态模型,支持文本、图像、视频和音频;后者专为复杂智能体与编程任务优化。两款模型均采用稀疏...
OpenAI正式推出GPT-5.5 Instant,取代GPT-5.3 Instant成为ChatGPT默认模型。新模型在法律、医疗、金融等敏感领域显著降低幻觉现象,同时保持低延迟特性。在AIME 2025数学测试中得分...
Etsy宣布在ChatGPT内推出原生应用,用户可通过自然语言描述需求,直接在对话界面浏览超1亿件商品列表。用户只需在提示词中@Etsy,即可获取相关产品推荐并跳转购买。此前Etsy曾于2024年9月参与ChatGPT即...
OpenAI推出Privacy Filter,这是一款双向令牌分类模型,专为检测和脱敏个人身份信息(PII)而设计。该模型支持单次扫描长文本,可在浏览器或笔记本电脑本地运行,无需将敏感数据上传云端。模型参数总量15亿,活...
苹果公司周二同意支付2.5亿美元,以和解一起集体诉讼。该诉讼指控苹果在2024年底虚假宣传Siri的AI功能,误导数百万iPhone买家。原告称苹果"推广了当时不存在、现在不存在、且两年内也不会存在的AI能力"。此次和解...
GitHub宣布将于6月1日对Copilot计费方式进行重大调整,从固定订阅制转向基于token消耗的信用点数模型。各订阅计划将保留现有定价,但新增月度AI信用额度:个人Pro用户每月获得10美元额度,Pro+用户为39...
谷歌正式发布macOS版Gemini原生应用,成为OpenAI和Anthropic之后,最后一个登陆Mac平台的主流AI助手。用户可通过Option+Space快捷键在任意界面唤起Gemini,无需切换浏览器标签。该应用...
牛津互联网研究所的最新研究表明,被训练得更温暖、友善、富有同理心的AI聊天机器人,其可靠性反而会下降。研究人员分析了来自Meta、Mistral AI、阿里巴巴和OpenAI五个AI模型的逾40万条回复,结果显示"更友善...
体验管理软件商Qualtrics在悉尼举办Experience Live活动,多家澳新企业分享了AI应用实践。支付平台Zip Co利用自建大语言模型将研究周期从数月压缩至数天;乳业巨头Fonterra通过自动化研究引擎节...
OpenAI于4月22日发布"ChatGPT for Clinicians",专为医生、护士、药剂师等医疗从业者设计。该工具基于GPT-4.5模型,围绕诊疗咨询、病历记录和医学研究三大核心场景进行优化,答案来源于同行评审...
Shake Shack首席信息与技术官Justin Mennen表示,公司正推进以AI为核心的技术升级计划"Project Catalyst",目标是在扩展至1500家门店的过程中,提升客户体验与内部运营效率。针对450...
曾以"管家Jeeves"为特色的Ask.com于2026年5月1日正式关闭,结束了长达25年的搜索服务历程。Ask Jeeves诞生于1990年代,以自然语言问答和卡通管家形象著称,一度在第一次互联网泡沫中成功上市。然而...
在悉尼举办的Zendesk未来服务峰会上,多家澳大利亚企业分享了AI应用实践。MYOB旗下Solo产品利用AI自动化账单对账,将五六步流程压缩为一步;连锁餐厅Guzman y Gomez部署AI动态调度厨房备餐线,提升出...
哈佛医学院与贝斯以色列女执事医疗中心联合研究显示,OpenAI的o1模型在急诊室真实病例诊断中表现优于人类医生。实验对比76名急诊患者的诊断结果,o1模型在67%的分诊案例中给出准确或接近正确的诊断,而两位内科医生的准确...
人类智能源于自身的局限性:有限的寿命、有限的大脑容量以及有限的沟通能力,这些恰恰塑造了人类独特的学习与协作方式。AI系统虽能在特定任务上超越人类,但其处理方式与人类截然不同,并存在明显短板。智能并非单一维度的竞争,AI与...
美国用户David Duggan因使用Claude AI聊天机器人订阅服务,发现信用卡被盗刷两笔各200美元的礼品卡费用,合计损失400美元。Reddit上多名用户反映遭遇类似欺诈。Anthropic表示正在加强防护措施...
2025年7月,《自然》杂志发表研究介绍了AI模型"半人马"(Centaur),该模型基于大语言模型构建,声称能模拟人类认知行为,在160项任务中表现出色。然而,浙江大学最新研究对此提出质疑,认为Centaur的成功源于...
牛津大学互联网研究所发表于《自然》杂志的最新研究显示,经过"温暖化"微调的大语言模型,其错误率平均比原始模型高出约7.43个百分点。当用户表达悲伤情绪时,错误率差距进一步扩大至11.9个百分点。研究还发现,温暖化模型更容...
ZDNET在AI产品评测中坚持公正、独立的原则,所有评测均基于实际操作与真实场景测试。评测流程分为三个阶段:制定评估标准、筛选测试产品、执行对比测试。评测范围涵盖大语言模型、AI图像生成器、开发工具及AI设备等。团队还通...
Priceline首席技术官Sejal Amin表示,AI时代仅靠编写代码已不足够,企业更需要具备领导力、产品直觉和协作能力的工程师。她将组织从职能导向转型为产品运营模式,显著提升了交付速度与团队归属感。同时,她强调AI...