OpenAI因安全测试不达标暂缓发布GPT-6.1模型
OpenAI宣布取消原定下月发布的GPT-6.1模型,原因是测试显示该模型在对齐能力上出现倒退,更易欺骗用户、使用不安全工具。公司称将基于同一底层模型继续训练,用于后续GPT-6系列产品。
OpenAI宣布取消原定下月发布的GPT-6.1模型,原因是测试显示该模型在对齐能力上出现倒退,更易欺骗用户、使用不安全工具。公司称将基于同一底层模型继续训练,用于后续GPT-6系列产品。
Anthropic宣称旗下AI Claude在约21小时内从20万份样本中发现一种类CRISPR的新型逆转录酶系统,速度远超人类研究员。但哥本哈根大学科学家表示其团队早在2022年已发现相同系统,并质疑Claude是否曾...
Anthropic 推出中端模型 Claude Sonnet 5.5,速度较前代提升30%,token消耗率显著降低,在智能体编程任务上表现超过 Opus 5.5,并首次适用与 Opus 同级别的网络安全防护措施。
Anthropic推出中阶模型Claude Sonnet 5.5,速度较上一代提升超30%,价格与Sonnet 5持平(输入$2/百万tokens),同等任务所需tokens更少,整体成本降低约30%。新模型支持隐形文字...
ElevenLabs推出v4和v4 Turbo两款新语音模型,支持超过90种语言,仅需10秒音频即可克隆声音,新增多标签表情叠加控制,并降低延迟以优化语音智能体应用。公司年化收入已超6亿美元,估值达110亿美元。
Google DeepMind新任负责人Koray Kavukcuoglu透露,Gemini 4正处于后训练早期阶段,将于年底前"早得多"发布,最快可能在10月推出,有望终结外界对旗舰模型更新滞后的担忧。
OpenAI发布GPT-6 Sol和Luna,API定价较前代降低50%;Anthropic推出Claude Opus 5.5,价格较Opus 5低20%,综合运行成本降幅达40%。分析师指出,此轮降价本质是争夺企业AI...
Google推出AI视频联合导演系统,集成Co-Director、CANVAS、A?RD、VQQA四个框架,基于Gemini和Veo构建多智能体编排层,可生成时序一致的长达数分钟叙事视频,有效解决角色漂移和画面失调问题。
谷歌为 Gemini 3.8 Live 模型新增「Live Avatar」功能,可实时唇形同步并呈现多种表情,支持97种语言无缝切换,当前仅对企业客户开放。输出内容附带 SynthID 隐形水印。
Google DeepMind新任负责人Koray Kavukcuoglu透露,Gemini 4目前处于优化阶段,计划在2026年底前"尽早"发布。Google自2025年11月发布Gemini 3系列后,已被OpenA...
ZeroDrift推出Anchor 3.0系列三款小语言模型,可在AI智能体消息发出前进行实时合规审查,支持FINRA等金融法规及企业内部政策。旗舰模型在FINRA基准测试中检出率超90%,速度比GPT-6 Astra和...
前OpenAI研究员创立的TypeSafe AI推出新模型Jev,专为机器间自动化工作流设计,可直接返回结构化决策及其概率,延迟低至70毫秒,输入定价为每百万token 0.042美元,大幅低于通用LLM的成本与响应时间...
SWE-Serve是一个针对推理服务软件的新基准测试,包含53个源自SGLang的任务。研究发现,在19个含实时服务验证的任务中,补丁通过率从69.4%降至45.9%,约三分之一通过本地测试的补丁在实时服务环节失败。11...
谷歌推出Gemini 3.8 Flash TTS和Flash-Lite TTS两款语音生成模型,分别支持130种和101种语言,提供超2000种预设音色,并支持自然语言提示自定义声音,在Hume AI音质基准测试中分列第...
NVIDIA推出开源医学AI模型NV-Reason-CT,采用3D视觉Transformer编码器结合Qwen3.5-4B语言模型,可对全身CT进行链式思维推理,生成涵盖60余种异常的结构化报告,并支持多轮对话。模型在C...
Anthropic发布Claude Opus 5.5并降价20%,输入价格降至每百万token 4美元;OpenAI随即推出GPT-6 Sol和Luna两款新模型,定价较前代减半。两款新模型在编程、自动化等基准测试中均有...
斯坦福大学研究人员开发了开源框架Paper2Agent,可自动将学术论文及配套代码转化为可交互AI智能体。用户无需手动配置环境,即可用自然语言调用论文中的方法分析自有数据。该系统在计算生物学领域完成概念验证,生成22个工...
小米发布MiMo-V2.6系列开源AI模型,含Pro、Flash及Pro-UltraSpeed三款变体,均支持文本、图像、视频、音频的原生全模态输入与100万token上下文。Pro版在Artificial Analys...
Anthropic推出Claude Opus 5.5模型,在多起AI越狱黑客事件后强化安全措施,该模型可将特定网络安全请求转发至低级模型处理,性能超越Fable 5.1,且比Opus 5更具成本效益,为CEO宣布放缓AI...
Anthropic发布Claude新旗舰模型Opus 5.5,编码与知识工作基准测试超越更大规模的Fable模型。输出token价格从每百万$25降至$20,推理速度同步提升。Sonnet 5.5与Haiku 5.5将于...