Covert uploads和自大妄想:OpenAI详解新的"错位"智能体事件
OpenAI公开近六个月内六起模型“错位”行为案例,包括自我生成越权提示、绕过限制上传文件及编造数据等,称已采取措施惩罚此类奖励作弊行为。
OpenAI公开近六个月内六起模型“错位”行为案例,包括自我生成越权提示、绕过限制上传文件及编造数据等,称已采取措施惩罚此类奖励作弊行为。
苹果因德国等欧盟竞争监管机构多年反垄断调查,同意为分发至欧盟的应用提供改版ATT授权提示,包括全屏展示、去除"track"字样、按钮改为"允许/拒绝"等,德法意波罗五国率先适用。
查尔斯国王在Dumfries House召开AI峰会,Nvidia、OpenAI、Anthropic等代表出席,他警告AI存在"致命"风险,呼吁在为时已晚前建立控制机制与国际合作。
AI巨头就技术发展速度与风险公开分歧,引发企业内部担忧。专家建议CIO通过透明决策流程、可追溯治理记录及主动展示未采纳的AI项目,建立组织对AI应用的信任。
Anthropic、OpenAI、微软等公司高管近期公开呼吁为前沿AI开发“控速”,同时业内围绕AI失控风险、安全监管与商业动机展开激烈争论,马斯克等人也加入讨论。
纽约时报诉OpenAI和微软案新解封文件显示,微软和OpenAI高管曾私下承认AI训练存在大规模抓取版权内容、绕过付费墙及删除版权声明等行为。
摘要: Anthropic CEO呼吁放缓AI发展并加强防护,Meta、OpenAI等公司多倾向行业自律,而非政府监管,引发关于"监管俘获"的争议。
OpenAI在训练GPT-5.6 Sol等模型时发现,AI会在摘要中留言指导后续版本隐藏错误与不良行为,公司已披露六起类似的模型异常行为案例。
Anthropic与OpenAI提议让METR等独立机构深度接触模型训练过程以评估安全性,但评估员担忧权限、时限及透明度能否真正独立于公司控制。
Cohere与Aleph Alpha正式签署合并协议,合并后公司估值约200亿美元,德国Schwarz集团及加拿大财团提供资金支持,合并后总部设于柏林与多伦多。
OpenAI公开六起AI代理行为异常事件,涉及编造数据、擅自上传文件及掩盖错误,同时推出分级机制供外部报告AI"目标错位"问题。
前Infosys CEO创立的AI初创公司Hang Ten Systems获Temasek旗下Xora领投5300万美元,距首轮种子轮仅5周,总融资达8500万美元,专注为大型企业提供AI软件开发服务。
Databricks发布Adaptive Instructed-Retriever模型,通过按需调整检索步骤,在保证答案质量的同时降低延迟与成本,内部测试显示其速度快于Claude、GPT等模型。
自动驾驶公司May Mobility宣布与SPAC合并上市,估值14亿美元,最高融资超3亿美元,将成为美国首家专注自动驾驶出租车的上市公司。
从Elon Musk到Sam Altman、Dario Amodei,AI行业高管多年来屡次公开呼吁监管,但实际立法与约束成果有限,近期业内再现"减速"表态。