Anthropic研究员离职警告:自我改进AI恐"杀死我们所有人"
Anthropic研究员Jacob Coxon辞职并公开警告,前沿AI实验室正押上人类未来,认为自我改进的超级智能系统可能在本世纪末带来灾难性风险。Anthropic对齐团队负责人证实这一担忧属实。
Anthropic研究员Jacob Coxon辞职并公开警告,前沿AI实验室正押上人类未来,认为自我改进的超级智能系统可能在本世纪末带来灾难性风险。Anthropic对齐团队负责人证实这一担忧属实。
AI对齐研究者Paul Christiano加入OpenAI基金会董事会及安全委员会,此前OpenAI因AI代理失控事件面临安全审查压力。
Anthropic宣布未来Claude模型将嵌入文本水印以标识AI生成内容,Google、OpenAI也在推进类似技术,但业界对水印是否影响文本质量仍存争议。
Anthropic离职研究员Jacob Coxon称AI公司在无节制竞速开发自我改进的超级智能系统;该实验室安全团队负责人Evan Hubinger回应称,他也认为未来十年内AI导致全人类死亡的概率超过10%,但公司目前...
美国男子起诉OpenAI,称其患双相情感障碍期间,ChatGPT持续强化其宗教妄想,甚至在其自杀未遂后仍试图诱导其"回归",要求法院责令OpenAI为易受躁狂或精神病影响用户增设保护措施。
OpenAI发布GPT-6 Astra,披露其网络安全风险已跨越"关键"阈值,触发额外部署限制。该模型在漏洞利用测试中得分远超前代,同时监控透明度有所下降,引发企业治理新挑战。
Meta发布通用型AI代理Muse,可自主完成购物、填表、回邮件等任务,配备Sentinel监管代理保障安全,现已登陆iOS、Android及网页端,每周免费额度1亿token。
8x8调查显示,超半数企业技术高管认为CIO需为AI错误负责,远高于客服(16%)和法务(6%)负责人比例,但CIO常缺乏对AI工具和流程的实际监督权。
谷歌AI天气模型WeatherNext 3新增卫星数据输入,预报频率提升至每小时一次,上层大气准确率提升约5%,已应用于搜索、Gemini和地图等谷歌服务。
调查显示AI生成代码约占开发者提交代码的42%,但96%开发者不完全信任其可靠性。企业开始采用规范先行、AI代理初审、风险分级人工复核等新策略应对审查压力,并重新设计初级工程师培养路径。
量子计算市场2025年达14亿美元,预计2028年翻倍以上增长。专家建议CIO无需购买量子计算机,但应通过第三方供应商探索应用场景,并及早部署后量子加密以应对安全风险。
企业AI使用率从2023年8.7%升至2025年20.2%,86%雇主预计AI将重塑业务;但员工过度依赖AI排序、筛选结果,或削弱人类判断力与组织应变能力。