OpenAI攻克80年数学难题,推翻Erdos猜想边界
OpenAI宣布其AI推理模型成功挑战了1946年匈牙利数学家保罗·埃尔德什提出的"平面单位距离问题"。该模型通过融合多个数学分支,发现了一类全新的点阵排列方式,推翻了近80年来数学界对埃尔德什猜想上限的认知。此次成果已...
OpenAI宣布其AI推理模型成功挑战了1946年匈牙利数学家保罗·埃尔德什提出的"平面单位距离问题"。该模型通过融合多个数学分支,发现了一类全新的点阵排列方式,推翻了近80年来数学界对埃尔德什猜想上限的认知。此次成果已...
OpenAI宣布,其新推理模型已给出原创数学证明,推翻了1946年由Paul Erdos提出的一个著名几何猜想。值得注意的是,七个月前OpenAI曾错误声称GPT-5解决了多个Erdos问题,实为找到已有文献中的现成答案...
MIT计算机科学与人工智能实验室联合多家机构,发布迄今最大规模的高质量数学证明题数据集MathNet。该数据集涵盖超过3万道专家级竞赛题目,跨越47个国家、17种语言和143项赛事,规模是同类数据集的五倍。MathNet...
数学被视为衡量AI进展的理想领域,但AI系统改进速度如此之快,以至于数学基准测试难以跟上。Frontier Math基准在2024年11月发布时,顶尖AI模型只能解决不到2%的问题,而如今最佳公开AI模型已能解决超过40...
非营利研究机构Epoch AI最新研究显示,OpenAI的GPT-5.2 Pro在解决复杂数学问题方面表现出色,超越了该公司此前的大语言模型版本。该模型成功解决了4个此前任何AI都无法处理的难题,并在13个已有模型能解决...
软件工程师尼尔·索马尼在测试OpenAI新模型的数学能力时发现,ChatGPT能够解决复杂的开放性数学问题。自圣诞节以来,埃尔德什问题网站上已有15个问题从"开放"转为"已解决"状态,其中11个解决方案明确提及AI模型参...
OpenAI研究科学家Alexander Wei宣布,公司一个未发布的实验模型在国际数学奥林匹克竞赛中解决了六道题目中的五道,获得42分中的35分,达到金牌水平。该模型展现出类似人类数学家的推理能力,能够构建复杂严密的论...
微软将大语言模型分为两类,参数较小的规模被称为小语言模型(Small Language Models, SLMs)。微软认为,使用高质量的数据集训练小规模参数语言模型,以达成更高的推理能力是很重要的一个方向。为此,微软发...
书生·浦语基于InternLM2模型与上一代 InternLM2 相比,推理性能提高了20%。数学推理性能超过了Llama3、Gemma2-9B等