10月7日消息,OpenAI公开了一批由一款尚未披露名称的先进AI模型生成的数学研究成果,共包含722篇手稿,涉及372组相互关联的研究结果。
据The Verge报道,独立顾问机构AGMAI,也就是数学与人工智能顾问组表示,这批成果包含了数百个数学开放问题的解决方案。
今年9月,OpenAI就曾宣布,其内部模型已经解决了数学多个领域中超过100个长期未解决的开放问题。当时公司没有公布具体涉及哪些问题,也没有明确这些研究结果什么时候公开。
现在,相关内容终于集中发布。
除了722篇数学手稿,OpenAI还同步公开了模型推理过程的简要说明、每项研究所消耗算力的大致估算,以及模型总共尝试解决了多少问题等统计信息。
OpenAI表示,平均每项数学成果消耗的计算量,大约相当于ChatGPT Pro思考模式运行3小时。
这意味着AI解决数学难题正在从单纯证明“模型偶尔能做出一道难题”,逐渐转向更加规模化的研究模式:模型可以批量尝试开放问题,再集中输出大量候选数学成果。
但这里最关键的一步仍然是验证。AI生成了一份看起来完整的数学证明,并不自动意味着相关问题已经得到数学界正式认可。每一项结果仍需要专家检查证明是否严谨、是否存在隐藏错误,以及所谓的开放问题此前是否已经有类似结果。
AGMAI在9月底发布了首批针对AI实验室的建议。该组织认为,由AI得到的数学成果应该及时公开,并尽可能通过成熟的学术渠道发表,而不是只由AI公司自行宣布。
AGMAI还建议,AI实验室在发布数学成果时,应披露使用的具体模型、提示词以及算力成本等关键信息,让外界能够更好地理解和验证成果是如何产生的。
值得注意的是,AGMAI还明确提出,AI公司不应该把数学研究成果当成宣传模型能力的营销工具。
该组织认为,如果头部实验室为了证明自己的模型更强,争相用尚未充分验证的数学成果进行产品宣传,会给数学研究社区带来明显负面影响,包括成果验证压力、优先权争议以及正常学术研究节奏被打乱。
OpenAI表示,目前已经把这些数学成果放到GitHub代码仓库中,并制定了相应的审查和引用规则,方便数学界进一步验证和使用。
扫码下载app 最新资讯实时掌握
