OpenAI于10月7日公布了一批由其未发布的前沿模型生成的数学研究成果,文件总量达722份手稿,涵盖372个结果家族,包含对数百个未解决问题的解答。这是该公司在数学领域持续输出成果的最新动作,也延续了外界对其研究发布方式与学术伦理的讨论。
据负责以负责任方式传达这些成果的独立咨询小组AGMAI介绍,此次公布的内容涉及多个长期存在的数学难题。OpenAI曾在九月份表示,其模型“已经解决了一百余个长期悬而未决的公开难题,覆盖数学的绝大多数分支领域”,但当时未说明具体解决了哪些问题,也未给出确切的发布时间。数周以来,外界一直在等待这批成果的正式公开。
本次对外发布的文稿及相关资料包含部分模型推理过程摘要、算力消耗估算值,以及尝试求解过的问题数量统计数据。OpenAI称,一项普通成果所消耗的算力,大致相当于ChatGPT Pro连续思考三小时的算力水平。这一数据为外界评估模型在数学研究中的实际投入提供了参考维度。
AGMAI于九月下旬发布首批建议,呼吁人工智能实验室尽可能通过成熟的学术渠道及时对外发布数学研究成果,同时应当披露所使用模型的名称、提示词、算力开销等详细信息。该小组还明确规劝人工智能企业“不要把发布数学成果当作推广自家模型的营销手段”,认为这类做法会给整个数学社群带来严重损害。OpenAI在本次发布中回应称,成果已发布在一处GitHub代码仓库当中,同时制定了文稿修订与引用相关的处理规范,并表示会继续探寻其他由学术社群托管的发布方案,使之符合咨询委员会提出的各项指导意见。对于后续版本的成果发布,该公司承诺会进一步完善文稿质量,优化引用情况、数学内容阐述以及成果展示形式。
数学与人工智能咨询小组(Advisory Group on Mathematics and Artificial Intelligence,AGMAI)的设立,本身即反映出人工智能实验室与数学界之间日益紧密却也充满张力的关系。该小组的职责是以负责任的方式传达AI生成的数学成果,其建议对OpenAI等前沿实验室的发布行为构成了一定程度的行业规范压力。
OpenAI并非唯一在数学领域快速推进的AI实验室。此前,Anthropic等竞争对手实验室已经产出数量迅速增长的一批数学成果,整个数学界仍处在消化阶段,其中甚至包含一道千禧年大奖难题的相关结果,该难题属于数学领域最知名的未解问题。今年各家人工智能实验室快速闯入数学这门学科,尤其是它们对外发布消息的方式,已经激起激烈争论,议题涉及科研范式、伦理规范,以及企业应当如何向人类数学家致谢——人工智能系统正是建立在人类数学家的已有工作之上,并有可能依托这些前人工作生成新结果。
从行业影响来看,OpenAI此次以GitHub仓库形式集中发布成果,并附带算力消耗与推理摘要,在披露透明度上较此前有所提升,但数学界对这批成果的评估与消化仍需时间。AGMAI提出的“不以发布成果为营销手段”的准则能否被AI实验室普遍采纳,以及学术社群托管发布方案能否落地,将影响未来AI数学成果的传播方式与学术认可路径。这批研究带来的完整影响,或许尚需一段时间才能够显现。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。