25位知名数学家近日联名签署一封公开信,指控以OpenAI为代表的人工智能实验室正在威胁数学界的知识产权。这封公开信标志着数学界与AI行业之间围绕数据使用和学术归属的紧张关系进一步升级。
公开信的核心论点在于,AI实验室在未经明确授权的情况下,大规模使用数学家发表的论文、专著和预印本成果来训练大语言模型,而这些模型随后被用于商业用途。签署者认为,这种做法不仅侵犯了数学家的知识产权,还可能从根本上改变数学研究的生态——当AI能够快速生成看似严谨的数学证明时,原创性贡献的认定和学术荣誉的分配将变得模糊。
此次争议并非孤立事件。近几个月来,OpenAI与数学界的关系持续恶化。此前已有数学家公开批评OpenAI在涉及数学推理能力的产品发布中,存在夸大模型能力、忽视人类数学家贡献的问题。部分学者指出,AI模型在数学基准测试中的表现被过度包装,而支撑这些测试的底层数学工具和理论框架,恰恰来自那些未被署名或补偿的数学家。
从行业影响来看,这封公开信触及了AI训练数据合法性与伦理的核心议题。目前,全球主要AI实验室普遍依赖网络公开数据训练模型,其中包含大量学术论文。尽管部分平台允许作者选择退出,但执行机制并不完善,数学家群体认为自身处于被动地位。公开信呼吁AI实验室建立更透明的数据使用披露机制,并在商业产品中明确标注学术成果的来源。
值得注意的是,数学界与AI行业并非完全对立。许多数学家同时参与AI基础理论研究,双方在形式化验证、自动定理证明等领域存在合作。但此次联名信表明,当商业利益与学术规范发生冲突时,信任正在被快速消耗。
截至发稿,OpenAI尚未对这封公开信作出公开回应。若AI实验室不能就数据使用和学术归属问题给出令学界满意的方案,类似的联名抗议可能从数学领域蔓延至更广泛的科学研究群体,进而影响AI行业获取高质量训练数据的可持续性。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。