9月14日,OpenAI o1团队在社交媒体平台X上举行了一场在线问答活动,包括研究科学家、产品经理在内的12位员工参与,就o1系列模型的命名逻辑、技术特性、提示词策略及未来规划等问题集中回应了外界关注。
关于命名,OpenAI开发者体验主管Romain Huet确认,o1中的“o”代表OpenAI,而非此前外界猜测的“Orion”。他解释称,由于该系列代表AI能力的新阶段,团队决定从头开始命名,将这一系列统称为OpenAI o1。其中“preview”为预览版,“mini”则因模型体积更小而得名。研究科学家Shengjia Zhao进一步说明,o1-preview是即将发布的o1模型的预览版本,具有临时性;而o1-mini并非未来模型的预览版,可能会在不久后更新,但不一定。
在模型能力方面,研究科学家Wenda Zhou透露,OpenAI o1是多模态模型,并在MMMU基准测试上实现了SOTA表现。不过,Hyung Won Chung在回答另一提问时表示,o1目前仅支持单模态文本输入。关于模型规模是否限制推理能力上限,研究员Jerry Tworek表示,目前尚未发现模型大小对扩展有任何限制。
提示词策略是本次问答的焦点之一。Hyung Won Chung指出,o1在展示边缘情况和潜在推理风格的提示下表现更优,模型擅长从示例中推理出线索。对于何时使用few-shot提示词,他建议在需要展示边缘情况和推理风格时采用。在token计算方面,产品经理Nikunj Handa确认o1与GPT-4o使用相同的分词器,计算方式一致。
针对推理阶段的工具调用,研究员Ahmed El-Kishky表示,目前尚无具体时间表,但团队计划在推理时启用模型支持函数调用及代码执行、浏览等功能。研究员Max Schwarzer则指出,o1能够完成比前代模型更复杂、更开放的任务,因此任务切块的需求将逐步减少。在RAG应用方面,Nikunj Handa建议仅向模型提供最相关的信息,避免因塞入过多不相关内容导致响应过于复杂。
OpenAI o1于9月12日正式发布,定位为具备深度推理能力的新模型系列。此次团队集体答疑显示,o1仍处于早期阶段,研究科学家Wenda Zhou表示,这一新范式距离成熟尚有距离。随着推理计算方式的持续演进,o1系列的能力边界和产品形态值得持续关注。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。