9月16日,据火山引擎官方消息,豆包2.1 Pro模型已于近期更新至0915版本。新模型API已在火山方舟平台全量上线,并接入豆包工作。用户在豆包工作内选用“豆包 2.1 Pro(0915 新版)”,即可体验升级后的工作任务执行能力。
据火山引擎介绍,豆包2.1 Pro更新版在视频推理、3D物体图像识别等多模态理解任务上均有增强。编程能力提升较为显著,可处理复杂代码仓库中的跨文件、长程问题。在“看图写代码”的多模态编程场景中,该版本已达到国内领先水平,可覆盖前端网页设计、游戏开发、3D建模等实际交付需求。
测试案例显示,新版豆包2.1 Pro可调度多个子Agent并行开发。面对开源游戏Luanti(约38.7万行代码)仓库中的1000个真实历史Issue,该模型能够在近36小时内将83%的问题修复至可合并级标准。在3D建模任务中,模型可识别庭院四季设计图,并以代码方式从0到1生成可演示、可控制镜头变化的3D动态场景。
通用Agent能力方面,豆包2.1 Pro更新版在金融投研、办公自动化等需要多轮调用工具、联网调研的长程场景中,强化了证据溯源、权威信源检索、时效判断和数据核验能力,幻觉问题有效降低,复杂长程任务推进更为稳定。以核查财报信息为例,新版模型可大范围检索跨语种内容、交叉比对不同来源信息,并形成可回溯的尽调报告,研究方法与交付报告质量接近专家水平。
成本方面,火山引擎表示,豆包2.1 Pro更新版的Token效率进一步优化,推理轮次和工具调用次数有所降低。其中图像推理和视频推理的Token消耗较上一代减少30%以上,有助于降低企业和开发者的使用成本。
此次更新正值国内大模型在企业级市场加速落地的阶段。豆包2.1 Pro通过接入豆包工作、强化Agent长程任务能力并优化Token效率,进一步面向企业办公与开发场景提升可用性。多模态编程与多Agent调度能力的实际表现,也将成为衡量其商业化落地效果的重要指标。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。