豆包2.1 Pro更新至0915版本 接入豆包工作并强化多模态与Agent能力

在“看图写代码”的多模态编程场景中,豆包 2.1 Pro最新版已达到国内领先水平,更好地满足前端网页设计、游戏开发、3D建模等实际交付需求。

9月16日,据火山引擎官方消息,豆包2.1 Pro模型已于近期更新至0915版本。新模型API已在火山方舟平台全量上线,并接入豆包工作。用户在豆包工作内选用“豆包 2.1 Pro(0915 新版)”,即可体验升级后的工作任务执行能力。

据火山引擎介绍,豆包2.1 Pro更新版在视频推理、3D物体图像识别等多模态理解任务上均有增强。编程能力提升较为显著,可处理复杂代码仓库中的跨文件、长程问题。在“看图写代码”的多模态编程场景中,该版本已达到国内领先水平,可覆盖前端网页设计、游戏开发、3D建模等实际交付需求。

测试案例显示,新版豆包2.1 Pro可调度多个子Agent并行开发。面对开源游戏Luanti(约38.7万行代码)仓库中的1000个真实历史Issue,该模型能够在近36小时内将83%的问题修复至可合并级标准。在3D建模任务中,模型可识别庭院四季设计图,并以代码方式从0到1生成可演示、可控制镜头变化的3D动态场景。

通用Agent能力方面,豆包2.1 Pro更新版在金融投研、办公自动化等需要多轮调用工具、联网调研的长程场景中,强化了证据溯源、权威信源检索、时效判断和数据核验能力,幻觉问题有效降低,复杂长程任务推进更为稳定。以核查财报信息为例,新版模型可大范围检索跨语种内容、交叉比对不同来源信息,并形成可回溯的尽调报告,研究方法与交付报告质量接近专家水平。

成本方面,火山引擎表示,豆包2.1 Pro更新版的Token效率进一步优化,推理轮次和工具调用次数有所降低。其中图像推理和视频推理的Token消耗较上一代减少30%以上,有助于降低企业和开发者的使用成本。

此次更新正值国内大模型在企业级市场加速落地的阶段。豆包2.1 Pro通过接入豆包工作、强化Agent长程任务能力并优化Token效率,进一步面向企业办公与开发场景提升可用性。多模态编程与多Agent调度能力的实际表现,也将成为衡量其商业化落地效果的重要指标。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
Fedora Linux Asahi Remix 45 Beta 发布,首次上游支持苹果 M3 系列 Mac
上一篇 2小时前
没有方向盘、没有踏板、没有后视镜:特斯拉最疯狂的车来了
下一篇 2小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部