# 豆包大模型 2.1 Pro 更新 0915 版本：Agent 交付与多模态 Coding 升级

- 来源：IT之家（RSS）
- 发布时间：2026-09-16 12:17
- AIHOT 分数：56
- AIHOT 链接：https://aihot.news/items/cmu3ljhlm064oroo4ltz83yiu
- 原文链接：https://www.ithome.com/1/003/012.htm

## AI 摘要

火山引擎宣布豆包大模型 2.1 Pro 更新至 0915 版本，API 全量上线火山方舟，豆包 App 与 TRAE 已同步接入。

## 正文

IT之家 9 月 16 日消息，火山引擎官方今日宣布为豆包大模型 2.1 Pro 更新至 0915 版本，API 全量上线火山方舟。

IT之家从官方获悉，豆包工作已完成升级，用户下载或升级至最新版，选取“豆包 2.1 Pro（0915 新版）”模型即可体验。

本次升级围绕企业生产级需求，覆盖 Agent 任务交付、多模态 Coding、多模态理解与 Token 效率优化。

除豆包外，TRAE 已同步接入 0915 版本。今年 6 月推出的 Doubao-Seed-Evolving 也更新至同一版本，企业无需更换 API 接入节点。

Agent 任务交付方面，官方称模型强化了证据溯源、权威信源检索、时效判断和数据核验能力，幻觉显著减少，更忠于工具调用事实。在金融投研、办公自动化等长报告任务中，结论有据可查，推进更稳。

以金融投研为例，官方称模型具备分析师级别分析框架，能自主拆解研究需求、查询高质量数据源并建模分析，产出专家级建模底稿。

多模态 Coding 能力强化，模型更懂复杂代码仓库，面对跨文件、长程问题能理清项目结构与模块关系、定位根因并修复，覆盖从理解需求到运行验证的端到端流程。

借助 VLM 能力，模型可直接读懂设计稿、图纸和操作录屏，将视觉信息转为前端代码和游戏逻辑，Web 3D 开发和游戏场景呈现效果提升。

多模态理解方面，视频推理能力增强，可在视频中定位证据、跨帧整合后作答，也能对照 SOP 辨认操作并解释原理。物理教学、工程、实验操作、医疗等专业内容理解提高，视频标注、内容质检、长视频剪辑与定位摘要等场景受益。

图像理解在 3D 物体与密集图文方向增强：可识别 CAD 工件、游戏引擎 3D 元素及 AR 空间；工程图纸尺寸标注与公差符号、PDF 图注脚注与表头层级、财报研报表格提取和跨页脚注引用等处理精度提升。

Token 效率同步优化，推理轮次和工具调用次数降低。图像推理和视频推理的 Token 消耗比上一代减少 30% 以上，看图解题、图像质检、视频审核等高频场景成本更低。
