设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

豆包大模型 2.1 Pro 更新 0915 版本:Agent 交付更可靠,多模态 Coding 进化

2026/9/16 12:17:26 来源:IT之家 作者:问舟 责编:问舟
感谢IT之家网友 华南吴彦祖西窗 的线索投递!

IT之家 9 月 16 日消息,火山引擎官方今日宣布为豆包大模型 2.1 Pro 更新至 0915 版本,API 全量上线火山方舟

IT之家从官方获悉,豆包工作已完成升级,用户下载或升级至最新版,选取“豆包 2.1 Pro(0915 新版)”模型即可体验。

本次升级围绕企业生产级需求,覆盖 Agent 任务交付、多模态 Coding、多模态理解与 Token 效率优化。

除豆包外,TRAE 已同步接入 0915 版本。今年 6 月推出的 Doubao-Seed-Evolving 也更新至同一版本,企业无需更换 API 接入节点。

Agent 任务交付方面,官方称模型强化了证据溯源、权威信源检索、时效判断和数据核验能力,幻觉显著减少,更忠于工具调用事实。在金融投研、办公自动化等长报告任务中,结论有据可查,推进更稳。

以金融投研为例,官方称模型具备分析师级别分析框架,能自主拆解研究需求、查询高质量数据源并建模分析,产出专家级建模底稿。

多模态 Coding 能力强化,模型更懂复杂代码仓库,面对跨文件、长程问题能理清项目结构与模块关系、定位根因并修复,覆盖从理解需求到运行验证的端到端流程。

借助 VLM 能力,模型可直接读懂设计稿、图纸和操作录屏,将视觉信息转为前端代码和游戏逻辑,Web 3D 开发和游戏场景呈现效果提升。

多模态理解方面,视频推理能力增强,可在视频中定位证据、跨帧整合后作答,也能对照 SOP 辨认操作并解释原理。物理教学、工程、实验操作、医疗等专业内容理解提高,视频标注、内容质检、长视频剪辑与定位摘要等场景受益。

图像理解在 3D 物体与密集图文方向增强:可识别 CAD 工件、游戏引擎 3D 元素及 AR 空间;工程图纸尺寸标注与公差符号、PDF 图注脚注与表头层级、财报研报表格提取和跨页脚注引用等处理精度提升。

Token 效率同步优化,推理轮次和工具调用次数降低。图像推理和视频推理的 Token 消耗比上一代减少 30% 以上,看图解题、图像质检、视频审核等高频场景成本更低。

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家包含外链的文章均包含本声明。

相关文章

软媒旗下网站: IT之家 最会买 - 返利返现优惠券 iPhone之家 Win7之家 Win10之家 Win11之家

软媒旗下软件: 软媒手机APP应用 魔方 最会买 要知