豆包大模型 2.1 Pro 更新 0915 版本:Agent 交付更可靠,多模态 Coding 进化

浏览24次 点赞0次 收藏0次
感谢网友 华南吴彦祖西窗 的线索投递!

9 月 16 日消息,火山引擎官方今日宣布为豆包大模型 2.1 Pro 更新至 0915 版本,API 全量上线火山方舟

从官方获悉,豆包工作已完成升级,用户下载或升级至最新版,选取“豆包 2.1 Pro(0915 新版)”模型即可体验。

本次升级围绕企业生产级需求,覆盖 Agent 任务交付、多模态 Coding、多模态理解与 Token 效率优化。

除豆包外,TRAE 已同步接入 0915 版本。今年 6 月推出的 Doubao-Seed-Evolving 也更新至同一版本,企业无需更换 API 接入节点。

Agent 任务交付方面,官方称模型强化了证据溯源、权威信源检索、时效判断和数据核验能力,幻觉显著减少,更忠于工具调用事实。在金融投研、办公自动化等长报告任务中,结论有据可查,推进更稳。

以金融投研为例,官方称模型具备分析师级别分析框架,能自主拆解研究需求、查询高质量数据源并建模分析,产出专家级建模底稿。

多模态 Coding 能力强化,模型更懂复杂代码仓库,面对跨文件、长程问题能理清项目结构与模块关系、定位根因并修复,覆盖从理解需求到运行验证的端到端流程。

借助 VLM 能力,模型可直接读懂设计稿、图纸和操作录屏,将视觉信息转为前端代码和游戏逻辑,Web 3D 开发和游戏场景呈现效果提升。

多模态理解方面,视频推理能力增强,可在视频中定位证据、跨帧整合后作答,也能对照 SOP 辨认操作并解释原理。物理教学、工程、实验操作、医疗等专业内容理解提高,视频标注、内容质检、长视频剪辑与定位摘要等场景受益。

图像理解在 3D 物体与密集图文方向增强:可识别 CAD 工件、游戏引擎 3D 元素及 AR 空间;工程图纸尺寸标注与公差符号、PDF 图注脚注与表头层级、财报研报表格提取和跨页脚注引用等处理精度提升。

Token 效率同步优化,推理轮次和工具调用次数降低。图像推理和视频推理的 Token 消耗比上一代减少 30% 以上,看图解题、图像质检、视频审核等高频场景成本更低。

声明:本文转载自IT 之家,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里查看更多信息!本站拥有对此声明的最终解释权。如涉及作品内容、版权和其它问题,请联系我们删除,我方收到通知后第一时间删除内容。

点赞(0) 收藏(0)
0条评论
珍惜第一个评论,它往往能得到较好的回响。
评论
游客
游客
登录后再评论
  • 鸟过留鸣,人过留评。
  • 和谐社区,和谐点评。
最新资讯