豆包大模型2.1 Pro升级,幻觉大幅降低
「豆包大模型2.1 Pro推出0915版本升级,聚焦生产工作场景,通过强化证据溯源、时效判断与交叉数据核验系统性降低幻觉,让Agent在复杂任务中更忠于事实。新版本同步提升多模态编程与长视频理解能力,图像与视频推理Token消耗较上一代下降30%以上。」
豆包大模型2.1 Pro近日迎来0915版本升级。本次升级将核心焦点锁定在实际生产工作场景,围绕降低AI幻觉、强化证据溯源与提升多任务处理可靠性三条主线展开,为企业级用户与开发者带来更具生产力价值的AI体验。
大模型在复杂业务场景中一本正经胡说八道的幻觉问题,一直是行业痛点。新版本通过强化证据溯源机制,优先调用权威来源的信息,并结合时效判断与交叉数据核验,让Agent在执行复杂任务时更加忠于事实,从源头压缩模型脱离事实自由发挥的空间。
以金融投研这类重度依赖数据分析的场景为例,模型可以自主拆解宏观或微观研究需求,调度数百个子Agent同步检索成百上千个网页。在这一过程中,它不仅会比对常规新闻通稿,还会引入卫星影像、船舶航迹等多维度的外部交叉资料进行佐证,确保最终生成的每一条研究结论都能溯源到对应的原始证据。
这种先找证据、再下结论的工作方式,让模型输出的可信度有了可验证的抓手。
除了文本与分析任务,多模态编程与代码工程理解能力也迎来同步进化。面对体量庞大的代码仓库,新版本能够清晰理清跨文件的复杂依赖关系,精准定位Bug的根源并给出修复方案。同时,得益于强大的视觉语言模型能力,开发者只需提供操作录屏或几张手绘草图,系统就能将其转化为可运行的网页、游戏逻辑或三维场景代码,进一步压缩从想法到可运行原型之间的距离。
在视觉与多媒体理解方面,新版本的长视频处理能力表现突出。它能够完整看完长视频内容,跨帧提取关键信息,并严格对照标准作业程序(SOP)查找现场操作中的问题,完美适配工程图纸解读、教学实验分析以及产品质量检测等专业领域。
值得一提的是,在模型能力大幅提升的同时,系统对运行效率进行了深度优化。图像与视频推理阶段的Token消耗量相比上一代大幅下降了30%以上,有效帮助企业开发者进一步压低实际业务调用的运营成本。目前,该版本的API已经正式在火山方舟上线,用户也可以直接在豆包工作中切换体验。
来源:Heooo AI工具导航