软件分类 游戏分类 资讯分类

原创DeepSeek-V4视觉模型惊艳亮相,智能体实力对标Opus-4.8

编辑:佚名 时间:2026-09-02 17:52:21

      据媒体最新报道,8月21日,DeepSeek在官方API文档详情页正式上线了全新视觉模型——DeepSeek-V4-Flash-Vision-Exp。作为V4系列首款原生支持图片输入的多模态模型,它的亮相标志着DeepSeek补齐了Agent体系中至关重要的感知输入环节,让模型真正拥有了“视觉”。

      DeepSeek-V4视觉模型惊艳亮相,智能体实力对标Opus-4.8

      在核心参数上,该模型具备高达100万的上下文窗口,最大输出长度达384K,并支持JSON输出、工具调用及对话前缀续写等丰富功能。图片将依据尺寸折算为Token,与文本Token合并计费。而在大家关心的价格方面,现阶段其API资费与普通V4-Flash保持一致,缓存命中空闲时段仅需0.05元/百万Token。

      性能表现无疑是此次更新的最大亮点。在纯文本能力方面,V4-Flash-Vision-Exp与正式版持平;但在需要视觉理解的Agent基准测试中,它相比DeepSeek-V4-Flash实现了大幅跃升,多模态Agent能力已成功接近Opus-4.8.展现出强悍的跨模态推理实力。

      距离DeepSeek开源Agent Harness框架仅过去一周,视觉能力便火速接入。这一快速迭代打通了以往相互独立的模型、图片、文件与工具执行链路,让开发者能以更低的成本构建出感知能力完备的智能体,进一步推动了多模态Agent生态的落地与普及。

热门推荐

相关文章