DeepSeek 视觉模型多模态 Agent 能力逼近 Opus 4.8,4 项打成 2:2

来源:ChainCatcher · 2026-08-21

AI 摘要

一句话摘要: DeepSeek视觉版模型多模态Agent能力与Opus 4.8打成2:2平手,文本能力未缩水。 关键事实: DeepSeek V4-Flash-Vision-Exp在4项多模态评测中与Opus 4.8各胜2项,视觉版相比纯文本版在ApexBench从26.2升至36.5,文本评测7项中6项高于纯文本版且DeepSWE超Opus 4.8。 涉及主体: DeepSeek, Opus 4.8, ChainCatcher 可能影响: 表明开源视觉多模态模型在Agent任务上已逼近顶尖闭源模型,可能加速多模态Agent应用落地,并加剧模型竞争。 是否值得继续跟踪: 是,因官方自测非独立榜单,需第三方验证,且视觉与文本能力协同提升趋势值得关注。 噪音/炒作风险: 中,官方自测数据存在选择性披露可能,但具体跑分对比有参考价值,需结合后续独立评测。

阅读原文 →

← 更多文章