DeepSeek launches multimodal vision understanding model V4-Flash-Vision-Exp, enabling multimodal API services.
AI 摘要
一句话摘要: DeepSeek发布多模态视觉理解模型V4-Flash-Vision-Exp,支持API调用,Agent性能接近Opus-4.8。 关键事实: 模型支持纯文本与多模态输入,Agent基准测试显著提升,支持三种图像提交方式及Files API,纯文本能力与V4-Flash相当。 涉及主体: DeepSeek, Opus-4.8 可能影响: 多模态Agent能力门槛降低,推动AI与Web3场景中视觉理解与自动化交互的集成,可能加剧模型API市场竞争。 是否值得继续跟踪: 是,实验模型快速迭代,性能接近头部竞品,后续正式版可能重塑多模态API生态。 噪音/炒作风险: 低,基于具体技术发布与基准数据,非概念炒作,但实验版本需观察稳定性。