#AI
DeepSeek 发视觉版 Flash 实验模型
DeepSeek 发布了实验性多模态模型 **V4-Flash-Vision-Exp**,在 V4-Flash 文本能力之上加入图像理解,主打视觉 agent 应用:可描述图片、从截图提取文字、分析图表,并支持 JPEG、PNG、GIF、WebP 多种格式。
官方公布的叫法偏保守——在 DeepSeek 自有多模态 agent 基准上,成绩「接近 Opus 4.8、有时超过」,而非全面领先。价格仍走 V4-Flash 档,单请求最多 600 张图片、单边 8192 像素;接口可直接对标 OpenAI 与 Anthropic 现有端点,降低迁移成本。
💡 为什么值得看Flash 补齐多模态,性能比肩 Opus,价格更低。
查证
来源档案
The Decoder
专注 AI 行业动态的英文科技媒体,转述 DeepSeek 官方发布与 API 文档
单源二手报道,具体性能对比来自 DeepSeek 自有基准、非第三方独立评测,数字可信但「媲美 Opus 4.8」的结论应谨慎看待
延伸阅读
600 张图/请求、单边 8192 像素、64 MiB Files API 这些参数对视觉 agent 工程是硬约束,原文给了完整规格表
同时对接 OpenAI Chat Completions/Responses 与 Anthropic Messages 端点,是 DeepSeek 用兼容性抢存量开发者的一种姿态