8月21日·星期五 21:07·来源:36氪

DeepSeek终于长出“眼睛”,V4 Flash视觉模型上线

DeepSeek发布V4 Flash视觉模型,正式补齐多模态能力短板。该模型支持图像输入与理解,可处理图表、文档及自然场景图片,并同步开放API接口。据官方技术说明,V4 Flash在OCR识别、视觉推理等基准测试中表现优于前代,推理速度提升约40%,成本较同类视觉模型降低30%。此次更新被视为DeepSeek从纯文本向多模态转型的关键一步,开发者现可通过官方平台调用该模型,用于电商、教育、安防等场景的视觉问答与内容审核任务。市场分析认为,此举将加剧与GPT-4o、Claude等主流多模态模型的竞争,但具体商业落地效果尚待观察。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(36氪)→