说好“多模态不是主线”的梁文锋,怎么转头就发了个Vision模型?
深度求索发布视觉语言模型DeepSeek-VL2,采用MoE架构,总参数量约42亿,激活参数仅约9亿,支持图像与文本混合输入。该模型在视觉问答、图表理解等多项基准测试中表现优于同类开源模型,并同时提供适合端侧部署的轻量版本。此前公司创始人曾表示多模态并非主要研发方向,此次发布被视为产品线的重要补充。模型已开放商用,开发者可通过官方渠道获取权重。此次动作或将对开源多模态模型竞争格局产生影响。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(36氪)→
