DeepSeek-VL2 AI 视觉模型开源：支持动态分辨率、处理科研图表、解析各种梗图等

日期：2024-12-27 作者：b1246758 移动：http://ljhr2012.riyuangf.com/mobile/quote/57734.html

12 月 14 日消息，DeepSeek 官方公众号昨日（12 月 13 日）发布博文，宣布开源 DeepSeek-VL2 模型，在各项评测指标上均取得了极具优势的成绩，官方称其视觉模型正式迈入混合专家模型（Mixture of Experts，简称 MoE）时代。

IT之家援引官方新闻稿，附上 DeepSeek-VL2 亮点如下：

DeepSeek-VL2 模型支持动态分辨率，仅使用一个 SigLIP-SO400M 作为图像编码器，通过将图像切分为多张子图和一张全局缩略图来实现动态分辨率图像支持。这一策略让 DeepSeek-VL2 最多支持 1152x1152 的分辨率和 1:9 或 9:1 的极端长宽比，适配更多应用场景。

DeepSeek-VL2 模型还得益于更多科研文档数据的学习，可以轻松理解各种科研图表，并通过 Plot2Code，根据图像生成 Python 代码。

模型和论文均已发布：

模型下载：https://huggingface.co/deepseek-ai

特别提示：本信息由相关用户自行提供，真实性未证实，仅供参考。请谨慎采用，风险自负。

点赞 0举报收藏 0评论 0

0 条相关评论

相关最新动态

推荐最新动态

点击排行