MiniMax Platform重要新发布2025-12-16
MiniMax 发布 VTP 系列视觉特征提取模型
MiniMax Releases VTP Series Visual Feature Extraction Models
开源多模态
EVENT SUMMARY
事件摘要
MiniMax 在 HuggingFace 同时发布 VTP-Small、VTP-Base、VTP-Large 三个视觉特征提取模型,填补了其在视觉编码器领域的空白。这些模型可能用于支撑多模态视觉理解或作为基础组件开放,覆盖不同场景需求。具体架构、训练数据及与多模态模型的关联尚未披露。
ANALYST VIEW
中立分析
为什么重要
VTP 系列填补了 MiniMax 在视觉编码器/特征提取领域的空白,可能用于支撑其多模态模型的视觉理解能力,也可能是面向开发者社区开放的视觉基础组件。
影响对象
面向需要视觉嵌入、图像检索、视觉相似度计算等能力的开发者,提供三种规模的预训练视觉编码器。
证据说明
HuggingFace API 确认三个 VTP 模型 ID、image-feature-extraction 任务类型及相同的 2025-12-16 创建日期。
不确定性
VTP 的具体架构(ViT/SigLIP 等变体)、训练数据、与 MiniMax 多模态模型的关联、基准测试成绩均未披露。
SOURCES