信号图谱
MiniMax Platform重要新发布2025-12-16

MiniMax 发布 VTP 系列视觉特征提取模型

MiniMax Releases VTP Series Visual Feature Extraction Models

开源多模态

EVENT SUMMARY

事件摘要

MiniMax 在 HuggingFace 同时发布 VTP-Small、VTP-Base、VTP-Large 三个视觉特征提取模型,填补了其在视觉编码器领域的空白。这些模型可能用于支撑多模态视觉理解或作为基础组件开放,覆盖不同场景需求。具体架构、训练数据及与多模态模型的关联尚未披露。

ANALYST VIEW

中立分析

为什么重要

VTP 系列填补了 MiniMax 在视觉编码器/特征提取领域的空白,可能用于支撑其多模态模型的视觉理解能力,也可能是面向开发者社区开放的视觉基础组件。

影响对象

面向需要视觉嵌入、图像检索、视觉相似度计算等能力的开发者,提供三种规模的预训练视觉编码器。

证据说明

HuggingFace API 确认三个 VTP 模型 ID、image-feature-extraction 任务类型及相同的 2025-12-16 创建日期。

不确定性

VTP 的具体架构(ViT/SigLIP 等变体)、训练数据、与 MiniMax 多模态模型的关联、基准测试成绩均未披露。

SOURCES

来源