信号图谱
腾讯云混元重要新发布2025-07-28

腾讯混元发布 hunyuan-turbos-vision-video 视频理解模型

Tencent Hunyuan Releases hunyuan-turbos-vision-video Video Understanding Model

多模态

EVENT SUMMARY

事件摘要

2025年7月28日,腾讯云混元发布视频生文模型 hunyuan-turbos-vision-video,基于 turbos-vision 基座构建,支持视频描述、视频内容问答等基本视频理解能力。模型最大输入24k tokens,最大输出8k tokens。视频理解是多模态模型的关键竞争领域,混元通过该模型切入,与 Gemini、GPT-4o 等形成竞争,但目前仅支持基本能力。主要面向视频内容分析、视频摘要、视频问答等场景的开发者和企业用户。

ANALYST VIEW

中立分析

为什么重要

视频理解是多模态模型的关键战场,混元通过视频生文模型切入,与 Gemini、GPT-4o 等形成竞争,但目前仅支持基本能力,与领先竞品可能存在差距。

影响对象

面向视频内容分析、视频摘要、视频问答等场景的开发者和企业用户。

证据说明

来源为腾讯云官方文档,直接证明了模型名称、能力范围、基座来源和输入输出限制。

不确定性

视频输入的具体时长限制、帧采样策略、与其他视频理解模型的效果对比未披露。

SOURCES

来源