腾讯云混元重要新发布2025-09-16
腾讯混元发布 t1-vision 视觉深度思考模型,全面提升多模态推理
Tencent Hunyuan Releases t1-vision Visual Deep Thinking Model with Enhanced Multimodal Reasoning
推理多模态效果提升
EVENT SUMMARY
事件摘要
2025年9月16日,腾讯云混元发布最新版 t1-vision 视觉深度思考模型(hunyuan-t1-vision-20250916),相比上一版在通用图文问答、视觉定位、OCR、图表分析、拍题解题、看图创作等任务上全面提升,并显著优化了英文和小语种能力。模型最大输入28k tokens,最大输出20k tokens。该模型在推理型多模态任务中形成差异化,与 OpenAI o1 系列视觉推理能力形成竞争对标,尤其在教育(拍题解题)和文档分析场景有应用潜力。主要面向教育科技、文档智能分析、多模态问答等需要深度视觉推理的开发者。
ANALYST VIEW
中立分析
为什么重要
视觉深度思考模型在推理型多模态任务中形成差异化,与 OpenAI o1 系列视觉推理能力形成竞争对标,尤其在教育(拍题解题)和文档分析场景有应用潜力。
影响对象
面向教育科技、文档智能分析、多模态问答等需要深度视觉推理的开发者。
证据说明
来源为腾讯云官方文档,直接证明了模型名称、任务覆盖范围、能力提升方向和输入输出限制。
不确定性
深度思考模式的具体推理时间、与快思考 Vision 1.5 的效果差异、定价未披露。
SOURCES