信号图谱
腾讯云混元重要新发布2025-09-16

腾讯混元发布 t1-vision 视觉深度思考模型,全面提升多模态推理

Tencent Hunyuan Releases t1-vision Visual Deep Thinking Model with Enhanced Multimodal Reasoning

推理多模态效果提升

EVENT SUMMARY

事件摘要

2025年9月16日,腾讯云混元发布最新版 t1-vision 视觉深度思考模型(hunyuan-t1-vision-20250916),相比上一版在通用图文问答、视觉定位、OCR、图表分析、拍题解题、看图创作等任务上全面提升,并显著优化了英文和小语种能力。模型最大输入28k tokens,最大输出20k tokens。该模型在推理型多模态任务中形成差异化,与 OpenAI o1 系列视觉推理能力形成竞争对标,尤其在教育(拍题解题)和文档分析场景有应用潜力。主要面向教育科技、文档智能分析、多模态问答等需要深度视觉推理的开发者。

ANALYST VIEW

中立分析

为什么重要

视觉深度思考模型在推理型多模态任务中形成差异化,与 OpenAI o1 系列视觉推理能力形成竞争对标,尤其在教育(拍题解题)和文档分析场景有应用潜力。

影响对象

面向教育科技、文档智能分析、多模态问答等需要深度视觉推理的开发者。

证据说明

来源为腾讯云官方文档,直接证明了模型名称、任务覆盖范围、能力提升方向和输入输出限制。

不确定性

深度思考模式的具体推理时间、与快思考 Vision 1.5 的效果差异、定价未披露。

SOURCES

来源