信号图谱
腾讯云混元重要新发布2025-12-17

混元发布 HY Vision 1.5 Instruct 图生文模型

Tencent Hunyuan Releases HY Vision 1.5 Instruct Image-to-Text Model

多模态效果提升

EVENT SUMMARY

事件摘要

腾讯云混元发布图生文模型 hunyuan-vision-1.5-instruct,基于文本 TurboS 基座生成的快思考模型。相比上一版本,在图像基础识别、图像分析推理等维度有明显效果提升。最大输入 24k tokens,最大输出 16k tokens。该模型定位为快思考视觉模型,面向文档分析、OCR、图文问答等企业场景,与 GPT-4o、Gemini 等多模态视觉模型形成对标。

ANALYST VIEW

中立分析

为什么重要

多模态视觉模型竞争加剧,混元 Vision 1.5 的快思考定位与 GPT-4o、Gemini 等形成对标,效果提升有助于腾讯在文档分析、OCR 等企业场景中增强竞争力。

影响对象

面向需要图像识别、分析推理、OCR、图文问答等能力的开发者和企业用户。

证据说明

来源为腾讯云官方文档,直接证明了模型名称、基座来源、版本迭代和能力提升方向。

不确定性

具体 benchmark 数据、与竞品模型的对比、定价未披露。

SOURCES

来源