智谱 BigModel重要新发布2026-01-30
智谱发布 GLM-OCR 多模态识别模型
Zhipu Releases GLM-OCR Multimodal Recognition Model
EVENT SUMMARY
事件摘要
智谱在 HuggingFace 发布 GLM-OCR 多模态图像文本识别模型,接收图像和文本输入并输出文本。这是智谱在 OCR 垂直领域的重要布局,面向文档数字化、票据识别等场景。识别精度、支持语言及与通用多模态模型的 OCR 能力差异尚未说明。
ANALYST VIEW
中立分析
为什么重要
GLM-OCR 是智谱在 OCR 这一垂直多模态领域的重要布局,与现有 OCR 解决方案形成竞争。
影响对象
面向需要文档数字化、票据识别、文字提取等 OCR 场景的开发者和企业用户。
证据说明
HuggingFace API 记录直接证明了 GLM-OCR 模型仓库的创建日期和任务类型。
不确定性
GLM-OCR 的识别精度、支持语言、具体参数量、与通用多模态模型的 OCR 能力差异均未说明。
SOURCES