信号图谱
智谱 BigModel重要新发布2026-01-30

智谱发布 GLM-OCR 多模态识别模型

Zhipu Releases GLM-OCR Multimodal Recognition Model

EVENT SUMMARY

事件摘要

智谱在 HuggingFace 发布 GLM-OCR 多模态图像文本识别模型,接收图像和文本输入并输出文本。这是智谱在 OCR 垂直领域的重要布局,面向文档数字化、票据识别等场景。识别精度、支持语言及与通用多模态模型的 OCR 能力差异尚未说明。

ANALYST VIEW

中立分析

为什么重要

GLM-OCR 是智谱在 OCR 这一垂直多模态领域的重要布局,与现有 OCR 解决方案形成竞争。

影响对象

面向需要文档数字化、票据识别、文字提取等 OCR 场景的开发者和企业用户。

证据说明

HuggingFace API 记录直接证明了 GLM-OCR 模型仓库的创建日期和任务类型。

不确定性

GLM-OCR 的识别精度、支持语言、具体参数量、与通用多模态模型的 OCR 能力差异均未说明。

SOURCES

来源