信号图谱
智谱 BigModel重要新发布单一来源 · 2 条记录2025-12-07

智谱发布 GLM-4.6V 及 Flash 版多模态视觉语言模型

Zhipu AI Releases GLM-4.6V and Flash Multimodal Vision Language Models

EVENT SUMMARY

事件摘要

智谱于 2025 年 12 月 7 日在 HuggingFace 同时发布了 GLM-4.6V 和 GLM-4.6V-Flash 两款多模态视觉语言模型。GLM-4.6V 作为 GLM-4.6 的视觉增强版本,适用于文档分析、图像问答和视觉推理等场景;GLM-4.6V-Flash 则为轻量级版本,为对延迟敏感的应用提供低延迟选项,适用于实时图像理解和移动端部署。两者的发布增强了智谱在多模态理解领域的竞争力,与 GPT-4V、Gemini Vision 等形成对标,满足了不同算力与延迟要求下的业务需求。具体参数量、视觉编码器细节及基准评测成绩尚未说明。

ANALYST VIEW

中立分析

为什么重要

增强了智谱在多模态理解领域的竞争力,与 GPT-4V、Gemini Vision 等形成对标,提供标准与低延迟多模态选项。

影响对象

面向需要图像理解能力的开发者,适用于文档分析、视觉推理、实时图像理解及移动端部署等场景。

证据说明

HuggingFace API 记录直接证明了 GLM-4.6V 和 GLM-4.6V-Flash 的发布。

不确定性

具体参数量、视觉编码器细节、支持的图像分辨率、基准评测成绩及 Flash 版与完整版的性能差异均未说明。

SOURCES

1 个来源 · 2 条记录

以下记录均来自同一来源,不构成多来源相互印证。