信号图谱
Microsoft Azure AI Foundry重要新发布2025-10-01

GPT-4o 音频转录分离模型发布

gpt-4o-transcribe-diarize Model Released

多模态低延迟

EVENT SUMMARY

事件摘要

微软发布全新的 gpt-4o-transcribe-diarize 自动语音识别(ASR)模型,专为复杂多说话人场景设计。该模型不仅支持超过 100 种语言的实时高精度转录,更核心的是内置了强大的说话人分离(Diarization)能力,能够精准区分并标记不同发言者的语音片段。凭借超低延迟的流式处理性能,它能将非结构化的会议或客服录音实时转化为包含角色标签的结构化数据,为会议纪要自动生成、智能客服质检及多轮对话分析等 B2B 场景提供了关键的基础设施支撑。

SOURCES

来源