2026-08-13 AI 行业竞争情报管理层简报
执行摘要
本日情报聚焦 API 服务的精细化运营与 Agent 基础设施演进。DeepSeek 发布 V4-Pro 模型并引入 API 峰谷计费机制,同时原生兼容 OpenAI Responses API。OpenAI 预览基于 Cerebras 硬件的 Ultrafast 推理层,将 GPT-5.6 Sol 速度提升 14 倍,并推出网络安全专用模型 GPT-5.6-Cyber 及企业级 Premium 席位。Google DeepMind 发布 Gemini 3.7 Flash 与手语转文字模型 SL2T。头部厂商正通过差异化定价、硬件加速和接口标准化优化算力分配并降低集成成本。
关键变化
DeepSeek 模型发布与定价机制重构 DeepSeek-V4-Pro 和 V4-Flash 正式 GA,V4-Pro 在 HLE、Terminal Bench 2.1、NL2Repo 等 Agent 与代码基准测试中表现提升,API 新增 low/high/max 三级思考力度控制。8 月 16 日 16:00 UTC 起实施峰谷计费:谷时(非高峰)价格减半,峰时价格大幅上涨(如 deepseek-v4-pro 峰时输入 $1.32/M,输出 $3.96/M)。此外,API 原生支持 OpenAI Responses API 格式,并提供一键配置脚本适配 Codex。
OpenAI 硬件加速推理与垂直领域扩展 OpenAI 预览 Ultrafast 服务层,利用 Cerebras 硬件将 GPT-5.6 Sol 输出速度提升至最高 750 tokens/s(提速 14 倍)。发布网络安全专用模型 GPT-5.6-Cyber,通过 Daybreak Red 提供授权漏洞研究和安全测试。商业化方面,任命 Dali Rajic 为首席营收官(CRO),ChatGPT Business 推出 Premium 席位(8 月 20 日前注册提供 $100 workspace credits),并发布 Zapier 和维珍大西洋航空等 ChatGPT Work 企业案例。
Google DeepMind 模型更新 发布 Gemini 3.7 Flash 模型,重点提升推理与低延迟能力。同时推出面向听障用户的手语转文字(SL2T)模型。
用户与市场影响
开发者与 API 调用方 DeepSeek 的峰谷计费要求开发者重构调用策略,将非实时任务迁移至谷时以控制成本,实时性要求高的任务将面临更高的峰时支出。其原生支持 Responses API 显著降低了从 OpenAI 迁移的代码重构门槛。OpenAI 的 Ultrafast 层为高频交易、实时语音交互等极度敏感低延迟场景提供了新的基础设施选项。
企业客户与商业化渗透 OpenAI 通过 CRO 任命、Premium 席位及企业案例发布,加速企业级市场的商业变现。GPT-5.6-Cyber 的发布及 Astra 安全评估的推进,为安全团队提供了针对漏洞研究和防御的垂直工具,拓展了高合规要求行业的采用场景。Responses API 正在成为 Agent 交互的事实标准,竞争平台主动兼容该标准以降低生态迁移阻力。
证据与不确定性
证据 DeepSeek 的峰谷计费规则、V4-Pro 基准测试数据及 Responses API 兼容性来自其官方 API 文档与更新日志 (api-docs.deepseek.com)。OpenAI 的 Ultrafast 层、GPT-5.6-Cyber、人事任命及企业案例来自其官方新闻与博客 (openai.com/news)。Google DeepMind 的 Gemini 3.7 Flash 和 SL2T 来自其官方博客 (deepmind.google/blog)。
不确定性 DeepSeek 峰时价格较此前固定价格的具体涨幅比例及峰时算力负载上限未完全披露,对高频调用客户的实际成本影响需进一步测算。OpenAI Ultrafast 服务层的具体定价标准、API 调用限制及全面 GA 时间尚未明确。GPT-5.6-Cyber 的具体授权门槛和 Daybreak Red 的审核机制细节数据不足,目前未详述。