信号图谱
日报2026-08-13·覆盖 17 条情报·生成于 2026/8/14 16:43:18
简洁版 高层快读详细版 完整分析

2026-08-13 日报 AI 行业竞争情报

执行摘要

本日情报聚焦于 API 服务的精细化运营与 Agent 基础设施的演进。DeepSeek 正式发布 V4-Pro 模型,显著增强 Agent 能力,并宣布于 8 月 16 日实施 API 峰谷计费机制,同时原生兼容 OpenAI Responses API。OpenAI 预览了基于 Cerebras 硬件的 Ultrafast 推理层,将 GPT-5.6 Sol 速度提升 14 倍,并推出网络安全专用模型 GPT-5.6-Cyber。Google DeepMind 发布了 Gemini 3.7 Flash 模型及手语转文字模型 SL2T。这些动态表明,头部厂商正通过差异化定价、硬件加速和接口标准化来优化算力分配并降低企业开发者的集成成本。

关键事件

  • DeepSeek V4 系列发布与定价调整:DeepSeek-V4-Pro 和 V4-Flash 正式 GA,V4-Pro 在 HLE、Terminal Bench 2.1、NL2Repo 等多项 Agent 和代码基准测试中表现提升。API 引入三级思考力度控制(low/high/max)。同时,API 定价从固定价格转为峰谷计费(8月16日16:00 UTC生效),谷时(非高峰)价格减半,峰时价格较此前大幅上涨(如 deepseek-v4-pro 峰时输入 $1.32/M,输出 $3.96/M)。此外,API 原生支持 OpenAI Responses API 格式并提供一键配置脚本以适配 Codex。
  • OpenAI 推理加速与垂直领域扩展:OpenAI 预览 Ultrafast 服务层,利用 Cerebras 硬件将 GPT-5.6 Sol 的输出速度提升至最高 750 tokens/s(提速 14 倍)。发布网络安全专用模型 GPT-5.6-Cyber,通过 Daybreak Red 提供授权漏洞研究和安全测试。ChatGPT Business 宣布推出 Premium 席位,提供更高使用量。
  • Google DeepMind 模型更新:发布 Gemini 3.7 Flash 模型,提升推理与低延迟能力。同时推出面向听障用户的手语转文字(SL2T)模型。

主要趋势

  • 推理算力分配与定价的精细化:API 提供商正通过更细粒度的定价和推理参数来优化算力负载与成本。DeepSeek 引入峰谷计费机制,通过谷时半价和峰时涨价来调节 API 调用流量,并新增三级思考力度控制以平衡推理效果与 Token 消耗。OpenAI 则通过推出基于专用硬件(Cerebras)的 Ultrafast 服务层,以极高的输出速度满足低延迟场景需求。这表明厂商正在从单一的“按 Token 计价”向基于时间、硬件和计算深度的多维定价与资源分配模式转变。
  • Agent 开发框架的标准化与生态兼容:降低 Agent 开发者的迁移和集成成本成为竞争焦点。DeepSeek V4-Pro 强化了 Agent 能力,并原生支持 OpenAI Responses API 格式。OpenAI 同期发布了聚焦 Agent 构建和新 Responses API 的 GPT-5.6 开发者指南,并展示了企业在 Agentic AI 方面的采用研究。这反映出 Responses API 正在成为 Agent 交互的事实标准,竞争平台通过主动兼容该标准来降低开发者的代码重构门槛。

用户与市场影响

  • 开发者与 API 调用方:DeepSeek 的峰谷计费要求开发者重新评估调用策略,将非实时任务迁移至谷时(01:00-04:00 和 06:00-10:00 UTC 之外的时段)以降低成本,而实时性要求高的任务将面临更高的峰时价格。原生支持 Responses API 显著降低了从 OpenAI 迁移至 DeepSeek 的开发成本。OpenAI 的 Ultrafast 层为高频交易、实时语音交互等对延迟极度敏感的应用提供了新的基础设施选项。
  • 企业客户与商业化:OpenAI 任命 Dali Rajic 为首席营收官(CRO),并推出 ChatGPT Business Premium 席位(8月20日前注册提供 $100 workspace credits),结合 Zapier 和维珍大西洋航空等 ChatGPT Work 企业案例的发布,显示其正在加速企业级市场的商业变现与渗透。GPT-5.6-Cyber 的发布及 Astra 安全评估的推进,则为安全团队提供了专门针对漏洞研究和防御的垂直工具。

证据与不确定性

  • 证据:DeepSeek 的峰谷计费规则、V4-Pro 基准测试数据及 Responses API 兼容性均来自其官方 API 文档与更新日志。OpenAI 的 Ultrafast 层、GPT-5.6-Cyber 及企业案例来自其官方新闻与博客。Google DeepMind 的 Gemini 3.7 Flash 和 SL2T 来自其官方博客。
  • 不确定性:DeepSeek 峰时价格较此前固定价格的具体涨幅比例及峰时算力负载上限未在摘要中完全披露,其对高频调用客户的实际成本影响需进一步测算。OpenAI Ultrafast 服务层的具体定价标准、API 调用限制及全面 GA 时间尚未明确。GPT-5.6-Cyber 的具体授权门槛和 Daybreak Red 的审核机制细节未详述。

数据来源

  • DeepSeek API 官方文档与更新日志 (api-docs.deepseek.com)
  • OpenAI 官方新闻与博客 (openai.com/news)
  • Google DeepMind 官方博客 (deepmind.google/blog)