6
里程碑
12
重要更新
5
常规动态
DeepSeek API 引入峰谷计费模式,价格大幅调整
DeepSeek 宣布 API 服务改为峰谷计费机制,非高峰时段价格为高峰时段的一半。高峰时段为 UTC 01:00-04:00 和 06:00-10:00,新价格于 2026 年 8 月 16 日生效。以 deepseek-v4-flash 为例,谷时输入 $0.22/M、输出 $0.66/M;峰时输入 $0.44/M、输出 $1.32/M,峰时价格涨幅显著。
DeepSeek V4 系列模型升级、支持 Responses API 及并发限制调整
DeepSeek 对 V4 系列模型进行多项重要更新:DeepSeek-V4-Pro 模型版本升级至 0813 版,完成新一轮迭代升级;V4-Pro 新增支持 Responses API,使开发者可在更强模型上构建复杂的 Agent 应用;此外,官方重新标注了 V4-Flash 和 V4-Pro 的并发限制数据,V4-Flash 保持 2500,V4-Pro 保持 500,并移除了 Responses API 相关的旧脚注。这一系列更新提升了模型推理基线,并进一步完善了 Agent 开发生态。
DeepSeek 预告即将全面上调 API 定价
DeepSeek 在定价页面发布涨价预告,计划在不久的将来全面上调 DeepSeek API 服务的整体定价,并预计涨幅显著,提醒用户提前规划使用量。作为行业内的价格锚点厂商,DeepSeek 的此次定价调整不仅反映了其算力成本与商业化战略的转变,更将直接重塑当前大模型 API 市场的价格体系。此举将对依赖低成本模型的开发者及企业客户产生深远影响,迫使市场重新评估性价比与模型能力的平衡,进而引发新一轮的市场竞争格局调整。
DeepSeek-V4-Pro 正式发布,Agent 能力大幅增强
DeepSeek-V4-Pro 在 APP、Web 和 API 上正式 GA。该版本显著增强了 Agent 能力,在 Terminal Bench 2.1 (87.9)、DeepSWE (62.7) 和 DSBench-FullStack (71.1) 等多项 Agent 基准测试中表现出色。
DeepSeek V4-Pro 和 V4-Flash 新增三级思考力度控制
DeepSeek V4-Pro 和 V4-Flash 模型现支持 low、high、max 三级思考力度控制,允许用户根据任务复杂度灵活选择推理深度,以平衡响应速度与思考质量。
DeepSeek API 原生支持 OpenAI Responses API 格式
DeepSeek API 现在原生支持 OpenAI Responses API 格式,并专门适配了 Codex,提供一键配置脚本,大幅降低了开发者从 OpenAI 迁移至 DeepSeek 的成本。
DeepSeek V4 系列模型发布及多项核心能力升级
DeepSeek 正式上线 V4 系列模型,包括 DeepSeek-V4-Flash(轻量版)和 DeepSeek-V4-Pro(专业版)。两款模型均支持 1M 上下文、Tool Calls,并以 Beta 形式提供 FIM Completion(代码补全)和 Chat Prefix Completion 能力。此外,V4 系列原生支持 Anthropic API 格式,Flash 版新增 Responses API 支持(Pro 版计划 8 月跟进)以及 Thinking 思考模式以增强推理能力。此次发布全面对标主流代码与 Agent 开发范式。
DeepSeek 预告即将大幅上调 API 整体定价
DeepSeek 在定价页面声明计划近期大幅上调 API 服务整体定价,建议用户提前规划用量,具体方案以官方通知为准。此举将直接改变当前 API 市场的价格预期。
DeepSeek-V4-Flash 公测及 Agent 能力大幅增强
DeepSeek-V4-Flash API 进入公测阶段,Agent 能力显著增强,多项基准测试远超 V4-Pro-Preview(如 Terminal Bench 2.1 达 82.7)。原生支持 Responses API 格式并专门适配 Codex,在 Agent 编码赛道持续发力。
DeepSeek-V4 发布及旧版 API 弃用公告
DeepSeek API 现支持 V4-Pro 和 V4-Flash 新一代旗舰模型,兼容 OpenAI 及 Anthropic 接口标准。旧模型名 deepseek-chat/reasoner 将于三个月后(2026-07-24)停用,强制推动 API 标准化迁移。
DeepSeek-V3.2 正式升级上线
deepseek-chat 和 deepseek-reasoner 均升级至 DeepSeek-V3.2,分别对应非思考和思考模式,推理基线全面提升,成为竞品主力模型的最新迭代版本。
DeepSeek-V3.2-Speciale 临时端点上线
DeepSeek-V3.2-Speciale 通过临时端点提供服务,价格同 V3.2,不支持工具调用,有效期至 2025-12-15,为短期实验性端点且功能受限。
DeepSeek-V3.2-Exp 实验版升级
deepseek-chat 和 deepseek-reasoner 升级至 DeepSeek-V3.2-Exp 实验版,为 V3.2 正式版做前期测试和验证。
DeepSeek-V3.1-Terminus 优化 Agent 与多语言体验
DeepSeek 升级至 V3.1-Terminus 版本,修复中英文混杂问题并优化 Code Agent 和 Search Agent 性能,针对 Agent 场景进行专项调优。
DeepSeek-V3.1 引入混合推理架构
DeepSeek-V3.1 引入混合推理架构,单模型同时支持思考/非思考模式,Agent 能力增强(SWE-bench Verified 66.0),推理效率显著提升,混合推理架构成为行业新标配。
deepseek-reasoner 升级至 R1-0528 支持 FC
deepseek-reasoner 升级至 R1-0528,基准显著提升(AIME 2025 达 87.5),减少幻觉,优化前端生成,新增 JSON 输出和 Function Calling 支持,补齐推理模型在 Agent 场景的关键能力。
deepseek-chat 升级至 V3-0324 版本
deepseek-chat 升级至 V3-0324,推理能力增强(MMLU-Pro 达 81.2),优化前端开发和中文写作能力,改进搜索能力和 Function Calling 准确性,提升 Agent 场景可用性。
DeepSeek-R1 推理模型首发
DeepSeek 发布 deepseek-reasoner 模型(DeepSeek-R1),通过 model='deepseek-reasoner' 调用。R1 是行业级推理模型里程碑,在数学、代码和科学推理等任务上表现突出。
DeepSeek-V3 首发上线
deepseek-chat 正式升级至 DeepSeek-V3,API 接口保持不变。V3 是 DeepSeek 当前生态的基石模型,标志着其在通用大模型领域的重大跃升。
deepseek-chat 升级至 V2.5-1210 版本
deepseek-chat 升级至 V2.5-1210 版本,数学和编码基准有所提升,同时优化了文件上传和网页摘要的用户体验。
DeepSeek V2.5 模型合并发布
DeepSeek 将 V2 Chat 与 Coder V2 合并为 V2.5 统一模型,通用能力和代码能力全面提升,指令遵循和对齐效果优化。
DeepSeek API 上线磁盘上下文缓存技术大幅降价
DeepSeek API 采用硬盘缓存技术实现上下文缓存,将长文本处理成本降低一个数量级,为长文本 Agent 场景提供极具竞争力的价格优势。
DeepSeek API 新增 JSON Mode、Function Calling 及 FIM 特性
DeepSeek API 新增 JSON Mode、Function Calling、Chat Prefix Completion(Beta)、8K max_tokens(Beta)及 FIM Completion(Beta)等多项能力,补齐 Agent 与 Coding 场景所需的基础 API 特性。