Beacon

Latest updates from supported sources.

DeepSeek Updates · 2026-09-10

DeepSeek-V4.1-Flash 发布

今天,我们正式发布 DeepSeek-V4.1-Flash 模型。这是我们全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 GPQA Diamond: 90.9 HLE: 36.8 (39.1*) Codeforces (Rating): 3471 MathArena Apex: 65.6 Terminal-Bench 2.1: 90.6 Terminal-Bench 3.0: 30.0 Terminal-Bench 4.0: 31.2 DeepSW...

Open original

DeepSeek Updates · 2026-08-21

DeepSeek-V4-Flash-Vision-Exp 发布

今天,全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台,这是一个实验性质的模型,用户可以通过设置 model='deepseek-v4-flash-vision-exp' 访问该模型。 Terminal Bench 2.1: 83.9 NL2Repo: 57.7 DeepSWE: 59.3 DSBench-Hard: 63.6 AutomationBench (Public): 25.7 ApexBench (Pass@1): 36.5 Agents' Last Exam: 2...

Open original

DeepSeek Updates · 2026-08-13

DeepSeek-V4-Pro 更新

DeepSeek-V4-Pro 正式版已同步在 APP、网页端和 API 更新上线。API 调用方式不变,模型名设置为 deepseek-v4-pro ,即可使用最新版本。 Agent 能力大幅提升 正式版 DeepSeek V4 Pro 极大增强了 Agent 能力,在生产环境中的性能表现提升尤为显著。 HLE (wo / w tools): 42.7/60.0 Terminal Bench 2.1: 87.9 NL2Repo: 61.5 Cybergym: 83.3 DeepSWE: 62.7 Toolathlon-Verified: 74.1...

Open original

DeepSeek Updates · 2026-08-13

DeepSeek-V4-Pro 更新

DeepSeek-V4-Pro 正式版已同步在 APP、网页端和 API 更新上线。API 调用方式不变,模型名设置为 deepseek-v4-pro ,即可使用最新版本。 Agent 能力大幅提升 正式版 DeepSeek V4 Pro 极大增强了 Agent 能力,在生产环境中的性能表现提升尤为显著。 HLE (wo / w tools): 42.7/60.0 Terminal Bench 2.1: 87.9 NL2Repo: 61.5 Cybergym: 83.3 DeepSWE: 62.7 Toolathlon-Verified: 74.1...

Open original

DeepSeek Updates · 2026-07-31

DeepSeek-V4-Flash 更新

DeepSeek-V4-Flash 正式版 API 上线公测,API 调用方式不变,模型名设置为 deepseek-v4-flash 即可使用最新版本。 Agent 能力大幅增强,基准测试远超 V4-Pro-Preview: Terminal Bench 2.1: 82.7 NL2Repo: 54.2 Cybergym: 76.7 DeepSWE: 54.4 Toolathlon verified: 70.3 Agent Last Exam: 25.2 Automation Bench (Public): 25.1 DSBench-FullStac...

Open original

DeepSeek Updates · 2026-04-24

DeepSeek-V4

DeepSeek API 已支持 V4-Pro 与 V4-Flash,支持 OpenAI ChatCompletions 接口与 Anthropic 接口。访问新模型时,base_url 不变, model 参数需要改为 deepseek-v4-pro 或 deepseek-v4-flash 。 旧有的 API 接口的两个模型名 deepseek-chat 与 deepseek-reasoner 将于三个月后(2026-07-24)停止使用。当前阶段内,这两个模型名分别指向 deepseek-v4-flash 的非思考模式与思考模式。 详细更新内容...

Open original

DeepSeek Updates · 2025-12-01

DeepSeek-V3.2-Speciale

我们非正式部署了 DeepSeek-V3.2-Speciale 的 API 服务,API 用户可以通过设置 base_url="https://api.deepseek.com/v3.2_speciale_expires_on_20251215" 访问该模型。该模型 API 价格不变,只支持思考模式下的对话功能,不支持工具调用等功能,最大输出长度默认为 128K,支持时间截止至北京时间 2025-12-15 23:59。 详细更新内容请 参阅文档

Open original

DeepSeek Updates · 2025-12-01

DeepSeek-V3.2

deepseek-chat 和 deepseek-reasoner 都已升级为 DeepSeek-V3.2. deepseek-chat 对应 DeepSeek-V3.2 的 非思考模式 deepseek-reasoner 对应 DeepSeek-V3.2 的 思考模式

Open original

DeepSeek Updates · 2025-09-29

DeepSeek-V3.2-Exp

deepseek-chat 和 deepseek-reasoner 都已经升级为 DeepSeek-V3.2-Exp。 deepseek-chat 对应 DeepSeek-V3.2-Exp 的 非思考模式 deepseek-reasoner 对应 DeepSeek-V3.2-Exp 的 思考模式 详细更新内容请 参阅文档

Open original

DeepSeek Updates · 2025-09-22

DeepSeek-V3.1-Terminus

deepseek-chat 和 deepseek-reasoner 都已经升级为 DeepSeek-V3.1-Terminus。 deepseek-chat 对应 DeepSeek-V3.1-Terminus 的 非思考模式 , deepseek-reasoner 对应 DeepSeek-V3.1-Terminus 的 思考模式 。 此次更新在保持模型原有能力的基础上,针对用户反馈的问题进行了改进,包括: 语言一致性:缓解了中英文混杂、偶发异常字符等情况; Agent能力:进一步优化了 Code Agent 与 Search Agent 的表现。

Open original

DeepSeek Updates · 2025-08-21

DeepSeek-V3.1

deepseek-chat 和 deepseek-reasoner 都已经升级为 DeepSeek-V3.1。 deepseek-chat 对应 DeepSeek-V3.1 的 非思考模式 , deepseek-reasoner 对应 DeepSeek-V3.1 的 思考模式 。 DeepSeek-V3.1 包含以下主要变化: 混合推理架构:一个模型同时支持思考模式与非思考模式 更高的思考效率:相比 DeepSeek-R1-0528,DeepSeek-V3.1-Think 能在更短时间内给出答案 更强的 Agent 能力:通过 Post-Train...

Open original

DeepSeek Updates · 2025-05-28

deepseek-reasoner

deepseek-reasoner 模型升级为 DeepSeek-R1-0528: 推理能力增强 基准测试提升显著(Pass@1) AIME 2025: 70.0→ 87.5 (+17.5) GPQA: 71.5 → 81.0 (+9.5) LCB_v6: 63.5 → 73.3 (+9.8) Aider: 57.0 → 71.6 (+14.6) 注:复杂推理问题相比老版本R1会使用更多tokens Web前端开发能力优化 生成的网页与游戏更加美观 幻觉降低 极大程度抑制了老版本R1所存在的幻觉问题 Json Output与Function Cal...

Open original

DeepSeek Updates · 2025-03-24

deepseek-chat

deepseek-chat 模型升级为 DeepSeek-V3-0324: 推理能力增强 基准测试提升显著 MMLU-Pro: 75.9 → 81.2 (+5.3) GPQA: 59.1 → 68.4 (+9.3) AIME: 39.6 → 59.4 (+19.8) LiveCodeBench: 39.2 → 49.2 (+10.0) Web前端开发能力优化 代码生成准确率提升 生成的网页与游戏前端更加美观 中文写作能力升级 风格与内容优化 实现与R1写作风格对齐 中长篇写作内容质量提升 功能增强 多轮交互式改写能力提升 翻译质量与书信写作优化 中...

Open original

DeepSeek Updates · 2025-01-20

deepseek-reasoner

deepseek-reasoner 是我们的新模型 DeepSeek-R1. 可以通过指定 model=deepseek-reasoner 调用。 详细更新,请参考: DeepSeek-R1 正式发布 调用指南,请参考: 推理模型

Open original

DeepSeek Updates · 2024-12-26

deepseek-chat

deepseek-chat 模型升级为 DeepSeek-V3,接口不变,可以通过指定 model=deepseek-chat 调用。 详细更新,请参考: DeepSeek-V3 正式发布

Open original

DeepSeek Updates · 2024-12-10

deepseek-chat

deepseek-chat 模型升级为 DeepSeek-V2.5-1210,模型各项能力提升,相关基准测试: 数学能力:在 MATH-500 基准测试中的表现从 74.8% 提升至 82.8% 代码能力:在 LiveCodebench (08.01 - 12.01) 基准测试中的准确率从 29.2% 提升至 34.38% 中文写作与推理能力:在内部测试集中表现也有相应提升 与此同时,全新版本的模型对文件上传和网页总结功能的用户体验进行了优化。

Open original

DeepSeek Updates · 2024-09-05

deepseek-coder & deepseek-chat 升级为 DeepSeek V2.5 模型

DeepSeek V2 Chat 和 DeepSeek Coder V2 两个模型已经合并升级,升级后的新模型为 DeepSeek V2.5。 为向前兼容,API 用户通过 deepseek-coder 或 deepseek-chat 均可以访问新的模型。 新模型在通用能力、代码能力上,都显著超过了旧版本的两个模型。 新模型更好的对齐了人类的偏好,在写作任务、指令跟随等多方面进行了优化: ArenaHard winrate从 68.3% 提升至 76.3% AlpacaEval 2.0 LC winrate从 46.61% 提升至 50.52% M...

Open original

DeepSeek Updates · 2024-08-02

API 上线硬盘缓存技术

DeepSeek API 创新采用硬盘缓存,价格再降一个数量级 更新详情请跳转文档 API 上线硬盘缓存 2024/08/02

Open original

DeepSeek Updates · 2024-07-25

API 接口更新

更新接口 /chat/completions JSON 输出 Function 调用 对话前缀续写(Beta) 8K 最长输出(Beta) 新增接口 /completions FIM 补全(Beta) 更新详情请跳转文档 API 升级新功能 2024/07/25

Open original