DeepSeek 是深度求索推出的国产开源大模型,提供免费网页对话与按 token 计费的 API。2026年9月10日正式发布新一代模型 DeepSeek-V4.1-Flash(API 模型名改为 deepseek-flash):552B 参数 MoE + 全新 Causal Encoder–Decoder 非对称架构(输入仅激活 8B、输出激活 16B),原生多模态视觉理解、1M 上下文 + 384K 最大输出,官方称其性能、费用、速度、总用时全面超越 V4 Pro。旧模型 V4 Flash 与 V4 Flash Vision Exp 已下线(模型名暂时路由到 V4.1-Flash);V4 Pro 自 2026-09-14 12:00(北京时间)起请求全部路由到 V4.1-Flash 并按新单价计费,直至 V4.1 Pro 上线。价格同步下调:闲时缓存命中输入¥0.02、未命中¥1、输出¥4(元/百万token),高峰翻倍。 定价:免费使用 + API 按量计费(V4.1-Flash 闲时输入¥1/输出¥4、缓存命中¥0.02;高峰翻倍)。编辑评分:⭐ 4.5。
DeepSeek 是什么?
深度求索推出的国产开源大模型,提供免费网页对话与按 token 计费的 API;2026年4月发布开源 DeepSeek-V4 系列,2026-07-31 V4-Flash 正式版(DeepSeek-V4-Flash-0731)发布并开源权重,2026-08-13 V4-Pro 正式版(DeepSeek-V4-Pro-0813)上线,Agent 能力大幅提升;2026-08-21 上线实验性多模态视觉模型 DeepSeek-V4-Flash-Vision-Exp;2026-09-10,DeepSeek 正式发布并开源新一代模型 DeepSeek-V4.1-Flash(552B MoE、原生多模态、1M 上下文),API 模型名改为 deepseek-flash,官方称其在性能、费用、速度、总用时上全面超越 V4 Pro;旧模型 V4-Flash 与 V4-Flash-Vision-Exp 同日下线(旧模型名暂时路由到 V4.1-Flash),V4 Pro 自 2026-09-14 12:00(北京时间)起请求全部路由到 V4.1-Flash 并按 V4.1-Flash 单价计费,直至 V4.1 Pro 上线。
DeepSeek 是深度求索推出的国产开源大模型,提供免费网页对话与按 token 计费的 API。2026年4月发布开源 DeepSeek-V4 系列(V4-Pro 1.6T/49B、V4-Flash 284B/13B),1M 上下文标配;2026-07-31 V4-Flash 正式版(DeepSeek-V4-Flash-0731)发布并开源权重,2026-08-13 V4-Pro 正式版(DeepSeek-V4-Pro-0813)上线,Agent 能力大幅提升;2026-08-21 上线实验性多模态视觉模型 DeepSeek-V4-Flash-Vision-Exp(V4 系列首个支持图片输入的模型,纯文本能力与 V4-Flash 持平,视觉 Agent 能力接近 Opus 4.8,官方自报)。
核心功能
- DeepSeek-V4.1-Flash:552B 参数 MoE + 全新 Causal Encoder–Decoder 非对称架构(输入仅激活 8B、输出激活 16B),2026-09-10 发布并开源(MIT),原生多模态视觉理解、1M 上下文 + 384K 最大输出,API 模型名 deepseek-flash
- DeepSeek-V4-Pro-0813(2026-09-14 12:00 起退役):1.6T 总参 / 49B 激活,2026-08-13 正式版上线,1M 上下文 + 384K 最大输出,Agent 能力逼近 Claude Fable 5
- DeepSeek-V4-Flash-0731:284B 总参 / 13B 激活,2026-07-31 正式版,Agent 基准全面超越 V4-Pro 预览版
- DeepSeek-V4-Flash-Vision-Exp(2026-09-10 已下线):实验性多模态视觉模型(2026-08-21 上线),支持图文混合输入(base64 内联/外部 URL/Files API),视觉 Agent 能力接近 Opus 4.8(官方自报),图片按 token 计费、单张最多 384 tokens
- 1M 上下文标配(DSA 稀疏注意力 + Token 压缩)
- 思考/非思考双模式,reasoning_effort 支持 low/high/max
- 0731 正式版开源 MIT 权重 + 原生 Responses API/Codex 支持
实测数据 & 关键指标
以下数据来自官方及公开评测信息(已核实),可溯源。
| 项目 | 详情 |
|---|---|
| 价格 | 免费使用 + API 按 token 计费(2026-09-10 12:00 起新价):V4.1-Flash 闲时缓存命中输入¥0.02、未命中输入¥1、输出¥4(元/百万token),高峰时段(周一至周五 9:00-12:00、14:00-18:00)翻倍为 ¥0.04/¥2/¥8。官方 API 文档确认 V4 Pro 有序下线,2026-09-14 12:00 起其请求按 V4.1-Flash 单价计费。 |
| 支持平台 | Web, App, API |
| 评分 | ⭐ 4.5 |
| 开发商 | 深度求索(DeepSeek) |
| DeepSeek-V4-Pro-08 | 1.6T 总参 / 49B 激活,2026-08-13 正式版,1M 上下文 + 384K 最大输出,Agent 能力逼近 Claude Fable 5 |
| DeepSeek-V4-Flash-07 | 284B 总参 / 13B 激活,2026-07-31 正式版,Agent 基准全面超越 V4-Pro 预览版 |
| DeepSeek-V4-Flash-Vis | 实验性多模态视觉模型(2026-08-21),V4 系列首个支持图片输入的模型,视觉 Agent 能力接近 Opus 4.8(官方自报) |
| 上下文 | 1M 上下文标配(DSA 稀疏注意力 + Token 压缩) |
价格与平台
- 价格:免费使用 + API 按 token 计费(2026-07 正式版引入峰谷定价):平时价 V4-Pro 输入¥0.025(缓存命中)/¥3(未命中)、输出¥6;V4-Flash 输入¥0.02(缓存命中)/¥1(未命中)、输出¥2(元/百万token)。高峰时段(北京时间每日9:00-12:00、14:00-18:00)价格翻倍。V4-Flash 与 V4-Flash-Vision-Exp 已于 2026-09-10 下线(旧模型名暂时路由到 V4.1-Flash)。2026-09-10 12:00 起 V4.1-Flash 新价为闲时缓存命中输入¥0.02、未命中输入¥1、输出¥4,高峰(周一至周五 9:00-12:00、14:00-18:00)翻倍;官方 API 文档确认 V4 Pro 有序下线,2026-09-14 12:00 起其请求按 V4.1-Flash 单价计费。此前的「大幅上调价格」预告已被本次下调取代。
- 平台:Web, App, API
- 官网:https://deepseek.com
优点
- V4 系列开源且 1M 上下文标配
- V4-Pro-0813 正式版 Agent 能力大幅提升(官方评测逼近 Claude Fable 5,SWE-bench 80.6%)
- V4-Flash-0731 正式版 Agent 能力大幅提升(Terminal-Bench 2.1 达 82.7,超 V4-Pro 预览版)
- 0731 权重 MIT 开源,附 DSpark 推测解码模块
- API 定价经济,且本次为「升级还降价」:V4.1-Flash 闲时输入¥1、输出¥4、缓存命中¥0.02(元/百万token,高峰翻倍)
缺点
- 自托管门槛抬高:V4.1-Flash FP8 权重约 510GB(约为 V4 Flash 三倍),起步需 8 卡节点;部分知识密集型基准仍落后于 V4 Pro(官方对比 HLE 约 36.8 对 42.7)
- 基准为厂商自报,DeepSeek Harness 尚未开源、外部暂无法复现
- V4 预览版曾受高端算力限制,吞吐有限
最终结论
DeepSeek 是AI对话领域的一款 AI 工具,其核心优势在于V4 系列开源且 1M 上下文标配。 2026-09-10 发布的 DeepSeek-V4.1-Flash 是又一次跃迁:最小尺寸反超自家旗舰(官方对比 DeepSWE v1.1 74.2 对 62.7、Terminal-Bench 2.1 90.6 对 87.9),KV Cache 显存占用降至上代约 1/4、SSD 降至 1/8,且定价同步下调;代价是 HLE 等知识密集型基准仍落后(36.8 对 42.7),自托管门槛抬高,且 V4 Pro 将于 2026-09-14 12:00 起退役。
提示:以上数据来源于官方发布与公开评测(已核实);价格与功能可能调整,请以官方最新信息为准。