DeepSeek 是深度求索做的国产大模型,也是过去两年把国内 API 价格拉下来的主要推手。官网提供网页对话,同时开放 API,模型权重开源。
目前的主力是 V4 系列。
V4 预览版于 2026 年 4 月 24 日上线并同步开源,8 月 12 日 V4 Pro 正式版发布。系列分两档:V4-Pro 总参数 1.6T、激活 49B,是当前全球最大的开源 MoE 模型之一;V4-Flash 总参数 284B、激活 13B,定位是高性价比的日常档。两款都配 1M token 上下文,默认开启思维链。
价格仍然是它最锋利的地方。V4-Pro 正式版每百万输入 token 0.435 美元、输出 0.87 美元,缓存命中的输入只要 0.003625 美元——缓存命中价和未命中价之间差了一百多倍,做长对话和 RAG 的项目一定要把缓存策略做对,否则账单差距会大到离谱。V4-Flash 的输入价压到每百万 0.14 美元。
能力上,V4 在代码、推理和长文档处理这几项是国内第一梯队,中文写作和知识问答稳定。弱项也存在:多模态能力相对薄弱,工具调用的稳定性不如闭源旗舰,超长任务里偶尔会出现思维链跑偏。
评论 0 请文明发言,共建良好生态