当前主线
DeepSeek API 已进入 V4 Flash 与 V4 Pro 两档,并在同一模型中支持 thinking 与 non-thinking。Flash 面向吞吐与成本,Pro 面向更高难度的推理、代码和 Agent 任务。旧版品牌或别名不应继续作为新系统的长期模型 ID。
开放权重生态为私有部署和推理优化提供另一条路径,但第三方推理服务上的端点、量化、上下文和价格不能自动视为 DeepSeek 官方规格。
Agent 与企业评估
企业应分别测试思考模式下的任务成功率、输出 Token 膨胀、函数参数正确率、代码变更质量与长任务恢复。高频简单任务可以路由到 Flash,高风险推理再升级到 Pro,并保留异构供应商回退。
风险与边界
模型别名退役会影响现有调用。必须固定具体模型 ID、订阅变更公告,并在升级前重跑评测集。自托管还要计算显存、并发、推理框架、安全更新和运维值班,而不是只看开放权重许可。