这是一条“渠道情报”,不是厂商背书
VibeToken 的模型详情页将 deepseek-v4-pro 描述为面向复杂推理、难编程和多步智能体的高能力档,并提供 OpenAI 兼容端点的接入说明。ClawSphere 将它记录为渠道可用性与报价观察:它能帮助企业发现可选接入方式与候选成本区间,但不替代模型厂商的性能承诺、服务等级、数据政策或价格公告。
DeepSeek 于 2026 年 8 月 13 日宣布 DeepSeek-V4-Pro 正式 GA。官方模型与价格页将当前版本写为 DeepSeek-V4-Pro-0813,API 模型名保持 deepseek-v4-pro。因此,“型号存在、正式版版本号与官方 API 可用”已由一手资料交叉核验;第三方渠道的性能、服务质量与结算仍需独立验证。
8 月 19 日渠道目录又新增 chat.deepseek_v4_pro_0813 固定版本端点,描述其为 1M 上下文的 0813 快照。该端点目前只在 P2 渠道接口出现;由于同一轮全量目录同时发生 3 个端点移除,ClawSphere 按安全门槛没有写入自动快照,也不把它升级为 DeepSeek 官方新增 API。企业若需要版本固定,应先向 DeepSeek 与渠道分别确认实际路由、下线策略和账单。
官方已核验规格与 8 月 16 日价格变化
截至 2026 年 8 月 21 日,DeepSeek 官方价格页列出 1M 上下文、最高 384K 输出、JSON、工具调用、Thinking / Non-Thinking 双模式,以及 Responses、OpenAI Chat Completions 和 Anthropic 兼容接口。官方账户默认并发上限为 Pro 500、Flash 2500;实际企业配额仍应以账户和扩容确认结果为准。
8 月 16 日 16:00 UTC 起,官方价格页已经切换到峰谷口径:Pro 谷时的缓存命中、缓存未命中输入、输出分别为 $0.022、$0.66、$1.98 / 100 万 token,峰时分别为 $0.044、$1.32、$3.96。峰时是 01:00—04:00 与 06:00—10:00 UTC,其余时段为谷时。企业应按真实调用时段、缓存命中与输出长度重新测算账单,不能把“谷时比峰时低 50%”写成相对旧价格全面降价。
官方推理模式文档提供 low、high、max 档位,默认开启 thinking 且默认 effort 为 high。推理档位是路由参数,不是质量保证;相同任务仍需记录成功率、输出 token、延迟与工具调用结果。
Responses API:支持状态已一致,兼容边界仍需测试
GA 公告称 V4 Pro 原生支持 OpenAI Responses API;截至 8 月 21 日,Responses API 专页也已经把 deepseek-v4-flash 与 deepseek-v4-pro 同时列为支持,先前的官方文档冲突已消除。
但“支持”仍不等于功能对等。该兼容层保持无状态,不支持 previous_response_id、conversation、store 与 background;function、服务端 web search 和名为 apply_patch 的 custom tool 获得支持,其他 custom tool、MCP、Computer Use、Code Interpreter 与 File Search 等类型不在支持范围。文档还明确说明部分不支持参数会被静默忽略,图像和文件输入会被替换为占位文本。生产迁移必须验证字段、工具、输入模态、错误码与流式事件,并保留 Chat Completions 或 Anthropic 接口回退。
可从渠道页读取的规格
- 模型标识:
deepseek-v4-pro。 - 接入形态:VibeToken 声称采用 OpenAI chat-completions 兼容形态;集成前应核对其当前文档、认证、限流与数据条款。
- 报价观察:VibeToken 网页仍写输入 ¥0.435、输出 ¥0.87、缓存输入 ¥0.003625 / 100 万 token;
chat.deepseek_v4_pro结构化 API 当前返回 ¥3、¥6、¥1,新增的chat.deepseek_v4_pro_0813又返回 ¥9、¥27、¥3。渠道自身三套口径不一致,不能直接用于采购预算。 - 适用假设:高难度编程、复杂推理与多步骤工具调用。这个假设来自渠道描述,不能代替企业评测结论。
对数字员工平台的意义:把“能力档位”做成路由策略
企业不应把“Pro”当作默认模型,更不能只因单价较低或榜单更高而全量切换。对数字员工而言,模型选择是一个可审计的路由决策:低风险的摘要、分类和提取可走低成本路径;涉及客户承诺、跨系统写入、复杂排障或长链路规划的任务,才进入高能力档候选池,并保留人工复核和回退模型。
建议为每条业务链路记录四类指标:任务成功率、工具参数正确率、端到端延迟、每次成功交付成本。缓存价格也只在重复上下文、命中口径与渠道账单都被确认后才纳入估算。
上线前核验清单
- 用真实但脱敏的企业样本比较 Pro、Flash 与至少一个独立备选模型。
- 针对工具调用测试权限边界、幂等性、失败重试和人工接管。
- 分别核对模型厂商与渠道方的数据保留、地域、账单、限流、可用性与支持承诺。
- 将供应商特有 SDK 隔离在模型网关之后,保留切换和回退能力;峰谷调度不能绕过业务时效与数据驻留要求。
来源与更新时间
- 渠道规格与报价观察:VibeToken · DeepSeek V4 Pro、当前端点 API及0813 固定版本 API,访问并复核于 2026-08-25;页面哈希继续变化,但结构化接口仍分别返回 ¥3/¥6/¥1 与 ¥9/¥27/¥3,网页仍显示第三套数字。本轮渠道全量目录同时移除 3 个端点,因此未写入自动快照。
- 官方发布:DeepSeek-V4-Pro GA Release,发布日期 2026-08-13。
- 官方规格与计费:Models & Pricing;Thinking Mode;Rate Limit & Isolation。
- 官方兼容边界:Using the Responses API。
页面随渠道或厂商更新而变化;出现冲突时,优先采用模型厂商官方文档,并将本页转入复核。本文没有实际调用受认证保护的模型端点,Responses 支持状态仍需企业账户冒烟测试确认。
公开参数字段
来自渠道结构化接口,仅反映当前接入形态。
渠道暂未给出结构化参数;接入前需检查当前 API 文档。