结论:模型规格已核验,渠道路由与报价仍需验证
VibeToken 当前收录 chat.qwen3_coder_next,并把它描述为 OpenAI Chat Completions 兼容的代码模型。ClawSphere 将其记录为 P2 渠道端点和人民币报价观察:它能证明该渠道目录当前列出了什么,不能单独证明实际路由的权重版本、阿里云官方价格、数据地域、限流、SLA 或下线策略。
Qwen 官方模型卡、技术博客和代码仓库交叉确认了型号、开放权重、Apache 2.0 许可、模型结构和本地部署入口。因此,“Qwen3-Coder-Next 是正式发布的代码 Agent 开放权重模型”属于官方事实;第三方 API 是否稳定提供同一权重仍是渠道事实。
3B 激活参数不等于 3B 权重内存
官方资料列出 80B 总参数、3B 激活参数和 256K 原生上下文。3B 描述 MoE 每个 Token 参与计算的参数规模,加载时仍要容纳约 80B 总权重。它可以降低单位 Token 的计算路径,却不能被写成普通 3B Dense 模型的内存门槛。
官方 vLLM 与 SGLang 示例使用张量并行,并提示服务启动失败时把上下文从 256K 降到 32K。企业容量评估应同时计入量化格式、KV Cache、并发、工具输出和运行时工作区;“256K 可用”不是任意单卡的默认承诺。
Qwen Code 更新说明的是运行时,不是模型能力保证
Qwen Code 在 8 月 20 日的官方周更中发布 /advisor、qwen sessions ps 和可恢复的 /review。其中 /advisor 通过只读独立会话返回结论、风险、缺失证据和建议;会话命令可列出本机正在运行的会话、目录、进程号与运行时间;PR 复核只有在报告、工作树、diff 和 PR 状态一致时才继续,否则重新开始。
这些是 Qwen Code 运行时的官方产品能力,不应反向写成 Qwen3-Coder-Next 模型天然具备独立复核、审计或恢复保证。模型负责生成与工具选择,运行时负责会话隔离、状态校验和命令执行;企业还要自己控制权限、日志、密钥、沙箱与人工批准。
渠道报价与企业采购边界
2026 年 8 月 26 日,VibeToken 结构化接口返回输入 ¥1.4、输出 ¥10.5 / 100 万 token,并带 15% 折扣字段。该数字只适用于渠道当前公开口径,不能与阿里云官方 API、私有化 GPU 成本或其他渠道直接混算。采购前至少应索取可验证账单样本,并确认缓存、税费、并发、数据驻留、故障响应和版本固定策略。
对于本地部署,则应按 80B 总权重、服务副本、KV Cache 与高可用冗余计算总拥有成本。不能用“3B 激活”证明低内存,也不能用第三方 Token 单价证明私有化更贵或更便宜。
上线前核验清单
- 用真实代码库测试补丁正确率、工具参数、测试通过率、回滚和人工接管。
- 把
/advisor一类独立复核放在高风险变更门槛上,且使用不同上下文或模型,避免同源盲点。 - 固定模型权重、提示模板、运行时和工具协议版本,长任务恢复前校验工作树与外部 PR 状态。
- 渠道 API 与本地权重都放在模型网关之后,保留独立供应商回退与审计日志。
来源与研究限制
- P0 官方模型资料:Qwen3-Coder-Next 模型卡、官方博客与代码仓库。
- P0 官方运行时动态:Qwen Code 2026-08-20 周更与 v0.21.14 Release。
- P2 渠道观察:VibeToken · Qwen3-Coder-Next及结构化 API,复核于 2026-08-26。
本页没有调用受认证保护的渠道端点,没有复现 Qwen 官方基准,也没有验证渠道后台实际路由。官方模型卡中的性能图表属于厂商自测;生产结论应以企业任务回放、合同和真实账单为准。
公开参数字段
来自渠道结构化接口,仅反映当前接入形态。
渠道暂未给出结构化参数;接入前需检查当前 API 文档。