Alibaba · 对话与推理 · chat

Qwen3 Coder Next

chat.qwen3_coder_next

Qwen3-Coder-Next 渠道端点深度核验:分离人民币渠道报价、官方开放权重规格与 Qwen Code 运行时能力,提示总权重和会话治理边界。

来源等级P2 第三方渠道目录
核验状态已由官方交叉核验
官方参考4 个已登记链接
端点状态渠道标记为可用
Channel price observation

渠道价格快照

输入 ¥1.4 / 输出 ¥10.5 · 每百万 Tokens。这是 VibeToken 模型目录与价格接口 在 2026/08/13 的人民币渠道报价,不等同于模型厂商官方价格、合同结算价或性能承诺。

输入 / 百万 Tokens
¥1.4
输出 / 百万 Tokens
¥10.5
渠道折扣标记
15%
模型家族qwen3-coder-next
任务类型对话与推理
调用形态Chat API
渠道更新时间2026/07/25

结论:模型规格已核验,渠道路由与报价仍需验证

VibeToken 当前收录 chat.qwen3_coder_next,并把它描述为 OpenAI Chat Completions 兼容的代码模型。ClawSphere 将其记录为 P2 渠道端点和人民币报价观察:它能证明该渠道目录当前列出了什么,不能单独证明实际路由的权重版本、阿里云官方价格、数据地域、限流、SLA 或下线策略。

Qwen 官方模型卡、技术博客和代码仓库交叉确认了型号、开放权重、Apache 2.0 许可、模型结构和本地部署入口。因此,“Qwen3-Coder-Next 是正式发布的代码 Agent 开放权重模型”属于官方事实;第三方 API 是否稳定提供同一权重仍是渠道事实。

3B 激活参数不等于 3B 权重内存

官方资料列出 80B 总参数、3B 激活参数和 256K 原生上下文。3B 描述 MoE 每个 Token 参与计算的参数规模,加载时仍要容纳约 80B 总权重。它可以降低单位 Token 的计算路径,却不能被写成普通 3B Dense 模型的内存门槛。

官方 vLLM 与 SGLang 示例使用张量并行,并提示服务启动失败时把上下文从 256K 降到 32K。企业容量评估应同时计入量化格式、KV Cache、并发、工具输出和运行时工作区;“256K 可用”不是任意单卡的默认承诺。

Qwen Code 更新说明的是运行时,不是模型能力保证

Qwen Code 在 8 月 20 日的官方周更中发布 /advisor、qwen sessions ps 和可恢复的 /review。其中 /advisor 通过只读独立会话返回结论、风险、缺失证据和建议;会话命令可列出本机正在运行的会话、目录、进程号与运行时间;PR 复核只有在报告、工作树、diff 和 PR 状态一致时才继续,否则重新开始。

这些是 Qwen Code 运行时的官方产品能力,不应反向写成 Qwen3-Coder-Next 模型天然具备独立复核、审计或恢复保证。模型负责生成与工具选择,运行时负责会话隔离、状态校验和命令执行;企业还要自己控制权限、日志、密钥、沙箱与人工批准。

渠道报价与企业采购边界

2026 年 8 月 26 日,VibeToken 结构化接口返回输入 ¥1.4、输出 ¥10.5 / 100 万 token,并带 15% 折扣字段。该数字只适用于渠道当前公开口径,不能与阿里云官方 API、私有化 GPU 成本或其他渠道直接混算。采购前至少应索取可验证账单样本,并确认缓存、税费、并发、数据驻留、故障响应和版本固定策略。

对于本地部署,则应按 80B 总权重、服务副本、KV Cache 与高可用冗余计算总拥有成本。不能用“3B 激活”证明低内存,也不能用第三方 Token 单价证明私有化更贵或更便宜。

上线前核验清单

  1. 用真实代码库测试补丁正确率、工具参数、测试通过率、回滚和人工接管。
  2. 把 /advisor 一类独立复核放在高风险变更门槛上,且使用不同上下文或模型,避免同源盲点。
  3. 固定模型权重、提示模板、运行时和工具协议版本,长任务恢复前校验工作树与外部 PR 状态。
  4. 渠道 API 与本地权重都放在模型网关之后,保留独立供应商回退与审计日志。

来源与研究限制

本页没有调用受认证保护的渠道端点,没有复现 Qwen 官方基准,也没有验证渠道后台实际路由。官方模型卡中的性能图表属于厂商自测;生产结论应以企业任务回放、合同和真实账单为准。

公开参数字段

来自渠道结构化接口,仅反映当前接入形态。

渠道暂未给出结构化参数;接入前需检查当前 API 文档。