NVIDIA · 轻薄本与普通 AI PC

Nemotron-Labs-Audex-2B

NVIDIA 的 2B 统一音频文本模型,可在同一权重中处理音频理解、ASR、翻译、TTS、音频生成与文本推理,适合本地语音 Agent 原型。

查看官方资料 官方源核验于 2026/08/19
参数规模2B
架构2B Dense · 统一音频文本模型
模态文本、音频理解、语音识别与翻译、语音与音频生成
上下文128K
Local deployment verdict

部署判断

2B Dense 主干降低了本地推理门槛,但音频编码器、离散音频词表、编解码器、128K KV Cache 与运行时插件都会增加实际内存;官方未给出统一设备占用,需按具体任务测量。

推荐起点
轻薄本与普通 AI PC
常见运行时
vLLM 0.20.0 + 官方插件、Transformers 4.53+
许可
NVIDIA Oneway Noncommercial License

型号与精度版本

多阶段 SFT 权重

同一模型家族中的基础、指令、推理、量化或多模态检查点用途可能完全不同。下载前应核对模型卡、提示模板、分词器、量化方法和运行时版本。

适合放进哪些本地工作流

本地语音助手原型
离线转写与翻译评测
音频理解
语音 Agent 研发

端侧模型更适合边界清楚、输入可控、失败可回退的任务。涉及客户承诺、财务写入、生产控制或复杂多步工具调用时,应保留云端高能力模型与人工审批作为升级路径。

进入数字员工路由前怎么测

  1. 加载测试记录具体设备、精度、运行时、上下文与首 Token 时间,避免只写“能跑”。
  2. 任务测试用脱敏企业样本测任务成功率、结构化输出和工具参数正确率。
  3. 压力测试加入长上下文、并发、热启动、内存峰值、功耗和降频观察。
  4. 治理测试验证模型许可、日志、更新、漏洞响应、人工接管与云端回退。

当前研究限制

  • 许可明确为非商业使用,企业生产落地前必须另行核权
  • 模型发布日期为 6 月 8 日,本次只是官方模型卡在 8 月 18 日进入监控
  • 全部榜单与复现配置属于厂商自测
  • 不同音频任务依赖额外插件与编解码器,不能只按 2B 权重估算

本页是官方资料索引与企业选型分析,不构成速度、显存、质量、许可或合规承诺。社区量化与第三方运行时应作为独立供应链组件审计。