NVIDIA · 嵌入式与手机

Cosmos3-Edge

NVIDIA 面向机器人、自动驾驶和智能空间的 4B 多模态世界模型,可生成文本、图像、视频与动作轨迹,并提供 Jetson 设备操作路径。

查看官方资料 官方源核验于 2026/08/29
参数规模4B 可训练参数
架构Mixture-of-Transformers · 自回归 + 扩散双塔
模态文本、图像、视频、动作轨迹
上下文Reasoner 最高 256K;Generator 文本输入 4K
Local deployment verdict

部署判断

官方仅验证 BF16 与 NVIDIA GPU 路径,并公布 Jetson Thor 16GB—128GB、AGX Orin 64GB 等平台结果;这证明特定嵌入式设备路径,不代表普通手机芯片可直接加载运行。

推荐起点
嵌入式与手机
常见运行时
vLLM-Omni、vLLM、PyTorch、Hugging Face Diffusers
许可
OpenMDW 1.1

型号与精度版本

Cosmos3-Edge
Cosmos3-Edge-Policy-DROID

同一模型家族中的基础、指令、推理、量化或多模态检查点用途可能完全不同。下载前应核对模型卡、提示模板、分词器、量化方法和运行时版本。

适合放进哪些本地工作流

机器人设备操作 Agent
工业现场视频推理
动作轨迹生成
Physical AI 仿真

端侧模型更适合边界清楚、输入可控、失败可回退的任务。涉及客户承诺、财务写入、生产控制或复杂多步工具调用时,应保留云端高能力模型与人工审批作为升级路径。

进入数字员工路由前怎么测

  1. 加载测试记录具体设备、精度、运行时、上下文与首 Token 时间,避免只写“能跑”。
  2. 任务测试用脱敏企业样本测任务成功率、结构化输出和工具参数正确率。
  3. 压力测试加入长上下文、并发、热启动、内存峰值、功耗和降频观察。
  4. 治理测试验证模型许可、日志、更新、漏洞响应、人工接管与云端回退。

当前研究限制

  • Edge 命名不等于手机可运行,官方只验证 NVIDIA GPU 与 Linux
  • 仅 BF16 获官方支持,FP4、FP8 与 FP16 未正式支持
  • 8 月 25 日已更换生成器检查点和运行时默认值,生产镜像必须固定权重哈希并回归
  • 速度、成功率和榜单均为 NVIDIA 厂商自测;不同 Jetson 分辨率不能直接横比
  • OpenMDW 1.1 需企业法务核对

本页是官方资料索引与企业选型分析,不构成速度、显存、质量、许可或合规承诺。社区量化与第三方运行时应作为独立供应链组件审计。