百灵 / inclusionAI · 高配笔记本与单卡工作站

UI-Venus-2-9B

面向移动应用、网页和桌面系统的 9B 视觉 GUI Agent 开放权重,通过截图观察、推理、动作和环境反馈形成闭环。

查看官方资料 官方源核验于 2026/08/29
参数规模9B 级 Dense 多模态模型;官方 BF16 权重文件约 18.82GB
架构Qwen3.5-9B 微调 · 视觉闭环 GUI Agent
模态截图、文本、移动端、网页与桌面 GUI 操作
上下文262,144(官方 vLLM 配方与模型配置)
Local deployment verdict

部署判断

官方权重索引给出的 BF16 文件总大小约 18.82GB;实际服务还需视觉预处理、KV Cache、长轨迹历史、vLLM 工作区与执行框架内存。移动应用能力通过截图、ADB 或浏览器框架实现,不表示 9B 权重直接在手机芯片运行。

推荐起点
高配笔记本与单卡工作站
常见运行时
vLLM OpenAI 兼容服务(官方配方,未做线上金丝雀验证)、Venus Mobile Framework / ADB、Chrome Side Panel 浏览器插件、离线截图序列示例
许可
待官方确认:模型卡明确标注权重许可尚未最终确认;代码仓库页面仍显示 Apache 2.0,当前存在冲突

型号与精度版本

BF16 Safetensors

同一模型家族中的基础、指令、推理、量化或多模态检查点用途可能完全不同。下载前应核对模型卡、提示模板、分词器、量化方法和运行时版本。

适合放进哪些本地工作流

受控 GUI Agent 评测
移动应用回归测试
浏览器任务自动化原型
桌面数字员工安全研究

端侧模型更适合边界清楚、输入可控、失败可回退的任务。涉及客户承诺、财务写入、生产控制或复杂多步工具调用时,应保留云端高能力模型与人工审批作为升级路径。

进入数字员工路由前怎么测

  1. 加载测试记录具体设备、精度、运行时、上下文与首 Token 时间,避免只写“能跑”。
  2. 任务测试用脱敏企业样本测任务成功率、结构化输出和工具参数正确率。
  3. 压力测试加入长上下文、并发、热启动、内存峰值、功耗和降频观察。
  4. 治理测试验证模型许可、日志、更新、漏洞响应、人工接管与云端回退。

当前研究限制

  • 模型权重许可尚未最终确认,不能在企业采购或商用评审中沿用代码仓库的 Apache 2.0 标牌
  • 手机、网页与桌面能力不等于权重在手机或终端芯片直接运行
  • 模型卡榜单、安全攻击成功率与环境覆盖均为厂商自测,技术报告仍待发布
  • 启动 vLLM 只提供模型 API;真实闭环还需要截图采集、动作解析、执行器、状态回读与失败恢复
  • ADB、浏览器控制和桌面操作属于高权限执行面,必须增加动作白名单、最小权限、审批与审计

本页是官方资料索引与企业选型分析,不构成速度、显存、质量、许可或合规承诺。社区量化与第三方运行时应作为独立供应链组件审计。