百灵 / inclusionAI · 嵌入式与手机

SingGuard 多模态安全护栏

可把运行时自然语言安全策略作为输入的多模态护栏家族,覆盖文本、图像、图文组合以及请求侧和响应侧审核。

查看官方资料 官方源核验于 2026/08/29
参数规模0.8B / 2B / 4B / 8B
架构Qwen3-VL 系列微调 · 生成式多模态护栏
模态文本、图像、图文组合、用户输入与模型响应
上下文以具体模型卡与 Qwen3-VL 基座配置为准
Local deployment verdict

部署判断

0.8B—4B 型号与 GGUF 便于在受限设备或本地网关评测,但视觉编码器、图像分辨率、策略文本、推理输出与 KV Cache 都会增加实际占用;官方未给出统一设备内存或吞吐数据。

推荐起点
嵌入式与手机
常见运行时
Transformers、vLLM chat-style 输入、llama.cpp / GGUF 生态
许可
Apache 2.0

型号与精度版本

SingGuard 0.8B
SingGuard 2B
SingGuard 4B
SingGuard 8B
GGUF 量化

同一模型家族中的基础、指令、推理、量化或多模态检查点用途可能完全不同。下载前应核对模型卡、提示模板、分词器、量化方法和运行时版本。

适合放进哪些本地工作流

本地输入输出审核
多模态内容安全
企业自定义策略试验
数字员工工具前后置护栏

端侧模型更适合边界清楚、输入可控、失败可回退的任务。涉及客户承诺、财务写入、生产控制或复杂多步工具调用时,应保留云端高能力模型与人工审批作为升级路径。

进入数字员工路由前怎么测

  1. 加载测试记录具体设备、精度、运行时、上下文与首 Token 时间,避免只写“能跑”。
  2. 任务测试用脱敏企业样本测任务成功率、结构化输出和工具参数正确率。
  3. 压力测试加入长上下文、并发、热启动、内存峰值、功耗和降频观察。
  4. 治理测试验证模型许可、日志、更新、漏洞响应、人工接管与云端回退。

当前研究限制

  • 安全标签仍由生成式模型产生,不能替代确定性权限、审批和数据防泄漏控制
  • 官方榜单与动态策略结果均为厂商自测,需用企业中文、方言、图文组合与对抗样本复测
  • 仓库示例的 2B/4B/8B 与 Hugging Face 0.8B 条目更新时间、命名并不完全一致,应按具体检查点核对
  • GGUF 或端侧命名不证明权重可直接在目标手机芯片稳定运行

本页是官方资料索引与企业选型分析,不构成速度、显存、质量、许可或合规承诺。社区量化与第三方运行时应作为独立供应链组件审计。