跳转到正文
报告库
用途分类 / 其他用途

Gws Modelarmor Sanitize Response Skill 安全审计

作者说它能做什么(原文)

Google Model Armor: Sanitize a model response through a Model Armor template.

第三方安全检查结论

发现安全风险

已检查文件
1
发现的风险
2
会不会运行危险命令?检查是否下载程序后直接运行、让他人远程控制电脑,或藏起要运行的命令。未发现风险
会不会泄露文件和密钥?检查是否发送含密码或密钥的文件,以及代码里是否直接写了密钥。发现 1 项风险
中风险

模型输出可能被发送到外部 Google Cloud 服务

原文依据:3 处
发现了什么

`--text`、完整 `--json` 请求以及管道输入都会交给带有项目、位置和模板资源名的 Model Armor 命令。模型输出可能包含提示词、用户内容、凭据、内部数据或前序命令打印的敏感信息。提供的文件没有说明传输、保留或日志策略。

为什么需要注意

如果输入含敏感数据,数据可能进入所选 Google Cloud 项目及其日志或处理系统,并受该项目的访问控制和保留政策影响。完整 JSON 还可能包含超出待过滤文本的额外字段。

该 Skill 的用途是把模型回复交给 Google Model Armor 模板处理;内容可来自 `--text`、完整 JSON 或管道。因此,运行示例命令时,模型输出会进入由项目、区域和模板标识的外部云服务,可能暴露其中包含的用户或内部数据。材料未说明日志和保留政策。用户可要求作者说明数据处理政策,并限制输入为不含凭据或机密信息的内容。

SKILL.md:30来自说明文档打开原文件
|------|----------|---------|-------------|| `--template` | ✓ | — | Full template resource name (projects/PROJECT/locations/LOCATION/templates/TEMPLATE) || `--text` | — | — | Text content to sanitize || `--json` | — | — | Full JSON request body (overrides --text) |
查看另外 2 个位置
SKILL.md:37来自说明文档打开原文件
```bashgws modelarmor +sanitize-response --template projects/P/locations/L/templates/T --text 'model output'model_cmd | gws modelarmor +sanitize-response --template ...```
SKILL.md:18来自说明文档打开原文件
Sanitize a model response through a Model Armor template
会不会删除文件或一直在后台运行?检查是否大范围删除文件、改写磁盘,或设置自动启动。发现 1 项风险
低风险

缺少共享依赖时会要求运行可生成文件的命令

原文依据:1 处
发现了什么

说明要求在共享 Skill 缺失时运行 `gws generate-skills`。该命令按名称和上下文会创建 Skill 文件,但提供的材料没有列出写入位置、覆盖规则或生成内容。

为什么需要注意

执行后可能在本地 Skill 配置区域创建或替换文件,从而改变后续代理所遵循的认证与安全指令;本材料不足以确定具体范围。

这段证据能说明什么

这是一个仅在共享 Skill 缺失时生效的生成命令,文本明确暗示会创建该依赖文件。不过,所给材料没有命令实现,也没有写入目录、覆盖行为或生成内容,因此无法判断它会修改哪些现有文件或造成何种具体风险。用户可先要求作者列出生成文件和覆盖规则,并在受限目录中运行。

这项判断针对展示的代码和适用条件,不表示风险已经实际发生。
SKILL.md:16来自说明文档打开原文件
> **PREREQUISITE:** Read `../gws-shared/SKILL.md` for auth, global flags, and security rules. If missing, run `gws generate-skills` to create it.
会不会绕过安全保护?检查是否跳过网站安全验证、开放过多文件权限,或取消操作前的确认。未发现风险
会不会误导 AI 或隐藏内容?检查工作说明是否要求 AI 忽略你的指令、干扰检查结果,或夹带看不见的文字。未发现风险
会不会偷偷改推广链接或收款方?检查是否强制替换推广链接或收款对象,同时要求隐瞒更改。未发现风险

Skill 逻辑拆解

5 个说明模块

该 Skill 的实时用途是把模型输出文本或完整 JSON 请求交给 `gws modelarmor +sanitize-response`,并使用指定的 Google Model Armor 模板进行出站过滤。管道示例也会把前一个命令的标准输出交给该服务。

查看原文
SKILL.md:23来自说明文档打开原文件
```bashgws modelarmor +sanitize-response --template <NAME>```
SKILL.md:31来自说明文档打开原文件
| `--template` | ✓ | — | Full template resource name (projects/PROJECT/locations/LOCATION/templates/TEMPLATE) || `--text` | — | — | Text content to sanitize || `--json` | — | — | Full JSON request body (overrides --text) |
SKILL.md:37来自说明文档打开原文件
```bashgws modelarmor +sanitize-response --template projects/P/locations/L/templates/T --text 'model output'model_cmd | gws modelarmor +sanitize-response --template ...```
SKILL.md:43来自说明文档打开原文件
- Use for outbound safety (model -> user).- For inbound safety (user -> model), use +sanitize-prompt.

该 Skill 依赖未提供的 `../gws-shared/SKILL.md` 来规定认证、全局参数和安全规则;因此本材料无法核实凭据来源、网络目标、日志行为或权限范围。缺失依赖不能视为安全保证。

查看原文
SKILL.md:16来自说明文档打开原文件
> **PREREQUISITE:** Read `../gws-shared/SKILL.md` for auth, global flags, and security rules. If missing, run `gws generate-skills` to create it.
SKILL.md:48来自说明文档打开原文件
- [gws-shared](../gws-shared/SKILL.md) — Global flags and auth- [gws-modelarmor](../gws-modelarmor/SKILL.md) — All filter user-generated content for safety commands
从这里开始 · 工作说明SKILL.md
gws-modelarmor-sanitize-response
连线表示工作说明包含的模块,不是实际运行顺序。点击模块可查看原文。
文件与检查记录1 个文件

检查范围与遗漏

逐文件查看涉及的内容

下方列出本次涉及的原文范围;纳入检查不代表已查清所有问题。

  • SKILL.md已纳入全文

这份报告只针对上方版本。我们看了拿到的代码和说明文件,没有实际运行 Skill,也没有检查它另外安装的软件包。因此,这不是“保证安全”的承诺;换了版本或使用环境,结果也可能不同。

  • SKILL.md工作说明

代码和说明中提到的操作

运行命令
SKILL.md:22来自说明文档打开原文件
```bashgws modelarmor +sanitize-response --template <NAME>
SKILL.md:36来自说明文档打开原文件
```bashgws modelarmor +sanitize-response --template projects/P/locations/L/templates/T --text 'model output'
读取了多少行
50
文件校验值(用于核对版本)
678ca1cb3a3d9ec0e0848d7f589a245006b60a48781ad7a6eaa9b29dd29eb185