安全审核
Agent 在发布 (尤其是上架广场) 前,会经过平台的安全审核。审核不通过的 Agent 无法发布/上架;已上架后发现违规的,平台会下架处理。本篇说明审什么、什么情况过不了。
审核什么
Agent 的对外呈现和行为定义都在审核范围内:
| 审核对象 | 审核关注点 |
|---|---|
| 名称 | 是否含违规、误导、仿冒性内容 (如"荐股大师""稳赚宝") |
| 头像 | 是否含违规图像,是否仿冒官方、监管机构或他人品牌 |
| 描述 / 开场白 | 对外宣称的能力是否违规 (如承诺收益、提供投资建议) |
| Prompt(System Prompt) | 提示词定义的行为是否违规,是否试图绕过平台合规护栏 |
- 审核发生在发布 / 上架广场环节 (发布到广场需通过安全扫描,Pro 及以上套餐)
- 修改上述内容后重新发布,会再次触发审核
会审核不通过的场景
以下场景一经识别即不通过 (与 合规要求的六大原则一一对应):
| # | 场景 | 典型例子 |
|---|---|---|
| 1 | 洗钱及协助非法资金流转 | 提示词引导拆分转账规避申报、隐匿资金来源、协助逃避追踪 |
| 2 | 市场操纵 | 名称/提示词涉及拉抬打压、对敲、伪造交易信号、组织喊单荐股 |
| 3 | 内幕交易与未公开重大信息 | 定位为"内幕消息""小道消息"类 Agent,或引导获取/传播 MNPI |
| 4 | 提供投资建议、承诺收益 | 名称或描述含"必涨""稳赚""保证收益""荐股",提示词要求输出买卖建议、目标价 |
| 5 | 逃税、规避制裁 | 协助设计逃税路径、规避监管或制裁措施 |
| 6 | 不良内容 | 名称/头像/提示词含色情、暴力、赌博、毒品、恐怖主义等内容 |
| 7 | 仿冒与侵权 | 头像/名称仿冒平台官方、监管机构、知名机构或他人品牌,盗用他人受版权保护的素材 |
| 8 | 侵犯隐私 | 提示词设计为诱导收集用户身份证件号、账户密码等个人敏感信息 |
| 9 | 绕过合规护栏 | 提示词中要求模型"忽略平台规则""不受合规限制"等越狱式指令 |
以上为常见场景列举,不是穷尽清单;平台保留对其他违法违规内容不予通过的权利,具体以审核结果为准。
审核不通过怎么办
- 按提示修改:对照上表定位问题,修改名称/头像/描述/提示词后重新提交
- 合规地实现同类需求:很多"不通过"其实是表述问题 —— 比如想做指标分析 Agent,把"金叉买入提醒"改为"金叉形态的中立解读"(描述性语言,见 参考 Prompt),即可合规上线
- 已上架被下架的:整改后可重新提交审核
关联阅读
- 合规要求 — 参考 Prompt、红线速查表与上线自查
- Guardrail 安全护栏 — 审核管"上线前",Guardrail 管"运行时"
- Agent 使用范围声明 — 广场 Agent 仅供学习交流