安全稽核
Agent 在釋出 (尤其是上架廣場) 前,會經過平臺的安全稽核。稽核不通過的 Agent 無法釋出/上架;已上架後發現違規的,平臺會下架處理。本篇說明審什麼、什麼情況過不了。
稽核什麼
Agent 的對外呈現和行為定義都在稽核範圍內:
| 稽核物件 | 稽核關注點 |
|---|---|
| 名稱 | 是否含違規、誤導、仿冒性內容 (如"薦股大師""穩賺寶") |
| 頭像 | 是否含違規影像,是否仿冒官方、監管機構或他人品牌 |
| 描述 / 開場白 | 對外宣稱的能力是否違規 (如承諾收益、提供投資建議) |
| Prompt(System Prompt) | 提示詞定義的行為是否違規,是否試圖繞過平臺合規護欄 |
- 稽核發生在釋出 / 上架廣場環節 (釋出到廣場需通過安全掃描,Pro 及以上套餐)
- 修改上述內容後重新發布,會再次觸發稽核
會稽核不通過的場景
以下場景一經識別即不通過 (與 合規要求的六大原則一一對應):
| # | 場景 | 典型例子 |
|---|---|---|
| 1 | 洗錢及協助非法資金流轉 | 提示詞引導拆分轉賬規避申報、隱匿資金來源、協助逃避追蹤 |
| 2 | 市場操縱 | 名稱/提示詞涉及拉抬打壓、對敲、偽造交易訊號、組織喊單薦股 |
| 3 | 內幕交易與未公開重大資訊 | 定位為"內幕訊息""小道訊息"類 Agent,或引導獲取/傳播 MNPI |
| 4 | 提供投資建議、承諾收益 | 名稱或描述含"必漲""穩賺""保證收益""薦股",提示詞要求輸出買賣建議、目標價 |
| 5 | 逃稅、規避制裁 | 協助設計逃稅路徑、規避監管或制裁措施 |
| 6 | 不良內容 | 名稱/頭像/提示詞含色情、暴力、賭博、毒品、恐怖主義等內容 |
| 7 | 仿冒與侵權 | 頭像/名稱仿冒平臺官方、監管機構、知名機構或他人品牌,盜用他人受版權保護的素材 |
| 8 | 侵犯隱私 | 提示詞設計為誘導收集使用者身份證件號、賬戶密碼等個人敏感資訊 |
| 9 | 繞過合規護欄 | 提示詞中要求模型"忽略平臺規則""不受合規限制"等越獄式指令 |
以上為常見場景列舉,不是窮盡清單;平臺保留對其他違法違規內容不予通過的權利,具體以稽核結果為準。
稽核不通過怎麼辦
- 按提示修改:對照上表定位問題,修改名稱/頭像/描述/提示詞後重新提交
- 合規地實現同類需求:很多"不通過"其實是表述問題 —— 比如想做指標分析 Agent,把"金叉買入提醒"改為"金叉形態的中立解讀"(描述性語言,見 參考 Prompt),即可合規上線
- 已上架被下架的:整改後可重新提交稽核
關聯閱讀
- 合規要求 — 參考 Prompt、紅線速查表與上線自查
- Guardrail 安全護欄 — 稽核管"上線前",Guardrail 管"執行時"
- Agent 使用範圍宣告 — 廣場 Agent 僅供學習交流