Agent Threat Rules:AI Agent 安全正在補上 Sigma / YARA 等級的規則層
整理 Threads 貼文與 Agent-Threat-Rule 官方 README:ATR 將 AI agent 威脅轉成可交換、可版本化、可落地到治理工具的 detection rule。重點不是攻擊細節,而是風險分類、規則治理、合規證據包與主權 AI 防禦。
GitHub API 與官方 README 顯示 ATR 為 MIT 授權;官方 data/stats.json 顯示版本 3.5.0、規則總數 768、10 個類別,並把 data/stats.json 視為數字衝突時的 canonical source。
README 列出 Microsoft Agent Governance Toolkit / PyRIT、Cisco AI Defense、MISP / CIRCL rulezet、OWASP Agent Security Regression Harness、SigmaHQ、AMD GAIA、FINOS Common Cloud Controls、Gen Digital Sage 等外部 PR / 整合紀錄。這些是 repo 自列的 adoption record;仍需逐一看 PR 狀態來判斷生產成熟度。
Panguard 官網把 ATR 定位為 agent security rule standard;PanGuard Sovereign 則主打本地、可稽核、可離線驗證的治理層。Threads 補充提到 Migrator 要把 Sigma / YARA / CVE / Garak / PyRIT 等舊規則轉成 ATR 格式與簽名合規證據包。
| ATR 類別 | 官方 stats 數量 | 防禦意義 |
|---|---|---|
| Prompt Injection | 219 | 偵測忽略指令、角色劫持、編碼 payload、語言/格式混淆等已知模式。 |
| Context Exfiltration | 108 | 辨識系統提示、環境變數、API key、跨使用者記憶等外洩徵兆。 |
| Agent Manipulation | 106 | 把 agent 行為操控與目標轉移變成可掃描的規則。 |
| Tool Poisoning | 85 | 處理 MCP 回應、工具 schema、隱藏指令、向量檢索條件污染等問題。 |
| Privilege Escalation / Skill Compromise |