Agent 工程

權限與安全

Agent 可以做到啲咩、唔可以做到啲咩?切換三種權限模式,觀察同一批操作的不同處理方式。

選擇權限模式
確認模式 預設
每個危險操作都需用戶確認
自動模式 危險
所有操作自動放行,無需確認
智能模式 Alice
LLM 分類器評估風險等級,按級處理
場景模擬
場景模擬:Agent 想執行 5 個操作
觀察當前模式下每個操作的處理方式
# 操作 工具元數據 風險評估 處理結果
選擇權限模式 → 點擊運行 → 觀察差異
三個設計決策
📌 設計決策 1:權限設計的核心矛盾:安全 vs 效率。每次彈窗確認都會打斷用戶流程,但不確認就可能造成不可逆破壞。你嘅產品揀邊個?
📌 設計決策 2:Alice 的「智能模式」用 LLM 來判斷風險,但 LLM 判斷也可能出錯。一次誤判可能刪掉用戶數據。呢個風險你接唔接受?
📌 設計決策 3:「只讀」和「破壞性」是工具級別的標記。產品經理要決定:你每一個工具屬於邊個風險等級?這是產品決策,不能推給工程。
Takeaway
Takeaway Agent 權限設計的本質是在安全和效率之間找平衡:全部確認最安全但最慢,全部放行最快但最危險。Alice 的做法是用 AI 判斷風險等級:低風險自動放行,高風險攔截確認。
⚠️
Agent 請求權限
拒絕
允許