AI 應用安全:除了攔截攻擊,還要管住 API 資源消耗
從 OWASP 的資源消耗風險出發,梳理 AI 介面的帳號配額、並行限制、逾時和成本監控,明確邊緣防護與業務鑑權各自負責什麼。
本文目錄
請求合法,也可能耗盡資源
OWASP API Security Top 10 將不受限制的資源消耗列為 API4:2023;OWASP 面向大型語言模型應用的風險清單也包含無限制消耗。對 AI 服務而言,一個通過鑑權的請求仍可能佔用很長推論時間、呼叫多個付費工具,或持續持有連線。只看惡意請求攔截量,無法判斷業務是否可持續運作。
把限制放到實際付費的業務主體上
建議同時記錄租戶、帳號、API Key 和呼叫入口。IP 限速可以作為一層控制,但共用出口可能聚集正常使用者,分散式呼叫也可能來自大量位址。業務側應按實際身分限制呼叫頻率、並行任務和可用模型,並在伺服器端校驗額度,不能相信用戶端自行申報的剩餘餘額。
長連線要有明確的結束條件
串流介面需要分別考慮首包等待、最大生成時長、輸出規模和用戶端斷開後的取消行為。使用者關閉頁面後,後台任務如果繼續執行,資源和上游費用仍可能增長。為佇列設定長度上限及過期策略,在過載時回傳明確狀態,避免無限排隊掩蓋故障。
邊緣防護與應用控制分工
邊緣側處理異常存取、常見 Web 攻擊和入口流量;業務側負責物件權限、模型呼叫額度、工具授權與敏感資料範圍。WAF 不能替代這些業務規則。API 接入防護後,要用真實用戶端驗證鑑權標頭、串流回應、逾時與重試行為,避免給機器呼叫套用無法完成的人機驗證。
上線前做一次小範圍驗證
在測試環境準備額度耗盡、並行超過上限、使用者中途取消和上游逾時四類案例。驗收重點是任務是否及時結束、費用是否能追溯到帳號,以及被限制的請求是否得到一致回應。監控應同時觀察請求成功率、生成延遲、活動連線和單位業務成本。
