AI 应用安全:除了拦截攻击,还要管住 API 资源消耗

从 OWASP 的资源消耗风险出发,梳理 AI 接口的账号配额、并发限制、超时和成本监控,明确边缘防护与业务鉴权各自负责什么。

本文目录

请求合法,也可能耗尽资源

OWASP API Security Top 10 将不受限制的资源消耗列为 API4:2023;OWASP 面向大模型应用的风险清单也包含无限制消耗。对 AI 服务而言,一个通过鉴权的请求仍可能占用很长推理时间、调用多个付费工具,或持续持有连接。只看恶意请求拦截量,无法判断业务是否可持续运行。

把限制放到实际付费的业务主体上

建议同时记录租户、账号、API Key 和调用入口。IP 限速可以作为一层控制,但共享出口可能聚集正常用户,分布式调用也可能来自大量地址。业务侧应按实际身份限制调用频率、并发任务和可用模型,并在服务端校验额度,不能相信客户端自行申报的剩余余额。

长连接要有明确的结束条件

流式接口需要分别考虑首包等待、最大生成时长、输出规模和客户端断开后的取消行为。用户关闭页面后,后台任务如果继续运行,资源和上游费用仍可能增长。为队列设置长度上限及过期策略,在过载时返回明确状态,避免无限排队掩盖故障。

边缘防护与应用控制分工

边缘侧处理异常访问、常见 Web 攻击和入口流量;业务侧负责对象权限、模型调用额度、工具授权与敏感数据范围。WAF 不能替代这些业务规则。API 接入防护后,要用真实客户端验证鉴权头、流式响应、超时与重试行为,避免给机器调用套用无法完成的人机验证。

上线前做一次小范围验证

在测试环境准备额度耗尽、并发超过上限、用户中途取消和上游超时四类用例。验收重点是任务是否及时结束、费用是否能追溯到账号,以及被限制的请求是否得到一致响应。监控应同时观察请求成功率、生成时延、活动连接和单位业务成本。

相关方案与资料

AI 应用安全方案

OWASP:API4 不受限制的资源消耗

OWASP:LLM10 无限制消耗

返回行业资讯 联系技术支持