待验证50% 置信事实精确时间
API限流通常以RPM(每分钟请求数)和TPM(每分钟Token数)两个维度执行,超限时返回429状态码并附带Retry-After响应头
1
来源数
50%
置信度
长期有效
时效性
2026/7/12
首次发现
来源
多模型分层部署:AI网关值得引入吗?
redditr/mlops2026/7/11
相关事实
已验证AI API的速率限制通常以RPM(每分钟请求数)和TPM(每分钟Token数)两个维度进行约束73% 相似待验证Anthropic对Claude API设有TPM(每分钟Token数)和RPM(每分钟请求数)上限73% 相似待验证Anthropic's API Rate Limiting mechanism measures request frequency in RPM (Requests Per Minute) and TPM (Tokens Per Minute).70% 相似待验证OpenAI按TPM(Tokens Per Minute)和RPM(Requests Per Minute)双重限制进行速率控制67% 相似已验证供应商的速率限制通常在每分钟请求数(RPM)、每分钟 Token 数(TPM)、每天 Token 数(TPD)三个维度同时生效66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/492468API
curl https://kongchang.com/api/v1/knowledge/claims/492468MCP
get_claim(id=492468)