ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

RPM、RPD、TPM、TPD 到底是什么?awesome-free-llm-apis 限流术语与免费额度规划终极指南

RPM、RPD、TPM、TPD 到底是什么?awesome-free-llm-apis 限流术语与免费额度规划终极指南 RPM、RPD、TPM、TPD 到底是什么awesome-free-llm-apis 限流术语与免费额度规划终极指南【免费下载链接】awesome-free-llm-apisList of Permanent Free LLM API (API Keys)项目地址: https://gitcode.com/gh_mirrors/aw/awesome-free-llm-apisawesome-free-llm-apis 是一份永久免费的大模型LLMAPI 清单。当你准备接入免费 AI 接口时最先被绕晕的往往是那些限流术语15 RPM、1,000 RPD、500K TPM、200K TPD……这些缩写到底什么意思怎么判断哪个服务商适合自己本文一次讲清这些免费 LLM API 限流术语的含义并给出一套实用的免费额度规划方法。为什么用免费 LLM API 前必须搞懂限流术语免费额度本质上是一份预算服务商按分钟和天两个时间尺度给你的请求数和 token 数设上限用完就会报错通常是 HTTP 429。请求Request一次 API 调用不管问题多长多短都算 1 次。Token大模型的字符单位中文约 1 个字 ≈ 1 token英文约 4 个字母 ≈ 1 token。不懂限流最常见的翻车现场是机器人上午好好的下午突然集体哑火——不是程序出错而是你撞上了 RPM每分钟上限或 RPD每天上限。限流术语速查表一张表看懂全部缩写 清单内置了一份术语表见 README.md 的 Glossary 部分这里再用大白话翻译一遍缩写全称含义通俗类比RPMRequests per minute每分钟请求数每分钟最多让多少人进门RPDRequests per day每天请求数全天一共发多少张门票RPSRequests per second每秒请求数每秒最多放多少人进门TPMTokens per minute每分钟 token 数每分钟最多花钱多少TPDTokens per day每天 token 数全天的消费预算记法很简单首字母是计量单位后两位是时间维度。R 代表请求RequestT 代表 token。怎么读懂限流标注清单里的 3 个真实例子从 data.json全清单的结构化数据里挑三种典型写法Groq30 RPM, 1,000 RPD—— 每分钟最多发 30 个请求全天累计最多 1,000 个。这种双限制意味着你没法一天开头就把 1,000 个请求打光必须分摊到全天。Gemini 2.5 Pro5 RPM, 50 RPD—— 每分钟 5 个、每天 50 个适合偶尔请教难题不适合高频调用。Mistral AI~1 RPS, 500K TPM—— 约每秒 1 个请求、每分钟瞬时吞吐 50 万 token其免费 Experiment 计划每月约 10 亿 token是全清单里 token 预算最宽裕的之一。另外要分清几种不同的限制口径按模型限OpenRouter 免费模型一般是 20 RPM / 200 RPD但这是每个模型单独的上限不是全家共享。按服务商总限ModelScope 是每用户全天 2,000 RPD单个模型还有 500 RPD 的动态上限。无每日上限NVIDIA NIM 只写~40 RPM没有每日 token 上限。未公布具体数字Ollama Cloud 按会话 每周限流且未公开数值使用时应先轻后重。免费额度规划四步法心算一下就够了 以一个个人助手机器人为例平均每天 100 次提问每次输入 输出约 1,000 token。估全天请求数→ 100 请求/天低于大多数服务商的 RPD5002,000轻松通过。估全天 token 数→ 100 × 1,000 10 万 token/天。Aion Labs 的 20K TPD 会不够用Cerebras1M TPD、Mistral每月约 10 亿 token则绰绰有余。估每分钟峰值→ 若 100 个请求集中在 10 分钟内发出就是 10/分钟需要至少 10 RPM。30 RPM 的 Groq、Cerebras 够用2 RPM 的匿名通道就不行。留一个备胎→ 同时配置 23 家服务商触发限流时自动切换或排队机器人就不会断片。一句话原则先看全天总量RPD / TPD够不够再看每分钟峰值RPM / TPM够不够。按使用场景挑选免费 LLM 服务商free-llm-apis/SKILL.md 里有一张选型对照表翻译成新手语言如下你在乎什么清单里的优选关键额度每分钟限额高、请求多Groq、Cerebras30 RPM1,00014,400 RPDtoken 总预算最足Mistral AI每月约 10 亿 token500K TPM模型种类最多Cloudflare Workers AI、NVIDIA NIM400 / 100 模型想要最强自研模型Google Gemini、GitHub Models515 RPM50150 RPD零注册快速尝鲜LLM7.io、OVHcloud30 RPM带 token/ 2 RPM匿名一家免费模型多OpenRouter20 RPM、200 RPD每模型去哪里查最新的限流数字免费额度会调整例如 Groq 在 2026 年把免费额度从 14,400 RPD 降到 1,000 RPD。把项目里的三件套当准星README.md全部服务商、模型与限流标注的完整列表脚注还会说明限流变更的背景。data.json同样的数据结构化呈现方便你按RPM ≥ X这样的条件筛选服务商。scripts/verify-providers.js维护者用来核验各家是否仍符合永久免费标准的脚本。入选标准写在 contributing.md 里只收录永久免费层——试用额度、限时促销、需要绑信用卡的一律不算。新手避坑清单 ⚠️429 不是 bug撞每分钟上限就等 1 分钟重试撞全天上限就等重置多数服务商在 0 点重置时区各家不同。别把每模型上限当成总上限OpenRouter 的 200 RPD 是每个模型各有一份。注意地域限制Google Gemini 免费层在欧洲、英国、瑞士不可用。隐私提醒部分服务商的免费层如 Gemini、Mistral、OpenRouter 免费模型可能将提示词用于训练敏感数据别往上游。总结RPM / RPS 管的是你的每分钟速度RPD / TPD 管的是你的全天总量TPM 管的是每分钟吞吐。选免费 LLM API 时先算清自己的全天请求数 全天 token 数 每分钟峰值再对照清单逐家核对以后遇到 429 报错你就知道该等一分钟、等一天还是该换一家了。【免费下载链接】awesome-free-llm-apisList of Permanent Free LLM API (API Keys)项目地址: https://gitcode.com/gh_mirrors/aw/awesome-free-llm-apis创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表