大模型常见的专用名词

复制代码
•	RPM(Requests Per Minute):每分钟最多允许发起多少次请求(调用次数)。超过就会报限流。 
•	TPM(Tokens Per Minute):每分钟最多允许处理多少 token。token 可以理解为"文本计费单位/处理单位"(中英文拆分规则不同)。 
•	重要:有的厂商 TPM只算输入 tokens,有的会把 输入+输出 都算进去;要以你用的厂商文档为准。 
•	RPD(Requests Per Day):每天(或滚动 24h)最多允许多少次请求。 
  1. Token & 上下文相关

    • Token:模型处理文本的基本单位;不是"字数",中文/英文的 token 数差异很大。

    • Context window / Context length(上下文窗口):一次请求里模型能"看到"的最大 token 数(输入+输出通常都占用窗口)。

    • Input tokens / Output tokens:输入消耗的 token、输出生成消耗的 token。

    • Max output tokens / max_tokens:这次最多允许模型生成多少 token(防止无限输出)。

    • Truncation(截断):输入太长时被系统或你自己截断,导致模型"看不到后半段"。

  2. 限流 / 吞吐相关

    • RPS / QPS(Requests/Queries Per Second):每秒请求数(有时平台会用这个口径,而不是 RPM)。

    • Burst(突发):短时间允许你"瞬时冲高",但会用更长窗口做平滑统计(常见于滚动窗口策略)。

    • Rolling window(滚动窗口):不是按整点清零,而是按"最近 60 秒 / 最近 24 小时"累计来算;所以你会看到"请在 X 分钟后重试"这种提示。 

    • Concurrency(并发):同时在跑的请求数量上限(有的平台单独限制并发)。

    • Throughput(吞吐):单位时间输出多少 token(tokens/s),和模型大小、推理硬件、解码策略有关。

    • Latency(延迟):从发请求到拿到响应的时间;常拆成 TTFT + 生成阶段。

  3. 流式与时延拆分

    • Streaming(流式输出):模型边生成边返回(更"快看到第一段")。

    • TTFT(Time To First Token):首 token 返回时间;对体验影响非常大。

    • Tokens/s(生成速度):流式时更直观。

  4. 计费与配额混合口径(不同厂商差异更大)

    • TPD(Tokens Per Day):每天 token 总量限制(有些平台有)。 

    • Spend limit(消费上限):按金额限制(例如 Anthropic/Claude 文档里会区分消费上限和速率限制)。 

    • Cached tokens(缓存 token):有的平台对"命中缓存"的 token 不计入限额或计费(具体看平台规则)。 

    • 音频类配额:例如按 Audio seconds per hour/day 计(做语音模型常见)。 

相关推荐
Bruce_Liuxiaowei1 小时前
WorkBuddy案例——自动化内容创作平台
人工智能·ai·大模型·智能体·workbuddy
刘大猫.3 小时前
GPT-5.5才发三周,5.6已在内测!OpenAI与Anthropic补贴大战同日开打,开发者坐收渔利
人工智能·ai·chatgpt·机器人·大模型·openai·anthropic
weixin_553654484 小时前
ChatGPT好用还是Gemini好用?
人工智能·chatgpt·大模型
DogDaoDao5 小时前
【GitHub】AgentMemory 深度解析:让 AI 编程代理拥有持久化记忆的 16K+ Star 开源方案
人工智能·开源·大模型·github·aigc·ai编程·aiagent
佳杰云星1 天前
如何给大模型集群选“大脑”?智算调度与管理平台 10 维选型指南(附选型评分表)
人工智能·kubernetes·大模型·云计算·gpu·算力调度·智算中心
牧子川1 天前
016-Function-Calling
大模型·tools·functioncalling
这是谁的博客?1 天前
[模型解析] Kimi: 模型架构与长上下文能力分析
ai·大模型·kimi·长上下文·月之暗面·国产ai
这是谁的博客?1 天前
[模型解析] GPT: 模型演进分析从GPT-3到GPT-5.5
gpt·ai·chatgpt·大模型·gpt-3·openai
养肥胖虎1 天前
完整学习LLM(一):为什么我要系统学习大模型
大模型·llm·学习路线
这是谁的博客?1 天前
[模型解析] DeepSeek: 技术创新与架构解析
ai·架构·大模型·moe·开源模型·deepseek·国产ai