大家好,我是搞自动化的大飞~
最近都在说DeepSeek斩杀线------意思是AI的极致性价比(虽然梁圣也涨价了)
但是AI的价格可不是淘宝京东比一下价格那么简单,"输入 Token"、"输出 Token"、"输入 Token 缓存命中价格"、"缓存未命中价格"一大堆专业词,傻傻分不清楚
两大类
首先AI收费分两大类
-
月/年付费------每个月/年付钱,获取一定的使用额度。适合普通用户
-
按Token收费------按实际使用量付费。适合企业或者开发者
输入/出 Token
按照Token收费中一般又会分为
- 输入 Token:每百万 XX 元
- 输出 Token:每百万 XX 元
这个很好理解,我们问AI问题,让AI做的任务都是输入 Token
AI思考,返回处理结果就是输出 Token
但一般输出 Token比输入 Token贵很多。以 DeepSeek V4 Flash 为例,输出的价格是 2 块钱,输入的价格 1 块钱,直接翻倍。
为啥?因为输入时,AI会把每个 Token 的关键特征分离、计算、保持就行了
但输出时需要先理解问题,之后网络搜索,整理结构,最后输出结果。耗费的算力很大,所以输出 Token收费会高一些
输入 Token 缓存命中价格
首先说一下缓存命中
我们问AI问题时,AI会把所有信息计算一遍,然后提取关键信息,保存为KV Cache
但如果你下一次提问,开头的内容和之前的完全一样,那AI就没必要再把开头那部分重新算一遍了。直接调取之前存好的关键信息,只计算后面不一样的信息就好了
这就是"命中缓存"。
比如,你需要让AI做自动化测试,开头固定
"你是一个 Python 自动化测试专家,请用中文回答......"
然后我们每次问问题,都会把这句放在最前面。
那么这句话只会在第一次计算时收费1元,下次再调用就可以收0.2元,因为几乎不需要算力。
而再调用的0.2元就是"输入 Token 缓存命中价格"
在这一点上,AI厂商还是挺良心的(不然AI的价格会非常离谱,没人用得起😂)
输入 Token 缓存未命中价格
这就非常好理解了,我们第二次输入的内容,和第一次不同的,都是缓存未命中的
它的价格几乎和输入 Token的价格持平,毕竟都是重新读取,分析,提取,保存
其他
除了"缓存命中",还有几个术语大概了解一下吧
- 上下文长度阶梯计价:有些模型,你单次输入的 Token 数超过一定阈值(比如 25.6 万),所有 Token 都会按更高单价结算。不是只超出的部分贵,是全部贵。
- 批量处理:不着急要结果的请求,走批量队列,价格通常是标准价的五折。
- 区域溢价:你用欧洲的服务器处理数据,要额外加钱。OpenAI 对某些模型收 10% 的区域附加费。
其实这些新的名词,本质上是为了AI收费更明确清晰,一方面AI厂商不想亏钱赚吆喝,要吃饭。另一方面用户不会不明不白的付费,所以就有了这一套挺复杂的计费标准
希望以后AI能更便宜一些,多像以前的梁圣学习😎