Pay-per-token
按AI处理的文本片段(token)数量计费的按量付费模式。
简单来说
Pay-per-token是指按照你实际使用AI服务的量来付费,具体来说,是按AI处理的文本被切分成的小片段数量计费。这些片段被称为token,大致相当于一个单词或其中一部分。
可以把它想象成电费或水费那样,按实际用量计量收费。它和每月固定费用、不限量使用的订阅制不同,也和整台租用、一直保持开机的预留容量方式不同。请求量大的月份账单会增加,不用的话几乎不产生费用。
初创公司或小型开发团队在第一次接入AI服务时,常常选择这种方式,因为不需要提前购买或预订服务器,只按实际发送的请求量计费。不过,一旦流量变大且变得可预测,提前购买一定容量的预留型方式反而可能更便宜。
在报道中是这样出现的
文章中提到:"计费默认采用pay-per-token的无服务器推理方式"。容易被误解的一点是,这种方式并不总是最便宜的选择。对流量稳定、可预测的团队而言,提前预订容量的PTU(预留容量)方式可能更划算,文章也特别指出,初创公司的信用额度并不适用于预留容量方式。
亲手试一试
打开你正在使用或正在考虑的AI服务的价格说明页面。如果价格是以每百万token多少钱的方式标示,那就是pay-per-token模式;如果是按月固定费用或预留容量单位标示,那就是另一种计费方式。可以根据自己的使用模式是波动大还是稳定,来判断哪种方式更划算。
