目前一些主流大模型公司的订阅性价比

目前一些主流大模型公司的订阅性价比
前言由于我个人主要是编码使用所以需要考虑缓存命中率的影响比如智谱的coding plan如果单看使用token额度可以说是碾压了其它家1020倍但考虑缓存命中一些以credit计价的套餐也没有想像的那么差劲以下是我个人最近半年尝试过后得到的一些心得和结论分享给大家纯个人经验不喜划走就好勿喷智谱目前pro档位一个月有20个5小时额度每5小时可用额度为110m一共22亿token考虑到后续大概率随着模型的变强会有更高的倍率我们这里按官方api的价格统一计价后文计算方法同理。我按正常工作时间只能使用上午一个5小时额度下午一个5小时额度计算智谱GLM5.2平峰期2倍额度消耗高峰期3倍消耗平均下来一个月实际可以使用的token额度为2200/2.5880m我的使用习惯实际上使用api的价格可以近似等于token数量*每100万输入价格*0.25计算结果为880*8*0.251760元包年套餐价格在120元左右性价比为1760/12014.67。再次提醒这只是我根据我使用的token数量与api价格大致的一个转换关系如果你的输出非常多那这个性价比会进一步提高因为code plan不分输入输出和缓存相当于你用的token越贵越划算和下文credits计费方式刚好反着的如果你的缓存命中更高且输出更少那性价比就会进一步降低千问千问在关闭穷人套餐两个月后重新开放了token plan个人版采用credits计价我直接说结论包年125左右每月可用额度为400元人民币的等价api价格具体能使用多少token要看你使用的模型这里没有具体的性价比计量单位因为比如假设你用了一个输入每100万6元的模型实际上在我的场景可以使用的token数量为400/(6*0.25)266.67m也就是只有2.6亿额度如果以GLM的套餐作为对比基准这时千问的性价比只有智谱的四分之一且这个值随着你使用模型的价格提高会越拉差距越大被glm完爆的但千问的最新模型动不动就有0.2折优惠之类的很难讲所以这种直接计价的就看他实际能用的额度价格与你实际支出费用之比就行了比如千问就是400/1253.2这个值是不太能直接和code plan里我们把总token数转为实际价值来计算性价比对比的。DeepSeek考虑到V4正式版白天价格翻倍我们直接按翻倍后的价格计算但这里需要注意deepseek的缓存命中价格非常低所以用0.25的系数不能反映出deepseek的性价比由于我个人也长期用deepseek在我的使用场景下大概系数是0.1左右即如果输入价格是6元/m则实际上带上缓存命中和输出后价格在6*0.10.6。因此实际上120元可以使用的token数量为120/0.6200m即只有2亿额度可以看到deepseek涨价以后即使保留100倍缓存倍率依然比code plan或者token plan有较大差距。Kimikimi由于新套餐一直不出老套餐包年大概159的档位可以使用600m按kimi2.7-code的价格600*6.5*0.25975,性价比为975/1596.13这个值可以与glm code plan的性价比直接对比MiniMax直接明码标价包年100元可用月额度1800m minimax-m3,token价值为1800*2.1*0.25945,性价比为945/1009.45可以看到由于minimax的token价格太便宜因此实际性价比依然不如智谱Xiaomi小米的套餐基本就是api付费价格没错还得是xiaomi的营销哈哈别人家都是按百万它按单位token写几十亿让你觉得赚了其实差不多的比如39套餐能用41块钱实际token额度这样因此和deepseek一样而且它也和deepseek一样缓存很便宜还是多模态的基本上就对标deepseek的性价比就可以了如果必须api调用要多模态选小米纯文本deepseek。OpenCode推荐一下opencode go如果未来真的都要以credits或者api价格来计算opencode go10美元可以使用60美元的月额度费用倍率为6,比千问的3.2好不少缺点是只有10美元的档位不过可以多开几个号来买Ark没错最后还是讲一下方舟这个code plan因为它极度不透明我是很不推荐大家去买它的实际性价比应该和千问code plan差不多但问题是你根本不知道它每个模型的倍率和消耗无法准确计算能用多少趁着9块钱活动可以薅羊毛原价不如直接买千问Tecent腾讯的性价比比千问和ark还要低一些而且我不确定他的token plan能否调用最新的开源大模型如果只能用hy3那就亏爆了所以我不推荐这个喜欢腾讯生态的可以尝试百度 科大讯飞其实还不错但是我没实际买过而且百度C端现在声量太低科大讯飞听说性价比不错不过都是各段时间才会上sota的开源模型有兴趣可以去试试。总结结论就是如果能抢到智谱优先智谱其次是kimi的套餐然后是minimal(如果你能接受这个模型的能力)。当临时用一下不用code plan时优先opencode go其次是qwen token plan和ark code plan。如果一个月很偶尔只是用那么一两下或者作为其他手段补充使用deepseek和mimo。在这个ai生成slop污染整个互联网的时代以上都是我自己个人经验手敲的一些实际真实开发的体感因为我是做算法的输出代码量相对没有前端之类的那么高结合自己的使用场景如果输出需要的多或者缓存命中低那就调大那个系数。然后想清楚在code plan这种计费体系系数越低性价比越低而在apicredits体系系数越低性价比越高相比于code plan来说。不喜勿喷如果对您有一点点帮助麻烦点个赞谢谢