聚焦电竞赛场,掌握一手游戏竞技资讯

别只看跑分,这三家国产模型成本也能差10倍

作者:别只看跑分,这三家国产模型成本也能差10倍

选AI模型别只盯着跑分,先算账。同一个活跑下来,三家能差十倍。下面是2026年7月18日查证的官方定价,价格单位美元。 先看按token付费(每百万token): ✅ MiniMax M3:输入0.3,输出1.2(上下文超512K翻倍到0.6和2.4) ✅ GLM-5.2:输入1.4,输出4.4 ✅ Kimi K3:输入3.0,输出15.0 拿一个具体任务算,输入50万token、输出5万token,差不多是啃完一个中型仓库再产出一批代码: ✅ M3:约0.21美元 ✅ GLM-5.2:约0.92美元 ✅ K3:约2.25美元 同一个活,K3是M3的十倍多。单次看就几毛钱,可你一天跑几十次就不是这个数了。 ✅ 缓存是最大的变量:M3缓存读0.06、GLM-5.2缓存0.26、K3缓存0.3,都是原价的五到十分之一。把不变的上下文放最前面吃缓存,省下的比换模型还多。 天天用的话,包月比按token划算得多。三家入门档挤在同一个区间: ✅ Kimi Code:Moderato每月15,Allegretto每月31(官方推荐档),上面还有79和159两档,配额按周刷新 ✅ GLM Coding Plan:Lite每月18,Pro每月72,Max每月160,年付打七折能降到12.6、50.4和112 ✅ MiniMax Token Plan:Plus每月20约17亿token,Max每月50约51亿,Ultra每月120约125亿 图2是这笔账的完整测算表,单价、单任务成本、缓存后成本、三家包月档位都列在一起。 包月的代价是有额度窗口:MiniMax是5小时滚动加周窗口、不结转,工作日下午三点到五点半高峰还会限流;Kimi和GLM也都是按周期给量。用量稳定就很划算,突发大批量还是按token更自由。 我自己是混着用:日常和批量跑M3,难题和前端才上K3,重复上下文一律走缓存,量上来了就换包月。 你一个月在模型上花多少?评论区对个账👇 #AI工具 #大模型 #Kimi #MiniMax #智谱GLM #AI编程 #降本增效 #AI提效

返回资讯列表