国产大模型的免费额度,谁真给,谁难拿
智谱定价页上「免费」出现了 34 次,其中 32 次是缓存存储那一列的「限时免费」,整行四项全免的模型只有两个。我拿自己的 key 调了四轮:GLM-4.7-Flash 四次全败,GLM-4.6V-Flash 四次成一次,返回都是「该模型当前访问量过大」。而同一时间、定价页上并没标免费的 GLM-4-Flash,四次全部正常,稳定 800 到 960 毫秒。顺着这条线把国产五家的免费政策捋了一遍,发现「免费」在各家的意思完全不同:混元送一年,百炼只有 90 天,Kimi 每分钟只让调 3 次,DeepSeek 干脆不送改成错峰半价。
我把智谱开放平台的定价页从头翻到尾,「免费」这个词出现了 34 次。
其中 32 次是同一列,缓存存储那一栏写的「限时免费」。
整行四项全免的模型只有两个:GLM-4.7-Flash 和 GLM-4.6V-Flash。输入、输出、缓存存储、缓存命中,四栏都写着「免费」,后者还支持图片和视频。
我拿自己的 key 调了它们四轮。
GLM-4.7-Flash:四次全部失败。 第一次是超时,后面三次返回 429,「该模型当前访问量过大,请您稍后再试」。
GLM-4.6V-Flash:四次成功一次。
而同一个 key、同一时间,定价页上并没有标免费的 GLM-4-Flash,四次全部正常返回,稳定在 800 到 960 毫秒。
先说清楚,429 是限流,不是永久不可用,也不是这家有什么问题。恰恰相反,它说明免费那一档太挤了。但对想白嫖的人来说,结论是一样的:标着免费的那个,你多半用不上。
这件事让我想把国产几家的「免费」重新捋一遍。捋完发现,这两个字在各家的意思完全不同。

五家,五种「免费」
智谱:有整行标免费的模型,但挤不进去。
就是上面那两个。真正能稳定用的是 GLM-4-Flash,它不在免费列表里,但便宜且一直没出过事。我这一个多月的测试里,它是唯一一个从没挂过的国产入口,前天还从 2546 毫秒提速到了 788 毫秒。
腾讯混元:不标免费,但送得实在。
官方文档写的是首次开通服务后发放免费调用额度,Hunyuan 系列共 100 万 tokens 共享消耗。关键在有效期:1 年。
这是我查下来有效期最长的一家。文档里也说得很直白,额度用完就要付费,没有永久免费的模型。价格上 Hunyuan-a13b 是列表里最便宜的,输入 0.5 元、输出 2 元每百万 token。
阿里百炼:给得最多,但只有 90 天。
按公开资料,百炼是每个模型各送 100 万 tokens,按单模型独立计算。它平台上挂着通义、DeepSeek、Kimi、MiniMax、智谱等多家的模型,全开通的话总量相当可观。
代价是有效期只有 90 天,而且只能抵扣实时推理,Batch 调用、上下文缓存、模型调优这些都不能用。这一条我没有从官方页面直接确认,是按公开资料整理的,真要依赖请自己去控制台核对。
Kimi:送钱,但限你手速。
新用户送 15 元余额。真正卡住你的不是钱,是频率。
这个我实测过:连发 8 个请求,第 4 个就开始 429,返回的原话是 request reached organization max RPM: 3。每分钟三次。公开资料里对它的描述也是「限制频率而非 token」,跟我测出来的完全对得上。
所以它当兜底可以,拿来跑批量任务必挂。两次请求之间得留 20 秒以上。
DeepSeek:不送,但教你省。
官方定价页上没有公布新用户赠送额度的具体数额。但它有一条别家没有的东西:错峰半价。
原文是「空闲时段价格为高峰时段价格的一半」,高峰时段指北京时间周一至周五的 9:00 到 12:00、14:00 到 18:00,其余时间都算空闲。
也就是说,同样的活,你晚上跑,价格直接砍一半。
还有个更大的价差在缓存上:deepseek-v4-flash 的输入,缓存未命中是 1.5 元每百万 token,命中是 0.05 元。差 30 倍。

所以真问题不是「谁免费」
把这五家摆在一起,会发现「免费」压根不是同一件事:
智谱的免费是「标了但挤不进去」,混元的免费是「送一年的量」,百炼的免费是「送很多但 90 天过期」,Kimi 的免费是「有钱但每分钟只让调三次」,DeepSeek 干脆不送,改成错峰打折。
真正该问的不是谁免费,是免费的那一份你能不能用上。
这也是我这一个多月测下来最深的一个体会。一份「谁家免费」的清单没什么用,因为标称和实际之间隔着限流、隔着有效期、隔着频率上限、隔着能不能用于你的场景。这些东西定价页上不会写在最显眼的地方,得自己去撞。

按今天的数据,我会这么选
图省事、要稳定,用智谱 GLM-4-Flash。不用抢免费档,它本来就便宜,而且是我测过的国产入口里唯一一个从没挂过的。国内直连不折腾网络。
量大、周期长,选腾讯混元。100 万 tokens 加一年有效期,是这几家里最不容易过期作废的组合。
短期集中跑一批活,用阿里百炼。每个模型各 100 万,多开几个模型总量很大,但记住 90 天的钟在走,别领了放着。
Kimi 只当兜底,别排主力。每分钟三次这个限制,批量任务上必然撞墙。
跑得多又不着急,考虑 DeepSeek 错峰。把任务挪到晚上或者周末,价格减半;能命中缓存的场景差价更大。
几句边界
智谱那两个模型的 429 是限流,我测的是一个账号、四轮、同一个时间段,不代表它们永远调不通,也不代表其他人的账号会遇到同样情况。换个时段可能就进去了。
腾讯混元和 DeepSeek 的数字来自它们的官方文档和定价页。阿里百炼那部分是按公开资料整理的,我没有从官方页面逐条确认,正文里已经标了出处性质。网上流传的另一条「混元有完全免费的模型」,我在官方文档里没有找到对应说法,所以没写进来。
各家的免费政策和限流阈值改起来很快,这篇是 2026 年 9 月 3 日的状态。真要下单之前,还是自己去控制台看一眼当天的说明。