上周有个朋友问我,现在哪个免费大模型 API 最好用。
我张嘴想答,发现自己答不上来。半年前我还能脱口而出一个名字和一串额度,结果上个月照着教程去调,返回模型不存在——那批模型早就退役了。
所以这几天我把国内还能用的平台重新注册了一遍,对着各家官方定价页和文档逐条核。下面这些数字都是 9 月 1 日当天查到的,额度这东西变得快,你动手前最好再对着页面确认一眼。
![图片[2]专注工具资源与实战教程2026年9月免费大模型API横评:5家实测额度对比专注工具资源与实战教程胖猫小栈](https://www.4bot.cn/wp-content/uploads/2026/09/4798e7674d20260901205348.webp)
先说结论
不存在一个”最好用”的,只有”最适合你现在要干的事”的。
| 你要干什么 | 选哪个 | 理由 |
|---|---|---|
| 长期白用、不想操心续期 | 智谱 GLM-4.7-Flash | 唯一官方标价 $0 且不带有效期 |
| 每天固定跑批量脚本 | 火山引擎(豆包) | 每天 200 到 500 万自动重置 |
| 一个 Key 试遍各种模型 | 硅基流动 | 100 多个模型聚合 |
| 跑批量任务、要并发 | 百度千帆 ERNIE-Speed | QPS 给到 50 |
| 长文档、超长上下文 | 智谱(200K)或 Gemini(1M) | 看你能不能连上 |
如果懒得看完全文:先去智谱建个 Key 放着,它是唯一一个我敢说”明年大概率还能用”的。
智谱 GLM-4.7-Flash:唯一敢说永久的
![图片[3]专注工具资源与实战教程2026年9月免费大模型API横评:5家实测额度对比专注工具资源与实战教程胖猫小栈](https://www.4bot.cn/wp-content/uploads/2026/09/14f022124820260901205354.webp)
这是我查完之后最推荐的一个,理由很直接——官方定价页上,glm-4.7-flash 这一栏的输入和输出价格就是 $0,没有”限时”、没有”新用户专享”,就是一个免费模型。官方更新日志里也写得很清楚,2026 年 1 月 19 日 GLM-4.7-Flash 作为免费模型上线。
规格是 30B-A3B 的 MoE,200K 上下文。新用户另外送 2000 万 token 的永久额度,这个有效期是永久,不是常见的 30 天或 90 天。
接入地址:https://open.bigmodel.cn/api/paas/v4
最近智谱还上了 Anthropic 兼容端点,这个对 Claude Code 用户挺关键。改两个环境变量就能直接切过去,代码一行不用动:
{
"env": {
"ANTHROPIC_BASE_URL": "https://open.bigmodel.cn/api/anthropic",
"ANTHROPIC_AUTH_TOKEN": "你的 Key"
}
}
短板也很明确:并发只有 1,而且慢。 有实测说同一句”重构这个 repo”,Claude Sonnet 4 几秒出结果,GLM-4.7-Flash 要 15 到 25 秒。同时跑多路 Agent worker 会直接撞限。
另外两个坑:
一是 model id 别写老版本。glm-4.5-flash 已经下架,glm-4.5-air 是付费档,网上一堆教程还在教这两个,照抄会直接报错。现在正确的是 glm-4.7-flash。
二是 别从 OpenRouter 拿智谱。OpenRouter 上挂的 z-ai/glm-4.7-flash 标价 $0.06 / $0.40 每百万 token,是加了中间价的。要走免费只能从 bigmodel.cn 直连。
火山引擎(豆包):唯一每天重置的
每天 200 万到 500 万 token,第二天自动刷新,实名后再送 50 万。
这个模式是现在独一份的。其他家基本都是”一次性送一笔,用完或过期就没了”,只有豆包是每天给你续上。如果你的用法是每天固定跑一批任务——比如定时抓数据、批量改写、每日报表——那豆包比任何一次性大额包都合适。
模型能力我就不吹了,日常够用,别指望它干重活。
硅基流动:一个 Key 调 100 多个模型
新用户 2000 万 token,9B 以下的小模型永久免费。
接入地址:https://api.siliconflow.cn/v1/chat/completions
它本质上是个模型聚合层,Qwen、DeepSeek、GLM 这些都能通过同一个 Key 调。想横向对比不同模型效果的时候,这家最省事,不用每家都去注册一遍。
要注意的是额度消耗速度跟模型绑定。有实测提到默认额度绑在 Qwen3-30B-A3B 上,切到 DeepSeek-V3 消耗会快不少,因为计价系数不一样。这个说法我只找到一处来源,没能交叉验证,你用的时候自己在用量页盯一眼。
阿里云百炼:量大,但会过期
每个模型各送 100 万 token,Qwen 全系加 DeepSeek 能叠加,总量能到千万级。
接入地址:https://dashscope.aliyuncs.com/compatible-mode/v1/chat/completions
![图片[4]专注工具资源与实战教程2026年9月免费大模型API横评:5家实测额度对比专注工具资源与实战教程胖猫小栈](https://www.4bot.cn/wp-content/uploads/2026/09/03c509a0d020260901205400.webp)
问题是 90 天有效期,过期作废。我看到有资料写”新用户 7000 万”,跟官方页面的口径对不上,估计是不同时期的活动。这种对不上的数字我一般不写死,你注册完直接看控制台显示的为准。
适合短期有明确大批量任务的人,别囤着。
百度千帆和讯飞:永久,但一个比一个慢
百度千帆的 ERNIE-Speed 永久免费,QPS 给到 50,这个并发在免费档里算很慷慨的。
讯飞星火的 Spark Lite 也永久免费,官方说法是不限 token 量。但 QPS 只有 2——两秒一个请求,跑个对话勉强,跑批量任务能急死人。
这两家适合做备胎,主力的活别指望它们。
国外的三家,简单带过
国内直连不太稳,我只列数字,不展开。
Google AI Studio:Gemini Flash 系列免费,大约 1500 请求/天、15 RPM、1M token/分钟,上下文给到 1M。额度给得大方,但能不能连上看你自己的网络。
Groq:1000 请求/天、30 RPM,Llama 4 Scout 给 500K token/天。LPU 硬件,速度是所有免费档里最快的。
OpenRouter:不充值的话 50 请求/天,一次性买 $10 额度后升到 1000 请求/天。上面挂着十几个 :free 后缀的模型,适合对比试玩,不适合干活。
顺带说个坏消息:Cerebras 从 2026 年 8 月起取消了免卡免费档,新账号改成 $5 试用金且 30 天过期,还得绑支付方式。之前它是最慷慨的一家,现在没了。
三个通用坑
先花有期限的,再慢慢用永久的。 百炼那种 90 天过期的优先消耗,智谱的永久额度留着当底牌。这个顺序反了会白白浪费。
别碰网上的共享 Key。 论坛和群里流传的免费共享 Key,要么随时失效,要么有数据安全风险。自己注册就几分钟的事。
免费 API 可能拿你的数据训练模型。 Google AI Studio 在部分地区的条款里就写明了会用于训练。涉及个人信息、账号密码、业务数据的,别往免费档里塞,本地跑开源模型更稳。
我的建议
如果只能选一个长期用,我选智谱 GLM-4.7-Flash。不是因为它额度最大,而是因为它没有有效期——这两年我看过太多”限时免费”最后变成”限完就收费”,智谱这种把 $0 明明白白写在定价页上的,反而最让人安心。
豆包的每日刷新适合当第二顺位,配合着用。真要短时间猛跑一轮 Agent 或者重构代码,百炼那批千万级的额度先领了花掉,别囤到 90 天之后作废。
最后说句实在的:免费额度是给你试错和练手的,不是让你把生产系统建在上面的。真上了量,找个便宜的付费档反而省心——毕竟半夜三点服务挂了的时候,你不会想起来省那几十块钱。
合规这块照例提一句,用各家 API 前看一眼服务条款和数据使用政策;开源模型做二次开发前看清 LICENSE,别想当然。
本站收集的资源仅供内部学习研究软件设计思想和原理使用,学习研究后请自觉删除,请勿传播,因未及时删除所造成的任何后果责任自负。
如果用于其他用途,请购买正版支持作者,谢谢!若您认为「 胖猫小栈 」发布的内容若侵犯到您的权益,请联系站长邮箱: botcn@hotmail.com 进行删除处理。
本站资源大多存储在云盘,如发现链接失效,请联系我们,我们会第一时间更新。










暂无评论内容