2026年9月免费大模型API横评:5家实测额度对比

图片[1]专注工具资源与实战教程2026年9月免费大模型API横评:5家实测额度对比专注工具资源与实战教程胖猫小栈
生成摘要
AI 生成,仅供参考

上周有个朋友问我,现在哪个免费大模型 API 最好用。

我张嘴想答,发现自己答不上来。半年前我还能脱口而出一个名字和一串额度,结果上个月照着教程去调,返回模型不存在——那批模型早就退役了。

所以这几天我把国内还能用的平台重新注册了一遍,对着各家官方定价页和文档逐条核。下面这些数字都是 9 月 1 日当天查到的,额度这东西变得快,你动手前最好再对着页面确认一眼。

图片[2]专注工具资源与实战教程2026年9月免费大模型API横评:5家实测额度对比专注工具资源与实战教程胖猫小栈

先说结论

不存在一个”最好用”的,只有”最适合你现在要干的事”的。

你要干什么选哪个理由
长期白用、不想操心续期智谱 GLM-4.7-Flash唯一官方标价 $0 且不带有效期
每天固定跑批量脚本火山引擎(豆包)每天 200 到 500 万自动重置
一个 Key 试遍各种模型硅基流动100 多个模型聚合
跑批量任务、要并发百度千帆 ERNIE-SpeedQPS 给到 50
长文档、超长上下文智谱(200K)或 Gemini(1M)看你能不能连上

如果懒得看完全文:先去智谱建个 Key 放着,它是唯一一个我敢说”明年大概率还能用”的。

智谱 GLM-4.7-Flash:唯一敢说永久的

图片[3]专注工具资源与实战教程2026年9月免费大模型API横评:5家实测额度对比专注工具资源与实战教程胖猫小栈

这是我查完之后最推荐的一个,理由很直接——官方定价页上,glm-4.7-flash 这一栏的输入和输出价格就是 $0,没有”限时”、没有”新用户专享”,就是一个免费模型。官方更新日志里也写得很清楚,2026 年 1 月 19 日 GLM-4.7-Flash 作为免费模型上线。

规格是 30B-A3B 的 MoE,200K 上下文。新用户另外送 2000 万 token 的永久额度,这个有效期是永久,不是常见的 30 天或 90 天。

接入地址:https://open.bigmodel.cn/api/paas/v4

最近智谱还上了 Anthropic 兼容端点,这个对 Claude Code 用户挺关键。改两个环境变量就能直接切过去,代码一行不用动:

{
  "env": {
    "ANTHROPIC_BASE_URL": "https://open.bigmodel.cn/api/anthropic",
    "ANTHROPIC_AUTH_TOKEN": "你的 Key"
  }
}

短板也很明确:并发只有 1,而且慢。 有实测说同一句”重构这个 repo”,Claude Sonnet 4 几秒出结果,GLM-4.7-Flash 要 15 到 25 秒。同时跑多路 Agent worker 会直接撞限。

另外两个坑:

一是 model id 别写老版本glm-4.5-flash 已经下架,glm-4.5-air 是付费档,网上一堆教程还在教这两个,照抄会直接报错。现在正确的是 glm-4.7-flash

二是 别从 OpenRouter 拿智谱。OpenRouter 上挂的 z-ai/glm-4.7-flash 标价 $0.06 / $0.40 每百万 token,是加了中间价的。要走免费只能从 bigmodel.cn 直连。

火山引擎(豆包):唯一每天重置的

每天 200 万到 500 万 token,第二天自动刷新,实名后再送 50 万。

这个模式是现在独一份的。其他家基本都是”一次性送一笔,用完或过期就没了”,只有豆包是每天给你续上。如果你的用法是每天固定跑一批任务——比如定时抓数据、批量改写、每日报表——那豆包比任何一次性大额包都合适。

模型能力我就不吹了,日常够用,别指望它干重活。

硅基流动:一个 Key 调 100 多个模型

新用户 2000 万 token,9B 以下的小模型永久免费。

接入地址:https://api.siliconflow.cn/v1/chat/completions

它本质上是个模型聚合层,Qwen、DeepSeek、GLM 这些都能通过同一个 Key 调。想横向对比不同模型效果的时候,这家最省事,不用每家都去注册一遍。

要注意的是额度消耗速度跟模型绑定。有实测提到默认额度绑在 Qwen3-30B-A3B 上,切到 DeepSeek-V3 消耗会快不少,因为计价系数不一样。这个说法我只找到一处来源,没能交叉验证,你用的时候自己在用量页盯一眼。

阿里云百炼:量大,但会过期

每个模型各送 100 万 token,Qwen 全系加 DeepSeek 能叠加,总量能到千万级。

接入地址:https://dashscope.aliyuncs.com/compatible-mode/v1/chat/completions

图片[4]专注工具资源与实战教程2026年9月免费大模型API横评:5家实测额度对比专注工具资源与实战教程胖猫小栈

问题是 90 天有效期,过期作废。我看到有资料写”新用户 7000 万”,跟官方页面的口径对不上,估计是不同时期的活动。这种对不上的数字我一般不写死,你注册完直接看控制台显示的为准。

适合短期有明确大批量任务的人,别囤着。

百度千帆和讯飞:永久,但一个比一个慢

百度千帆的 ERNIE-Speed 永久免费,QPS 给到 50,这个并发在免费档里算很慷慨的。

讯飞星火的 Spark Lite 也永久免费,官方说法是不限 token 量。但 QPS 只有 2——两秒一个请求,跑个对话勉强,跑批量任务能急死人。

这两家适合做备胎,主力的活别指望它们。

国外的三家,简单带过

国内直连不太稳,我只列数字,不展开。

Google AI Studio:Gemini Flash 系列免费,大约 1500 请求/天、15 RPM、1M token/分钟,上下文给到 1M。额度给得大方,但能不能连上看你自己的网络。

Groq:1000 请求/天、30 RPM,Llama 4 Scout 给 500K token/天。LPU 硬件,速度是所有免费档里最快的。

OpenRouter:不充值的话 50 请求/天,一次性买 $10 额度后升到 1000 请求/天。上面挂着十几个 :free 后缀的模型,适合对比试玩,不适合干活。

顺带说个坏消息:Cerebras 从 2026 年 8 月起取消了免卡免费档,新账号改成 $5 试用金且 30 天过期,还得绑支付方式。之前它是最慷慨的一家,现在没了。

三个通用坑

先花有期限的,再慢慢用永久的。 百炼那种 90 天过期的优先消耗,智谱的永久额度留着当底牌。这个顺序反了会白白浪费。

别碰网上的共享 Key。 论坛和群里流传的免费共享 Key,要么随时失效,要么有数据安全风险。自己注册就几分钟的事。

免费 API 可能拿你的数据训练模型。 Google AI Studio 在部分地区的条款里就写明了会用于训练。涉及个人信息、账号密码、业务数据的,别往免费档里塞,本地跑开源模型更稳。

我的建议

如果只能选一个长期用,我选智谱 GLM-4.7-Flash。不是因为它额度最大,而是因为它没有有效期——这两年我看过太多”限时免费”最后变成”限完就收费”,智谱这种把 $0 明明白白写在定价页上的,反而最让人安心。

豆包的每日刷新适合当第二顺位,配合着用。真要短时间猛跑一轮 Agent 或者重构代码,百炼那批千万级的额度先领了花掉,别囤到 90 天之后作废。

最后说句实在的:免费额度是给你试错和练手的,不是让你把生产系统建在上面的。真上了量,找个便宜的付费档反而省心——毕竟半夜三点服务挂了的时候,你不会想起来省那几十块钱。

合规这块照例提一句,用各家 API 前看一眼服务条款和数据使用政策;开源模型做二次开发前看清 LICENSE,别想当然。

© 版权声明
THE END
喜欢就支持一下吧
点赞12 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容