目前市面上免费的大模型API汇总 接口大全(2026年08月更新)|额度与限制对比

目前市面上免费的大模型API汇总 接口大全(2026年08月更新)|额度与限制对比

goodspeed
goodspeed
·5 min read

Token 不够用,可以看这篇,选择最合适的包月套餐: 2026 国内主流 AI 厂商会员计划价格对比

2026 免费大模型 API 接口大全

今天我给大家统计了 26-08 月免费可用的大模型 API,一共 22 个,请大家自取。

总结一下,表格在这里:

大模型 免费限制 文档地址
AMD【26年08更新】 每天自动发 **10 美元 额度,每天重置, 支持 DeepSeek-V4-Flash(响应极快,日常对话/翻译首选) 注册地址
AGnes AI【26年06更新】 暂时无限期免费,支持文字、图片和视频模型 注册地址
移动 MoMA【26年05更新】 送 2500 w token,支持 coding plan(5 小时 1200 次每月最多 18000 次),需实名认证 注册地址
百灵大模型【26年04更新】 每天送 50w token API 地址
七牛 【26 年 01 更新】 所有 AI 推理的新客户,注册得1000万 Token,可以使用 claude 模型 文档地址
讯飞星火大模型【26 年 02 更新】 glm-5/glm-4.7/kimi-2.5/minimax-2.5 免费使用 有效期:2026-03-05 文档查看
fireworks.ai【26 年 02 更新】 注册送 6 刀额度 官网地址
Zhipu (智谱) 【26 年 01 月更新】 GLM 4.7 新年优惠 文档查看
SiliconCloud 【26 年 01 月更新】 注册送 16元代金券,RPM 限制为 100,QPS 限制为 3,支持 glm4.7 / minimax-m2.1 ,14 免费模型 文档查看
派欧云【26 年 01 月更新】 注册送 500w tokens ,支持 Kimi K2.5 ,ERNIE-4.5-0.3B 免费使用 注册地址
字节火山方舟 每个模型送 50 w tokens 文档查看
英伟达 【26 年 01 月更新】 免费提供 6 个月 GLM 4.7和Minimax M2.1 文档查看
ZenMux 【25 年 11 月更新】 Gemini 3 Pro 免费使用 文档查看
Cerebras 【25 年 6 月更新】 推理 API 对所有开发者免费开放,每天免费发送100万token 使用地址
x.ai【25 年 5 月更新】 充值 5$,每月送 150$, 赠费可以使用 grok 所有模型 25-05-31 之后不再赠送 文档查看
Free-QWQ【25 年 3 月更新】 完全免费、无限制的 QwQ 32B 大语言模型 API 文档查看
百度千帆大模型平台 Lite、Speed-8 K:RPM = 300,TPM = 300000 Speed-128 K:RPM = 60,TPM = 300000 文档查看55
腾讯混元大模型 限制并发数为 5 路 链接
Cloudflare Workers AI 免费可以每天使用 1 万 token, 每天 UTC 0 点更新 文档查看
阿里通义千问模型 每个模型送 100W token 邀请链接
字节扣子 QPS (每秒发送的请求数):2 QPM (每分钟发送的请求数):60 QPD (每天发送的请求数):3000 文档查看
Llama Family 1. 每天 8-22 点:接口限速每分钟 20 次并发 2. 每天 22-次日 8 点:接口限速每分钟 50 次并发 文档查看
Groq rpm 为 30,rpd 为 14400,TOKENS PER MINUTE 也有限制 文档查看
Google Gemini 15 RPM(每分钟请求数); 100 万 TPM(每分钟令牌); 1500 RPD(每天请求数) 链接

DartNode - VPS 推荐

  • 如果你有github 100星以上的开源项目,可以免费申请一台 1GB RAM • 1 Core • 10 GB SSD VPS。
  • 如果没有开源项目,1GB RAM • 1 Core • 10 GB SSD​ 也只需 2$,不限流量,强烈推荐👍, 注册地址

可以免费使用的 vibe coding 平台:

  1. Qwen CLI 每天免费 2000 次 API 请求,速率限制为每分钟 60 次,且无 Token 数量限制: https://coder.qwen.ai/
  2. Trae 国内版: https://www.trae.cn/
  3. codebuddy 有免费额度: https://www.codebuddy.com/

1. 讯飞星火大模型:小火苗也有大能量

  • 模型名字: 讯飞星火大模型
  • 可用的模型: spark-lite ( 别看它叫 lite,能量可不小!)
  • 免费限制: 这小火苗可是相当给力,tokens 使用总量无限,每秒还能处理 2 个请求,而且永久有效!简直是业界良心啊!
  • 访问链接: 控制台传送门
  • 文档地址: 说明书在这里

2. 百度千帆大模型平台:模型多到挑花眼

  • 模型名字: 百度千帆大模型平台
  • 可用的模型: yi_34 b_chat, ERNIE-Speed-8 K, ERNIE-Speed-128 K, ERNIE-Lite-8 K, ERNIE-Lite-8 K-0922, ERNIE-Tiny-8 K(这么多选择,够你玩一阵子了!)
  • 免费限制: Lite 和 Speed-8 K 模型每分钟可以处理 300 个请求,以及 300,000 个 tokens;Speed-128 K 模型则稍微“矜持”一点,每分钟 60 个请求和 300,000 个 tokens。
  • 访问链接: 控制台入口
  • 文档地址: 详细教程请看这里

3. 腾讯混元大模型:混元出击,势不可挡

  • 模型名字: 腾讯混元大模型
  • 可用的模型: hunyuan-lite (轻量级选手,性能也不错哦!)
  • 免费限制: 最多支持 5 个请求同时进行。
  • 访问链接: 控制台直达
  • 文档地址: 使用指南在此

4. Cloudflare Workers AI:全球加速,AI 也飞起来

  • 模型名字: Cloudflare Workers AI
  • 可用的模型: 所有模型(没错,全部免费!Cloudflare 大佬真是豪气!)
  • 免费限制: 每天可以使用 1 万个 tokens,每天 UTC 时间 0 点更新额度。
  • 访问链接: 控制台入口
  • 文档地址: 官方文档请戳这里

5. 字节扣子:百变扣子,无限可能

  • 模型名字: 字节扣子
  • 可用的模型: 豆包·Function call 模型 (32 K)、通义千问-Max (8 K)、MiniMax 6.5 s (245 K)、Moonshot(8 K)、Moonshot(32 K)、Moonshot(128 K)(模型选择多多,玩转 AI 不在话下!)
  • 免费限制: API 免费用,但每个空间的使用限制是:每秒 2 个请求,每分钟 60 个请求,每天 3000 个请求。
  • 访问链接: 控制台入口
  • 文档地址: 开发指南拿走不谢

6. 字节火山方舟:模型任你挑,计费更灵活!

  • 模型名字: 字节火山方舟
  • 可用的模型: 火山方舟现在提供了丰富的模型选择,包括豆包系列 (Doubao-lite 和 Doubao-pro,分别有 4K, 32K, 128K 和 256K 上下文长度)、智谱 AI 的 GLM3-130B 系列以及月之暗面的 Moonshot 系列。还有 Mistral AI 的开源模型 Mistral-7B。真是琳琅满目,总有一款适合你!
  • 免费限制: 现在火山方舟的计费方式更清晰啦!所有模型都按 token 使用量(包括输入和输出文本)计费,每小时出账,按量后付费。不过别担心,每个模型都给你准备了 50 万 token 的免费额度!够你先玩一阵子了。
  • 访问链接: 控制台传送门
  • 文档地址: 详细说明在这里

7. Llama Family:羊驼家族,实力不俗

  • 模型名字: Llama Family
  • 可用的模型: “Atom-13 B-Chat”, “Atom-7 B-Chat”, “Atom-1 B-Chat”, “Llama 3-Chinese-8 B-Instruct”(羊驼家族来袭,快来体验!)
  • 免费限制: 每天早上 8 点到晚上 10 点,每分钟 20 个请求;晚上 10 点到第二天早上 8 点,每分钟 50 个请求。
  • 访问链接: 控制台通道
  • 文档地址: 文档在此

8. Groq:性能怪兽,速度惊人

  • 模型名字: Groq
  • 可用的模型: “gemma-7 b-it、mixtral-8 x 7 b-32768、llama 3-70 b-8192、llama 3-8 b-8192”(速度与激情,Groq 给你带来极致体验!)
  • 免费限制: 每分钟 30 个请求,每天 14400 个请求,每分钟使用的 tokens 数量有限制。
  • 访问链接: 控制台密钥
  • 文档地址: 使用手册

9. Zhipu (智谱):清华出品,必属精品

  • 模型名字: Zhipu (智谱)
  • 可用的模型: GLM-4-Flash,GLM-4 V-Flash(清华出品,质量保证!)
  • 免费限制: GLM-4-Flash:tokens 使用总量无限,每秒 2 个请求,永久有效。GLM-4 V-Flash:图像大小限制为 5 M,像素不超过 6000*6000,支持 jpg、png 和 jpeg 格式。
  • 访问链接: 控制台入口
  • 文档地址: 使用指南

10. SiliconCloud:硅云起飞,AI 加速

  • 模型名字: SiliconCloud
  • 可用的模型: “Qwen 2.5(7 B)、Llama 3.1(8 B)等”(云端模型,即开即用!)
  • 免费限制: 每分钟 100 个请求,每秒 3 个请求,如需更多,可以申请。
  • 访问链接: 控制台入口
  • 文档地址: 官方文档

11. 01 万物:万物互联,AI 驱动

  • 模型名字: 01 万物
  • 可用的模型: yi-lightning / yi-large / yi-large-rag/yi-large-fc/yi-medium / yi-spark/yi-medium-200 k/yi-vision/yi-large-turbo(模型种类丰富,总有一款适合你!)
  • 免费限制: 每分钟 4 个请求,每个模型每分钟使用的 tokens 数量为 32000 到 200000,充值可解锁更多,注册送 36 元,相当于 36 M 可用 tokens。
  • 访问链接: 控制台入口
  • 文档地址: API 参考

12. Google Gemini:谷歌出品,必属精品

  • 模型名字: Google Gemini
  • 可用的模型: gemini-1.5-pro、gemini-1.5-flash、gemini-1.0-pro、gemini-pro-vision、gemini-2.0-flash-exp、gemini-2.0-flash-thinking-exp-1219 (谷歌出品,必属精品!)
  • 免费限制: 每分钟 15 个请求,每分钟 100 万个 tokens,每天 1500 个请求。
  • 访问链接: 控制台入口
  • 文档地址: API 说明

13. GLHF:开源大模型,任你选择

  • 模型名字: GLHF
  • 可用的模型: Meta Llama 3.1 405 b Instruct (and 70 b, and 8 b), Qwen 2 72 b, Mixtral 8 x 22 b, Gemma 2 27 b, Jamba 1.5 Mini (support for the Jamba 1.5 Large is in the works), Phi-3 (开源大模型,任你选择!)
  • 免费限制: 使用 vLLM 和定制的自动扩展 GPU 调度程序来运行(几乎)任何开源大型语言模型:只需粘贴指向 Hugging Face 存储库的链接即可。可以使用我们的聊天 UI 或兼容 OpenAI 的 API。最多允许使用 8 个 Nvidia H 100 80 Gb GPU。
  • 访问链接: API
  • 文档地址: API

好啦!以上就是这次免费全部内容,希望大家都能找到适合自己的 AI 模型,开启愉快的探索之旅!记得多多分享给身边的朋友哦! 🚀

精选工具

网格与起形工具

在线绘画网格起形生成器 & 美术辅助工具

在参考图片上自由叠加网格、一点/两点透视辅助线、肖像比例标尺与黑白素描明度分析。一键提取填色线稿、生成临摹作业纸并打印 —— 100% 浏览器本地免费运行。

免费照片转填色线稿与黑白轮廓生成器

一键将任何照片转换为纯净、可打印的黑白素描线稿与填色线稿。适用于儿童填色书、水彩转印、手账描摹与速写起形 —— 100% 浏览器本地免费处理。

免费数字油画底稿与色块简化生成器

将任何照片转换为带编号的数字油画填色模板与色块简化图。智能提取匹配调色板并导出可打印画纸底稿 —— 100% 浏览器本地免费生成。

免费一点/两点/三点透视网格生成器

自由创建 1点、2点、3点透视与等角轴测网格。适用于场景概念设计、建筑速写、漫画分镜与空间起形 —— 支持导出透明 PNG 与打印画纸。

免费美术临摹作业纸生成器 (教师与学生练习专用)

一键生成包含“左侧带网格参考图 + 右侧空白对照网格”的专业 A4 / Letter 美术临摹练习卷。专为美术教学课堂、素描作业与个人练形设计。

免费画幅比例与画布缩放换算器 (画家与壁画专用)

精准计算参考图片与真实油画框、壁画墙面之间的宽高比、放大倍率与画纸上每个格子的真实厘米/英寸物理尺寸 —— 100% 免费。

汇聚通义千问、百炼、TokenPlan、Qoder、万小智、秒悟等核心产品;覆盖文本、图像、代码、语音全场景能力。
秒悟 Meoo 新用户送 12000 积分,订阅套餐首月限量低至 9.9 元
搭建您的专属大模型主页

相关网站

Gemini 2.0
Gemini 2.0
Gemini 2.0 notre modèle d'IA le plus performant à ce jour, conçu pour l'ère agentique.
Grok by xAI
Grok by xAI
xAI est une entreprise d'intelligence artificielle dont la mission est de faire progresser la découverte scientifique et d'approfondir notre compréhension de l'univers. Notre premier produit est Grok - une IA conversationnelle.
Groq
Groq
Groq - Informations sur le Produit d'Inférence IA Rapide
n8n
n8n
Outil d'automatisation des workflows sécurisé et natif AI pour les personnes techniques. Insérez du code quand vous en avez besoin. Code source complet et auto-hébergement disponible.
ZenMux
ZenMux
ZenMux.ai nutzt große Sprachmodelle, um Text und multimodale Inhalte blitzschnell in höchster Qualität zu erzeugen. KI-Artikel, flexible Stile, intelligente Titel-Vorschläge und Team-Bearbeitung lösen Kreativ- und Effizienzprobleme. Ideal für Creator, Marketing-Profis und KMU – sofort loslegen!