FreeLLMAPI 是一个可以自己部署在电脑上的开源软件,作用是把 34 家 AI 厂商各自提供的免费大模型接口集中起来,对外只保留一个统一入口。项目方统计,把这 34 家的免费额度加在一起,每月可用的推理容量约为 74 亿 token,覆盖 635 个免费模型端点。项目发布在 GitHub 上,目前获得约 2.35 万个 Star(收藏关注数),Fork 约 3200 个,采用 MIT 开源协议,代码公开、可自由使用和修改。
先解释两个基础词:大模型是用海量文本训练出来、能理解并生成文字的 AI 程序;token 是大模型服务计费与限流的最小计量单位,大致相当于半个到一个汉字。厂商说的每月送多少 token、每天限多少次请求,都围绕它计算。
它解决的问题:免费额度太散
目前主流 AI 厂商几乎都向个人开发者开放免费层:每月送几百万 token、每天允许几千次请求。单独看,每家的额度只够试用;但十几家、几十家叠加起来,就是一份持续的算力可用。
麻烦在于手动使用:34 家厂商意味着 34 套接口协议、34 套限流规则、34 个可能出错的环节;哪家调了免费上限、哪家下线了模型,都要自己盯着。FreeLLMAPI 的作用,就是把这一堆额度收进一个软件统一管理。
工作方式
FreeLLMAPI 运行在自己的电脑或服务器上(支持 Docker 一键部署,也有 Windows 和 macOS 桌面版)。用户把各家的 API 密钥(访问各厂商接口的凭证)填进去,密钥用 AES-256-GCM 加密后存进本地数据库,不对外暴露。软件对外只开放一个兼容 OpenAI 格式的接口,任何支持 OpenAI 接口规范的客户端都能直接连上来。
收到请求后,它按用户排好的优先级挑一家额度未触顶的厂商转发;遇到某家限流或报错,自动换下一家。同时按「平台、模型、密钥」三个维度跟踪每把密钥的用量,保证始终处在各家的免费上限之内。
模型目录每天从项目官网同步两次带有签名的更新,新免费模型、额度变化、兼容性修复会自动落到本地。免费版拿到的是月度快照,新模型约晚 30 天入库;付费订阅(19 美元一年)当天就能同步。
能配合谁使用
项目最常见的用法是给编程助手提供免费额度:Claude Code、Codex CLI、Gemini CLI、Aider、Cursor、Zed 等工具都能用一条命令接到这个统一接口上。它还提供图像、视频、语音生成接口,以及把多个模型结果并行融合、再综合出答案的功能。
局限也要说明
免费层毕竟是免费层,有几点要清楚:池子里没有各家最新最强的付费模型;请求延迟不稳定,每天接近额度耗尽时,可用模型的质量会下降;厂商的服务条款不一定允许这类代理聚合,合规责任在使用者自己。项目方在说明文档里也写明:仅供个人实验与学习,不适合生产环境,正式产品或业务应换用付费 API。
结论
FreeLLMAPI 把分散的免费额度变成了一池可以统一调用的算力。对个人开发者做实验、跑原型、给编程助手省成本来说,它是一个实用的免费工具;但天花板同样明确——不保证稳定性、不包含顶级模型。做个人项目值得一试,做正式业务还是要回到付费 API。