FreeLLMAPI:把 34 家免费模型额度聚合成一个 OpenAI 兼容接口,5 条命令跑通

发布时间:2026/10/1 21:09:42
FreeLLMAPI:把 34 家免费模型额度聚合成一个 OpenAI 兼容接口,5 条命令跑通 FreeLLMAPI把 34 家免费模型额度聚合成一个 OpenAI 兼容接口5 条命令跑通【免费下载链接】freellmapi7.4 billion tokens per month. 34 free LLM providers. 635 free model endpoints. All behind one /v1 endpoint, plus any custom OpenAI-compatible endpoint. Smart routing, automatic failover, encrypted keys. Personal experimentation only.项目地址: https://gitcode.com/GitHub_Trending/fr/freellmapi写小项目时最卡脖子的往往是 API 成本一家提供商的免费额度用完了下家的密钥格式又不同限流规则还各搞各的。FreeLLMAPI 做的事很直接——把 34 家提供商的免费层打包成一个本地 OpenAI 兼容接口你只需把 SDK 的base_url指过来选哪家模型、哪家限流了该换谁全由路由器接管。免费池有多大三组数字定预期先给结论单月免费推理容量约7.4 亿 token原文口径 7.4 billion目录覆盖474 个模型家族、635 个免费端点584 个聊天、41 个 Embedding、7 个转录、3 个视频。这些数字是理论上限不是 SLA 承诺每家的实际配额、每日上限都不一样路由器的职责就是把它们用满且不超限。判断要不要跑如果你的月用量在几百万 token 以内、又不想为开发环境付费这个池子够用很久如果你要的是某个特定前沿模型它池子里没有直接跳过。最短路径安装5 条命令起服务前提机器上装好 Docker。以下命令克隆仓库、生成静态加密主密钥、写入.env、启动容器。git clone https://gitcode.com/GitHub_Trending/fr/freellmapi cd freellmapi ENCRYPTION_KEY$(openssl rand -hex 32) printf ENCRYPTION_KEY%s\nPORT3001\n $ENCRYPTION_KEY .env docker compose up -d其中ENCRYPTION_KEY是后续所有提供商密钥落盘加密用的主密钥丢了就无法解密已存的密钥务必自己留好PORT3001决定服务端口。Windows 用户丢进 WSL 执行即可或者从 Releases 直接装桌面版.exe——桌面版免账号免密码从系统托盘点开仪表盘。更多部署细节备份、局域网、Termux见 安装与部署文档。验证装好了没有三步走一次真请求✅ 装完别猜按下面三步验证任何一步卡住就说明没通。打开http://localhost:3001服务器版首次进入要先建一个邮箱 密码账号进Keys页把你手头的提供商密钥加进去Google AI Studio、Groq、Mistral 都行任意 OpenAI 兼容端点也可以在Fallback Chain里排好优先顺序复制页头的统一密钥freellmapi-…格式到Playground页发一句话。判断标准Playground 里出了回复且回复下方标明了实际应答的提供商、模型 ID 和延迟就算成功。如果页面打不开先查两件事容器在不在跑docker compose ps、端口是不是 3001。三个核心机制逐个拆限流自动切换请求怎么做到不断流它解决的问题某家提供商被限流429或出错5xx时你的请求不该失败。路由器对每个已启用模型实时打三个分——速度、能力、可靠性——挑分数最高、密钥健康且没触限的模型去应答一旦上游返回 429/5xx这把密钥被置入冷却请求自动转给链上下一个模型。类比成电话的自动呼叫转移一条线忙通话直接转下条线不挂断。触发方式就一个请求里传modelauto也支持auto:fast、auto:smart、auto:reliable等策略别名或auto:档案名走指定链完整别名表见 API 参考。怎么确认生效每个响应都带X-Routed-Via: 平台/模型头写明是谁真正处理了请求Models页的列表顺序就是此刻的真实路由顺序每个模型挂着实时评分。统一密钥N 把密钥收成 1 把它解决的问题管 N 套提供商密钥的麻烦。真实密钥用 AES-256-GCM 加密存进本地 SQLite每次请求时才在内存里解密调用调用完即弃明文不落盘你的应用从头到尾只接触那把freellmapi-…统一密钥相当于把一排房间钥匙锁进保险柜手里只留一张门禁卡。用法是把 SDK 的api_key填成统一密钥base_url指向http://localhost:3001/v1其余代码和你调 OpenAI 官方 API 完全一样。from openai import OpenAI client OpenAI(base_urlhttp://localhost:3001/v1, api_keyfreellmapi-your-unified-key) resp client.chat.completions.create( modelauto, messages[{role: user, content: 一句话总结罗马帝国的衰落}], ) print(resp.choices[0].message.content) print(resp.headers.get(x-routed-via))怎么确认生效调用正常返回且 Keys 页里每把密钥旁边有健康状态点和最近一次体检时间。Fusion 多模型合成一份答案更稳它解决的问题单个免费模型能力有限回答不够稳。触发方式是请求虚拟模型modelfusion路由器把同一份提示词并行发给一组风格各异的免费模型各自起草再交给一个裁判模型综合出一份最终答案。面板、裁判和策略可以在仪表盘的Fusion页配置也可以按请求覆盖。怎么确认生效同一个问题分别用单模型和 fusion 各问一遍对比信息密度与细节覆盖差异通常立竿见影。最常见的 4 个故障与解决办法⚠️ 下面四条是实际踩坑率最高的提前知道能省不少时间。1. 忘密码收不到重置邮件。服务器版没有邮箱可发链接一次性重置码直接打在服务器日志里15 分钟内有效。用docker compose logs -f freellmapi翻日志拿到码回登录页填进重置表单即可。2. 局域网里别的设备打不开页面一直卡着。容器默认只发布在127.0.0.1跨设备访问http://服务器IP:3001必然挂起。要开放就用HOST_BIND0.0.0.0 docker compose up -d启动——且只在信任的网络里这么干服务是单用户的全部防护就那把统一密钥。3. 误判免费层的稳定性。池子里没有前沿模型也没有 SLA。头部模型跑满每日配额后傍晚到深夜整体智力会明显下滑UTC 午夜才重置。白天用没问题别指望深夜它还跟早上一样聪明。4. 拿个人项目底座当生产依赖。项目定位就是个人实验与学习。真要做产品发布前换成付费 API上游提供商的服务条款对你经它代理的流量同样适用合规责任在你自己各家的条款解读见架构文档。数据目录、卸载方式、日志位置等运维细节在安装与部署文档里。跑通之后值得接着玩的方向两个方向性价比最高把编程智能体指过来。Claude Code、Codex CLI、Aider、Cline、Cursor 等十几种工具都有一键配置生成器如npx freellmapi setup-claude会备份现有配置、只合并不覆盖Claude Code 和 Codex 还有凭证零落盘的启动器。每个工具的配方在 clients 文档。把本地模型接进免费池。Ollama、vLLM 这类本地端点可以作为自定义 OpenAI 兼容端点加进 Keys 页和本地模型混着路由免费池 私有模型一起调度。流式、工具调用、Embedding、图像/视频/语音生成的完整接口清单见 API 参考路由与故障转移的内部实现想深挖的话架构索引按组件逐个讲了。【免费下载链接】freellmapi7.4 billion tokens per month. 34 free LLM providers. 635 free model endpoints. All behind one /v1 endpoint, plus any custom OpenAI-compatible endpoint. Smart routing, automatic failover, encrypted keys. Personal experimentation only.项目地址: https://gitcode.com/GitHub_Trending/fr/freellmapi创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考