云计算百科
云计算领域专业知识百科平台

FreeLLMAPI 介绍

FreeLLMAPI 是一个开源的 OpenAI 兼容 API 代理网关,由开发者 tashfeenahmed 创建并托管在 GitHub 上(github.com/tashfeenahmed/freellmapi),目前已有超过 6000 个 Star。

它的核心思路非常巧妙:将约 14 家 AI 服务商的免费 API 额度聚合到一个统一端点上,对外暴露标准的 OpenAI 接口,让开发者可以零成本使用大模型。

核心功能

  • 多平台免费额度聚合:整合了 Google Gemini、Groq、Cerebras、SambaNova、Mistral、OpenRouter、GitHub Models、Cloudflare Workers AI、Cohere、智谱 Z.ai、MiniMax、NVIDIA NIM 等约 14 家平台的免费 API,每月总计约 13 亿 tokens 的免费推理额度。
  • OpenAI 兼容接口:对外暴露标准的 /v1/chat/completions 和 /v1/models 端点,兼容 OpenAI 官方 SDK、LangChain、LlamaIndex 等客户端,只需修改 base_url 即可无缝接入现有项目。
  • 自动故障转移:当首选提供商返回 429/5xx 错误或超时时,自动将其置为冷却状态,并按预设优先级链尝试下一家提供商,最多重试 20 次。
  • 智能速率与配额追踪:针对每个(平台、模型、密钥)组合实时跟踪 RPM、RPD、TPM、TPD 用量,确保始终调用未超限的健康密钥。
  • 粘性会话锁定:多轮对话在 30 分钟内锁定同一模型,防止中途切换导致上下文断裂。
  • AES-256-GCM 密钥加密:上游 API 密钥在数据库中静态加密,仅在请求时于内存中临时解密。
  • 可视化仪表盘:内置 React/Vite 管理后台,支持拖拽调整回退链优先级、Playground 快速测试、以及延迟/成功率/Token 用量等统计分析。

快速上手 环境准备 Node.js 20 以上 Git 部署步骤

# 克隆仓库

git clone https://github.com/tashfeenahmed/freellmapi.git

cd freellmapi

# 安装依赖

npm install

# 生成加密密钥并创建 .env 文件

cp .env.example .env

echo "ENCRYPTION_KEY=$(node -e "console.log(require('crypto').randomBytes(32).toString('hex'))")" >> .env

# 启动开发服务器

npm run dev

启动后访问 http://localhost:5173,在 Keys 页面添加各服务商的 API Key,即可生成统一的 Bearer Token。

使用示例

局限性与注意事项

  • 非前沿模型:免费层级通常对应中等规模模型(如 Llama 3.3 70B、GLM-4.5),无法获得 GPT-5 或 Claude Opus 级别的顶级推理能力。
  • 性能波动:不同服务商的延迟差异较大(Groq/Cerebras 极快,其他可能较慢),且随着每日免费额度消耗,路由可能回退到较小或较慢的模型。
  • 本地优先:项目设计为个人自用,不支持多租户认证,不建议直接暴露于公网。
  • 功能限制:目前仅支持文本聊天,暂不支持嵌入(embedding)、图像生成、音频或多模态输入。

适用场景 FreeLLMAPI 非常适合 个人开发者、学生、小型初创团队 用于本地实验、原型验证和低成本 AI 应用开发。它通过技术手段将分散的免费资源整合成一股合力,提供了一个零成本、高可用性的大模型接入方案。

赞(0)
未经允许不得转载:网硕互联帮助中心 » FreeLLMAPI 介绍
分享到: 更多 (0)

评论 抢沙发

评论前必须登录!