logo NodeSeekbeta

🔥 GPT-Load 2.0 发布!!!轻量易用的自托管 AI 网关

GitHub:https://github.com/tbphp/gpt-load
官网:https://www.gpt-load.com

2.0 RC 版本已发布,这次是完整重写,不是 1.x 的小升级重构。

GPT-Load 2.0 的初衷很简单:开发者手里的 AI 资源越来越杂,各种 API Key 还有订阅,再各个客户端里反复配、切换账号太繁琐。
所以 2.0 的使用方式尽量做得简单:

导入资源 → 生成 AccessKey → 直接调用。

之后,GPT-Load 会自动帮你处理凭据轮换、权重调度、失败重试、冷却、黑名单、会话亲和和健康判定。


和 CPA、New API、sub2api 的区别?

这些项目做得很好、功能已经很成熟,我一直在使用。
CPA 适合直接把 Codex、Claude 等订阅账号代理成 API。
New API 和 sub2-api 更偏用户体系、额度、计费、充值和 API 分发。

GPT-Load 2.0 的设计语言更偏向于简洁、轻量、易用。
主要面向个人和内部团队,专注把手里的各种上游资源收进同一个资源池,再统一调度、容错和观测。


部署也尽量轻量

多种部署方式,部署后免配置就可使用。
一个 Go 二进制自带管理界面,默认使用 SQLite,不需要 Redis,也不用单独部署前端、后端和一堆服务。
并且提供了更多平台的适配:Linux、Mac、Win 的原生版本,Win 还有服务化安装程序。

推荐使用 Docker 快速部署:

git clone --depth 1 --branch v2 https://github.com/tbphp/gpt-load.git
cd gpt-load

cp .env.example .env
docker compose up -d

# 查看首次部署生成的管理密钥
docker compose exec gpt-load sh -c 'cat /app/data/auth.key'

打开 http://127.0.0.1:3001,使用上面输出的管理密钥登录。


2.0 功能介绍

  • 协议:OpenAI Chat Completions / Responses / Anthropic Messages / Gemini
  • 订阅渠道:Codex、Claude、Antigravity、Grok
  • API渠道:OpenAI、Anthropic、Gemini、xAI、Azure OpenAI、AWS Bedrock、Vertex AI、DeepSeek、Moonshot、SiliconFlow、智谱、阿里、火山、OpenRouter、Groq,任意兼容的 OpenAI Compatible 以及常用的 New-API、CPA
  • 调度:多凭据加权轮询、重试、冷却、黑名单、会话亲和、协议自动分级并转换
  • 观测:健康状态、路由诊断、请求日志、用量与成本估算、缓存率
  • 访问密钥分发: AccessKey 支持限流、IP、周期额度等分发功能,权限控制:可以限定能用哪些分组、协议、模型等。并且还可以通过访问密钥登录访问受限的专用页面。
  • 部署:单个 Go 二进制内嵌管理界面,SQLite / MySQL / PostgreSQL 都支持,凭据用本地 encryption.key 静态加密。除 Docker 外提供五平台原生二进制,Windows 有安装包,装完是个低权限系统服务

Warning

提醒老用户:2.x 与 1.x 数据不兼容,请独立部署并验证后再切换。

Important

遇到问题欢迎提 Issue,觉得有用也欢迎点个 Star:https://github.com/tbphp/gpt-load。


最后,放一点预览截图:
GPT-Load 首页
GPT-Load 账号卡片
GPT-Load 健康页

12
  • 这周重点是 Codex、WebSocket、协议兼容和调度稳定性上,新增了一些能力和修复了不少实际问题。

    GPT-Load 2.0 近一周更新(截至 v2.0.0-rc.18)

    • WebSocket: 原生 Responses WebSocket,连接复用、连续会话、预热、多轮请求及逐轮治理。
    • Codex 额度实时更新增强: 完善被动额度刷新,以及修复各种更新事件机制问题。
    • 故障转移: ws 首轮异常时支持自动切换凭据,并完善 ws客户端重连恢复机制。
    • 调度优化: 统一全局重试预算,支持按模型独立冷却,并扩大部分 4xx / 5xx 场景下的安全重试与换组能力。
    • 缓存亲和: 支持 prompt_cache_key 参与请求亲和,补齐 Codex 稳定缓存分组,改善连续请求缓存命中表现。
    • 协议兼容: 加强等协议转换,完善 DeepSeek、Codex、Grok 的系统指令、工具调用及原生消息兼容。
    • 用量统计: 修正流式输入 token 及费用统计错误。
    • 功能扩展: Responses 状态续接、Rerank 、Gemini / Antigravity 生图转换 Ultrafast 模式支持。
    • 账号管理: 支持更多格式的订阅凭据导入、自定义上游地址,并修复 Codex / Claude 多账号身份判重问题。
    • 管理优化: 分组密钥测试支持自选协议和模型,Access Key 支持自定义生成,同时优化日志时间筛选及相关管理交互。
    • 其他若干兼容性、稳定性和性能优化。
  • 好耶~

  • 好东东 xhj003

  • 好用在用,感谢作者

  • bd

  • 好东西,收藏下先

  • 这一周还是更新的很频繁的,解决了很多反馈的问题,以及新增了不少功能还有各种优化。

    GPT-Load 2.0 近一周更新(截止 v2.0.0-rc.10)

    • 参数覆盖:按协议、模型匹配规则,统一修改或删除请求参数。
    • 调度升级:全局加权轮询、连续分配限制,支持原生优先或混合权重策略。
    • 价格倍率:分组和 AccessKey 可分别设置费用倍率。
    • 密钥与用量:支持复制配置发放新密钥、按密钥查看用量及日志、自定义统计时间。
    • 批量管理:单次最多导入 5,000 条 API Key,支持全量下载、启停和恢复。
    • 渠道扩展:新增 Sub2API 专用上游渠道。
    • 跨域配置:支持后台配置 CORS 和自定义响应头。
    • 管理优化:重构设置页,补齐订阅账号权重、分组快速启停及日志路由展示。
    • 其他若干修复和优化。
  • 厉害的大佬,我的Claude推荐的你的项目才发现你也在nd站里面 xhj003

  • 简洁、轻量确实更适全个人使用

12

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

📈用户数目📈

目前论坛共有71788位seeker

🎉欢迎新用户🎉