如何使用 CPA Manager Plus 组织您的神经网络查询
当您为生产环境或个人工具部署多个神经网络模型时,混乱最终会随之而来。一个请求发往 Claude,第二个发往 Gemini,第三个在 OpenAI 超时,到月底您会收到一笔令人费解的账单。如果您已经在使用 CLIProxyAPI (CPA) 进行流量路由,默认界面很快就会变得不够用。
CPA Manager Plus (CPAMP) 项目填补了这一空白。它是一个控制面板和可观测性系统,可部署在您自己的服务器上,在本地存储请求历史记录,并帮助您了解令牌的实际消耗位置。

底层架构
该工具由两部分组成。第一部分是 Web 界面,可以直接嵌入到 CPA 中替换默认面板。第二部分是一个独立的 Go 语言 Manager Server,配套 SQLite 数据库。
架构简单直接,无需云端注册。项目不会向外发送任何遥测数据——所有日志和模型定价数据都存储在本地文件中。访问密钥在写入数据库前会使用本地密钥 data.key 进行加密。

主要面板功能
查找故障且不泄露数据
API 聚合器的主要问题在于很难理解请求失败的原因。日志通常要么是一团乱麻,要么是包含敏感用户数据的原始 JSON。
CPAMP 从 CPA 队列中拉取数据并存储到 SQLite。您可以按状态、延迟、令牌类型和账户进行搜索。错误响应体会自动剥离私人信息。如果您需要将日志导出到其他系统进行调试,可以以 JSONL 格式导出历史记录。
精确的成本跟踪
面板按模型、提供商、账户、客户端 API 密钥和项目细分成本。
价格自动从 models.dev 获取,如有问题会回退到 LiteLLM 和 OpenRouter。如果您有自定义端点或企业折扣,可以手动覆盖价格。应用程序考虑了复杂的定价结构:输入令牌和输出令牌的差异、上下文缓存以及推理令牌。

账户控制和配额自动化
在使用 Codex 和 xAI 账户池时,您经常会遇到请求窗口限制。CPAMP 可以按计划检查账户状态、读取配额状态,并在接近限制时自动将账户置于冷却期。如果某个账户出现问题,它会进入单独的操作队列进行手动审查或恢复。

如何启动
部署 CPA 和管理器套件的最简单方式是使用 Docker Compose。创建一个配置文件:
services:
cli-proxy-api:
image: eceasy/cli-proxy-api:latest
restart: unless-stopped
ports:
- '8317:8317'
volumes:
- cpa-data:/app/data
cpa-manager-plus:
image: seakee/cpa-manager-plus:latest
restart: unless-stopped
ports:
- '18317:18317'
volumes:
- cpa-manager-plus-data:/data
volumes:
cpa-data:
cpa-manager-plus-data:
使用命令 docker compose up -d 启动容器。启动后,打开地址 http://<host>:18317/management.html,从容器日志中获取生成的管理员密钥 cpa-manager-plus,然后通过 URL 和主密钥链接 CPA。
如果您的代理已经在单独运行,管理器可以作为独立容器启动:
docker run -d \
--name cpa-manager-plus \
--restart unless-stopped \
-p 18317:18317 \
-v cpa-manager-plus-data:/data \
seakee/cpa-manager-plus:latest
适用人群
该项目面向那些为团队或个人脚本维护自己的神经网络网关的人。如果您厌倦了盲目猜测管道失败的原因以及哪位同事耗尽了整个每日令牌限额,CPAMP 可以解决问题,无需额外麻烦地使用外部监控服务。数据库在几分钟内即可启动,无需 ClickHouse 或 Grafana 设置,并立即为您提供清晰的全景视图。
相关项目