# LibreChat 自定义端点：模型、标题与 API 费用

> 为 LibreChat 添加自定义端点，使用小范围模型列表、服务端凭证，并检查标题生成与其他后台调用，准确评估完整对话费用。

_发布 2026-09-29 · 更新 2026-09-29 · [KeepRouter Editorial](https://keeprouter.com/editorial-policy#editorial-team) · 5 分钟阅读_

![应用、AI Gateway 与模型供应商之间的分层责任图](https://keeprouter.com/editorial/blog/ai-gateway-guide.png)

_应用通过明确的请求边界连接模型 API。概念示意图。_

在 LibreChat 现有配置的 `endpoints.custom` 中添加兼容 API，并用服务器环境变量引用 Key。先提供明确的小模型列表和普通文本聊天，再分别验证标题、记忆、工具与文档检索。

本文是已有部署的配置增量，不要用一个简短片段覆盖完整的认证、存储和应用配置。

## 新增一个命名端点

[官方端点参考](https://www.librechat.ai/docs/configuration/librechat_yaml/object_structure/custom_endpoint)定义了地址、环境变量凭证、模型与标题设置。将下面片段合并进现有 `librechat.yaml`，保留原版本和其他配置：

```yaml
endpoints:
  custom:
    - name: KeepRouter
      apiKey: '${KEEPROUTER_API_KEY}'
      baseURL: https://keeprouter.com/v1
      models:
        default:
          - free
        fetch: false
      titleConvo: false
      # titleModel: current_model  # 启用标题时设置
      modelDisplayLabel: KeepRouter
```

在服务器的秘密配置中设置 `KEEPROUTER_API_KEY`。文件中的占位引用不是要原样发给 API 的密钥。按实际部署方式加载新配置，然后检查新端点是否出现。

关闭自动获取、只列出一个模型，是为了缩小测试范围，不代表服务不支持模型发现。确认可用聊天型号后，再扩大选择。

## 显示名不是服务端别名

| 配置 | 作用 | 起步检查 |
| --- | --- | --- |
| name | 界面连接名称 | 明确选中 KeepRouter |
| baseURL | API 前缀 | 不重复 `/v1` |
| models | 提供给用户的选择 | 使用真实聊天型号 |
| 显示标签 | 便于用户辨认 | 不替代 API 型号 |
| 标题模型 | 后台生成会话标题 | 首次测试暂不启用 |

新建会话，给出一个明确事实并检查正常结束。`free` 只是连通样本，不能证明付费模型的工具、附件或复杂任务表现。

## 把后台调用计入预算

标题会产生额外请求，记忆、总结和检索也可能有单独模型配置。[LibreChat 记忆说明](https://www.librechat.ai/docs/features/memory)展示了独立端点与模型设置，更换聊天连接不会自动迁移这些调用。

假设一天有一百个会话，每个五条消息，则有五百次可见轮次；若每个新会话额外生成一次标题，再增加一百次请求。这只说明调用数，短标题与长文档回答的 token 消耗并不相同。

普通聊天正常后再启用标题，并明确选择支持的型号。标题模型不存在时，主回答可能成功，界面却仍显示后台错误。

## 不要把删参数当成兼容性保证

自定义端点可以配置参数转换，但删除一个 stop 等字段可能改变行为。保留脱敏后的最小错误请求，对照 [API 文档](/api/docs)，判断限制来自网关、模型还是具体操作。

只有应用接受相应行为变化时才移除参数。依赖某个供应商专属功能的工作流，可以保留原生集成，不必全部塞进通用聊天接口。

## 同时验证用户权限

管理员能配置，并不代表目标角色一定能使用。用实际用户角色确认端点与模型列表，避免试用期间误选其他付费线路。共享连接的 Key 放在服务器，不写进会话 URL 或提示词。

使用正常问题、追问和一个明确不支持的操作组成小样本。分别记录主回答与后台错误；图片操作失败不能被文本回答掩盖。

到[模型目录](/models)选择付费候选，用[费用计算器](/tools/api-cost-calculator)估算完整会话预算。主路径和后台调用都通过之后，再替换旧端点。

## 常见问题

### fetch: false 表示 API 不支持模型发现吗？

不是。本文用它固定首次测试的模型列表。聊天选择明确后，可单独评估自动发现。

### 为什么初始关闭标题生成？

为了隔离主聊天请求。连通后再使用支持的型号开启标题，并计入后台费用。

### 可以直接覆盖整个配置文件吗？

不能。这是待合并的端点片段，需要保留已有版本、其他端点与部署设置。

## 参考的一手资料

_本文最近复核 2026-09-29_

1. [LibreChat custom endpoint reference](https://www.librechat.ai/docs/configuration/librechat_yaml/object_structure/custom_endpoint)
2. [LibreChat memory configuration](https://www.librechat.ai/docs/features/memory)

## 继续阅读

- [Open WebUI 自定义 API：连接模型与排查功能差异](https://keeprouter.com/zh/blog/open-webui-openai-compatible-api.md)
- [RAG 每次查询多少钱：别只计算生成 token](https://keeprouter.com/zh/blog/rag-api-cost-per-query.md)
- [quickstart](https://keeprouter.com/docs/quickstart.md)

## 用一条小请求试用接入配置

按步骤设置，把密钥保留在服务端，并检查返回的答案与用量。

[打开接入指南](https://keeprouter.com/docs/quickstart)

[创建 Key，测试免费模型](https://keeprouter.com/login?returnTo=%2Fconsole%2Fkeys%3Fmodel%3Dfree)

免费测试使用 free 模型；其他付费型号需要足够预付额度。

[全部文章](https://keeprouter.com/zh/blog.md) · [模型与价格](https://keeprouter.com/models.md)
