SillyTavern 自定义 API 设置

使用 TokenHub 配置 SillyTavern 自定义 OpenAI-compatible 聊天设置并验证第一条消息。

SillyTavern是什么?

SillyTavern 是一个高级用户聊天前端,用于与许多模型 API 进行角色扮演和长格式对话。

此 SillyTavern 设置遵循其自定义 OpenAI-compatible 聊天 Completion 流程。使用以 /v1 结尾的 API 根,在发现不可用时提供准确的模型 ID,并在长时间对话之前使用测试消息。 SillyTavern 是一个前端,而不是捆绑的模型服务,长时间的角色扮演会话可以积累大量的 prompt 和历史代币。使用测试消息确认自定义聊天 Completion,如果发现失败,请手动输入模型,并在开始长时间对话之前检查上下文限制和使用情况。

SillyTavern 的 TokenHub 入口不是 Text Completion,也不是某家厂商预设,而是 Chat Completions 下的 Custom (OpenAI-compatible)。官方明确提示,自定义端点不保证与每项 SillyTavern 功能兼容,需要用 Test Message 实测。

按官方 Connecting 顺序配置

  1. 打开 API Connections
  2. API type 切换到 Chat Completion
  3. Chat Completion Source 选择 Custom (OpenAI-compatible)
  4. Custom endpoint URL 填 https://us-api.tokenhub.com/v1
  5. API Key 填 TokenHub API Key。
  6. 若 TokenHub 的 /v1/models 返回列表,从下拉框选择模型;否则在文本框手动输入完整 Model ID。
  7. 点击 Test Message 发送最小测试提示。

官方特别要求 URL 末尾可以是 /v1,但不要追加 /chat/completions,因为 SillyTavern 会自行拼接该路径。

状态检查失败时再使用 Bypass API status check

如果 Test Message 和实际对话都能正常返回,但 SillyTavern 仍提示 endpoint 不工作,可以勾选 Bypass API status check。它只关闭状态告警,不会修复 401、404、超时或模型错误;真实请求失败时不应启用它掩盖问题。

Prompt Post-Processing 是 SillyTavern 特有设置

自定义端点若要求合并相邻角色、只保留一个 system message 或必须由 user 开头,可按官方从宽到严选择:None、Merge consecutive messages、Semi-strict、Strict、Single user message。

需要工具调用时,不要选择带 no tools 的 Post-Processing 变体;Merge、Semi-strict 与 Strict 的 no-tools 版本会从 prompt 中移除工具调用。先保持 None,用基础 Chat Completions 验证,只有遇到明确的角色格式错误再收紧。

依据 SillyTavern 的表单排错

  • 模型下拉为空:说明 /models 未返回可用列表,改用文本框手动输入 Model ID。
  • 404:确认 endpoint 只到 /v1
  • Test Message 成功但状态告警:才考虑 Bypass API status check。
  • 工具突然不可用:检查 Prompt Post-Processing 是否选了 no-tools 变体。
  • 角色消息格式报错:逐级尝试 Merge、Semi-strict 或 Strict,不要一次把全部消息压成单条。

官方资料

推荐模型怎么选?

任务选择方向适合原因
复杂任务旗舰推理模型更适合规划、多步骤执行和复杂上下文。
日常使用均衡模型在效果、速度和成本之间取得平衡。
批量任务快速低成本模型减少摘要和简单处理的成本。
前往模型广场比较价格和能力

SillyTavern 定制 API FAQ

我应该选择哪种 API 类型?

选择聊天 Completion,然后选择自定义 (OpenAI-compatible) 作为源。

如果 SillyTavern 无法列出我的 TokenHub 型号怎么办?

手动输入准确的型号 ID。即使 /v1/models 列表不可用,自定义端点也可以工作。

我应该打开绕过 API 状态检查吗?

仅当测试消息有效但状态检查继续发出错误警告时。它不会修复非工作端点。

为什么长时间的 SillyTavern 聊天会变慢或失败?

角色 prompts 和聊天历史记录持续消耗上下文。查看模型上下文限制和令牌使用情况,然后在需要时总结或修剪历史记录。

如何验证 SillyTavern 自定义端点?

运行测试消息,确认所选模型保持活动状态,并在开始长时间聊天之前检查 TokenHub 日志中的 Chat Completions 请求。

配置资料

本页配置以 TokenHub 教程和官方资料为依据,最后核验于 2026-09-08。