SillyTavern 使用指南:设置、模型和高级 RP 功能实用指南
您可能已经听说了:SillyTavern 是用于大型语言模型角色扮演和聊天的最灵活的前端之一。但是从哪里开始,应该使用哪些模型,以及如何在不破坏任何东西的情况下解锁其最佳功能?本指南将逐步引导您,没有多余的内容,只有从安装到专业级别会话的实用、以解决方案为导向的路径。
什么是 SillyTavern?为什么要使用它?
SillyTavern 是一个强大且可定制的 UI,用于与 LLM(托管 API 和本地模型)进行交互。可以将其视为沉浸式聊天、角色扮演、世界构建和故事协作的控制室。它连接到 OpenAI、Anthropic 和 Google 等 API,或连接到 KoboldAI 和 oobabooga/text-generation-webui (TGI/ExLlama 等) 等本地后端,让您可以微调会话的氛围、记忆和风格。它旨在平易近人但又深入,具有角色卡、长期记忆、扩展和用于提示和采样的精细控制等功能。
快速设置:从零到第一次聊天
按照这个简化的流程。一旦您感到舒适,可以稍后重新访问高级设置。
1) 安装和启动
- 从其 GitHub 存储库(或维护的分支)克隆或下载 SillyTavern,然后按照包含的启动脚本针对您的操作系统进行操作。在 Windows 上,您通常运行
start.bat 来启动本地 Web 服务器;在 macOS/Linux 上,start.sh 脚本很常见。
- 打开终端中显示的本地 URL(通常为 ` 或 SillyTavern 打印的端口)以访问 UI。
提示:保持 SillyTavern 文件夹整洁——角色卡、预设和扩展都位于可预测的子文件夹中,从而更容易进行备份。
2) 选择您的模型路径:API 或本地
- 托管 API:启动速度最快;在 SillyTavern 的 API 设置面板中输入您的 API 密钥。
- 本地后端:最适合隐私和控制;将 SillyTavern 连接到 KoboldAI 或 oobabooga/text-generation-webui 等本地服务器。
SillyTavern 支持各种 API 提供商和本地连接器,文档中提供了有关优势、限制和用例的说明。
3) 输入 API 凭据(如果使用托管模型)
- 可以通过将 API 密钥粘贴到 SillyTavern 的连接选项卡中来添加 OpenAI、Anthropic、Google (Gemini) 和其他提供商。
- 提示:使用每个提供商的预设;不同的模型对略有不同的系统提示、温度和惩罚的反应更好。
社区报告指出,Google 的 Gemini 可以通过 Google AI Studio 密钥免费使用,使其成为经济高效的实验起点。
4) 连接到本地 LLM(可选)
- 启动您的本地后端(KoboldAI、text-generation-webui/oobabooga、LM Studio 等)并验证它是否正在提供 API 端点。
- 在 SillyTavern 中,选择相应的连接器并输入本地 URL 和任何必需的参数。
5) 创建或导入角色
- 单击“角色”→“新建”以从头开始构建,或从您的库中导入角色卡 (PNG/JSON)。
- 填写角色、描述、示例对话和定义字段。角色刻画越具体,RP 一致性越好。
6) 开始聊天
- 基于本地 Llama 的模型:私有、可定制;质量取决于量化和微调。
- KoboldAI/oobabooga 堆栈:对推理、提示格式和扩展的深度控制。
SillyTavern 的 API 连接指南在一个地方概述了支持的提供商和注意事项。
角色塑造:构建保持角色个性的角色
精彩的会话始于精彩的角色卡。
- 背景故事:3-5 个要点,说明形成历史;避免详尽的时间表。
- 示例对话:3 次交流,突出显示语气、节奏和情感范围。
专业提示:添加环境锚点(例如,“城市闻起来像雨水和旧霓虹灯”),以使模型具有描述性,而无需不断提醒。
扩展、插件和强大功能
SillyTavern 拥有一个扩展其功能的附加组件生态系统:
- 世界/故事工具:场景模板、NPC 名单和事件提示。
- TTS/STT:通过文本到语音和语音到文本启用您的会话。
- 图像挂钩:某些连接器支持图像提示/响应(取决于模型)。
在启用高级集成之前,请查看文档以了解提供商特定的功能、提示格式和速率限制说明。
安全、过滤器和界限
- 模型策略:API 模型(例如,Anthropic、Google)执行可能影响某些内容类型的安全规则。相应地调整您的创作目标。
- 本地控制:本地模型为您提供更多自由,但也提供更多责任——预先设置个人界限和内容标签。
- 会话卫生:使用内容警告、选择加入场景和清晰的过渡。如果出现问题,请总结、重置语气并重新锚定场景。
故障排除:常见问题的快速修复
- 模型重复或循环:增加重复惩罚,稍微降低温度,向内存中添加更多基础事实。
- 脱离角色的回应:加强角色的定义并添加 2-3 个示例对话;收紧系统提示。
- 成本飙升(API 使用):减少上下文长度,启用较短的回复,定期总结,或切换到成本较低的模型以用于填充场景。
- 本地模型速度慢:尝试较小的量化,启用 GPU 加速,或降低最大令牌数。
- 连接错误:重新检查提供商 URL、密钥有效性和模型名称。查阅 API 连接页面以获取确切的参数。
10 分钟入门工作流程(复制此内容)
- 选择一个提供商(例如,用于低成本测试的 Gemini 或用于长篇故事的 Claude)。
- 创建一个具有角色、背景故事要点和 3 个示例对话的角色。
- 将温度设置为 0.8,Top-p 设置为 0.9,重复惩罚设置为中等。
- 10 条消息后,导出聊天记录,记下两项改进,并更新角色卡。
重复此循环,您将看到显着的一致性提升。
模型特定提示(备忘单)
- OpenAI:喜欢简洁的系统提示;使用编号步骤清楚地格式化说明。
- Claude:擅长多段式简介;非常适合叙事连续性和总结。
- Gemini:适用于结构化提示和显式约束;检查免费套餐配额。
- 本地 Llama:使用指令调整的变体;测试 2-3 个量化以获得速度/质量。
备份、导出和组织
- 每个“宇宙”使用单独的文件夹,以防止知识的交叉污染。
- 定期导出聊天记录 (JSON/HTML) 并快照您的角色卡。
- 保留一份“元”文档,记录采样设置、模型版本和值得注意的会话。
值得注意的是:使用 Sider.AI 加速您的工作流程
如果您在 SillyTavern 之外起草角色简历、场景大纲或知识片段,侧边栏助手可以帮助您快速迭代。顺便说一句,Sider.AI 的浏览器内助手可以总结长篇记录、提出角色怪癖或生成场景种子,然后您可以将结果直接粘贴到 SillyTavern 中。它是世界构建和提示润色的便捷的预制作伴侣。 主要收获
- 从简单开始:选择一个提供商、一个角色和一个小记忆簿。
资源
- SillyTavern API 连接概述:支持的提供商、限制和说明。
- 关于最佳模型和免费/低成本选项(如 Gemini)的社区讨论。
- GitHub 上关于 SillyTavern 作为角色扮演和聊天的 LLM 前端的概述。
常见问题解答
Q1:如何将 SillyTavern 连接到 OpenAI、Claude 或 Gemini?
打开 SillyTavern 的 API 设置并粘贴每个提供商的 API 密钥,然后选择模型名称并保存。官方 API 连接指南列出了您可能需要设置的支持的提供商和参数。
Q2:我可以使用 SillyTavern 和本地模型(如 Llama)吗?
是的。运行本地后端,例如 KoboldAI 或 oobabooga/text-generation-webui,然后将 SillyTavern 指向本地服务器 URL。确保后端公开 API 端点并使用兼容的指令调整模型。
Q3:哪些设置可以提高 SillyTavern 中的角色扮演一致性?
完善系统提示,向角色卡添加示例对话,并使用小记忆簿来记录事实和关系。调整温度、Top-p 和重复惩罚以平衡创造力和连贯性。
Q4:哪个模型最适合 SillyTavern 中的长篇故事讲述?
Claude 模型在长上下文叙事连贯性方面表现出色,而 OpenAI 和 Gemini 则用途广泛且经济高效,适合一般聊天。如果您对调整它们感到满意,本地 Llama 模型非常适合隐私。
Q5:如何在 SillyTavern 中使用 API 模型降低令牌成本?
缩短上下文长度,启用简洁的回复,并定期总结弧线。您还可以切换到成本较低的模型以用于填充场景,并将高级模型用于关键时刻。