SillyTavern 使用指南:設定、模型與進階角色扮演功能實用指南
您一定聽說過:SillyTavern 是與大型語言模型進行角色扮演和聊天的最靈活前端之一。但您該從何處開始?應該使用哪些模型?又該如何在不破壞任何東西的情況下解鎖其最佳功能?本指南將逐步引導您完成,沒有任何多餘內容,只有從安裝到專業級別會話的實用、以解決方案為導向的路徑。
什麼是 SillyTavern?以及為什麼要使用它?
SillyTavern 是一個強大、可自訂的 UI,用於與 LLM(託管 API 和本地模型)互動。可以將其視為您進行沉浸式聊天、角色扮演、世界構建和故事協作的控制室。它可以連接到 OpenAI、Anthropic 和 Google 等 API,或連接到 KoboldAI 和 oobabooga/text-generation-webui (TGI/ExLlama 等) 等本地後端,讓您可以微調會話的氛圍、記憶和風格。它旨在平易近人且深入,具有角色卡、長期記憶、擴充功能以及提示和採樣的精細控制等功能。
快速設定:從零到第一次聊天
按照這個簡化的流程。一旦您感到舒適,稍後可以重新訪問進階設定。
1) 安裝並啟動
- 從其 GitHub 儲存庫(或維護的分支)克隆或下載 SillyTavern,然後按照包含的啟動腳本針對您的作業系統執行。在 Windows 上,您通常運行
start.bat 來啟動本地 Web 伺服器;在 macOS/Linux 上,start.sh 腳本很常見。
- 開啟終端機中顯示的本地 URL(通常是 ` 或 SillyTavern 列印的埠)以存取 UI。
提示:保持您的 SillyTavern 資料夾整潔——角色卡、預設和擴充功能位於可預測的子資料夾中,使備份更容易。
2) 選擇您的模型路徑:API 或本地
- 託管 API:啟動速度最快;在 SillyTavern 的 API 設定面板中輸入您的 API 金鑰。
- 本地後端:最適合隱私和控制;將 SillyTavern 連接到 KoboldAI 或 oobabooga/text-generation-webui 等本地伺服器。
SillyTavern 支援各種 API 提供者和本地連接器,並且在文件中註明了優勢、限制和使用案例。
3) 輸入 API 憑證(如果使用託管模型)
- 可以透過將 API 金鑰貼到 SillyTavern 的連線標籤中來新增 OpenAI、Anthropic、Google (Gemini) 和其他服務。
- 提示:使用每個提供者的預設;不同的模型對略有不同的系統提示、溫度和懲罰反應更好。
社群報告指出,Google 的 Gemini 可以透過 Google AI Studio 金鑰免費使用,使其成為經濟高效的實驗起點。
4) 連接到本地 LLM(可選)
- 啟動您的本地後端(KoboldAI、text-generation-webui/oobabooga、LM Studio 等),並驗證它是否正在提供 API 端點。
- 在 SillyTavern 中,選擇相應的連接器並輸入本地 URL 和任何所需的參數。
5) 建立或導入角色
- 點擊「角色」→「新增」從頭開始建立,或從您的資料庫匯入角色卡 (PNG/JSON)。
- 填寫人物誌、描述、範例對話和定義欄位。角色描述越具體,角色扮演的一致性越好。
6) 開始聊天
- 基於本地 Llama 的模型:私有、可自訂;品質取決於量化和微調。
- KoboldAI/oobabooga 堆疊:對推理、提示格式和擴充功能進行深度控制。
SillyTavern 的 API 連線指南在一處概述了支援的提供者和注意事項。
角色塑造:建立保持角色一致性的人格
一次精彩的會話始於一張出色的角色卡。
- 背景故事:3-5 個要點,說明形成歷史;避免詳盡的時間表。
專業提示:新增環境錨點(例如,「城市聞起來有雨和舊霓虹燈的味道」),以保持模型具有描述性,而無需不斷提醒。
擴充功能、外掛程式和強大功能
SillyTavern 有一個擴充其功能的附加元件生態系統:
- 世界/故事工具:場景範本、NPC 名單和事件提示。
- TTS/STT:使用文字轉語音和語音轉文字功能啟用您的會話。
- 圖像掛鉤:某些連接器支援圖像提示/回應(取決於模型)。
在啟用進階整合之前,請查看文件以了解提供者特定的功能、提示格式和速率限制注意事項。
安全、篩選器和界限
- 模型策略:API 模型(例如,Anthropic、Google)強制執行安全規則,這些規則可能會影響某些內容類型。相應地調整您的創作目標。
- 本地控制:本地模型為您提供更多自由,但也帶來更多責任——預先設定個人界限和內容標籤。
- 會話衛生:使用內容警告、選擇加入場景和清晰的過渡。如果發生脫軌,請總結、重置語氣並重新錨定場景。
疑難排解:常見問題的快速修復
- 模型重複或循環:增加重複懲罰,稍微降低溫度,向記憶中新增更多基礎事實。
- 脫離角色回應:加強角色的定義並新增 2-3 個範例對話;收緊系統提示。
- 成本飆升(API 使用):減少上下文長度,啟用更短的回覆,定期總結,或切換到成本較低的模型以用於填充場景。
- 本地模型速度慢:嘗試較小的量化,啟用 GPU 加速,或降低最大 Token 數。
- 連線錯誤:重新檢查提供者 URL、金鑰有效性和模型名稱。請查閱 API 連線頁面以取得確切的參數。
10 分鐘入門工作流程(複製此內容)
- 選擇一個提供者(例如,Gemini 用於低成本測試,或 Claude 用於長篇故事)。
- 建立一個具有人物誌、背景故事要點和 3 個範例對話的角色。
- 將溫度設定為 0.8,Top-p 0.9,重複懲罰中等。
- 在 10 條訊息後,匯出聊天記錄,記下兩項改進,並更新角色卡。
重複此循環,您將看到顯著的一致性提升。
模型特定提示(速查表)
- OpenAI:喜歡簡潔的系統提示;使用編號步驟清楚地格式化說明。
- Claude:擅長多段簡報;非常適合敘事連續性和摘要。
- Gemini:適用於結構化提示和明確的約束;檢查免費層配額。
- 本地 Llama:使用指示調整變體;測試 2-3 個量化以獲得速度/品質。
備份、匯出和組織
- 為每個「宇宙」使用單獨的資料夾,以防止知識的交叉污染。
- 定期匯出聊天記錄 (JSON/HTML) 並快照您的角色卡。
- 保留一份「元」文件,記錄採樣設定、模型版本和值得注意的會話。
值得注意:使用 Sider.AI 加速您的工作流程
如果您在 SillyTavern 之外起草角色簡介、場景大綱或知識片段,側邊欄助手可以幫助您快速迭代。順便說一句,Sider.AI 的瀏覽器內助手可以總結長篇文字記錄、提出角色怪癖或產生場景種子,然後您可以將結果直接貼到 SillyTavern 中。它是世界構建和提示潤色的便捷預生產助手。 主要收穫
- 從簡單開始:選擇一個提供者、一個角色和一本小的記憶書。
資源
- SillyTavern API 連線概覽:支援的提供者、限制和注意事項。
- 關於最佳模型和免費/低成本選項(如 Gemini)的社群討論。
- SillyTavern 作為角色扮演和聊天的 LLM 前端的 GitHub 概覽。
常見問題解答
Q1:如何將 SillyTavern 連接到 OpenAI、Claude 或 Gemini?
開啟 SillyTavern 的 API 設定,然後貼上每個提供者的 API 金鑰,然後選擇模型名稱並儲存。官方 API 連線指南列出了您可能需要設定的受支援提供者和參數。
Q2:我可以使用 SillyTavern 與 Llama 等本地模型嗎?
可以。執行 KoboldAI 或 oobabooga/text-generation-webui 等本地後端,然後將 SillyTavern 指向本地伺服器 URL。確保後端公開 API 端點並使用相容的指示調整模型。
Q3:哪些設定可以提高 SillyTavern 中的角色扮演一致性?
改進系統提示、向角色卡新增範例對話,並使用小的記憶書來記錄事實和關係。調整溫度、Top-p 和重複懲罰,以平衡創造力和連貫性。
Q4:哪個模型最適合 SillyTavern 中的長篇故事?
Claude 模型在長上下文敘事連貫性方面表現出色,而 OpenAI 和 Gemini 用於一般聊天的多功能且經濟高效。如果您對調整它們感到滿意,本地 Llama 模型非常適合隱私。
Q5:如何在 SillyTavern 中使用 API 模型降低 Token 成本?
縮短上下文長度、啟用簡潔的回覆並定期總結弧線。您還可以切換到成本較低的填充場景模型,並將高級模型用於關鍵時刻。