So verwenden Sie SillyTavern: Eine praktische Anleitung zu Einrichtung, Modellen und erweiterten RP-Funktionen
Sie haben das Summen gehört: SillyTavern ist eines der flexibelsten Frontends für Rollenspiele und Chats mit großen Sprachmodellen. Aber wo fangen Sie an, welche Modelle sollten Sie verwenden, und wie schalten Sie die besten Funktionen frei, ohne etwas kaputt zu machen? Diese Anleitung führt Sie Schritt für Schritt durch den Prozess – kein unnötiges Gerede, sondern ein praktischer, lösungsorientierter Weg von der Installation bis hin zu professionellen Sitzungen.
Was ist SillyTavern – und warum sollte man es verwenden?
SillyTavern ist eine leistungsstarke, anpassbare Benutzeroberfläche für die Interaktion mit LLMs – sowohl gehostete APIs als auch lokale Modelle. Stellen Sie es sich als Ihre Kontrollzentrale für immersive Chats, Charakter-Rollenspiele, Worldbuilding und Story-Kollaboration vor. Es verbindet sich mit APIs wie OpenAI, Anthropic und Google oder mit lokalen Backends wie KoboldAI und oobabooga/text-generation-webui (TGI/ExLlama usw.), sodass Sie die Stimmung, das Gedächtnis und den Stil Ihrer Sitzungen feinabstimmen können. Es ist so konzipiert, dass es zugänglich und dennoch tiefgründig ist, mit Funktionen wie Charakterkarten, Langzeitgedächtnis, Erweiterungen und granularen Steuerelementen für Prompts und Sampling.
Schnelle Einrichtung: Von Null zum ersten Chat
Folgen Sie diesem optimierten Ablauf. Sie können die erweiterten Einstellungen später erneut aufrufen, sobald Sie sich wohlfühlen.
1) Installieren und starten
- Klonen oder laden Sie SillyTavern von seinem GitHub-Repository (oder einem gepflegten Fork) herunter und folgen Sie dem enthaltenen Startskript für Ihr Betriebssystem. Unter Windows führen Sie normalerweise eine
start.bat aus, um den lokalen Webserver zu starten; unter macOS/Linux ist ein start.sh-Skript üblich.
- Öffnen Sie die lokale URL, die im Terminal angezeigt wird (normalerweise ` oder der Port, den SillyTavern ausgibt), um auf die Benutzeroberfläche zuzugreifen.
Tipp: Halten Sie Ihren SillyTavern-Ordner aufgeräumt – Charakterkarten, Voreinstellungen und Erweiterungen befinden sich in vorhersehbaren Unterordnern, was Backups einfacher macht.
2) Wählen Sie Ihren Modellpfad: API oder lokal
- Gehostete API: Am schnellsten zu starten; geben Sie Ihren API-Schlüssel im API-Einstellungsfeld von SillyTavern ein.
- Lokales Backend: Am besten für Datenschutz und Kontrolle; verbinden Sie SillyTavern mit einem lokalen Server wie KoboldAI oder oobabooga/text-generation-webui.
SillyTavern unterstützt eine breite Palette von API-Anbietern und lokalen Konnektoren, mit Hinweisen zu Stärken, Grenzen und Anwendungsfällen in der Dokumentation.
3) API-Zugangsdaten eingeben (falls gehostete Modelle verwendet werden)
- OpenAI, Anthropic, Google (Gemini) und andere können hinzugefügt werden, indem Sie API-Schlüssel in den Verbindungs-Tab von SillyTavern einfügen.
- Tipp: Verwenden Sie Voreinstellungen pro Anbieter; verschiedene Modelle reagieren besser auf leicht unterschiedliche System-Prompts, Temperaturen und Strafen.
Community-Berichte weisen darauf hin, dass Googles Gemini kostenlos mit einem Google AI Studio-Schlüssel verwendet werden kann, was es zu einem kostengünstigen Ausgangspunkt für Experimente macht.
4) Verbindung zu lokalen LLMs herstellen (optional)
- Starten Sie Ihr lokales Backend (KoboldAI, text-generation-webui/oobabooga, LM Studio usw.) und vergewissern Sie sich, dass es einen API-Endpunkt bereitstellt.
- Wählen Sie in SillyTavern den entsprechenden Konnektor aus und geben Sie die lokale URL und alle erforderlichen Parameter ein.
- Validieren Sie, indem Sie eine kurze Testnachricht senden.
5) Einen Charakter erstellen oder importieren
- Klicken Sie auf Charaktere → Neu, um von Grund auf neu zu erstellen, oder importieren Sie eine Charakterkarte (PNG/JSON) aus Ihrer Bibliothek.
- Füllen Sie Persona-, Beschreibungs-, Beispiel-Dialog- und Definitionsfelder aus. Je spezifischer die Charakterisierung, desto besser die RP-Konsistenz.
6) Chat starten
- Wählen Sie Ihren Charakter und Ihr Modell aus und schreiben Sie dann Ihre erste Nachricht.
- Verwenden Sie einen sanften Opener wie: „Lass uns die Szene festlegen: .“
- Lokale Llama-basierte Modelle: Privat, anpassbar; die Qualität hängt von der Quantisierung und Feinabstimmung ab.
- KoboldAI/oobabooga Stacks: Tiefe Kontrolle über Inferenz, Prompt-Formate und Erweiterungen.
Die API-Verbindungsanleitung von SillyTavern listet unterstützte Anbieter und Vorbehalte an einem Ort auf.
Charakter-Gestaltung: Aufbau von Persönlichkeiten, die im Charakter bleiben
Eine großartige Sitzung beginnt mit einer großartigen Charakterkarte.
- Persona: 2–4 Sätze über Identität, Rolle, Stimme.
- Hintergrundgeschichte: 3–5 Stichpunkte zur prägenden Geschichte; vermeiden Sie erschöpfende Zeitachsen.
- Ziele und Grenzen: Klären Sie Wünsche und Grenzen, die der Charakter nicht überschreiten wird.
- Sprachmuster: Fügen Sie ein paar Beispiele für Redewendungen oder Eigenheiten hinzu.
- Beispiel-Dialog: 3 Austausche, die Ton, Tempo und emotionale Bandbreite hervorheben.
Profi-Tipp: Fügen Sie Umgebungsanker hinzu (z. B. „die Stadt riecht nach Regen und altem Neon“), um das Modell beschreibend zu halten, ohne ständige Erinnerungen.
Erweiterungen, Plugins und Power-Funktionen
SillyTavern verfügt über ein Ökosystem von Add-ons, die seine Fähigkeiten erweitern:
- Gedächtnis und Lorebooks: Automatisches Einfügen von wichtigen Fakten, wenn Auslöser erkannt werden.
- Welt-/Story-Tools: Szenenvorlagen, NPC-Listen und Ereignis-Prompts.
- TTS/STT: Sprachaktivieren Sie Ihre Sitzungen mit Text-to-Speech und Speech-to-Text.
- Image Hooks: Einige Konnektoren unterstützen Image-Prompts/Antworten (modellabhängig).
- Automatisierung: Makros für wiederkehrende narrative Beats oder Formatierung.
Überprüfen Sie die Dokumentation auf anbieterspezifische Funktionen, Prompt-Formate und Ratenbegrenzungs-Hinweise, bevor Sie erweiterte Integrationen aktivieren.
Sicherheit, Filter und Grenzen
- Modellrichtlinien: API-Modelle (z. B. Anthropic, Google) erzwingen Sicherheitsregeln, die sich auf bestimmte Inhaltstypen auswirken können. Passen Sie Ihre kreativen Ziele entsprechend an.
- Lokale Kontrolle: Lokale Modelle geben Ihnen mehr Freiheit, aber auch mehr Verantwortung – legen Sie persönliche Grenzen und Inhalts-Tags im Voraus fest.
- Sitzungshygiene: Verwenden Sie Inhaltswarnungen, Opt-in-Szenen und klare Übergänge. Wenn etwas entgleist, fassen Sie zusammen, setzen Sie den Ton zurück und verankern Sie das Szenario neu.
Fehlerbehebung: Schnelle Lösungen für häufige Probleme
- Das Modell wiederholt sich oder schleift: Erhöhen Sie die Wiederholungsstrafe, senken Sie die Temperatur leicht und fügen Sie dem Gedächtnis mehr grundlegende Fakten hinzu.
- Out-of-Character-Antworten: Stärken Sie die Definition des Charakters und fügen Sie 2–3 Beispiel-Dialoge hinzu; straffen Sie den System-Prompt.
- Kosten steigen (API-Nutzung): Reduzieren Sie die Kontextlänge, aktivieren Sie kürzere Antworten, fassen Sie regelmäßig zusammen oder wechseln Sie zu einem kostengünstigeren Modell für Füllszenen.
- Lokales Modell ist langsam: Versuchen Sie eine kleinere Quantisierung, aktivieren Sie die GPU-Beschleunigung oder senken Sie die maximale Anzahl an Token.
- Verbindungsfehler: Überprüfen Sie die Anbieter-URL, die Schlüsselgültigkeit und den Modellnamen erneut. Konsultieren Sie die API-Verbindungsseite für genaue Parameter.
Ein 10-Minuten-Starter-Workflow (zum Kopieren)
- Wählen Sie einen Anbieter (z. B. Gemini für kostengünstige Tests oder Claude für lange Story-Bögen).
- Erstellen Sie einen Charakter mit Persona, Hintergrundgeschichte in Stichpunkten und 3 Beispiel-Dialogen.
- Stellen Sie die Temperatur auf 0,8, Top‑p 0,9, Wiederholungsstrafe mittel ein.
- Fügen Sie ein kleines Gedächtnisbuch hinzu: Setting, Beziehungen, aktive Ziele.
- Starten Sie den Chat mit einem klaren Szenenaufbau und dem gewünschten Ton.
- Exportieren Sie nach 10 Nachrichten den Chat, notieren Sie zwei Verbesserungen und aktualisieren Sie die Charakterkarte.
Wiederholen Sie diese Schleife, und Sie werden dramatische Konsistenzgewinne sehen.
Modellspezifische Tipps (Spickzettel)
- OpenAI: Mag prägnante System-Prompts; formatieren Sie Anweisungen klar mit nummerierten Schritten.
- Claude: Gedeiht mit mehrabsätzlichen Briefings; ideal für narrative Kontinuität und Zusammenfassungen.
- Gemini: Funktioniert gut mit strukturierten Prompts und expliziten Einschränkungen; überprüfen Sie die Kontingente des Free-Tiers.
- Lokales Llama: Verwenden Sie instruct-tuned Varianten; testen Sie 2–3 Quantisierungen für Geschwindigkeit/Qualität.
Backups, Exporte und Organisation
- Verwenden Sie separate Ordner pro „Universum“, um eine Kreuzkontamination von Lore zu verhindern.
- Exportieren Sie Chats regelmäßig (JSON/HTML) und erstellen Sie Snapshots Ihrer Charakterkarten.
- Führen Sie ein „Meta“-Dokument, das Sampling-Einstellungen, Modellversionen und bemerkenswerte Sitzungen aufzeichnet.
Erwähnenswert: Beschleunigung Ihres Workflows mit Sider.AI
Wenn Sie Charakterbios, Szenenentwürfe oder Lore-Snippets außerhalb von SillyTavern entwerfen, kann Ihnen ein Sidebar-Assistent helfen, schnell zu iterieren. Übrigens, der In-Browser-Assistent von Sider.AI kann lange Transkripte zusammenfassen, Charakter-Eigenheiten vorschlagen oder Szenen-Seeds generieren, und dann können Sie die Ergebnisse direkt in SillyTavern einfügen. Es ist ein praktischer Pre-Production-Begleiter für Worldbuilding und Prompt-Polishing. Wichtigste Erkenntnisse
- Beginnen Sie einfach: Wählen Sie einen Anbieter, einen Charakter und ein kleines Gedächtnisbuch.
- Kontrolle ist König: System-Prompts, Sampling und Gedächtnis formen die Konsistenz.
- Wählen Sie Modelle nach Ziel: narrative Länge, Kosten, Kreativität oder Datenschutz.
- Iterieren Sie: exportieren, überprüfen und verfeinern Sie Ihre Charakterkarte und Voreinstellungen.
Ressourcen
- SillyTavern API-Verbindungen Übersicht: unterstützte Anbieter, Limits und Hinweise.
- Community-Diskussion über die besten Modelle und kostenlose/kostengünstige Optionen wie Gemini.
- GitHub-Übersicht über SillyTavern als LLM-Frontend für Rollenspiele und Chats.
FAQ
F1:Wie verbinde ich SillyTavern mit OpenAI, Claude oder Gemini?
Öffnen Sie die API-Einstellungen von SillyTavern und fügen Sie Ihre API-Schlüssel für jeden Anbieter ein. Wählen Sie dann den Modellnamen aus und speichern Sie. Die offizielle API-Verbindungsanleitung listet unterstützte Anbieter und Parameter auf, die Sie möglicherweise festlegen müssen.
F2:Kann ich SillyTavern mit einem lokalen Modell wie Llama verwenden?
Ja. Führen Sie ein lokales Backend wie KoboldAI oder oobabooga/text-generation-webui aus und verweisen Sie SillyTavern auf die lokale Server-URL. Stellen Sie sicher, dass das Backend einen API-Endpunkt bereitstellt und ein kompatibles instruct-tuned Modell verwendet.
F3:Welche Einstellungen verbessern die Rollenspielkonsistenz in SillyTavern?
Verfeinern Sie den System-Prompt, fügen Sie der Charakterkarte Beispiel-Dialoge hinzu und verwenden Sie ein kleines Gedächtnisbuch für Fakten und Beziehungen. Optimieren Sie Temperatur, Top‑p und Wiederholungsstrafen, um Kreativität und Kohärenz auszugleichen.
F4:Welches Modell ist am besten für Long-Form-Storytelling in SillyTavern geeignet?
Claude-Modelle sind stark für die narrative Kohärenz in langen Kontexten, während OpenAI und Gemini vielseitig und kostengünstig für allgemeine Chats sind. Lokale Llama-Modelle eignen sich hervorragend für den Datenschutz, wenn Sie sich mit deren Optimierung auskennen.
F5:Wie kann ich die Token-Kosten mit API-Modellen in SillyTavern reduzieren?
Verkürzen Sie die Kontextlänge, aktivieren Sie prägnante Antworten und fassen Sie Handlungsbögen regelmäßig zusammen. Sie können auch zu kostengünstigeren Modellen für Füllszenen wechseln und Premium-Modelle für entscheidende Momente verwenden.