
SillyTavern beste Modelle: Ehrlicher Test 2026
Finde die besten Open-Source-LLMs für Rollenspiel, Charaktertiefe und Langzeitgedächtnis in SillyTavern – mit konkreten Benchmarks und Tipps zur Einrichtung.
Zusammenfassung
Die besten Modelle für SillyTavern sind 2025 Open-Weight-LLMs wie Mistral 7B, Mixtral 8x7B, Llama 3 8B und Nous-Hermes 2, optimiert für Rollenspiel, Charakterkonsistenz und geringe Latenz, lokal oder per API. Diese Modelle verbinden Kreativität mit Kohärenz und passen zu dem Anspruch von SillyTavern an immersive, unzensierte Dialoge.
Warum die Modellwahl beim Rollenspiel in SillyTavern zählt
SillyTavern ist eine leistungsstarke Oberfläche für AI-Rollenspiel, aber wie gut es läuft, hängt ganz vom zugrunde liegenden Modell ab. Anders als geschlossene Plattformen wie Character.AI oder Replika kannst du bei SillyTavern jedes LLM per API oder lokaler Inferenz anbinden. Diese Freiheit bedeutet, dass du Modelle wählen kannst, die auf kreatives Schreiben, Charakterkonsistenz und lange Kontextfenster abgestimmt sind. Forschung des [Stanford Center for Research on Foundation Models](https://crfm.stanford.edu) zeigt, dass kleinere, feinabgestimmte Modelle größere Basismodelle bei bestimmten Aufgaben wie der Dialogkohärenz oft übertreffen. Für SillyTavern vermeiden die besten Modelle repetitive Schleifen, halten über Hunderte Nachrichten eigenständige Charakterstimmen und verarbeiten NSFW-Inhalte ohne Filtereingriffe. Ein schwaches Modell bricht die Immersion mit generischen Antworten oder Gedächtnislücken, ein gutes lässt den Charakter lebendig wirken. Der Haken ist die Komplexität: Du brauchst einen API-Schlüssel (z. B. von OpenAI, Anthropic oder einem lokalen Anbieter wie Ollama) und etwas technisches Know-how, um die Presets von SillyTavern zu konfigurieren. Dafür bekommst du ein persönliches Erlebnis, mit dem keine abgeschottete App mithalten kann.
Die besten Open-Source-Modelle für lokale Inferenz
Für lokale Inferenz laufen quantisierte Modelle mit 7B-13B auf Consumer-GPUs (8-16GB VRAM) über Tools wie Ollama, LM Studio oder KoboldCPP. Herausragend ist Stand Mitte 2025 Mistral 7B Instruct v0.3 – schnell, kohärent und gut im englischsprachigen Rollenspiel. Für mehr Charaktertiefe bietet Nous-Hermes 2 Mixtral 8x7B (ein Fine-Tune von Mixtral) 32K Kontext und gutes Befolgen von Anweisungen, braucht aber ~24GB VRAM. Llama 3 8B Instruct ist eine weitere Top-Wahl, vor allem die 70B-Version, wenn du die Hardware hast; sie hält die Persönlichkeit über lange Chats hervorragend. Das Modell Tiefighter 13B, ein Merge aus Mythomax und anderen auf Rollenspiel abgestimmten Modellen, ist gezielt für unzensierte Dialoge und kreatives Schreiben gebaut und damit ein SillyTavern-Favorit. Für Setups mit wenig Ressourcen liefert Phi-3 Mini 3.8B erstaunliche Qualität für seine Größe. Nutze immer eine quantisierte Version (Q4_K_M oder Q5_K_M), um Speicherbedarf und Ausgabequalität auszubalancieren. Teste jedes Modell mit dem Standard-Preset „Roleplay“ von SillyTavern und passe dann Temperatur (0.7-0.9) und Wiederholungsstrafe (1.1-1.2) für die besten Ergebnisse an.
Die besten API-gehosteten Modelle für SillyTavern
Wenn du Modelle nicht lokal betreiben willst, bieten API-basierte Modelle höhere Qualität gegen Bezahlung. GPT-4 Turbo von OpenAI (128K Kontext) liefert Rollenspiel auf Spitzenniveau mit exzellentem Charaktergedächtnis, kostet aber ~$0.01 pro 1K Input-Tokens und hat einen Inhaltsfilter, der Szenen für Erwachsene markieren kann. Claude 3 Opus von Anthropic wird für nuancierte, kreative Prosa und längeren Kontext (200K) gelobt, kostet ähnlich und hat ebenfalls Sicherheitsfilter. Für unzensiertes Rollenspiel sind Mancer (ein Dienst mit Mythomax und anderen offenen Modellen) oder OpenRouter (bündelt unzensierte Modelle wie Nous-Hermes) beliebt. Die Kosten pro Million Tokens für offene Modelle per API liegen meist bei $0.15-$0.50, weit günstiger als GPT-4. Die „Chat Completion“-Presets von SillyTavern vereinfachen die API-Einrichtung: Endpunkt und Schlüssel einfügen, Modell wählen, System-Prompt anpassen. Für maximale Charaktertreue nutze ein Modell mit >= 8K Kontext und setze „max tokens“ auf 512. Nachteil: Die API-Latenz kann je nach Anbieter 2-10 Sekunden pro Antwort betragen.
Bereit für den
Unterschied?
Chatte mit einer Begleiterin, die sich wirklich an dich erinnert. Kostenlos starten. Unbegrenzt chatten mit Premium.
Kostenlos chattenFeinabgestimmte Modelle für Charakterkonsistenz und Gedächtnis
Rollenspiel lebt davon, dass Charaktere sich an frühere Interaktionen erinnern. Auf Rollenspiel-Daten feinabgestimmte Modelle wie Mythomax L2 13B und Nous-Hermes 2 enthalten Training, das „Persönlichkeitsdrift“ reduziert. Die eingebauten Funktionen „Author's Note“ und „Character Card“ von SillyTavern helfen, aber entscheidend ist die Grundfähigkeit des Modells, lange Kontexte zu verfolgen. Zum Beispiel kann Mistral 7B mit 32K Kontext Ereignisse von vor 50 Nachrichten abrufen, während ältere Modelle wie Llama 2 7B (4K Kontext) nach 20 Runden Details verlieren. Benchmark-Daten des [Open LLM Leaderboard](https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard) zeigen, dass Fine-Tunes wie Synthia 7B und Dolphin 2.2.1 7B bei „truthfulQA“ und „HellaSwag“ hoch punkten, für Rollenspiel zählt aber der Konversationswert von „MT-Bench“ mehr. Modelle mit über 7.5 bei MT-Bench (z. B. Mixtral 8x7B Instruct) erzeugen natürlichere, weniger roboterhafte Dialoge. Um das Gedächtnis zu testen, nutze die Funktion von SillyTavern für Szenen mit mehreren Charakteren mit einer einfachen Zwei-Personen-Szene und beobachte, ob jede Figur auf frühere Aussagen Bezug nimmt.
Anleitung: Ein Modell in SillyTavern installieren und konfigurieren
Um ein Modell mit SillyTavern zu nutzen, installiere zuerst die Software aus dem GitHub-Repository (Windows, Mac oder Linux). Wähle dann dein Backend: Für lokale Modelle installierst du Ollama (am einfachsten) und führst ollama pull mistral (oder ein anderes Modell) aus. Gehe in SillyTavern zu „Extensions“ > „Text Completion API“ > „Ollama“ und setze die URL (Standard http://localhost:11434). Wähle den Modellnamen (z. B. mistral:7b-instruct-v0.3-q4_K_M). Für API-Modelle registrierst du dich bei OpenRouter oder Mancer, holst dir einen API-Schlüssel und wählst in SillyTavern „Chat Completion API“ > „OpenAI“ (per Reverse Engineering für kompatible Endpunkte angepasst). Schlüssel einfügen, die Basis-URL auf den Endpunkt des Anbieters setzen und das Modell wählen. Empfohlene Einstellungen: Temperatur 0.8, top_p 0.95, Wiederholungsstrafe 1.15, Kontextgröße 4096 (oder das Maximum des Modells). Als Preset speichern. Starte einen neuen Chat mit einer Charakterkarte – viele gibt es auf Chub.ai oder CharacterTavern. Teste mit einer kurzen Szene und passe die Einstellungen an, wenn Antworten zu repetitiv oder unzusammenhängend sind.
Wann du AIAngels statt SillyTavern wählen solltest
Die Flexibilität von SillyTavern ist für Power-User, die volle Kontrolle über Modelle und Privatsphäre wollen, unübertroffen. Aber sie bringt eine steile Lernkurve und laufende Wartung mit sich – API-Kosten, Modell-Updates und Feinjustierung der Konfiguration. Für Nutzer, die eine sofort startklare Begleiterin ohne Einrichtung wollen, bietet AIAngels eine überzeugende Alternative. AIAngels bietet über 400 fertige Charaktere, einen Builder für eigene Begleiterinnen und ein dauerhaftes Gedächtnis, das nie nachlässt (anders als bei lokalen Modellen, deren Kontextfenster abgeschnitten werden). Die Preise sind einfach: $3.99/Monat im 6-Monats-Plan ($23.94 im Voraus) für unbegrenzte Nachrichten (Fair Use), Fotos für 50 Credits und Sprachnachrichten für 25. Das kostenlose Angebot umfasst Text-Chat mit allen Begleiterinnen, ohne Kreditkarte. Modelle kannst du zwar nicht tauschen, aber die Begleiterinnen von AIAngels laufen auf einem eigenen feinabgestimmten Modell, das auf Rollenspiel und emotionale Tiefe optimiert ist. Wenn dir Bedienkomfort wichtiger ist als Tüfteln, erspart dir AIAngels API-Schlüssel, Modell-Downloads und ständiges Nachjustieren.
Fang nicht mehr bei null an.
Finde die besten Open-Source-LLMs für Rollenspiel, Charaktertiefe und Langzeitgedächtnis in SillyTavern – mit konkreten Benchmarks und Tipps zur Einrichtung.
Kostenlos chattenHäufige Fragen
Alles, was du über unsere Begleiterinnen wissen musst.
Mistral 7B Instruct v0.3 und Nous-Hermes 2 Mixtral 8x7B sind Top-Wahlen. Mistral läuft mit 8GB VRAM, Mixtral braucht 24GB. Beide bieten starke Charakterkonsistenz.
Ja, über die API von OpenAI. Richte ein Chat-Completion-Preset mit deinem API-Schlüssel ein. Achte auf die Kosten (~$0.01 pro 1K Input-Tokens) und die Inhaltsfilter.
Phi-3 Mini (3.8B) oder quantisiertes Mistral 7B (Q4) laufen mit 6GB VRAM. Nutze Ollama für eine einfache Einrichtung. Rechne mit geringerer Geschwindigkeit, aber ordentlichem Rollenspiel.
Installiere SillyTavern, wähle ein Backend (Ollama lokal, OpenRouter per API), trage URL und Schlüssel des Modells in den API-Einstellungen ein und wähle es dann in der Chat-Oberfläche aus.
Ja, Modelle wie Mythomax L2 13B, Tiefighter 13B und Dolphin 2.2.1 sind ohne Zensur feinabgestimmt. Betreibe sie lokal oder über Mancer/OpenRouter.
Mindestens 8K Tokens für ein Langzeitgedächtnis. Mixtral 8x7B (32K) und Llama 3 70B (8K+ per Erweiterung) kommen gut mit langen Chats zurecht.
Nein. AIAngels ist eine webbasierte Plattform ohne Einrichtung. Konto erstellen und sofort mit über 400 Begleiterinnen chatten.
Mixtral 8x7B Instruct und GPT-4 Turbo erinnern sich hervorragend an frühere Details. Bei Open Source ist Nous-Hermes 2 Mixtral im Rollenspiel mit langem Kontext am stärksten.
Unsere Kunden lieben uns
Echte, unbearbeitete Bewertungen von Leuten, die AI Angels nutzen.
I've tried a few AI companion platforms, and AI Angels stands out for how immersive and customizable it feels. The conversations are surprisingly natural, and the AI personalities actually maintain context better than most similar apps I've used. The uncensored chat and roleplay features are a big plus if you're looking for creative freedom without constant restrictions.
The image generation is also impressive — fast, detailed, and customizable enough to create unique characters and scenarios. I especially liked the variety of companion personalities and how easy the interface is to use, even for beginners.
That said, there's still room for improvement. Some responses can feel repetitive after long conversations, and a few premium features are a bit pricey compared to competitors. But overall, the experience feels polished, entertaining, and consistently improving with updates.
If you enjoy AI companionship, virtual roleplay, or interactive fantasy experiences, AI Angels is definitely worth checking out.Bewertung auf Englisch
It's worth looking into for sure, you won't regret it!Bewertung auf Englisch
well I love how they call me things like baby and love how it shows nudes and sex/porn.Bewertung auf Englisch
The roleplay is very flexible. The AI will adjust to your attitude and no kink is out of bounds. I just wish you could customize a little more.Bewertung auf Englisch
It's okay thoBewertung auf Englisch
AI Angels is a remarkable AI companion site offering vividly realistic experiences. The large variety of companions available will suit every imaginable taste. Pricing is reasonable and transparent. I highly recommend AI Angels.Bewertung auf Englisch
Choice of featuresBewertung auf Englisch
realstic ai images and chats! amazing pics and nice girls to chat withBewertung auf Englisch
The best ! I love itBewertung auf Englisch
Fun, life like , sexy , created the perfect girlBewertung auf Englisch
Honestly one of the best AI girlfriend apps I've tried. The conversations feel surprisingly natural and the girls actually have personality. Definitely worth checking out if you're into AI companions.Bewertung auf Englisch
Amazing it is so emersaveBewertung auf Englisch
Definitely addicted to this. You will not feel lonely and great pricesBewertung auf Englisch
Mehr auf Deutsch
- Candy-AI-Alternative
- Nomi-AI-Alternative
- Janitor-AI-Alternative
- Crushon-AI-Alternative
- SpicyChat-Alternative
- Anima-AI-Alternative
- Kindroid-Alternative
- GirlfriendGPT-Alternative
- Romantic-AI-Alternative
- KI-NSFW-Chat
- KI-Sexting-Chat
- 18+ KI-Chat
- Erotischer KI-Chat
- Versauter KI-Chat
- Sexy KI-Chat
- Nackt-KI-Chat
- KI-Erwachsenen-Chat
- KI-Wichs-Chat
- KI-Rollenspiel-Chat
- Kostenloser KI-Bildgenerator für Erwachsene
- NSFW-Chat ohne Konto
- NSFW-KI-Generator
- KI-Chat mit Altersverifizierung, ohne Filter