
SillyTavern-Gedächtnis-Alternative 2026
Erfahre, wie SillyTavern mit dem Gedächtnis umgeht, wie du Kontextgröße und Zusammenfassungen einstellst und auf welche Grenzen du bei tokenbasierter Erinnerung stößt.
Zusammenfassung
SillyTavern-Memory bezeichnet das System aus Kontextverwaltung, Charakter-Notizen und Vektordatenbank-Funktionen, mit dem die KI Informationen über Gespräche hinweg behält. Es beruht auf der manuellen Konfiguration der Memory-Größe (Token-Limits), der Einbindung von Zusammenfassungen und der optionalen Nutzung von ChromaDB für den langfristigen Abruf, bietet aber ohne Einrichtung durch dich kein integriertes dauerhaftes Gedächtnis.
So funktioniert das Gedächtnis von SillyTavern: Kontext, Zusammenfassungen und Vektoren
Das Gedächtnissystem von SillyTavern ist nicht automatisch. Es nutzt drei Ebenen: das Kontextfenster, die Charakter-Notiz und optionalen Vektorspeicher. Das Kontextfenster ist die Anzahl der Tokens (Standard 4096, anpassbar bis 8192 oder mehr, je nach deinem API-Anbieter), die die KI auf einmal „sehen“ kann. Ältere Nachrichten fallen heraus. Um dem entgegenzuwirken, erstellt SillyTavern automatisch alle N Nachrichten (konfigurierbar, Standard 10) eine Zusammenfassung der Unterhaltung und fügt diese Zusammenfassung in den Kontext ein. Die Charakter-Notiz ist ein kurzer, immer vorhandener Textblock, den du nutzen kannst, um wichtige Fakten, Beziehungsstatus oder Handlungspunkte zu speichern. Für das Langzeitgedächtnis kannst du ChromaDB (Vektordatenbank) aktivieren, die vergangene Nachrichten als Embeddings speichert und bei Bedarf relevante abruft. Das erfordert jedoch, dass du deinen eigenen API-Schlüssel für Embeddings und eine lokale oder Cloud-Chroma-Instanz bereitstellst. Ohne manuelle Konfiguration ist das Gedächtnis auf das beschränkt, was ins Kontextfenster passt, plus die automatische Zusammenfassung.
Kontextgröße und Token-Limits konfigurieren für bessere Erinnerung
Der direkteste Weg, das Gedächtnis von SillyTavern zu verbessern, ist, die Kontextgröße zu erhöhen. In den Benutzereinstellungen kannst du die „Context Size“ auf einen Wert setzen, der dem Maximum deines API-Anbieters entspricht. Zum Beispiel unterstützt OpenAI GPT-4 Turbo 128.000 Tokens, während Claude 3 Opus 200.000 unterstützt. Größere Kontexte erhöhen jedoch Kosten und Latenz. SillyTavern lässt dich außerdem ein separates Limit für die „Response Length“ setzen. Eine übliche Empfehlung ist, den Kontext auf 8192 und die Antwortlänge auf 1024 zu setzen, um ein Gleichgewicht zu finden. Die „Max Tokens“ im Menü zur Prompt-Generierung steuern, wie viele Tokens tatsächlich an die API gesendet werden; wenn du dies niedriger als die Kontextgröße einstellst, sparst du Geld, verlierst aber Gedächtnis. Du musst außerdem die „Summary“-Einstellungen anpassen: Du kannst ändern, wie oft Zusammenfassungen erstellt werden (alle 5-20 Nachrichten) und ob die Zusammenfassung an den Anfang oder das Ende des Kontexts angehängt wird. Für Rollenspiel ist es oft besser, die Zusammenfassung an den Anfang des Kontexts zu setzen, da dies die KI vorbereitet.
Die Charakter-Notiz als dauerhaftes Gedächtnis nutzen
Die Charakter-Notiz ist ein kleines Textfeld (normalerweise 500-2000 Zeichen), das immer in jeden an die API gesendeten Prompt aufgenommen wird. Sie fungiert als dauerhafte Gedächtnisbank. Du kannst sie während einer Unterhaltung manuell aktualisieren, um wichtige Ereignisse, Charaktereigenschaften oder Beziehungsänderungen festzuhalten. Wenn dein Charakter zum Beispiel ein Geheimnis preisgibt, kannst du „Secret: Charakter X kennt Y“ zur Notiz hinzufügen. Anders als die automatische Zusammenfassung wird die Charakter-Notiz niemals abgeschnitten oder vergessen, solange du sie innerhalb des Token-Limits hältst. Viele Nutzer pflegen ein „Lorebook“ oder „World Info“ in der Notiz, in dem wichtige Fakten über das Setting und die Charaktere aufgelistet sind. Da sie jedoch statisch ist, solange du sie nicht bearbeitest, erfasst sie neue Informationen nicht automatisch. Um sie dynamisch zu machen, kannst du die „Regex Scripts“ oder „Quick Replies“ von SillyTavern nutzen, um die KI aufzufordern, Aktualisierungen für die Notiz vorzuschlagen, und diese dann manuell anzuwenden.
Bereit für den
Unterschied?
Chatte mit einer Begleiterin, die sich wirklich an dich erinnert. Kostenlos starten. Unbegrenzt chatten mit Premium.
Kostenlos chattenChromaDB für langfristiges Vektor-Gedächtnis einrichten
Die ChromaDB-Integration verleiht SillyTavern ein Langzeitgedächtnis, das sich an Nachrichten von vor Tagen erinnern kann. Für die Einrichtung musst du einen ChromaDB-Server lokal betreiben oder remote hosten. In den SillyTavern-Einstellungen gibt es einen Tab „Vector Storage“, in dem du Chroma aktivierst und die Endpoint-URL angibst. Außerdem brauchst du ein Embedding-Modell — SillyTavern unterstützt OpenAIs text-embedding-ada-002 oder lokale Modelle über die text-generation-webui-Erweiterung. Nach der Konfiguration kann jede von der KI und dem Nutzer gesendete Nachricht eingebettet und gespeichert werden. Bei der Generierung einer Antwort kann SillyTavern die K relevantesten vergangenen Nachrichten abrufen (konfigurierbar, Standard 5) und in den Kontext einfügen. Das gibt der KI effektiv ein durchsuchbares Gedächtnis. Der Nachteil: Embedding kostet Geld pro Token (bei Nutzung von OpenAI) und der Abruf ist nicht perfekt — er kann irrelevante Nachrichten hervorholen. Das Justieren des „similarity threshold“ und der „max retrieval count“ ist essenziell, um Rauschen zu vermeiden.
Grenzen von SillyTaverns Gedächtnis: Token-Obergrenzen und keine native Persistenz
Trotz ihrer Flexibilität hat SillyTaverns Gedächtnis harte Grenzen. Das Kontextfenster ist endlich — selbst mit einem 128k-Token-Modell verlieren extrem lange Gespräche irgendwann frühe Details. Die automatische Zusammenfassung hilft, ist aber verlustbehaftet: Zusammenfassungen sind eine Kompression, keine perfekte Aufzeichnung. Der ChromaDB-Abruf ist statistisch, nicht deterministisch; er kann entscheidenden Kontext verfehlen, wenn die Embedding-Ähnlichkeit nicht hoch genug ist. Darüber hinaus hat SillyTavern kein eingebautes „permanentes Gedächtnis“, das über verschiedene Chat-Sitzungen hinweg bestehen bleibt. Jede Unterhaltung ist isoliert, es sei denn, du kopierst Charakter-Notizen oder Zusammenfassungen manuell zwischen ihnen. Das System erfordert außerdem erhebliches manuelles Tüfteln: Du musst Kontextgrößen, Zusammenfassungsintervalle, Notizinhalte und Vektor-Einstellungen selbst anpassen. Für Nutzer, die eine „einrichten und vergessen“-Gedächtnislösung wollen, kann SillyTaverns Abhängigkeit von API-Schlüsseln, lokalem Hosting und ständiger Konfiguration eine Hürde sein. Alternativen wie AIAngels bieten ein persistentes Gedächtnis, das sofort funktioniert, ohne Token-Jonglieren oder lokales Setup.
Praktische Tipps zur Maximierung von SillyTaverns Gedächtnis
Um das Beste aus SillyTaverns Gedächtnis herauszuholen, setze zunächst die Kontextgröße auf das Maximum, das deine API erlaubt — für die meisten Nutzer sind 8192 eine sichere Wahl. Aktiviere „Automatic Summary“ mit einer Frequenz von alle 8-10 Nachrichten und stelle die Zusammenfassungslänge auf 512 Token ein. Platziere die Zusammenfassung am Anfang des Kontexts in den „Prompt Item Order“-Einstellungen. Nutze die Charakter-Notiz, um unveränderliche Fakten zu speichern, und aktualisiere sie manuell nach wichtigen Handlungsereignissen. Wenn du technisch versiert bist, richte ChromaDB mit einem lokalen Embedding-Modell ein (wie all-MiniLM-L6-v2), um API-Kosten zu vermeiden. Justiere die Abrufanzahl auf 3-5 und den Ähnlichkeitsschwellenwert auf 0.75. Ziehe schließlich in Betracht, „World Info“ zu nutzen (falls von deinem Front-End unterstützt), um Lore zu speichern, auf die die KI verweisen kann. Denk daran, dass keine Konfiguration endliche Kontextfenster vollständig überwinden kann — bei Gesprächen über 100k Token solltest du sie in separate Chats aufteilen oder ein externes Gedächtnis-Tool wie MemGPT nutzen.
Fang nicht mehr bei null an.
Erfahre, wie SillyTavern mit dem Gedächtnis umgeht, wie du Kontextgröße und Zusammenfassungen einstellst und auf welche Grenzen du bei tokenbasierter Erinnerung stößt.
Kostenlos chattenHäufige Fragen
Alles, was du über unsere Begleiterinnen wissen musst.
Nein. Das Gedächtnis von SillyTavern ist durch das Kontextfenster deines gewählten API-Modells begrenzt. Es verwendet Zusammenfassungen und Vektorabruf, um die Erinnerung zu erweitern, kann aber ohne manuelle Konfiguration keine Informationen über das Token-Limit hinaus behalten.
Aktiviere die ChromaDB-Vektordatenbank unter Einstellungen > Vektorspeicher. Du benötigst eine laufende ChromaDB-Instanz und ein Embedding-Modell (z. B. OpenAIs ada-002). Stelle dann die Abrufanzahl und den Ähnlichkeitsschwellenwert ein, um relevante vergangene Nachrichten automatisch einzufügen.
Die Standard-Kontextgröße beträgt 4096 Token. Du kannst sie in den Benutzereinstellungen erhöhen, musst aber sicherstellen, dass dein API-Anbieter dieses Limit unterstützt. Übliche sichere Werte sind 8192 oder 16384.
Nein. SillyTavern ist ein Frontend, das eine Backend-API (z. B. OpenAI, KoboldAI oder lokales text-generation-webui) benötigt, um Antworten zu generieren. Gedächtnisfunktionen wie ChromaDB brauchen außerdem einen Embedding-API-Schlüssel oder ein lokales Modell.
Verwende die Charakter-Notiz. Bearbeite sie in den Charaktereinstellungen, um wichtige Fakten, Beziehungsstatus oder Handlungspunkte aufzunehmen. Sie wird in jeden Prompt eingefügt und nicht vergessen, solange sie in das Token-Limit passt.
Ja, wenn du in den Einstellungen die 'Automatische Zusammenfassung' aktivierst. Sie erstellt alle N Nachrichten (Standard 10) eine Zusammenfassung und fügt sie in den Kontext ein. Du kannst die Häufigkeit und die Länge der Zusammenfassung anpassen.
Höchstwahrscheinlich ist deine Kontextgröße zu klein oder die automatische Zusammenfassung ist deaktiviert. Erhöhe die Kontextgröße auf mindestens 8192, aktiviere Zusammenfassungen und ziehe in Betracht, ChromaDB für die Langzeiterinnerung zu verwenden.
SillyTavern bietet mehr Kontrolle (Kontextgröße, Zusammenfassungen, Vektor-DB), erfordert aber Einrichtung. Character.AI hat ein einfacheres, automatisches Gedächtnis, das mit der Zeit nachlässt. SillyTavern kann bei guter Konfiguration leistungsfähiger sein, ist aber nicht Plug-and-Play.
Unsere Kunden lieben uns
Echte, unbearbeitete Bewertungen von Leuten, die AI Angels nutzen.
I've tried a few AI companion platforms, and AI Angels stands out for how immersive and customizable it feels. The conversations are surprisingly natural, and the AI personalities actually maintain context better than most similar apps I've used. The uncensored chat and roleplay features are a big plus if you're looking for creative freedom without constant restrictions.
The image generation is also impressive — fast, detailed, and customizable enough to create unique characters and scenarios. I especially liked the variety of companion personalities and how easy the interface is to use, even for beginners.
That said, there's still room for improvement. Some responses can feel repetitive after long conversations, and a few premium features are a bit pricey compared to competitors. But overall, the experience feels polished, entertaining, and consistently improving with updates.
If you enjoy AI companionship, virtual roleplay, or interactive fantasy experiences, AI Angels is definitely worth checking out.Bewertung auf Englisch
It's worth looking into for sure, you won't regret it!Bewertung auf Englisch
well I love how they call me things like baby and love how it shows nudes and sex/porn.Bewertung auf Englisch
The roleplay is very flexible. The AI will adjust to your attitude and no kink is out of bounds. I just wish you could customize a little more.Bewertung auf Englisch
It's okay thoBewertung auf Englisch
AI Angels is a remarkable AI companion site offering vividly realistic experiences. The large variety of companions available will suit every imaginable taste. Pricing is reasonable and transparent. I highly recommend AI Angels.Bewertung auf Englisch
Choice of featuresBewertung auf Englisch
realstic ai images and chats! amazing pics and nice girls to chat withBewertung auf Englisch
The best ! I love itBewertung auf Englisch
Fun, life like , sexy , created the perfect girlBewertung auf Englisch
Honestly one of the best AI girlfriend apps I've tried. The conversations feel surprisingly natural and the girls actually have personality. Definitely worth checking out if you're into AI companions.Bewertung auf Englisch
Amazing it is so emersaveBewertung auf Englisch
Definitely addicted to this. You will not feel lonely and great pricesBewertung auf Englisch
Mehr auf Deutsch
- Candy-AI-Alternative
- Nomi-AI-Alternative
- Janitor-AI-Alternative
- Crushon-AI-Alternative
- SpicyChat-Alternative
- Anima-AI-Alternative
- Kindroid-Alternative
- GirlfriendGPT-Alternative
- Romantic-AI-Alternative
- KI-NSFW-Chat
- KI-Sexting-Chat
- 18+ KI-Chat
- Erotischer KI-Chat
- Versauter KI-Chat
- Sexy KI-Chat
- Nackt-KI-Chat
- KI-Erwachsenen-Chat
- KI-Wichs-Chat
- KI-Rollenspiel-Chat
- Kostenloser KI-Bildgenerator für Erwachsene
- NSFW-Chat ohne Konto
- NSFW-KI-Generator
- KI-Chat mit Altersverifizierung, ohne Filter