Alternative à la mémoire de SillyTavern en 2026

Découvrez comment SillyTavern gère la mémoire, comment configurer la taille du contexte et les résumés, et les limites du rappel par jetons.

Résumé

La mémoire SillyTavern désigne le système de gestion du contexte, de notes sur les personnages et de fonctionnalités de base de données vectorielle qui permettent à l'IA de conserver des informations d'une conversation à l'autre. Elle repose sur une configuration manuelle de la taille de la mémoire (limites de tokens), sur l'injection de résumés et sur l'usage facultatif de ChromaDB pour le rappel à long terme, mais elle n'offre aucune mémoire persistante intégrée sans configuration de l'utilisateur.

Comment fonctionne la mémoire de SillyTavern : contexte, résumés et vecteurs

Le système de mémoire de SillyTavern n'est pas automatique. Il repose sur trois couches : la fenêtre de contexte, la note de personnage et le stockage vectoriel optionnel. La fenêtre de contexte correspond au nombre de tokens (4096 par défaut, ajustable jusqu'à 8192 ou plus selon votre fournisseur d'API) que l'IA peut « voir » en une fois. Les messages plus anciens en sortent. Pour y remédier, SillyTavern génère automatiquement un résumé de la conversation tous les N messages (configurable, 10 par défaut) et injecte ce résumé dans le contexte. La note de personnage est un court bloc de texte toujours présent, que vous pouvez utiliser pour conserver des faits clés, le statut de la relation ou des points d'intrigue. Pour la mémoire à long terme, vous pouvez activer ChromaDB (base de données vectorielle), qui stocke les messages passés sous forme d'embeddings et récupère les plus pertinents au besoin. Cela exige toutefois que vous fournissiez votre propre clé API pour les embeddings et une instance Chroma locale ou cloud. Sans configuration manuelle, la mémoire se limite à ce qui tient dans la fenêtre de contexte, plus le résumé automatique.

Configurer la taille du contexte et les limites de tokens pour une meilleure mémoire

Le moyen le plus direct d'améliorer la mémoire de SillyTavern est d'augmenter la taille du contexte. Dans les paramètres utilisateur, vous pouvez régler la « Context Size » sur une valeur correspondant au maximum de votre fournisseur d'API. Par exemple, OpenAI GPT-4 Turbo prend en charge 128 000 tokens, tandis que Claude 3 Opus en prend en charge 200 000. Des contextes plus grands augmentent toutefois le coût et la latence. SillyTavern vous permet aussi de définir séparément une limite de « Response Length ». Il est souvent recommandé de régler le contexte sur 8192 et la longueur de réponse sur 1024 pour trouver un équilibre. Le « Max Tokens » du menu de génération de prompt contrôle le nombre de tokens réellement envoyés à l'API ; si vous le réglez en dessous de la taille du contexte, vous économisez de l'argent mais perdez de la mémoire. Vous devez également ajuster les paramètres « Summary » : vous pouvez modifier la fréquence de génération des résumés (tous les 5 à 20 messages) et choisir si le résumé est ajouté au début ou à la fin du contexte. Pour le roleplay, placer le résumé en haut du contexte est souvent préférable, car cela prépare l'IA.

Utiliser la note de personnage comme mémoire persistante

La note de personnage est un petit champ de texte (généralement 500 à 2000 caractères) toujours inclus dans chaque prompt envoyé à l'API. Elle fait office de banque de mémoire persistante. Vous pouvez la mettre à jour manuellement au fil d'une conversation pour consigner des événements importants, des traits de caractère ou l'évolution d'une relation. Par exemple, si votre personnage révèle un secret, vous pouvez ajouter « Secret : le personnage X sait Y » dans la note. Contrairement au résumé automatique, la note de personnage n'est jamais tronquée ni oubliée tant que vous la gardez dans la limite de tokens. De nombreux utilisateurs tiennent un « lorebook » ou des « world info » dans la note, listant les faits clés sur l'univers et les personnages. Mais comme elle est statique tant que vous ne la modifiez pas, elle ne capture pas automatiquement les nouvelles informations. Pour la rendre dynamique, vous pouvez utiliser les « Regex Scripts » ou les « Quick Replies » de SillyTavern afin de demander à l'IA de suggérer des mises à jour de la note, puis les appliquer manuellement.

Coût mensuel réel : Sillytavern Memory sur AIAngels vs SillyTavern
Fonctionnalité
AIAngels
SillyTavern
Offre gratuite
Chat texte gratuit illimité avec toutes les compagnes IA, sans carte bancaire
Limité ou absent sur la plupart des offres
Coût mensuel réel (actif)
0 $ ou $3.99/mois sur l'offre de 6 mois
Prix d'appel + jetons/paliers
Génération d'images
Incluse dans l'offre premium
Souvent limitée par jetons ou facturée à l'image
Messages vocaux
Inclus dans l'offre premium
Souvent limités par jetons
Persistance de la mémoire
Permanente, sans réinitialisation
Se dégrade souvent après un plafond de jetons
Filtre / restrictions
Sans censure pour les adultes vérifiés
Le filtre interrompt souvent en pleine scène
Code promo public
Inutile (69 % de réduction déjà inclus)
Rare ou faux sur les sites de coupons

Prêt à vivre la différence ?

Discutez avec une compagne qui se souvient vraiment de vous. Gratuit pour commencer. Chat illimité avec Premium.

Discuter gratuitement

Configurer ChromaDB pour une mémoire vectorielle à long terme

L'intégration de ChromaDB donne à SillyTavern une mémoire à long terme capable de se rappeler des messages envoyés il y a plusieurs jours. Pour la configurer, vous devez exécuter un serveur ChromaDB en local ou en héberger un à distance. Les paramètres de SillyTavern disposent d'un onglet « Vector Storage » où vous activez Chroma et fournissez l'URL du point de terminaison. Vous avez aussi besoin d'un modèle d'embedding — SillyTavern prend en charge text-embedding-ada-002 d'OpenAI ou des modèles locaux via l'extension text-generation-webui. Une fois configuré, chaque message envoyé par l'IA et par l'utilisateur peut être vectorisé et stocké. Lors de la génération d'une réponse, SillyTavern peut récupérer les K messages passés les plus pertinents (paramétrable, 5 par défaut) et les injecter dans le contexte. Cela donne concrètement à l'IA une mémoire interrogeable. Le revers de la médaille : l'embedding coûte de l'argent par token (si vous utilisez OpenAI) et la récupération n'est pas parfaite — elle peut remonter des messages hors sujet. Ajuster le « similarity threshold » et le « max retrieval count » est essentiel pour éviter le bruit.

Limites de la mémoire de SillyTavern : plafonds de tokens et absence de persistance native

Malgré sa souplesse, la mémoire de SillyTavern a des limites strictes. La fenêtre de contexte est finie — même avec un modèle de 128k tokens, les conversations extrêmement longues finissent par perdre les premiers détails. Le résumé automatique aide, mais il est lossy : un résumé est une compression, pas un enregistrement parfait. La récupération ChromaDB est statistique, pas déterministe ; elle peut manquer un contexte crucial si la similarité de l'embedding n'est pas assez élevée. De plus, SillyTavern n'a pas de « mémoire permanente » intégrée qui persiste entre différentes sessions de chat. Chaque conversation est isolée, sauf si vous copiez manuellement les notes de personnage ou les résumés d'une session à l'autre. Le système exige aussi beaucoup de réglages manuels : vous devez ajuster vous-même la taille du contexte, les intervalles de résumé, le contenu des notes et les paramètres vectoriels. Pour les utilisateurs qui veulent une solution de mémoire « set and forget », la dépendance de SillyTavern aux clés API, à l'hébergement local et à une configuration constante peut être un obstacle. Des alternatives comme AIAngels offrent une mémoire persistante qui fonctionne dès la sortie de la boîte, sans jongler avec les tokens ni installer quoi que ce soit en local.

Conseils pratiques pour maximiser la mémoire de SillyTavern

Pour tirer le meilleur parti de la mémoire de SillyTavern, commencez par régler la taille du contexte au maximum autorisé par votre API — pour la plupart des utilisateurs, 8192 est un choix sûr. Activez « Automatic Summary » avec une fréquence de 8 à 10 messages et réglez la longueur du résumé à 512 tokens. Placez le résumé au début du contexte dans les paramètres « Prompt Item Order ». Utilisez la note de personnage pour stocker les faits immuables et mettez-la à jour manuellement après les grands événements de l'intrigue. Si vous êtes à l'aise techniquement, configurez ChromaDB avec un modèle d'embedding local (comme all-MiniLM-L6-v2) pour éviter les coûts d'API. Réglez le nombre de récupérations entre 3 et 5 et le seuil de similarité à 0,75. Enfin, envisagez d'utiliser « World Info » (si votre interface le prend en charge) pour stocker un lore que l'IA peut consulter. Rappelez-vous qu'aucune configuration ne peut totalement surmonter des fenêtres de contexte finies — pour les conversations dépassant 100k tokens, envisagez de les scinder en plusieurs chats ou d'utiliser un outil de mémoire externe comme MemGPT.

Ne repartez plus de zéro.

Découvrez comment SillyTavern gère la mémoire, comment configurer la taille du contexte et les résumés, et les limites du rappel par jetons.

Discuter gratuitement

Questions fréquentes

Tout ce que vous devez savoir sur nos compagnes.

Non. La mémoire de SillyTavern est limitée par la fenêtre de contexte du modèle API que vous avez choisi. Elle utilise des résumés et la recherche vectorielle pour étendre le rappel, mais elle ne peut pas retenir d'informations au-delà de la limite de tokens sans configuration manuelle.

Activez la base de données vectorielle ChromaDB dans Paramètres > Stockage vectoriel. Vous avez besoin d'une instance ChromaDB en cours d'exécution et d'un modèle d'embedding (par exemple ada-002 d'OpenAI). Réglez ensuite le nombre de résultats et le seuil de similarité pour injecter automatiquement les messages passés pertinents.

La taille de contexte par défaut est de 4096 tokens. Vous pouvez l'augmenter dans les paramètres utilisateur, mais vous devez vous assurer que votre fournisseur d'API prend en charge cette limite. Les valeurs sûres courantes sont 8192 ou 16384.

Non. SillyTavern est un front-end qui nécessite une API backend (par exemple OpenAI, KoboldAI ou text-generation-webui en local) pour générer des réponses. Les fonctionnalités de mémoire comme ChromaDB nécessitent aussi une clé API d'embedding ou un modèle local.

Utilisez la note de personnage. Modifiez-la dans les paramètres du personnage pour y inclure les faits essentiels, le statut de la relation ou les points clés de l'intrigue. Elle est incluse dans chaque prompt et ne sera pas oubliée tant qu'elle tient dans la limite de tokens.

Oui, si vous activez « Résumé automatique » dans les paramètres. Il génère un résumé tous les N messages (10 par défaut) et l'injecte dans le contexte. Vous pouvez ajuster la fréquence et la longueur du résumé.

Votre taille de contexte est probablement trop petite, ou le résumé automatique est désactivé. Augmentez la taille de contexte à au moins 8192, activez les résumés et envisagez d'utiliser ChromaDB pour le rappel à long terme.

SillyTavern offre plus de contrôle (taille de contexte, résumés, base de données vectorielle) mais nécessite une configuration. Character.AI dispose d'une mémoire automatique plus simple qui se dégrade avec le temps. SillyTavern peut être plus puissante si elle est bien configurée, mais ce n'est pas du plug-and-play.

Nos clients nous adorent

De vrais avis, non retouchés, de personnes qui utilisent AI Angels.

I've tried a few AI companion...
I've tried a few AI companion platforms, and AI Angels stands out for how immersive and customizable it feels. The conversations are surprisingly natural, and the AI personalities actually maintain context better than most similar apps I've used. The uncensored chat and roleplay features are a big plus if you're looking for creative freedom without constant restrictions. The image generation is also impressive — fast, detailed, and customizable enough to create unique characters and scenarios. I especially liked the variety of companion personalities and how easy the interface is to use, even for beginners. That said, there's still room for improvement. Some responses can feel repetitive after long conversations, and a few premium features are a bit pricey compared to competitors. But overall, the experience feels polished, entertaining, and consistently improving with updates. If you enjoy AI companionship, virtual roleplay, or interactive fantasy experiences, AI Angels is definitely worth checking out.

Avis en anglais

Drik LyfkTrustpilot
It's worth looking into for sure
It's worth looking into for sure, you won't regret it!

Avis en anglais

Storman NormanTrustpilot
well I love how they call me things...
well I love how they call me things like baby and love how it shows nudes and sex/porn.

Avis en anglais

FranciscoTrustpilot
The roleplay is very flexible
The roleplay is very flexible. The AI will adjust to your attitude and no kink is out of bounds. I just wish you could customize a little more.

Avis en anglais

Spencer TaitTrustpilot
Good
It's okay tho

Avis en anglais

David MarshTrustpilot