2026 में SillyTavern मेमोरी का विकल्प

जानें कि SillyTavern मेमोरी को कैसे संभालता है, कॉन्टेक्स्ट साइज़ और सारांश कैसे कॉन्फ़िगर करें, और टोकन-आधारित रिकॉल में आपको किन सीमाओं का सामना करना पड़ेगा।

सारांश

SillyTavern मेमोरी का मतलब है कॉन्टेक्स्ट मैनेजमेंट, कैरेक्टर नोट्स और वेक्टर डेटाबेस फीचर्स का सिस्टम, जिससे AI बातचीत के दौरान जानकारी याद रख पाता है। इसमें मेमोरी साइज़ (टोकन लिमिट) सेट करना, समरी इंजेक्शन और लंबे समय तक याद रखने के लिए ChromaDB का ऑप्शनल इस्तेमाल मैन्युअली कॉन्फ़िगर करना पड़ता है, लेकिन बिना यूज़र सेटअप के इसकी कोई बिल्ट-इन पर्सिस्टेंट मेमोरी नहीं है।

SillyTavern मेमोरी कैसे काम करती है: कॉन्टेक्स्ट, सारांश और वेक्टर

SillyTavern की मेमोरी सिस्टम अपने आप काम नहीं करती। यह तीन परतों का उपयोग करती है: कॉन्टेक्स्ट विंडो, कैरेक्टर नोट, और ऑप्शनल वेक्टर स्टोरेज। कॉन्टेक्स्ट विंडो वह टोकन संख्या है (डिफ़ॉल्ट 4096, आपके API प्रोवाइडर के अनुसार 8192 या उससे ज़्यादा तक बढ़ाई जा सकती है) जिसे AI एक बार में 'देख' सकती है। पुराने मैसेज बाहर हो जाते हैं। इससे निपटने के लिए, SillyTavern हर N मैसेज पर अपने आप बातचीत का सारांश बनाती है (कॉन्फ़िगर करने योग्य, डिफ़ॉल्ट 10) और उस सारांश को कॉन्टेक्स्ट में डाल देती है। कैरेक्टर नोट एक छोटा, हमेशा मौजूद टेक्स्ट ब्लॉक है जिसका उपयोग आप मुख्य तथ्य, रिलेशनशिप स्टेटस या प्लॉट पॉइंट स्टोर करने के लिए कर सकते हैं। लॉन्ग-टर्म मेमोरी के लिए, आप ChromaDB (वेक्टर डेटाबेस) चालू कर सकते हैं जो पुराने मैसेज को एम्बेडिंग के रूप में स्टोर करता है और ज़रूरत पड़ने पर प्रासंगिक वाले निकाल लाता है। हालांकि, इसके लिए आपको एम्बेडिंग के लिए अपनी खुद की API key और एक लोकल या क्लाउड Chroma इंस्टेंस देना होगा। मैन्युअल कॉन्फ़िगरेशन के बिना, मेमोरी उतनी ही सीमित है जितनी कॉन्टेक्स्ट विंडो में फिट होती है, साथ में ऑटोमैटिक सारांश।

बेहतर रिकॉल के लिए कॉन्टेक्स्ट साइज़ और टोकन सीमाएं सेट करना

SillyTavern मेमोरी सुधारने का सबसे सीधा तरीका कॉन्टेक्स्ट साइज़ बढ़ाना है। यूज़र सेटिंग्स में, आप 'Context Size' को अपने API प्रोवाइडर की अधिकतम सीमा के अनुसार सेट कर सकते हैं। उदाहरण के लिए, OpenAI GPT-4 Turbo 128,000 टोकन सपोर्ट करता है, जबकि Claude 3 Opus 200,000। हालांकि, बड़े कॉन्टेक्स्ट से लागत और लेटेंसी बढ़ती है। SillyTavern आपको 'Response Length' की सीमा अलग से सेट करने देती है। एक आम सलाह है कि संतुलन के लिए कॉन्टेक्स्ट 8192 और रिस्पॉन्स लेंथ 1024 रखें। प्रॉम्प्ट जनरेशन मेन्यू में 'Max Tokens' तय करता है कि API को असल में कितने टोकन भेजे जाएं; अगर आप इसे कॉन्टेक्स्ट साइज़ से कम रखते हैं, तो पैसे बचते हैं पर मेमोरी चली जाती है। आपको 'Summary' सेटिंग्स भी एडजस्ट करनी होंगी: आप बदल सकते हैं कि सारांश कितनी बार बनें (हर 5-20 मैसेज पर) और सारांश कॉन्टेक्स्ट के शुरू में जुड़े या अंत में। रोलप्ले के लिए, सारांश को कॉन्टेक्स्ट के ऊपर रखना अक्सर बेहतर होता है, क्योंकि इससे AI तैयार हो जाती है।

कैरेक्टर नोट को स्थायी मेमोरी की तरह उपयोग करना

कैरेक्टर नोट एक छोटा टेक्स्ट फ़ील्ड है (आमतौर पर 500-2000 अक्षर) जो API को भेजे जाने वाले हर प्रॉम्प्ट में हमेशा शामिल होता है। यह एक स्थायी मेमोरी बैंक की तरह काम करता है। आप बातचीत के दौरान इसे मैन्युअली अपडेट कर सकते हैं ताकि ज़रूरी घटनाएं, कैरेक्टर के गुण या रिलेशनशिप में बदलाव रिकॉर्ड कर सकें। उदाहरण के लिए, अगर आपका कैरेक्टर कोई राज़ बताता है, तो आप नोट में 'Secret: character X knows Y' जोड़ सकते हैं। ऑटोमैटिक सारांश के विपरीत, कैरेक्टर नोट तब तक कभी कटता या भूलता नहीं जब तक आप इसे टोकन सीमा के अंदर रखते हैं। कई यूज़र नोट में एक 'lorebook' या 'world info' रखते हैं, जिसमें सेटिंग और कैरेक्टर के मुख्य तथ्य होते हैं। हालांकि, क्योंकि यह तब तक स्थिर रहता है जब तक आप इसे एडिट न करें, यह अपने आप नई जानकारी नहीं पकड़ता। इसे डायनामिक बनाने के लिए, आप SillyTavern के 'Regex Scripts' या 'Quick Replies' का उपयोग करके AI से नोट में अपडेट सुझाने को कह सकते हैं, फिर उन्हें मैन्युअली लागू कर सकते हैं।

असली मासिक लागत: AIAngels पर Sillytavern Memory बनाम SillyTavern
फ़ीचर
AIAngels
SillyTavern
फ्री टियर
सभी AI कंपैनियन के साथ अनलिमिटेड फ्री टेक्स्ट चैट, क्रेडिट कार्ड की ज़रूरत नहीं
ज़्यादातर प्लान पर सीमित या बिल्कुल नहीं
असली मासिक लागत (सक्रिय)
6 महीने के प्लान पर $0 या $3.99/महीना
हेडलाइन कीमत + टोकन/टियर
इमेज जनरेशन
प्रीमियम में शामिल
अक्सर टोकन-गेटेड या हर इमेज पर अलग शुल्क
वॉइस मैसेज
प्रीमियम में शामिल
अक्सर टोकन-गेटेड
मेमोरी बनी रहती है
स्थायी, कभी रीसेट नहीं होती
अक्सर टोकन कैप के बाद कमज़ोर पड़ जाती है
फ़िल्टर / पाबंदियाँ
वेरिफाइड वयस्कों के लिए बिना सेंसर
फ़िल्टर अक्सर सीन के बीच में टोक देता है
पब्लिक प्रोमो कोड
ज़रूरत नहीं (69% छूट पहले से शामिल)
कूपन साइटों पर दुर्लभ या फ़र्ज़ी

फर्क महसूस करने के लिए तैयार?

एक ऐसी साथी से चैट करें जो आपको सच में याद रखती है। मुफ़्त शुरू करें। Premium के साथ असीमित चैट।

मुफ़्त चैट करें

लॉन्ग-टर्म वेक्टर मेमोरी के लिए ChromaDB सेट करना

ChromaDB इंटीग्रेशन SillyTavern को लॉन्ग-टर्म मेमोरी देता है, जो कई दिन पुराने मैसेज भी याद रख सकती है। इसे सेट करने के लिए आपको ChromaDB सर्वर लोकली चलाना होगा या रिमोटली होस्ट करना होगा। SillyTavern की सेटिंग्स में 'Vector Storage' टैब होता है, जहाँ आप Chroma इनेबल करते हैं और endpoint URL देते हैं। आपको एक embedding मॉडल भी चाहिए — SillyTavern, OpenAI के text-embedding-ada-002 या text-generation-webui एक्सटेंशन के ज़रिए लोकल मॉडल्स को सपोर्ट करता है। एक बार कॉन्फ़िगर होने के बाद, AI और यूज़र द्वारा भेजा गया हर मैसेज embed और स्टोर किया जा सकता है। रिस्पॉन्स जनरेट करते समय, SillyTavern सबसे रेलेवेंट पिछले मैसेज के टॉप K (कॉन्फ़िगर करने योग्य, डिफ़ॉल्ट 5) निकालकर कॉन्टेक्स्ट में डाल सकता है। इससे असल में AI को एक सर्च करने लायक मेमोरी मिल जाती है। नुकसान यह है: embedding पर हर टोकन का खर्च आता है (अगर OpenAI इस्तेमाल कर रहे हैं) और रिट्रीवल परफ़ेक्ट नहीं होता — यह बेमतलब मैसेज भी निकाल सकता है। शोर से बचने के लिए 'similarity threshold' और 'max retrieval count' ट्यून करना ज़रूरी है।

SillyTavern मेमोरी की सीमाएँ: टोकन की छत और नेटिव पर्सिस्टेंस का अभाव

इतनी लचीलापन के बावजूद, SillyTavern की मेमोरी की कड़ी सीमाएँ हैं। कॉन्टेक्स्ट विंडो सीमित है — 128k टोकन मॉडल के साथ भी, बहुत लंबी बातचीत में शुरुआती डिटेल्स आख़िर में खो जाती हैं। ऑटोमैटिक सारांश मदद करता है पर लॉसी है: सारांश एक कम्प्रेशन है, परफ़ेक्ट रिकॉर्ड नहीं। ChromaDB रिट्रीवल स्टैटिस्टिकल है, डिटरमिनिस्टिक नहीं; अगर embedding similarity काफ़ी ऊँची नहीं है तो यह ज़रूरी कॉन्टेक्स्ट मिस कर सकता है। इसके अलावा, SillyTavern में ऐसी बिल्ट-इन 'permanent memory' नहीं है जो अलग-अलग chat सेशन्स में बनी रहे। हर बातचीत अलग-थलग है, जब तक आप खुद कैरेक्टर नोट्स या सारांश एक से दूसरे में कॉपी न करें। इस सिस्टम में काफ़ी मैन्युअल टिंकरिंग भी चाहिए: कॉन्टेक्स्ट साइज़, सारांश इंटरवल, नोट कंटेंट और वेक्टर सेटिंग्स खुद एडजस्ट करनी पड़ती हैं। जो यूज़र 'set and forget' मेमोरी सोल्यूशन चाहते हैं, उनके लिए SillyTavern की API keys, लोकल होस्टिंग और लगातार कॉन्फ़िगरेशन पर निर्भरता एक बाधा बन सकती है। AIAngels जैसे विकल्प persistent मेमोरी देते हैं जो बिना किसी सेटअप के काम करती है, न टोकन का झंझट और न लोकल सेटअप की ज़रूरत।

SillyTavern मेमोरी का अधिकतम फ़ायदा उठाने के व्यावहारिक टिप्स

SillyTavern की मेमोरी से भरपूर फ़ायदा उठाने के लिए, कॉन्टेक्स्ट साइज़ को अपने API की अधिकतम सीमा तक सेट करें — ज़्यादातर यूज़र्स के लिए 8192 सुरक्षित विकल्प है। 'Automatic Summary' को हर 8-10 मैसेज की फ्रीक्वेंसी पर इनेबल करें और सारांश की लंबाई 512 टोकन रखें। 'Prompt Item Order' सेटिंग्स में सारांश को कॉन्टेक्स्ट की शुरुआत में रखें। कैरेक्टर नोट का इस्तेमाल अपरिवर्तनीय तथ्यों को स्टोर करने के लिए करें और बड़े प्लॉट इवेंट्स के बाद उसे मैन्युअली अपडेट करें। अगर आप टेक-सेवी हैं, तो API खर्च से बचने के लिए लोकल embedding मॉडल (जैसे all-MiniLM-L6-v2) के साथ ChromaDB सेट करें। रिट्रीवल काउंट 3-5 और similarity threshold 0.75 पर ट्यून करें। आख़िर में, 'World Info' इस्तेमाल करने पर विचार करें (अगर आपका फ्रंट-एंड इसे सपोर्ट करता है) ताकि AI ज़रूरत पड़ने पर lore देख सके। याद रखें, सीमित कॉन्टेक्स्ट विंडो को कोई भी कॉन्फ़िगरेशन पूरी तरह नहीं हरा सकता — 100k टोकन से ज़्यादा की बातचीत के लिए, अलग-अलग chats में बाँटने या MemGPT जैसे बाहरी मेमोरी टूल का इस्तेमाल करने पर विचार करें।

अब शुरुआत से शुरू करना बंद करें।

जानें कि SillyTavern मेमोरी को कैसे संभालता है, कॉन्टेक्स्ट साइज़ और सारांश कैसे कॉन्फ़िगर करें, और टोकन-आधारित रिकॉल में आपको किन सीमाओं का सामना करना पड़ेगा।

मुफ़्त चैट करें

अक्सर पूछे जाने वाले सवाल

हमारी AI साथियों के बारे में वह सब जो आपको जानना चाहिए।

नहीं। SillyTavern मेमोरी आपके चुने हुए API मॉडल के कॉन्टेक्स्ट विंडो तक सीमित है। यह रिकॉल बढ़ाने के लिए सारांश और वेक्टर रिट्रीवल का उपयोग करती है, लेकिन मैन्युअल कॉन्फ़िगरेशन के बिना टोकन सीमा से आगे की जानकारी नहीं रख सकती।

Settings > Vector Storage में ChromaDB वेक्टर डेटाबेस चालू करें। आपको एक चल रहा ChromaDB इंस्टेंस और एक एम्बेडिंग मॉडल (जैसे OpenAI का ada-002) चाहिए। फिर retrieval count और similarity threshold सेट करें ताकि प्रासंगिक पुराने मैसेज अपने आप इंजेक्ट हो जाएँ।

डिफ़ॉल्ट कॉन्टेक्स्ट साइज़ 4096 टोकन है। आप इसे यूज़र सेटिंग्स में बढ़ा सकते हैं, लेकिन आपके API प्रोवाइडर को वह सीमा सपोर्ट करनी चाहिए। आम सुरक्षित मान 8192 या 16384 हैं।

नहीं। SillyTavern एक फ्रंट-एंड है जिसे जवाब जनरेट करने के लिए बैकएंड API (जैसे OpenAI, KoboldAI या लोकल text-generation-webui) चाहिए। ChromaDB जैसी मेमोरी फ़ीचर्स के लिए भी एम्बेडिंग API key या लोकल मॉडल चाहिए।

कैरेक्टर नोट का उपयोग करें। कैरेक्टर सेटिंग्स में इसे एडिट करके मुख्य तथ्य, रिलेशनशिप स्टेटस या प्लॉट पॉइंट्स डालें। यह हर प्रॉम्प्ट में शामिल होता है और जब तक टोकन सीमा में फ़िट हो, भूला नहीं जाएगा।

हाँ, अगर आप सेटिंग्स में 'Automatic Summary' चालू करें। यह हर N मैसेज (डिफ़ॉल्ट 10) पर सारांश बनाता है और उसे कॉन्टेक्स्ट में इंजेक्ट करता है। आप फ़्रीक्वेंसी और सारांश की लंबाई बदल सकते हैं।

सबसे संभावित कारण है कि आपका कॉन्टेक्स्ट साइज़ बहुत छोटा है, या automatic summary बंद है। कॉन्टेक्स्ट साइज़ कम से कम 8192 करें, सारांश चालू करें, और लॉन्ग-टर्म रिकॉल के लिए ChromaDB इस्तेमाल करने पर विचार करें।

SillyTavern ज़्यादा कंट्रोल देता है (कॉन्टेक्स्ट साइज़, सारांश, वेक्टर DB) लेकिन सेटअप चाहिए। Character.AI की मेमोरी सरल और अपने आप चलती है, पर समय के साथ कमज़ोर पड़ती जाती है। अच्छे से कॉन्फ़िगर करें तो SillyTavern ज़्यादा पावरफुल हो सकता है, लेकिन यह प्लग-एंड-प्ले नहीं है।

हमारे ग्राहक हमें पसंद करते हैं

AI Angels इस्तेमाल करने वालों के असली, बिना एडिट किए रिव्यू।

I've tried a few AI companion...
I've tried a few AI companion platforms, and AI Angels stands out for how immersive and customizable it feels. The conversations are surprisingly natural, and the AI personalities actually maintain context better than most similar apps I've used. The uncensored chat and roleplay features are a big plus if you're looking for creative freedom without constant restrictions. The image generation is also impressive — fast, detailed, and customizable enough to create unique characters and scenarios. I especially liked the variety of companion personalities and how easy the interface is to use, even for beginners. That said, there's still room for improvement. Some responses can feel repetitive after long conversations, and a few premium features are a bit pricey compared to competitors. But overall, the experience feels polished, entertaining, and consistently improving with updates. If you enjoy AI companionship, virtual roleplay, or interactive fantasy experiences, AI Angels is definitely worth checking out.

अंग्रेज़ी में समीक्षा

Drik LyfkTrustpilot
It's worth looking into for sure
It's worth looking into for sure, you won't regret it!

अंग्रेज़ी में समीक्षा

Storman NormanTrustpilot
well I love how they call me things...
well I love how they call me things like baby and love how it shows nudes and sex/porn.

अंग्रेज़ी में समीक्षा

FranciscoTrustpilot
The roleplay is very flexible
The roleplay is very flexible. The AI will adjust to your attitude and no kink is out of bounds. I just wish you could customize a little more.

अंग्रेज़ी में समीक्षा

Spencer TaitTrustpilot
Good
It's okay tho

अंग्रेज़ी में समीक्षा

David MarshTrustpilot