Альтернатива памяти SillyTavern в 2026 году

Узнайте, как SillyTavern работает с памятью, как настроить размер контекста и сводки, и с какими ограничениями вы столкнётесь при recall на основе токенов.

Кратко

Память SillyTavern — это система управления контекстом, заметок о персонажах и функций векторной базы данных, которые позволяют ИИ сохранять информацию между разговорами. Она опирается на ручную настройку размера памяти (лимитов токенов), внедрение сводок и опциональное использование ChromaDB для долгосрочного вспоминания, но без пользовательской настройки встроенной постоянной памяти не имеет.

Как работает память SillyTavern: контекст, сводки и векторы

Система памяти SillyTavern не работает автоматически. Она использует три слоя: контекстное окно, заметку о персонаже и опциональное векторное хранилище. Контекстное окно — это количество токенов (по умолчанию 4096, настраивается до 8192 и более в зависимости от вашего API-провайдера), которые ИИ может «видеть» одновременно. Старые сообщения выпадают. Чтобы бороться с этим, SillyTavern автоматически создаёт сводку беседы каждые N сообщений (настраивается, по умолчанию 10) и вставляет эту сводку в контекст. Заметка о персонаже — это короткий, всегда присутствующий блок текста, который вы можете использовать для хранения ключевых фактов, статуса отношений или сюжетных моментов. Для долговременной памяти можно включить ChromaDB (векторную базу данных), которая хранит прошлые сообщения в виде эмбеддингов и извлекает нужные при необходимости. Однако для этого требуется предоставить собственный API-ключ для эмбеддингов и локальный или облачный экземпляр Chroma. Без ручной настройки память ограничена тем, что помещается в контекстное окно, плюс автоматическая сводка.

Настройка размера контекста и лимитов токенов для лучшего запоминания

Самый прямой способ улучшить память SillyTavern — увеличить размер контекста. В настройках пользователя вы можете задать «Context Size» в значение, соответствующее максимуму вашего API-провайдера. Например, OpenAI GPT-4 Turbo поддерживает 128 000 токенов, а Claude 3 Opus — 200 000. Однако больший контекст увеличивает стоимость и задержку. SillyTavern также позволяет отдельно задать лимит «Response Length». Распространённая рекомендация — установить контекст 8192, а длину ответа 1024 для баланса. «Max Tokens» в меню генерации промпта управляет тем, сколько токенов фактически отправляется в API; если задать его ниже размера контекста, вы экономите деньги, но теряете память. Также нужно настроить «Summary»: можно изменить, как часто генерируются сводки (каждые 5–20 сообщений) и добавляется ли сводка в начало или конец контекста. Для ролевой игры размещение сводки в начале контекста часто лучше, так как это настраивает ИИ.

Использование заметки о персонаже как постоянной памяти

Заметка о персонаже — это небольшое текстовое поле (обычно 500–2000 символов), которое всегда включается в каждый промпт, отправляемый в API. Она действует как постоянный банк памяти. Вы можете вручную обновлять её во время беседы, чтобы записывать важные события, черты персонажа или изменения в отношениях. Например, если ваш персонаж раскрывает секрет, вы можете добавить в заметку «Секрет: персонаж X знает Y». В отличие от автоматической сводки, заметка о персонаже никогда не обрезается и не забывается, пока вы держите её в пределах лимита токенов. Многие пользователи ведут в заметке «лорбук» или «world info», перечисляя ключевые факты о сеттинге и персонажах. Однако, поскольку она статична, если вы её не редактируете, она не захватывает новую информацию автоматически. Чтобы сделать её динамичной, можно использовать «Regex Scripts» или «Quick Replies» SillyTavern, чтобы побудить ИИ предлагать обновления заметки, а затем вручную их применять.

Реальная стоимость в месяц: Sillytavern Memory на AIAngels против SillyTavern
Функция
AIAngels
SillyTavern
Бесплатный тариф
Неограниченный бесплатный текстовый чат со всеми AI-компаньонками, без кредитной карты
Ограничен или отсутствует в большинстве тарифов
Реальная стоимость в месяц (активная)
$0 или $3.99/мес на тарифе 6 мес.
Заголовочная цена + токены/уровни
Генерация изображений
Включено в премиум
Часто за токены или за каждое изображение
Голосовые сообщения
Включено в премиум
Часто за токены
Сохранение памяти
Постоянное, никогда не сбрасывается
Часто ухудшается после лимита токенов
Фильтр / ограничения
Без цензуры для подтверждённых взрослых
Фильтр часто прерывает сцену
Публичный промокод
Не нужен (69% скидки уже включены)
Редко или подделка на сайтах купонов

Готовы почувствовать разницу?

Начните общаться с компаньонкой, которая действительно вас помнит. Начните бесплатно. Безлимитный чат с Premium.

Бесплатный чат

Настройка ChromaDB для долговременной векторной памяти

Интеграция ChromaDB даёт SillyTavern долговременную память, способную вспоминать сообщения многодневной давности. Чтобы её настроить, нужно запустить сервер ChromaDB локально или разместить его удалённо. В настройках SillyTavern есть вкладка «Vector Storage», где вы включаете Chroma и указываете URL эндпоинта. Также нужна модель эмбеддингов — SillyTavern поддерживает OpenAI text-embedding-ada-002 или локальные модели через расширение text-generation-webui. После настройки каждое сообщение, отправленное ИИ и пользователем, может быть преобразовано в эмбеддинг и сохранено. При генерации ответа SillyTavern может извлечь top K наиболее релевантных прошлых сообщений (настраивается, по умолчанию 5) и вставить их в контекст. Это фактически даёт ИИ память с поиском. Минус: эмбеддинги стоят денег за токен (если использовать OpenAI), а извлечение неидеально — оно может подтянуть нерелевантные сообщения. Настройка «порога схожести» и «максимального числа извлекаемых сообщений» необходима, чтобы избежать шума.

Ограничения памяти SillyTavern: потолки токенов и отсутствие встроенной постоянной памяти

Несмотря на гибкость, у памяти SillyTavern есть жёсткие пределы. Контекстное окно конечно — даже с моделью на 128k токенов очень длинные беседы в конце концов теряют ранние детали. Автоматическое резюме помогает, но оно с потерями: резюме — это сжатие, а не точная запись. Извлечение из ChromaDB статистическое, а не детерминированное; оно может упустить важный контекст, если схожесть эмбеддингов недостаточно высока. Кроме того, в SillyTavern нет встроенной «постоянной памяти», сохраняющейся между разными сессиями чата. Каждая беседа изолирована, если вы вручную не перенесёте заметки о персонаже или резюме между ними. Система также требует значительной ручной возни: вам самим нужно настраивать размеры контекста, интервалы резюмирования, содержимое заметок и параметры векторов. Для пользователей, которым нужно решение «настроил и забыл», зависимость SillyTavern от API-ключей, локального хостинга и постоянной конфигурации может стать барьером. Альтернативы вроде AIAngels предлагают постоянную память, которая работает из коробки, без жонглирования токенами и локальной настройки.

Практические советы по максимальному использованию памяти SillyTavern

Чтобы выжать максимум из памяти SillyTavern, начните с установки размера контекста на максимум, который допускает ваш API — для большинства пользователей 8192 — надёжный вариант. Включите «Automatic Summary» с частотой каждые 8–10 сообщений и задайте длину резюме в 512 токенов. Поместите резюме в начало контекста в настройках «Prompt Item Order». Используйте заметку о персонаже для неизменных фактов и обновляйте её вручную после важных сюжетных событий. Если вы технически подкованы, настройте ChromaDB с локальной моделью эмбеддингов (например, all-MiniLM-L6-v2), чтобы избежать расходов на API. Настройте число извлекаемых сообщений на 3–5, а порог схожести — на 0,75. Наконец, подумайте об использовании «World Info» (если ваш интерфейс это поддерживает) для хранения лора, к которому ИИ может обращаться. Помните, что никакая конфигурация не может полностью преодолеть конечное контекстное окно — для бесед, превышающих 100k токенов, стоит разделить их на отдельные чаты или использовать внешний инструмент памяти вроде MemGPT.

Хватит начинать с нуля.

Узнайте, как SillyTavern работает с памятью, как настроить размер контекста и сводки, и с какими ограничениями вы столкнётесь при recall на основе токенов.

Бесплатный чат

Частые вопросы

Всё, что нужно знать о наших ИИ-компаньонках.

Нет. Память SillyTavern ограничена контекстным окном выбранной вами модели API. Она использует резюме и векторный поиск, чтобы продлить запоминание, но не может удерживать информацию сверх лимита токенов без ручной настройки.

Включите векторную базу данных ChromaDB в разделе «Настройки» > «Векторное хранилище». Вам нужен запущенный экземпляр ChromaDB и модель эмбеддингов (например, ada-002 от OpenAI). Затем задайте количество извлекаемых сообщений и порог схожести, чтобы релевантные прошлые сообщения автоматически подставлялись в контекст.

Размер контекста по умолчанию — 4096 токенов. Его можно увеличить в настройках пользователя, но нужно убедиться, что ваш API-провайдер поддерживает такой лимит. Обычные безопасные значения — 8192 или 16384.

Нет. SillyTavern — это фронтенд, которому для генерации ответов нужен бэкенд-API (например, OpenAI, KoboldAI или локальный text-generation-webui). Функции памяти вроде ChromaDB также требуют ключа API для эмбеддингов или локальной модели.

Используйте заметку о персонаже. Отредактируйте её в настройках персонажа, добавив ключевые факты, статус отношений или сюжетные моменты. Она включается в каждый запрос и не забудется, пока укладывается в лимит токенов.

Да, если включить «Автоматическое резюме» в настройках. Оно создаёт резюме каждые N сообщений (по умолчанию 10) и подставляет его в контекст. Частоту и длину резюме можно настроить.

Скорее всего, у вас слишком маленький размер контекста или отключено автоматическое резюме. Увеличьте размер контекста минимум до 8192, включите резюме и рассмотрите использование ChromaDB для долговременного запоминания.

SillyTavern даёт больше контроля (размер контекста, резюме, векторная БД), но требует настройки. В Character.AI память проще и работает автоматически, но со временем деградирует. При хорошей настройке SillyTavern может быть мощнее, но это не готовое решение «из коробки».

Наши клиенты нас любят

Настоящие отзывы без правок от тех, кто пользуется AI Angels.

I've tried a few AI companion...
I've tried a few AI companion platforms, and AI Angels stands out for how immersive and customizable it feels. The conversations are surprisingly natural, and the AI personalities actually maintain context better than most similar apps I've used. The uncensored chat and roleplay features are a big plus if you're looking for creative freedom without constant restrictions. The image generation is also impressive — fast, detailed, and customizable enough to create unique characters and scenarios. I especially liked the variety of companion personalities and how easy the interface is to use, even for beginners. That said, there's still room for improvement. Some responses can feel repetitive after long conversations, and a few premium features are a bit pricey compared to competitors. But overall, the experience feels polished, entertaining, and consistently improving with updates. If you enjoy AI companionship, virtual roleplay, or interactive fantasy experiences, AI Angels is definitely worth checking out.

Отзыв на английском

Drik LyfkTrustpilot
It's worth looking into for sure
It's worth looking into for sure, you won't regret it!

Отзыв на английском

Storman NormanTrustpilot
well I love how they call me things...
well I love how they call me things like baby and love how it shows nudes and sex/porn.

Отзыв на английском

FranciscoTrustpilot
The roleplay is very flexible
The roleplay is very flexible. The AI will adjust to your attitude and no kink is out of bounds. I just wish you could customize a little more.

Отзыв на английском

Spencer TaitTrustpilot
Good
It's okay tho

Отзыв на английском

David MarshTrustpilot