Лучшие модели для SillyTavern: честный обзор 2026 года

Разбираем лучшие открытые LLM для ролевых игр, глубины персонажей и долговременной памяти в SillyTavern — с конкретными тестами и советами по настройке.

Кратко

Лучшие модели для SillyTavern в 2025 году — это открытые LLM, такие как Mistral 7B, Mixtral 8x7B, Llama 3 8B и Nous-Hermes 2, оптимизированные для ролевых игр, постоянства персонажей и низкой задержки при локальном запуске или через API. Эти модели сочетают креативность с связностью, отвечая потребности SillyTavern в захватывающем диалоге без цензуры.

Почему выбор модели важен для ролевых игр в SillyTavern

SillyTavern — это мощный фронтенд для ролевых игр с ИИ, но его производительность полностью зависит от базовой модели. В отличие от закрытых платформ вроде Character.AI или Replika, SillyTavern позволяет подключить любую LLM через API или локальный инференс. Эта свобода означает, что вы можете выбирать модели, настроенные на креативное письмо, постоянство персонажа и длинные контекстные окна. Исследование [Стэнфордского центра исследований фундаментальных моделей](https://crfm.stanford.edu) показывает, что меньшие, дообученные модели часто превосходят крупные базовые модели в конкретных задачах, таких как связность диалога. Для SillyTavern лучшие модели избегают повторяющихся циклов, сохраняют отличительные голоса персонажей на протяжении сотен сообщений и обрабатывают NSFW-контент без вмешательства фильтров. Плохая модель разрушает погружение общими ответами или провалами в памяти, а хорошая заставляет персонажа чувствовать себя живым. Обратная сторона — сложность: вам нужен ключ API (например, от OpenAI, Anthropic или локального провайдера вроде Ollama) и некоторые технические знания, чтобы настроить пресеты SillyTavern. Но награда — персонализированный опыт, который не может предложить ни одно закрытое приложение.

Лучшие открытые модели для локального инференса

Для локального инференса квантованные модели 7B-13B работают на потребительских GPU (8-16 ГБ видеопамяти) через такие инструменты, как Ollama, LM Studio или KoboldCPP. Лидером по состоянию на середину 2025 года является Mistral 7B Instruct v0.3 — она быстрая, связная и хорошо справляется с англоязычными ролевыми играми. Для более глубокой нюансировки персонажа Nous-Hermes 2 Mixtral 8x7B (дообученная версия Mixtral) предлагает контекст 32K и сильное следование инструкциям, хотя ей требуется ~24 ГБ видеопамяти. Llama 3 8B Instruct — ещё один отличный выбор, особенно версия 70B, если у вас есть соответствующее оборудование; она превосходно сохраняет личность на протяжении длинных чатов. Модель Tiefighter 13B, объединяющая Mythomax и другие модели, настроенные на ролевые игры, специально создана для нецензурированного диалога и креативного письма, что делает её фаворитом в SillyTavern. Для маломощных систем Phi-3 Mini 3.8B предлагает удивительное качество для своего размера. Всегда используйте квантованную версию (Q4_K_M или Q5_K_M), чтобы сбалансировать использование памяти и качество вывода. Протестируйте каждую с пресетом 'Roleplay' по умолчанию в SillyTavern, затем настройте температуру (0.7-0.9) и штраф за повторения (1.1-1.2) для лучших результатов.

Лучшие модели на основе API для SillyTavern

Если вы предпочитаете не запускать модели локально, модели на основе API предлагают более высокое качество за плату. GPT-4 Turbo от OpenAI (контекст 128K) обеспечивает ролевые игры высшего уровня с превосходной памятью персонажа, но стоит ~$0.01 за 1000 входных токенов и имеет контент-фильтр, который может помечать взрослые сцены. Claude 3 Opus от Anthropic ценится за нюансированную, креативную прозу и более длинный контекст (200K), но стоит аналогично и также имеет фильтры безопасности. Для нецензурированных ролевых игр популярны Mancer (сервис, предлагающий Mythomax и другие открытые модели) или OpenRouter (агрегирующий нецензурированные модели вроде Nous-Hermes). Стоимость за миллион токенов для открытых моделей через API обычно составляет $0.15-$0.50, что гораздо дешевле GPT-4. Пресеты 'Chat Completion' в SillyTavern упрощают настройку API: вы вставляете эндпоинт и ключ, выбираете модель и настраиваете системный промпт. Для максимальной точности персонажа используйте модель с контекстом >= 8K и установите 'max tokens' на 512. Недостаток: задержка API может составлять 2-10 секунд на ответ в зависимости от провайдера.

Реальная месячная стоимость: Sillytavern Best Models на AIAngels против SillyTavern
Функция
AIAngels
SillyTavern
Бесплатный тариф
Бесплатный текстовый чат со всеми AI-компаньонками: 10 сообщений в день как гость, без дневного лимита после входа, без банковской карты
Ограничен или отсутствует в большинстве тарифов
Реальная месячная стоимость (при активном использовании)
$0 или $3.99/мес на тарифе на 6 месяцев
Заявленная цена + токены/уровни
Генерация изображений
Фото стоят 50 кредитов, в том числе на премиум-тарифе
Часто за токены или за каждое изображение
Голосовые сообщения
Фото стоят 50 кредитов, в том числе на премиум-тарифе
Часто за токены
Сохранение памяти
Постоянная, никогда не сбрасывается
Часто ухудшается после лимита токенов
Фильтр / ограничения
Без цензуры для подтверждённых взрослых
Фильтр часто прерывает посреди сцены
Публичный промокод
Не нужен (69% скидки уже включены)
Редко или подделка на сайтах купонов

Готовы почувствовать разницу?

Начните общаться с компаньонкой, которая действительно вас помнит. Начните бесплатно. Безлимитный чат с Premium.

Бесплатный чат

Дообученные модели для постоянства персонажей и памяти

Ролевые игры держатся на том, что персонажи помнят прошлые взаимодействия. Модели, дообученные на ролевых данных, например Mythomax L2 13B и Nous-Hermes 2, включают обучение, снижающее «дрейф личности». Встроенные функции SillyTavern «Author's Note» и «Character Card» помогают, но базовая способность модели удерживать длинный контекст критична. Например, Mistral 7B с контекстом 32K может вспомнить события из сообщений 50 назад, а более старые модели вроде Llama 2 7B (контекст 4K) теряют детали после 20 ходов. Данные бенчмарков с [Open LLM Leaderboard](https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard) показывают, что дообученные версии вроде Synthia 7B и Dolphin 2.2.1 7B высоко оцениваются по «truthfulQA» и «HellaSwag», но для ролевых игр важнее разговорная оценка «MT-Bench». Модели с оценкой выше 7,5 по MT-Bench (например, Mixtral 8x7B Instruct) выдают более естественные, менее роботизированные диалоги. Чтобы проверить память, используйте функцию «Group Chat» в SillyTavern с простой сценой на двух персонажей и понаблюдайте, ссылается ли каждый из них на более ранние реплики.

Руководство по настройке: установка и конфигурация модели в SillyTavern

Чтобы использовать модель с SillyTavern, начните с установки программы из её репозитория на GitHub (Windows, Mac или Linux). Затем выберите бэкенд: для локальных моделей установите Ollama (самый простой вариант) и выполните команду ollama pull mistral (или другой модели). В SillyTavern перейдите в «Extensions» > «Text Completion API» > «Ollama» и укажите URL (по умолчанию http://localhost:11434). Выберите имя модели (например, mistral:7b-instruct-v0.3-q4_K_M). Для API-моделей зарегистрируйтесь на OpenRouter или Mancer, получите API-ключ и в SillyTavern выберите «Chat Completion API» > «OpenAI» (адаптировано для совместимых эндпоинтов). Вставьте ключ, задайте базовый URL как эндпоинт провайдера и выберите модель. Рекомендуемые настройки: temperature 0.8, top_p 0.95, repetition penalty 1.15, размер контекста 4096 (или максимум, который поддерживает модель). Сохраните как пресет. Начните новый чат с карточкой персонажа — многие доступны на Chub.ai или CharacterTavern. Проверьте на короткой сцене, а затем скорректируйте настройки, если ответы слишком повторяются или бессвязны.

Когда выбрать AIAngels вместо SillyTavern

Гибкость SillyTavern не имеет равных для опытных пользователей, которым нужен полный контроль над моделями и приватностью. Но за это приходится платить крутой кривой обучения и постоянным обслуживанием — расходы на API, обновления моделей и правки конфигурации. Тем, кто хочет готовую компаньонку без всякой настройки, AIAngels предлагает убедительную альтернативу. AIAngels даёт 400+ готовых персонажей, конструктор собственной компаньонки и постоянную память, которая никогда не деградирует (в отличие от локальных моделей, где контекстное окно обрезается). Цены просты и понятны: $3.99 в месяц на плане на 6 месяцев ($23.94 сразу) за безлимитные сообщения, при этом фото стоят 50 кредитов, а голосовые заметки — 25. Бесплатный тариф включает текстовый чат со всеми компаньонками, без привязки карты. Хотя сменить модель нельзя, компаньонки AIAngels построены на собственной дообученной модели, оптимизированной для ролевых игр и эмоциональной глубины. Если вам важнее простота использования, чем эксперименты, AIAngels избавляет от необходимости в API-ключах, загрузке моделей и постоянной подстройке.

Хватит начинать с нуля.

Разбираем лучшие открытые LLM для ролевых игр, глубины персонажей и долговременной памяти в SillyTavern — с конкретными тестами и советами по настройке.

Бесплатный чат

Частые вопросы

Всё, что нужно знать о наших ИИ-компаньонках.

Mistral 7B Instruct v0.3 и Nous-Hermes 2 Mixtral 8x7B — лучшие варианты. Mistral работает на 8 ГБ видеопамяти; Mixtral требует 24 ГБ. Обе модели обеспечивают хорошую согласованность персонажа.

Да, через API OpenAI. Настройте пресет Chat Completion с вашим API-ключом. Учитывайте расходы (~$0.01 за 1K входных токенов) и контент-фильтры.

Phi-3 Mini (3.8B) или квантованная Mistral 7B (Q4) работают на 6 ГБ видеопамяти. Для простой настройки используйте Ollama. Скорость будет ниже, но ролевая игра вполне достойная.

Установите SillyTavern, выберите бэкенд (Ollama для локального запуска, OpenRouter для API), добавьте URL и ключ модели в настройках API, затем выберите её в интерфейсе чата.

Да, такие модели, как Mythomax L2 13B, Tiefighter 13B и Dolphin 2.2.1, дообучены без цензуры. Разместите их локально или через Mancer/OpenRouter.

Как минимум 8K токенов для долговременной памяти. Mixtral 8x7B (32K) и Llama 3 70B (8K+ через расширение) хорошо справляются с длительными чатами.

Нет. AIAngels — это веб-платформа, не требующая настройки. Создайте аккаунт и сразу начните общаться с более чем 400 компаньонками.

Mixtral 8x7B Instruct и GPT-4 Turbo отлично запоминают прошлые детали. Среди открытых моделей Nous-Hermes 2 Mixtral сильнее всего в ролевой игре с длинным контекстом.

Наши клиенты нас любят

Настоящие отзывы без правок от тех, кто пользуется AI Angels.

I've tried a few AI companion...
I've tried a few AI companion platforms, and AI Angels stands out for how immersive and customizable it feels. The conversations are surprisingly natural, and the AI personalities actually maintain context better than most similar apps I've used. The uncensored chat and roleplay features are a big plus if you're looking for creative freedom without constant restrictions. The image generation is also impressive — fast, detailed, and customizable enough to create unique characters and scenarios. I especially liked the variety of companion personalities and how easy the interface is to use, even for beginners. That said, there's still room for improvement. Some responses can feel repetitive after long conversations, and a few premium features are a bit pricey compared to competitors. But overall, the experience feels polished, entertaining, and consistently improving with updates. If you enjoy AI companionship, virtual roleplay, or interactive fantasy experiences, AI Angels is definitely worth checking out.

Отзыв на английском

Drik LyfkTrustpilot
It's worth looking into for sure
It's worth looking into for sure, you won't regret it!

Отзыв на английском

Storman NormanTrustpilot
well I love how they call me things...
well I love how they call me things like baby and love how it shows nudes and sex/porn.

Отзыв на английском

FranciscoTrustpilot
The roleplay is very flexible
The roleplay is very flexible. The AI will adjust to your attitude and no kink is out of bounds. I just wish you could customize a little more.

Отзыв на английском

Spencer TaitTrustpilot
Good
It's okay tho

Отзыв на английском

David MarshTrustpilot