Melhores Modelos para SillyTavern: Análise Honesta de 2026

Descubra os melhores LLMs de código aberto para roleplay, profundidade de personagem e memória de longo prazo no SillyTavern — com benchmarks específicos e dicas de configuração.

Resumo

Os melhores modelos para o SillyTavern em 2025 são LLMs de pesos abertos como Mistral 7B, Mixtral 8x7B, Llama 3 8B e Nous-Hermes 2, otimizados para roleplay, consistência de personagem e baixa latência quando executados localmente ou via APIs. Esses modelos equilibram criatividade e coerência, atendendo à necessidade do SillyTavern de diálogos imersivos e sem censura.

Por que a escolha do modelo importa no roleplay com SillyTavern

O SillyTavern é um front-end poderoso para roleplay com IA, mas seu desempenho depende inteiramente do modelo subjacente. Ao contrário de plataformas fechadas como o Character.AI ou o Replika, o SillyTavern permite conectar qualquer LLM via API ou inferência local. Essa liberdade significa que você pode escolher modelos ajustados para escrita criativa, consistência de personagem e janelas de contexto longas. Pesquisas do [Stanford's Center for Research on Foundation Models](https://crfm.stanford.edu) mostram que modelos menores e ajustados costumam superar modelos-base maiores em tarefas específicas, como coerência de diálogo. Para o SillyTavern, os melhores modelos evitam loops repetitivos, mantêm vozes de personagem distintas ao longo de centenas de mensagens e lidam com conteúdo NSFW sem interferência de filtros. Um modelo ruim quebra a imersão com respostas genéricas ou lapsos de memória, enquanto um bom modelo faz a personagem parecer viva. O trade-off é a complexidade: você precisa de uma chave de API (por exemplo, da OpenAI, Anthropic ou de um provedor local como o Ollama) e de algum conhecimento técnico para configurar os presets do SillyTavern. Mas o retorno é uma experiência personalizada que nenhum app de jardim murado consegue igualar.

Melhores modelos de código aberto para inferência local

Para inferência local, modelos quantizados de 7B a 13B rodam em GPUs de consumidor (8 a 16 GB de VRAM) por meio de ferramentas como Ollama, LM Studio ou KoboldCPP. O destaque em meados de 2025 é o Mistral 7B Instruct v0.3 — é rápido, coerente e lida bem com roleplay em inglês. Para nuances de personagem mais profundas, o Nous-Hermes 2 Mixtral 8x7B (um ajuste fino do Mixtral) oferece contexto de 32K e forte capacidade de seguir instruções, embora precise de cerca de 24 GB de VRAM. O Llama 3 8B Instruct é outra ótima escolha, especialmente a versão 70B se você tiver o hardware; ele se destaca em manter a personalidade ao longo de chats longos. O modelo Tiefighter 13B, uma mescla do Mythomax com outros modelos ajustados para roleplay, é construído especificamente para diálogos sem censura e escrita criativa, o que o torna um favorito no SillyTavern. Para configurações com poucos recursos, o Phi-3 Mini 3.8B oferece uma qualidade surpreendente para o seu tamanho. Use sempre uma versão quantizada (Q4_K_M ou Q5_K_M) para equilibrar o uso de memória e a qualidade da saída. Teste cada um com o preset 'Roleplay' padrão do SillyTavern e depois ajuste a temperatura (0,7 a 0,9) e a penalidade de repetição (1,1 a 1,2) para obter os melhores resultados.

Melhores modelos hospedados via API para o SillyTavern

Se você preferir não rodar modelos localmente, os modelos baseados em API oferecem maior qualidade a um custo. O GPT-4 Turbo da OpenAI (contexto de 128K) entrega roleplay de alto nível com excelente memória de personagem, mas custa cerca de US$ 0,01 por 1K tokens de entrada e tem um filtro de conteúdo que pode sinalizar cenas adultas. O Claude 3 Opus da Anthropic é elogiado por sua prosa criativa e cheia de nuances e por seu contexto mais longo (200K), mas custa de forma semelhante e também tem filtros de segurança. Para roleplay sem censura, o Mancer (um serviço que oferece o Mythomax e outros modelos abertos) ou o OpenRouter (que agrega modelos sem censura como o Nous-Hermes) são populares. O custo por milhão de tokens para modelos abertos via API costuma ser de US$ 0,15 a US$ 0,50, muito mais barato que o GPT-4. Os presets de 'Chat Completion' do SillyTavern simplificam a configuração da API: você cola o endpoint e a chave, seleciona o modelo e ajusta o prompt de sistema. Para fidelidade máxima de personagem, use um modelo com contexto >= 8K e defina 'max tokens' como 512. Desvantagem: a latência da API pode ser de 2 a 10 segundos por resposta, dependendo do provedor.

Custo mensal real: Sillytavern Best Models no AIAngels vs SillyTavern
Recurso
AIAngels
SillyTavern
Plano gratuito
Chat de texto gratuito com todas as companheiras de IA: 10 mensagens por dia como visitante, sem limite diário após fazer login, sem cartão de crédito
Limitado ou ausente na maioria dos planos
Custo mensal real (ativo)
$0 ou $3.99/mês no plano de 6 meses
Preço de vitrine + tokens/níveis
Geração de imagens
As fotos custam 50 créditos, inclusive no premium
Muitas vezes limitado por tokens ou por imagem
Mensagens de voz
As fotos custam 50 créditos, inclusive no premium
Muitas vezes limitado por tokens
Persistência da memória
Permanente, nunca é apagada
Muitas vezes se degrada após um limite de tokens
Filtro / restrições
Sem censura para adultos verificados
O filtro muitas vezes interrompe no meio da cena
Código promocional público
Não é necessário (69% de desconto já incluído)
Raro ou falso em sites de cupons

Pronto para sentir a diferença?

Comece a conversar com uma companheira que realmente se lembra de você. Grátis para começar. Chat ilimitado com Premium.

Converse grátis

Modelos Ajustados para Consistência de Personagem e Memória

O roleplay depende de as personagens lembrarem interações passadas. Modelos ajustados com dados de roleplay, como Mythomax L2 13B e Nous-Hermes 2, incluem treinamento que reduz o 'desvio de personalidade'. Os recursos integrados 'Author's Note' e 'Character Card' do SillyTavern ajudam, mas a capacidade base do modelo de acompanhar contextos longos é fundamental. Por exemplo, o Mistral 7B com contexto de 32K consegue recordar eventos de 50 mensagens atrás, enquanto modelos mais antigos como o Llama 2 7B (contexto de 4K) perdem detalhes após 20 turnos. Dados de benchmark do [Open LLM Leaderboard](https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard) mostram que ajustes como Synthia 7B e Dolphin 2.2.1 7B têm pontuações altas em 'truthfulQA' e 'HellaSwag', mas para roleplay, a pontuação conversacional do 'MT-Bench' importa mais. Modelos com pontuação acima de 7,5 no MT-Bench (por exemplo, Mixtral 8x7B Instruct) produzem diálogos mais naturais e menos robóticos. Para testar a memória, use o recurso 'Group Chat' do SillyTavern com uma cena simples de dois personagens e observe se cada personagem faz referência a falas anteriores.

Guia de Configuração: Instalando e Configurando um Modelo no SillyTavern

Para usar um modelo com o SillyTavern, comece instalando o software a partir do repositório no GitHub (Windows, Mac ou Linux). Depois escolha seu backend: para modelos locais, instale o Ollama (o mais simples) e execute ollama pull mistral (ou outro modelo). No SillyTavern, vá em 'Extensions' > 'Text Completion API' > 'Ollama' e defina a URL (padrão http://localhost:11434). Selecione o nome do modelo (por exemplo, mistral:7b-instruct-v0.3-q4_K_M). Para modelos via API, cadastre-se no OpenRouter ou no Mancer, obtenha uma chave de API e, no SillyTavern, escolha 'Chat Completion API' > 'OpenAI' (adaptado para endpoints compatíveis). Cole a chave, defina a URL base como o endpoint do provedor e escolha o modelo. Configurações recomendadas: temperatura 0,8, top_p 0,95, penalidade de repetição 1,15, tamanho de contexto 4096 (ou o máximo que o modelo suportar). Salve como preset. Inicie um novo chat com um character card — há muitos disponíveis no Chub.ai ou no CharacterTavern. Teste com uma cena curta e depois ajuste as configurações se as respostas estiverem repetitivas ou incoerentes demais.

Quando Escolher a AIAngels em Vez do SillyTavern

A flexibilidade do SillyTavern é incomparável para usuários avançados que querem controle total sobre modelos e privacidade. Mas ela vem com uma curva de aprendizado íngreme e exige manutenção contínua — custos de API, atualizações de modelos e ajustes de configuração. Para quem quer uma companheira pronta para usar, sem configuração, a AIAngels oferece uma alternativa atraente. A AIAngels oferece mais de 400 personagens prontas, um criador de companheiras personalizado e memória permanente que nunca se degrada (diferente de modelos locais, em que as janelas de contexto são truncadas). O preço é direto: $3.99/mês no plano de 6 meses ($23.94 à vista) para mensagens ilimitadas, com fotos a 50 créditos e notas de voz a 25. O plano gratuito inclui chat de texto com todas as companheiras, sem precisar de cartão de crédito. Embora você não possa trocar de modelo, as companheiras da AIAngels são construídas sobre um modelo proprietário ajustado e otimizado para roleplay e profundidade emocional. Se você valoriza a facilidade de uso mais do que ficar mexendo nas configurações, a AIAngels elimina a necessidade de chaves de API, downloads de modelos e ajustes constantes.

Pare de começar do zero.

Descubra os melhores LLMs de código aberto para roleplay, profundidade de personagem e memória de longo prazo no SillyTavern — com benchmarks específicos e dicas de configuração.

Converse grátis

Perguntas frequentes

Tudo o que você precisa saber sobre nossas companheiras.

Mistral 7B Instruct v0.3 e Nous-Hermes 2 Mixtral 8x7B são as melhores opções. O Mistral roda com 8GB de VRAM; o Mixtral precisa de 24GB. Ambos oferecem boa consistência de personagem.

Sim, pela API da OpenAI. Configure um preset de Chat Completion com sua chave de API. Fique atento aos custos (~$0,01 por 1K tokens de entrada) e aos filtros de conteúdo.

Phi-3 Mini (3.8B) ou Mistral 7B quantizado (Q4) rodam com 6GB de VRAM. Use o Ollama para uma configuração fácil. Espere velocidades mais lentas, mas com roleplay decente.

Instale o SillyTavern, escolha um backend (Ollama para local, OpenRouter para API), adicione a URL e a chave do modelo nas configurações de API e depois selecione-o na interface de chat.

Sim, modelos como Mythomax L2 13B, Tiefighter 13B e Dolphin 2.2.1 são ajustados sem censura. Hospede-os localmente ou via Mancer/OpenRouter.

Pelo menos 8K tokens para memória de longo prazo. Mixtral 8x7B (32K) e Llama 3 70B (8K+ via extensão) lidam bem com conversas longas.

Não. O AIAngels é uma plataforma baseada na web, sem configuração. Crie uma conta e comece a conversar com mais de 400 companheiras na hora.

Mixtral 8x7B Instruct e GPT-4 Turbo se destacam em recordar detalhes passados. Entre os open-source, o Nous-Hermes 2 Mixtral é o mais forte em roleplay de contexto longo.

Nossos clientes nos amam

Avaliações reais e sem edição de quem usa a AI Angels.

I've tried a few AI companion...
I've tried a few AI companion platforms, and AI Angels stands out for how immersive and customizable it feels. The conversations are surprisingly natural, and the AI personalities actually maintain context better than most similar apps I've used. The uncensored chat and roleplay features are a big plus if you're looking for creative freedom without constant restrictions. The image generation is also impressive — fast, detailed, and customizable enough to create unique characters and scenarios. I especially liked the variety of companion personalities and how easy the interface is to use, even for beginners. That said, there's still room for improvement. Some responses can feel repetitive after long conversations, and a few premium features are a bit pricey compared to competitors. But overall, the experience feels polished, entertaining, and consistently improving with updates. If you enjoy AI companionship, virtual roleplay, or interactive fantasy experiences, AI Angels is definitely worth checking out.

Avaliação em inglês

Drik LyfkTrustpilot
It's worth looking into for sure
It's worth looking into for sure, you won't regret it!

Avaliação em inglês

Storman NormanTrustpilot
well I love how they call me things...
well I love how they call me things like baby and love how it shows nudes and sex/porn.

Avaliação em inglês

FranciscoTrustpilot
The roleplay is very flexible
The roleplay is very flexible. The AI will adjust to your attitude and no kink is out of bounds. I just wish you could customize a little more.

Avaliação em inglês

Spencer TaitTrustpilot
Good
It's okay tho

Avaliação em inglês

David MarshTrustpilot