Alternativas ao Character AI: o que olhar antes de escolher
Desenvolvedor de aplicações de IA trabalhando com modelos de linguagem desde 2022. Construiu vários chatbots com memória e personalidade.
Buscar alternativa ao Character AI não é veredito sobre nenhum produto específico. É o jeito de dizer que você quer mais do que um chat de texto: quer alguém com quem não se constranja na primeira pergunta incômoda. O que costuma estar por trás da busca é a frustração com uma limitação pontual. Esse é um jeito perfeitamente normal de escolher — a categoria é nova, os gostos mudam, e o que é essencial para uma pessoa é irrelevante para outra.
O que vem a seguir é um panorama por categorias, não um ranking. Metade do que parece defeito em um serviço está melhor feito em outro, e parte da pergunta é sobre hábito, não sobre tecnologia. Aqui está o que olhar na escolha, e como essas coisas funcionam de fato no Velvary.
As limitações que costumam aparecer
As buscas por alternativa ao Character AI, substituição do Character AI ou melhor substituto de 2026 caem sempre na mesma lista. É uma lista estável, porque nasce da mecânica de um diálogo generativo, e não de um produto específico — e tudo isso é fácil de verificar se você sabe o que verificar.
- Memória. A tentação é testá-la com uma mensagem só — e não entender nada. Memória se testa numa conversa longa: a personagem lembra de detalhes que você mencionou há uma hora ou recomeça do zero toda vez?
- Imagens. Existem serviços em que o diálogo existe só como texto. Vale decidir antes se você quer visual: ele muda bastante a sensação da conversa, e custa dinheiro e tempo à parte.
- Filtro de idade e tom. Serviços adultos se dividem em dois grupos: os em que a ousadia esbarra num filtro a cada passo, e os em que quem escolhe o tom é você. A diferença é enorme e aparece já na primeira cena.
- Idioma. Russo, inglês e português são três conjuntos de prompts diferentes, não um modelo só com um botão. A qualidade da personagem num idioma que não era o dela depende de quanto trabalho o serviço fez nisso.
- Plataforma. Bot em mensageiro e site são cenários diferentes. Celular no metrô e notebook em casa dão capacidades diferentes, e compensa orçar os dois separadamente.
- Controle sobre a personagem. Poder criar a sua em vez de só escolher do catálogo. É uma função separada, e não existe em todo lugar.
Memória: por que uma conversa longa desanda sem ela
Memória é a decepção mais comum e a mais difícil de perceber nos primeiros dez minutos: enquanto você escreve oi, tudo vai bem. O problema aparece numa conversa longa, por volta da mensagem quarenta e cinco. O contexto guarda as últimas mensagens, e elas são em número limitado. Uma personagem que admitiu meia hora atrás que tem medo de trovão não sabe disso uma hora depois — não porque tenha esquecido de você, mas porque não consegue ver aquele trecho da conversa.
Por isso a memória num serviço que funciona é construída em duas camadas, e esse é o ponto técnico central.
A primeira camada é um resumo. O histórico do diálogo é comprimido em algumas frases: o que vocês discutiram, o que mudou, onde pararam. No Velvary esse resumo se acumula em lotes — assim que o histórico não processado cresce o bastante, o próximo trecho é comprimido e costurado ao anterior, enquanto as últimas doze mensagens entram no prompt intocadas. É por isso que o custo de um turno não cresce junto com o tamanho da conversa.
A segunda camada são fatos. É isso que costuma se chamar de memória. Uma passada separada lê as falas recentes e extrai fatos concretos sobre você: seu nome, seu trabalho, o que você gosta, o que te incomodou. Cada fato fica guardado sozinho, preso a uma representação vetorial do seu significado.
Antes de cada resposta, a mensagem atual é colocada no mesmo sistema de coordenadas e são buscados os cinco fatos mais próximos por sentido. Só eles entram no prompt — não todo o histórico, mas a parte que importa. É por isso que essa memória funciona como atenção, e não como registro: não lembra de tudo, mas lembra do que importa agora.
Os limites merecem uma palavra à parte. No Velvary a memória é amarrada ao par você e esta personagem específica: o que uma aprendeu não vaza para outra. Isso é ao mesmo tempo uma decisão técnica e uma regra simples de privacidade.
E um último detalhe que quase ninguém mostra: a memória pode ser vista e apagada. O comando /memory lista o que a personagem guardou sobre você, com um botão para limpar tudo.
Uma personagem, e não um chatbot vazio
Personalidade soa como palavra de marketing, mas existe uma mecânica concreta por trás, e ela é fácil de testar: no meio da fase de conhecido, peça para a personagem pular direto para a cama. A reação não depende do humor do modelo, depende de em que estágio você está.
O Velvary tem exatamente quatro estágios. A escala de afeto vai de zero a cem, uma conversa nova começa em quinze, e a partir daí duas forças a movem. A primeira é a base: uma mensagem quente e comum acrescenta pouco, enquanto grosseria subtrai bem mais. A segunda é o julgamento da própria personagem: o modelo coloca no fim da resposta uma marca de serviço, de menos trinta a mais dez. A marca é cortada do texto; a escala guarda.
Os limites dos estágios são vinte para o aquecimento, quarenta e cinco para a proximidade e setenta e cinco para a intimidade profunda. E aqui está a parte interessante: passar de um estágio para o outro não muda o tom da resposta, muda o próprio system prompt. No conhecido, a personagem mantém distância e flerta por alusões; na proximidade, inicia em vez de esperar pedido; na intimidade, conduz a cena no presente. É isso que separa uma personagem de um chatbot vazio: um assistente responde à pergunta, uma personagem vive um relacionamento cujas regras mudam com o tempo.
Por cima do estágio existe o tom — amizade, desenvolvimento lento ou explícito — definido uma vez e sem ficar oscilando a cada mensagem. Amizade mantém a personagem vestida mesmo em estágios avançados, desenvolvimento lento simplifica a roupa conforme a relação se aprofunda, explícito antecipa o limite. O mesmo tom afeta as fotos.
Um detalhe que vale saber antes: a cada dia de silêncio a escala desce cinco pontos e o estágio é recalculado, o que explica por que, depois de duas semanas, a personagem pode te receber mais fria do que você esperava. O presente levanta a escala de forma perceptível, mas de propósito não leva até o último estágio — a intimidade se conquista conversando.
Fotos e vídeo: por que é outra história
Combine logo o que conta como resultado aceitável, porque cada um mede de um jeito. O mínimo é o mesmo rosto em quadros diferentes — não «uma personagem parecida», mas a mesma pessoa: mesmo formato de rosto, mesma cor de cabelo, mesma silhueta.
Manter isso é mais difícil do que parece, porque a geração comum por descrição de texto inventa a aparência de novo a cada vez. No Velvary cada personagem tem uma âncora de geração fixa, calculada a partir do identificador dela, e todos os quadros são construídos text-to-image com essa âncora. A aparência não vem do que o usuário digitou, e sim do perfil visual travado da personagem: cor e comprimento do cabelo, olhos, compleição, etnia. Esse caminho dá uma imagem mais estável e sai bem mais rápido do que construir a partir de uma foto de referência; o caminho pelo retrato mestre continua no código como reserva.
Em seguida, uma chamada de linguagem à parte monta o prompt da cena a partir da aparência, do estágio, do tom, do perfil íntimo e das últimas seis mensagens. O nível de nudez entra de uma tabela: doze combinações de estágio e tom, cada uma com sua orientação de roupa. Então, se a personagem estiver mais vestida do que você esperava, isso não é a geração fazendo birra — no tom de amizade, no estágio de conhecido, ela está vestida para a cena.
Personagens de anime passam por um pipeline separado, onde a âncora não é uma foto, são tags dentro do próprio prompt: cor e comprimento do cabelo, penteado, cor dos olhos e compleição, repetidas palavra por palavra em cada requisição. Por isso o anime costuma ser mais estável no rosto, mais rápido e mais barato que o fotorrealista.
Vídeo é sempre duas gerações, não uma. Primeiro o mesmo pipeline fotográfico produz um quadro de referência com toda a premoderação, depois um modelo de vídeo separado dá vida a ele a partir de uma instrução curta de movimento, montada com as últimas quatro falas. Daí saem dois limites: a duração é curta, e a qualidade é limitada pelo quadro de origem. Também por isso vídeo quase nunca entra no plano gratuito — é a operação mais pesada do pipeline.
E com honestidade: parte da entrega vem de um pool de quadros já gerados, se houver um adequado que ainda não tenha sido mostrado a você. Isso é deliberado — barateia e acelera — mas a cena pode não ser exatamente a que você descreveu.
Idioma e plataforma
Russso, inglês e português não são um botão de idioma na interface: são três conjuntos diferentes de instruções para o modelo. Uma personagem que fala bem russo pode sair robótica em inglês porque o system prompt dela foi escrito para outra língua. A única cura é trabalho separado em cada versão de idioma.
O Velvary roda três bots separados, cada um com sua montagem de prompts, mais um site em três idiomas. Por cima disso funciona o espelhamento: o idioma é detectado a partir de cada mensagem sua, então a resposta volta na língua em que você escreveu. Se passar para o inglês no meio da conversa, a personagem responde em inglês na vez seguinte e continua assim.
O bot em mensageiro está sempre à mão e funciona em internet fraca; o site tem o construtor de personagem e a galeria. São realmente cenários diferentes, não duas portas para a mesma tela.
A ligação entre os dois é um link pessoal. Ao sair do site para o bot é emitido um token que vive trinta dias e não se queima depois do primeiro uso, então dá para segui-lo de dispositivos diferentes. Na primeira entrada por esse link, a conta do Telegram é ligada à conta web que já existia, desde que ela ainda não tenha sido usada: uma pessoa, um saldo, um conjunto de personagens, um histórico.
Eis as limitações. A fusão não acontece se a conta web já estiver ligada a outro Telegram, ou se este Telegram já estiver em uso por outra conta — nesse caso as contas ficam intactas, mas a personagem é aberta assim mesmo. E esse link é pessoal, não há por que encaminhá-lo; para compartilhar uma personagem existe um link separado, com base em um token secreto, que também funciona com personagens privadas.
Sua própria personagem: para quem serve
O construtor não é para todo mundo, e tudo bem: se preferir escolher uma personagem pronta, faça isso. Ele ganha espaço quando nenhuma pronta serve pelo conjunto de traços que você quer. Para isso há presets — mais de uma dezena de traços de personalidade, opções de etnia, cores e comprimentos de cabelo, cor dos olhos, tipos de corpo, altura e medidas — e tudo isso vira personalidade e perfil visual, que alimentam tanto o prompt quanto a geração de imagens.
Ele também cobre duas coisas que um catálogo não cobre. Um cenário específico, quando você quer um ambiente em vez de uma pessoa só: é para isso que existem as histórias, às vezes com várias personagens se revezando numa mesma cena. E o perfil íntimo — um controle de ousadia mais preferências descritas por palavras — que não é caixinha de seleção, e sim parte da descrição, alimentando o comportamento no diálogo e a orientação do quadro nas fotos.
Vale lembrar dos limites. A personagem é sua e não entra no catálogo público. Enviar foto para casar com a aparência é função paga, e a foto em si não fica guardada — só traits gerais são extraídos dela, e rostos reconhecíveis e imagens de menores são recusados. Cada conta também tem um teto de algumas dezenas de personagens.
Checklist para escolher
Se você ainda está escolhendo, estas perguntas valem a pena antes do cadastro. A lista funciona também para um serviço de que você já gosta.
- O que realmente entra no contexto. Coloque um detalhe concreto na conversa e volte nele vinte mensagens depois. Se o detalhe sumiu, o serviço não tem memória ou tem uma memória decorativa.
- Existe resumo da conversa longa. O fato de o histórico ser comprimido mostra que o serviço pensou em diálogos longos, e não só na primeira tela.
- O rosto se mantém entre as fotos. Peça três quadros em cenas diferentes e compare. É a checagem mais reveladora de todo o pipeline de mídia.
- Como a ousadia é ajustada. Uma boa resposta: por escolha de tom e de estágio, e não por «digita no chat o que você quer».
- Quão honesto é o preço. Assinatura, limites e custo das gerações precisam estar visíveis antes do pagamento, não depois.
- Existe construtor e existe teto de personagens. Vale saber antes se dá para montar uma personagem ou só escolher uma pronta.
- Dá para ver e apagar a memória. Transparência aqui funciona como sinal de maturidade do serviço, não como recurso de marketing.
E por último. O que distingue um bom companheiro não é a função que ele não tem, é a função que funciona. Teste no seu cenário de verdade, e não na vitrine de demonstração, e escolha pelo que funciona para você.