
NovelAI é um serviço por assinatura da Anlatan que roda no navegador e reúne o modelo de imagem anime NovelAI Diffusion V5 com modelos de linguagem narrativos próprios, oferecendo a escritores e ilustradores geração privada, controlo de prompt ao nível das tags e texto ilimitado a partir de 10 dólares por mês.
Já usou esta ferramenta? Avalie-a
Já usou esta ferramenta? Avalie-a
NovelAI é um serviço por assinatura entregue através do navegador, operado pela Anlatan Inc., empresa registada no Delaware, que combina uma infraestrutura de geração de imagens orientada ao anime com uma família de modelos de linguagem narrativos desenvolvidos internamente. A página inicial apresenta a proposta sem rodeios — «Crie arte anime e histórias de IA de alta qualidade» — e as duas metades partilham realmente uma única conta, uma única assinatura e um único ciclo de faturação, em vez de serem vendidas como produtos separados. Autores que procuram um modelo de contexto longo capaz de acompanhar o elenco de um romance e ilustradores que querem controlo ao nível das tags sobre personagens de anime subscrevem exatamente os mesmos três planos.
O serviço é invulgar entre as ferramentas criativas de IA em dois aspetos que moldam quase tudo o resto. Primeiro, os modelos de imagem a partir da geração V4 são descritos na documentação oficial como «modelos de geração de imagens inteiramente originais, treinados de raiz sem depender de um modelo base público como o Stable Diffusion» — uma rutura com as próprias origens da plataforma em 2022, quando o seu primeiro modelo de imagem era um derivado fortemente modificado do Stable Diffusion. Segundo, a geração é privada por conceção: as perguntas frequentes indicam que as gerações de imagem funcionam por sessão, que nada é armazenado do lado do servidor e que os pedidos, carregamentos, edições e gerações não são registados. Essa postura de privacidade é um diferenciador genuíno e explica também por que motivo a plataforma praticamente não inclui barreiras de conteúdo no trabalho privado.
O modelo de imagem principal atual, NovelAI Diffusion V5, foi anunciado a 21 de agosto de 2026 nas variantes Curated e Full, acrescentando transparência alfa verdadeira, renderização de texto multilingue, páginas completas de banda desenhada numa só geração e posicionamento de até 22 personagens distintas. Do lado do texto, o carro-chefe é o Xialong, um ajuste fino narrativo de 355 mil milhões de parâmetros sobre o GLM-4.6 da ZhipuAI, com uma janela de contexto de 28 672 tokens. Os preços começam nos 10 dólares por mês; existe um período de avaliação gratuito único, mas nenhum escalão gratuito permanente.
A documentação de imagem lista seis modelos selecionáveis, e a escolha não é decorativa: cada um comporta-se de forma diferente e deve ser escolhido consoante o que se pretende produzir. Os dois eixos que contam são a geração (V5, V4.5, V4) e o grau de curadoria do conjunto de dados (Full contra Curated). Os modelos Full são treinados sobre aquilo a que a documentação chama «um conjunto de dados mais abrangente, ainda que menos curado», ao passo que os modelos Curated recorrem a «um conjunto de treino algo menor, com imagens mais limpas e mais focadas». Full é a escolha quando precisa de algo específico que o Curated não alcança; Curated é o valor por omissão mais seguro para uso geral.
O V5, lançado a 21 de agosto de 2026, é de longe o maior deles. O próprio anúncio de assinatura da Anlatan situa a sua arquitetura em 2,5 vezes o tamanho do V4.5, o que constitui a razão declarada para as restrições de computação abordadas mais adiante. As capacidades em destaque são uma compreensão mais apurada da linguagem natural, prompts multilingues alargados, posicionamento de personagens reformulado com suporte para até 22 figuras distintas, maior fidelidade de imagem, saída com transparência alfa verdadeira e um novo nível de melhoria «Max» para ampliação.
Um pormenor prático apanha frequentemente os recém-chegados: os modelos V4 e V4.5 usam o tokenizador T5, e a documentação avisa que «a maioria dos caracteres Unicode (por exemplo, emojis a cores ou caracteres japoneses) não é suportada pelo modelo como parte dos prompts». Se escrever prompts em japonês por hábito, por a estética ser anime, o modelo não lerá o que espera nessas gerações.
O sistema de prompts do NovelAI aproxima-se mais de um vocabulário de tags ao estilo Danbooru do que do prompting conversacional dos modelos de imagem generalistas, embora a partir do V4 se tenha somado uma compreensão genuína da linguagem natural. Na prática pode misturar registos: uma descrição de cena em linguagem natural seguida de uma série de tags separadas por vírgulas para o penteado, os olhos, o enquadramento e a pose. O orçamento de tokens do prompt ronda os 512 tokens T5, abrangendo o prompt base e todos os prompts de personagem em conjunto, o que é generoso mas não ilimitado assim que começa a descrever várias personagens em pormenor.
A sintaxe de ênfase permite reforçar ou atenuar conceitos isolados sem reescrever o prompt inteiro, e a ênfase numérica negativa proporciona uma remoção dirigida de um conceito que um prompt negativo abrangente suprimiria em excesso. O sampler, os passos, a guidance e a semente estão todos expostos diretamente na interface, pelo que um resultado de que goste pode ser reproduzido ou variado deliberadamente e não por acaso.
É a funcionalidade a que o NovelAI mais deve a sua reputação entre quem ilustra. Em vez de descrever duas pessoas num único prompt e torcer para que o modelo não misture os seus atributos, escreve um bloco de prompt separado por personagem. A página inicial demonstra o padrão com dois prompts de personagem — um para uma rapariga de cabelo verde e pupilas em forma de estrela num vestido vermelho, outro para uma mulher de cabelo laranja com casaco preto a segurar um cone de gelado — posicionadas lado a lado. O V4 introduziu isto como capacidade de primeira ordem e o V5 estende o sistema de posicionamento até 22 personagens numa mesma imagem.
O transbordo de atributos entre personagens é o modo de falha mais teimoso na geração anime com vários sujeitos, e uma estrutura de prompts por personagem enfrenta-o ao nível da arquitetura em vez de recorrer a truques de redação.
O campo Undesired Content é onde lista aquilo que o modelo deve evitar, e ocupa um separador do mesmo campo de entrada do prompt principal. O NovelAI inclui predefinições injetadas automaticamente, e vale a pena ser preciso quanto ao seu conteúdo, porque o nome convida a uma leitura errada. A predefinição Heavy V4.5 Full, por exemplo, injeta: lowres, artistic error, film grain, scan artifacts, worst quality, bad quality, jpeg artifacts, very displeasing, chromatic aberration, dithering, halftone, screentone, multiple views, logo, too many watermarks, negative space, blank page.
Cada um destes termos é um descritor de qualidade. A documentação formula o propósito da mesma maneira: injetar as predefinições faz com que «a IA evite alguns aspetos genericamente indesejáveis e produza conteúdo de maior qualidade». Existe uma variante Human Focus que acrescenta termos anatómicos como bad anatomy e mismatched pupils, e uma variante Furry Focus para os conjuntos de dados furry e kemono. Há ainda uma opção «No Default UC» que desativa por completo as predefinições. Trata-se de um sistema de qualidade de imagem, não de um sistema de segurança de conteúdo, e os utilizadores não devem confundi-lo com o segundo.
Para além do texto para imagem, a plataforma traz uma cadeia de edição completa. O Image2Image altera pormenores seguindo uma composição existente, e o Enhance eleva o nível de detalhe de uma geração já concluída. O Vibe Transfer extrai as qualidades estéticas de uma imagem de referência e aplica-as como inspiração visual direta a novas gerações — útil para manter um aspeto coerente ao longo de uma série sem manter um prompt de estilo interminável. O Inpaint permite pintar sobre uma zona para corrigir um erro ou pedir algo diferente apenas nessa região.
O grupo Director Tools trata do pós-processamento: remover fundo, arte de linha, esboço, colorização, emoção e desobstrução. Operam sobre uma geração terminada e pertencem àquela classe de pequenos utilitários que normalmente exigem abrir outro editor; tê-los ao lado do histórico de geração poupa uma quantidade apreciável de idas e vindas.
O lado do texto funciona desde junho de 2021 e possui a sua própria linhagem de modelos, cada um batizado com o nome de uma figura mitológica. O Xialong, lançado a 31 de março, é o carro-chefe atual: um ajuste fino de 355 mil milhões de parâmetros sobre o GLM-4.6 da ZhipuAI com o conjunto de dados narrativo do NovelAI, e o maior ajuste fino que a equipa produziu. Oferece 28 672 tokens de contexto no site mais uma janela de arrasto de 8 192 tokens, o que significa que o contexto utilizável no editor de histórias oscila na realidade entre 28 672 e 36 864 tokens à medida que uma história cresce, antes de ser reduzido de novo. A documentação assinala uma propriedade de conceção deliberada: ao contrário dos modelos treinados com aprendizagem por reforço, o Xialong «produz resultados genuinamente diferentes nas repetições e maior variedade de nomes» — algo que pesa bastante se o seu método consiste em relançar um parágrafo até acertar.
Os modelos anteriores continuam elucidativos quanto à trajetória da plataforma. O Kayra é um modelo próprio de 13 mil milhões de parâmetros treinado com cerca de 1,6 biliões de tokens e uma janela de 8 192 tokens, lançado a 28 de julho de 2023. O Clio é um irmão de 3 mil milhões de parâmetros de maio de 2023 com a mesma janela. O Erato, de setembro de 2024, assenta no Llama 3 70B Base com treino continuado sobre os dados de pré-treino Nerdstash do NovelAI. Os assinantes Opus mantêm ainda acesso ao Xialong bem como aos modelos experimentais antigos Krake e Llama 3 Erato.
Dois interruptores merecem menção porque passam facilmente despercebidos. O modo Furry antepõe a tag fur dataset, ao seu prompt, repondo o comportamento dos antigos modelos furry dedicados dentro da arquitetura V4.5 e V5. Separadamente, colocar background dataset, no início de um prompt desloca a saída para paisagens, retratos de animais e naturezas-mortas com acabamento fotográfico, sem pessoas. Esta segunda opção responde discretamente à queixa habitual de que os modelos afinados para anime não conseguem produzir um simples plano de ambiente.
A síntese de voz vem incluída em vez de ser vendida à parte: a avaliação gratuita compreende 100 gerações e todos os planos pagos a partir do Tablet são ilimitados. O NovelAI Explore é a galeria pública da plataforma e é inteiramente voluntária: nada é partilhado se não o carregar deliberadamente. Cada publicação passa por revisão manual antes de aparecer, e as regras de carregamento proíbem material NSFW, tags de direitos de autor, personagem ou artista, e publicidade. As imagens produzidas com Character Reference, Image-to-Image ou Inpainting não podem sequer ser publicadas; as perguntas frequentes explicam que são «mais difíceis de moderar e mais fáceis de usar indevidamente».
O fluxo de trabalho mais comum consiste em desenhar uma personagem e depois manter esse design estável ao longo de muitas imagens. Entre o controlo da semente, o Vibe Transfer para coerência estética e os blocos de prompt por personagem, isto é alcançável sem treinar um modelo próprio — o que importa, já que a plataforma não tem atualmente planos para permitir que os utilizadores treinem os seus próprios módulos de imagem. Grupos de jogos de mesa, autores de banda desenhada online e artistas de personagens originais recorrem a isto para construir uma bíblia visual antes de se comprometerem com a arte final. O desafio é sustentar imagens anime coerentes ao longo de dezenas de tomadas.
Como a geração de texto e de imagem vive na mesma assinatura, um autor a redigir uma light novel pode gerar ilustrações de cena sem estabelecer uma segunda relação com um fornecedor. Os 28 672 tokens de contexto do Xialong bastam para reter uma quantidade substancial de ambientação já estabelecida, e o mecanismo Lorebook injeta as entradas pertinentes apenas quando são acionadas, o que mantém o gasto de contexto proporcional ao que uma cena realmente exige.
A novidade central do V5 — páginas completas numa só geração — altera aquilo que aqui é exequível. Anteriormente, compor uma página implicava gerar os quadros separadamente e montá-los à mão; combinada com as melhorias na renderização de texto multilingue, a saída de página numa única passagem representa uma mudança real de fluxo de trabalho para quem produz narrativa sequencial. Ainda assim, conte com afinar quadros através do Inpaint: uma página inteira gerada de uma vez raramente fica correta em todos os quadros.
O modo Text Adventure tem interface e mecânica de comandos próprias. O Xialong lida com ele com uma ressalva documentada pela equipa: no modo de aventura textual as entradas do utilizador são enviadas como instruções, e quem conduzir aventuras fora do modo dedicado deve usar a sintaxe de instrução { em vez do prefixo tradicional >. Quem migrar um fluxo de aventura antigo para o Xialong precisa de saber isto, sob pena de as saídas derivarem.
As Director Tools — em particular remover fundo e arte de linha — tornam o NovelAI utilizável como fonte a montante de cadeias que terminam noutro lugar. A saída com fundo transparente do V5 importa-se diretamente para uma ferramenta de paginação ou animação, e a extração de arte de linha fornece uma base para colorização manual. Segundo os termos declarados pela plataforma, mantém a propriedade daquilo que gera, o que torna este tipo de utilização a jusante juridicamente simples do ponto de vista do fornecedor, ainda que as questões de direitos de autor sobre o próprio resultado continuem a ser da sua responsabilidade.
Como nada é registado nem armazenado do lado do servidor, o NovelAI é muito usado para trabalhos que as pessoas não querem deixar nos servidores de um fornecedor: manuscritos inéditos, conceitos de personagem encomendados sob acordo de confidencialidade, ou simplesmente material que um utilizador considera privado. O compromisso é real e merece ser dito com franqueza: nada ser armazenado significa que nada é recuperável, e uma recarga da página de imagens esvazia a fila do histórico.
O registo faz-se no site principal e exige verificação por e-mail antes de as quotas da avaliação gratuita serem desbloqueadas. A avaliação gratuita Paper concede 30 gerações de imagem até 1024x1024, 50 gerações de texto e 100 gerações de síntese de voz. Tudo o que configurar e cada história que escrever durante a avaliação transitam se subscrever, pelo que nada se perde em montar as coisas devidamente desde o início.
É o passo que os novos utilizadores mais saltam. Escolher V5 Curated em vez de V5 Full altera aquilo que o modelo consegue alcançar, e a descrição do modelo atualmente selecionado surge mesmo por cima da caixa de prompt — clique nela para trocar. Se estiver a gerar em direto ou num contexto partilhado, a documentação recomenda explicitamente o Curated. Se um conceito concreto não sair, o Full é o modelo com o conjunto de dados mais amplo.
Comece pelo sujeito e pelo enquadramento, acrescente depois as tags de aparência, a seguir o ambiente e por fim o estilo. Introduzir tudo de uma vez torna impossível perceber que termo causou o problema. Use o botão do dado — o gerador de prompts aleatórios — quando quiser um ponto de partida em vez de um campo vazio.
As definições por omissão são um ponto de partida razoável, e a própria recomendação da plataforma para poupar consumo é elucidativa: como o custo escala com o número de píxeis da resolução escolhida, baixar a resolução poupa mais do que baixar o número de passos. Mantenha os passos em 28 ou menos e gere uma imagem de cada vez se estiver no Opus e quiser permanecer dentro das condições de geração gratuita.
Se a composição está certa mas um pormenor falha, use o Inpaint em vez de regenerar. Se a composição falha mas a estética acerta, use o Image2Image com a força ajustada. Se um conceito indesejado reaparece vezes sem conta, acrescente-o ao Undesired Content ou recorra à ênfase numérica negativa para uma remoção mais cirúrgica. A documentação oferece um exemplo lateral verdadeiramente útil: a tag freckles (sardas) pode criar artefactos, e acrescentar tattoo (tatuagem) ao Undesired Content pode eliminar os artefactos mantendo as sardas.
Nunca é demais insistir. As gerações são por sessão e perdem-se ao recarregar ou ao sair da página de geração de imagens. Existe um botão no fundo da barra lateral do histórico que descarrega a sessão inteira num ficheiro .zip — use-o antes de fechar o separador, não depois.
Em projetos de texto, invista cedo em Memory, Author's Note e no Lorebook em vez de confiar no contexto em bruto. As entradas do Lorebook ativam-se por palavras-chave, o que significa que um corpo extenso de ambientação estabelecida só custa contexto quando é pertinente. As histórias exportam-se como ficheiros JSON .story e .scenario incluindo todas as definições, Memory, Author's Note, entradas de Lorebook e módulos, e há um botão «Download All Stories» em User Settings > Account para cópia em massa.
Comece com as predefinições recomendadas ativas, porque melhoram comprovadamente a qualidade da saída, mas perceba o que estão a fazer. Se o seu estilo inclui intencionalmente tramas ou meios-tons — plausível em trabalho de manga —, a predefinição Heavy está ativamente a combatê-lo, uma vez que ambos os termos constam dela. Passe para Light, ou para No Default UC e construa a sua própria lista.
Se um prompt produz resultados confusos no Full, correr o mesmo prompt no Curated revela frequentemente se o problema está no seu prompt ou no conjunto de dados. O conjunto de treino mais limpo do Curated tende a produzir composições mais previsíveis, pelo que um prompt que funciona no Curated e falha no Full indica normalmente um problema de ponderação e não de descrição.
Se está no Opus, vale a pena interiorizar as quatro condições da geração sem Anlas: uma imagem de cada vez, sem imagem base, pelo menos tamanho Normal e 28 passos no máximo. A geração em lote, o image-to-image e contagens elevadas de passos saem todos da faixa gratuita. Muitos utilizadores queimam Anlas sem darem por isso simplesmente por deixarem a contagem de lote acima de um.
Como nada é armazenado do lado do servidor, um resultado reproduzível depende inteiramente de ter registado a semente a par do prompt e das definições. As imagens descarregadas transportam metadados de geração, mas se exportar num formato que os remove, a receita desaparece. Verifique a definição de formato de descarga antes de uma sessão longa.
Dado o tratamento que o tokenizador T5 dá aos caracteres não latinos no V4 e V4.5, as tags em inglês são o caminho fiável. É contraintuitivo para um produto construído em torno do anime, e é o tipo de pormenor que produz resultados silenciosamente medíocres em vez de erros evidentes.
Os termos concedem-lhe uma janela de exportação de 45 dias após o fim de uma assinatura, findos os quais a Anlatan se reserva o direito de eliminar o conteúdo. Este é cifrado com uma chave derivada da sua palavra-passe e do seu e-mail, e os termos são explícitos ao afirmar que uma palavra-passe perdida significa conteúdo irrecuperável. Para um projeto sério, as exportações locais periódicas não são opcionais.
Se der por si a escrever um preâmbulo de estilo de 40 tokens em cada prompt, é sinal de que deve passar ao Vibe Transfer com uma imagem de referência. Sustenta a coerência estética com mais fiabilidade do que tags de estilo repetidas e liberta orçamento de prompt para o sujeito.
Os ilustradores de anime e manga constituem o encaixe mais nítido. O vocabulário de tags, os prompts multipersonagem, a seleção de seis modelos e a cadeia de inpainting foram todos construídos em torno deste estilo em concreto e não oferecidos como uma opção entre muitas. Quem produz maioritariamente em estilo anime obterá aqui mais por cada dólar do que num modelo generalista onde o anime é apenas um modificador de prompt.
Os autores de ficção longa, sobretudo os que trabalham em formatos por episódios ou de romance web, formam o outro público central. A combinação de 28 672 tokens de contexto, de um Lorebook que cresce com a complexidade de uma história e de geração de texto ilimitada já a partir do plano de 10 dólares torna a economia previsível de um modo que a tarifação por token de uma API não permite.
Os criadores de jogos de mesa e ficção interativa ganham com o modo Text Adventure aliado à arte de personagens na mesma assinatura — uma combinação que de outro modo significaria dois fornecedores.
Os utilizadores sensíveis à privacidade — autores sob acordo de confidencialidade, pessoas a desenvolver propriedade intelectual inédita ou quem se sinta desconfortável com o registo de prompts — ficam servidos por esta arquitetura sem registo nem armazenamento de uma forma que poucos concorrentes igualam.
Quem deve procurar noutro lado: quem precise de saídas fotorrealistas, já que os modelos estão afinados para anime por conceção; equipas que exijam funcionalidades de colaboração, espaços de trabalho partilhados ou controlos administrativos, nenhum dos quais faz parte do produto; programadores que queiram uma API pública documentada para integração de terceiros; e quem exija uma aplicação móvel nativa em vez de uma aplicação web progressiva. Também ficarão desiludidos os utilizadores que precisem de um escalão gratuito permanente, pois a quota gratuita é uma avaliação única.
O NovelAI é entregue inteiramente através do navegador. As perguntas frequentes referem que qualquer computador ou dispositivo móvel com um navegador atualizado o consegue executar, desde que haja ligação estável, e que o site está adicionalmente disponível como aplicação web progressiva instalável a partir do próprio site através de um navegador móvel. Essa via PWA constitui a experiência móvel oficial.
Não existe aplicação nativa oficial. Uma pesquisa na App Store da Apple devolve vários produtos com nomes confusamente semelhantes — «Novel AI - AI Story Generator», «NovelAI | AI Story Generator», «Novel AI : AI Story Generator» — publicados por programadores individuais sem relação com a Anlatan. São produtos distintos que partilham o nome por coincidência, e as suas classificações, faixas etárias e avaliações nada dizem sobre o serviço alojado em novelai.net. Quem procurar em lojas de aplicações deve saber que aí não encontrará o original.
A infraestrutura assenta na API própria da Anlatan, com os modelos treinados e afinados alojados em máquinas fornecidas pela CoreWeave. Os pagamentos são processados através da Chargebee, e o apoio funciona por e-mail em support@novelai.net, com um contacto empresarial separado em contact@anlatan.ai. É mantida uma página pública de estado em status.novelai.net.
Há três escalões de assinatura mensal mais uma avaliação gratuita única. As assinaturas renovam-se exatamente 30 dias após o pagamento.
Paper (avaliação gratuita) exige uma conta verificada por e-mail e fornece 30 gerações de imagem até 1024x1024, 50 gerações de texto e 100 gerações de síntese de voz. As definições e histórias criadas durante a avaliação transitam ao subscrever. Trata-se de uma avaliação, não de um escalão gratuito: as quotas não se renovam mensalmente.
Tablet — 10 dólares por mês. Geração ilimitada de texto e de síntese de voz durante toda a assinatura, mais 1 000 Anlas de assinatura por mês para geração de imagens.
Scroll — 15 dólares por mês. Tudo o que o Tablet inclui, com um tamanho de contexto maior para a narrativa, mais os mesmos 1 000 Anlas de assinatura.
Opus — 25 dólares por mês. O maior contexto, de 28 672 tokens, acesso exclusivo ao Xialong bem como aos modelos experimentais antigos Krake e Llama 3 Erato, 10 000 Anlas de assinatura por mês, e geração de imagens sem gastar Anlas sujeita a quatro condições: uma imagem de cada vez, sem imagem base, pelo menos tamanho Normal e um valor de passos de 28 ou inferior.
Os três escalões recebem 20 % de desconto nas compras de Anlas a pedido. Existe uma opção de pagamento conforme o uso para quem não pretenda uma assinatura mensal.
Duas mecânicas em torno dos Anlas merecem atenção. Primeira, a reserva de Anlas de assinatura é uma reposição e não uma acumulação: é reposta até ao montante do seu escalão todos os meses, e apenas se o saldo estiver abaixo desse montante, pelo que os Anlas não utilizados nunca se somam. Segunda, e mais recente, na sequência do lançamento do V5 a Anlatan anunciou que 31 dias após a estreia quaisquer Anlas de assinatura não utilizados serão repostos a zero no momento em que a assinatura terminar — e se cancelar antecipadamente, serão repostos a zero na data em que a assinatura teria originalmente terminado. A empresa nota ainda que nunca conseguiu restituir os Anlas do mês anterior ao processar um reembolso.
Quanto a reembolsos, os termos são diretos: os serviços por assinatura não oferecem reembolso a menos que a empresa o conceda expressamente. Cancelar interrompe cobranças futuras e o acesso mantém-se até expirar o período pago. Note também que não pode comprar Anlas adicionais depois de ter cancelado.
O Midjourney entrega uma amplitude estilística maior e saídas fotorrealistas e pictóricas mais fortes, mas nada oferece do lado da geração de texto e um controlo bastante menos granular, ao nível das tags, sobre os atributos das personagens. É a melhor escolha quando o anime é apenas um entre vários estilos de que precisa.
O Stable Diffusion em local, através de interfaces como o ComfyUI ou o Automatic1111, oferece controlo total, custo zero por imagem depois do hardware e acesso a um vasto ecossistema de checkpoints e LoRA de anime da comunidade. As contrapartidas são uma GPU capaz, um esforço de instalação assinalável e manutenção contínua. Os próprios modelos de imagem do NovelAI começaram como derivados do Stable Diffusion antes de a geração V4 passar a modelos treinados de raiz, pelo que a linhagem é aqui diretamente pertinente.
O Sudowrite e assistentes de ficção dedicados semelhantes competem na metade da escrita com ferramentas de desenvolvimento narrativo mais estruturadas — esquemas, oficinas de personagens, passagens de revisão — mas não geram imagens e apoiam-se em geral em modelos de fronteira de terceiros em vez de ajustes finos narrativos treinados de propósito.
Os assistentes generalistas como o ChatGPT ou o Claude superam os modelos do NovelAI em análise, pesquisa e retorno estrutural, e saem muito mais baratos para uso ocasional. São mais restritivos quanto à temática, não oferecem afinação comparável para ficção longa, e as suas capacidades de imagem não são especializadas em anime.
O AI Dungeon é a comparação mais próxima especificamente para ficção interativa e dispõe de aplicação móvel nativa, que o NovelAI não tem. O NovelAI mantém em geral vantagem na qualidade da prosa e na extensão do contexto, e inclui uma geração de imagens que o AI Dungeon não iguala.
O resumo honesto: o NovelAI vence na combinação específica de controlo de imagem afinado para anime, ajustes finos narrativos de contexto longo, geração privada e uma assinatura única de preço fixo. Se precisar apenas de uma dessas metades, uma alternativa especializada servi-lo-á provavelmente melhor e muitas vezes mais barato.
É a alteração recente mais importante e chegou no dia seguinte ao lançamento do V5. A Anlatan anunciou que os assinantes Opus enfrentam agora limites de uso no NovelAI Diffusion V5 em concreto, ao passo que todos os restantes modelos de imagem e todos os modelos de texto permanecem ilimitados. A causa declarada é uma restrição de computação decorrente de a arquitetura do V5 ser 2,5 vezes maior do que a do V4.5, agravada por aquilo que a empresa descreve como um pequeno número de utilizadores a consumir uma fatia desproporcionada da computação.
O limite funciona como um saldo que se recarrega continuamente: cada geração do V5 em resoluções normais e até 28 passos consome dele, e o saldo repõe-se hora a hora, minuto a minuto, esteja ou não a gerar. Uma recarga completa a partir do zero demora cerca de uma semana, e a empresa afirma ter dimensionado a capacidade de modo a que a maioria dos assinantes Opus nunca a esgote. Se esgotar, pode continuar gastando Anlas de assinatura ou comprados. Tanto a resolução como o número de passos influenciam o consumo, e baixar a resolução poupa mais.
Os utilizadores devem pesar isto com honestidade: a proposta do Opus era antes entendida como geração ilimitada sujeita a quatro condições simples, e no modelo mais recente passa a ser um saldo medido. A empresa optou por esta via em vez de aumentar preços de forma generalizada ou introduzir atrasos artificiais, e divulgou-a diretamente, mas é uma alteração substancial daquilo que o escalão de topo compra.
Os modelos de imagem do NovelAI foram construídos sobre material anime cuja proveniência foi publicamente contestada. O meio tecnológico japonês GIGAZINE noticiou em outubro de 2022 que o conjunto de dados usado no treino incluía numerosas imagens do fórum de ilustração Danbooru, a par de uma análise técnica das modificações que o NovelAI aplicou ao Stable Diffusion: melhorar o CLIP para prompts baseados em tags, usar recorte aleatório em vez de recorte central e triplicar o comprimento máximo do prompt.
O próprio Danbooru fixou a sua posição sem ambiguidade: «O Danbooru não está afiliado ao NovelAI nem a qualquer outro gerador de IA, e não apoiamos nem sancionamos o que fazem», acrescentando que não é um site de IA e que não utiliza as obras carregadas para treino de IA. O site nota ainda que apagar uma obra do Danbooru não a retirará de um modelo já treinado, e encaminha os artistas para contactarem diretamente o NovelAI. A entrada da Wikipédia em inglês sobre o NovelAI regista que o serviço gerou controvérsia considerável pelas imagens produzidas, e que o Pixiv respondeu implementando requisitos de rotulagem de IA embora recusando eliminar por completo as obras assistidas por IA.
Quem planeie uso comercial deve incorporar este historial. Está por resolver mais do que arrumado, e os próprios termos da plataforma transferem a responsabilidade para si.
As perguntas frequentes são frontais: o NovelAI não reclama a propriedade daquilo que cria, mas «é possível que a IA gere conteúdo que possa ser considerado material protegido por direitos de autor», e se pretender partilhar publicamente ou comercializar, «é da sua própria responsabilidade assegurar que não infringe qualquer material protegido». Os termos reforçam que mantém todos os direitos e a propriedade do seu conteúdo, ao passo que a Anlatan declina responsabilidade pelo uso fora do serviço. Não existe uma oferta de indemnização como a que alguns fornecedores de imagem orientados para empresas já disponibilizam.
A geração por sessão implica que uma recarga do navegador ou a saída da página de imagens esvazia permanentemente a sua fila de histórico. Não há recuperação do lado do servidor porque não existe cópia do lado do servidor. No caso das histórias, o conteúdo é cifrado com uma chave derivada da sua palavra-passe e do seu e-mail, e os termos afirmam claramente que uma palavra-passe perdida significa conteúdo irrecuperável. Após o fim de uma assinatura existe uma janela de exportação de 45 dias antes de a Anlatan se reservar o direito de eliminar o conteúdo armazenado.
Os potenciais utilizadores devem compreender a postura efetiva da plataforma em vez de inferirem uma. Os termos de serviço exigem ter 18 anos ou mais e capacidade para celebrar um contrato legal nos Estados Unidos, mas não descrevem qualquer mecanismo de verificação para além da confirmação por e-mail. A cláusula de má conduta enumera comportamentos proibidos — revenda, partilha de conta, contornar restrições de acesso, abuso de bots, substituir profissões licenciadas, contornar negócios regulados como o jogo — e não contém restrição alguma sobre a temática gerada. As predefinições de Undesired Content são filtros de qualidade e não de segurança, e podem ser desativadas por completo. A própria formulação da documentação sobre o modelo Curated, recomendado a quem queira «garantir com toda a certeza que não gera imagens sensíveis por acidente», dá a entender o que os modelos Full conseguem produzir.
A única proibição de conteúdo explícita aplica-se ao NovelAI Explore, a galeria pública voluntária, onde os carregamentos passam revisão manual e as regras vedam material NSFW, tags de direitos de autor, personagem ou artista, e publicidade. Essa proibição rege a partilha pública, não a geração privada. As próprias perguntas frequentes da Anlatan descrevem o serviço como oferecendo «um nível de liberdade sem precedentes ao utilizador» e «um recreio ilimitado para a sua imaginação». Utilizadores institucionais, docentes e quem implante isto num ambiente partilhado ou supervisionado devem planear em conformidade.
À data de redação, a documentação oficial dos modelos de imagem continua a apresentar o V4.5 como «atual», ao passo que tanto a página inicial como o blogue oficial anunciaram o V5. Separadamente, as perguntas frequentes indicam limites de contexto de texto de 3 072 tokens para o escalão mais baixo e 8 192 para o mais alto, enquanto a documentação de assinatura e as páginas de modelos descrevem 28 672 tokens para o Opus. São contradições entre fontes oficiais vigentes e não uma única página desatualizada, e os utilizadores devem tratar as páginas de assinatura e de modelos como autoritárias quanto ao tamanho do contexto.
Não existe uma API pública documentada para integração de terceiros. A plataforma declara não ter atualmente planos para permitir que os utilizadores criem os seus próprios módulos de imagem. Não há colaboração, espaços de trabalho partilhados nem funcionalidades administrativas: é uma ferramenta criativa de utilizador único. E a limitação do tokenizador T5 significa que os caracteres não latinos, incluindo japonês, não são suportados de forma fiável dentro dos prompts no V4 e V4.5.
Não existe um corpo substancial de avaliação independente verificável. As tentativas de obter classificações do G2 e do Product Hunt foram bloqueadas, e a ficha do diretório Toolify mostra zero avaliações de utilizadores. Circulam muitíssimos artigos do género «análise do NovelAI 2026», mas os que emergem nas pesquisas são publicados por plataformas de geração de imagens concorrentes e sites de marketing de afiliação, vários dos quais contêm erros factuais sobre a geração de modelos atual. Nenhum é citado aqui, e os leitores devem descontá-los em conformidade. A estimativa de tráfego de terceiros da Toolify coloca o site em cerca de 4,2 milhões de visitas mensais com uma duração média de visita superior a dez minutos — uma estimativa, não um número divulgado, ainda que a profundidade de envolvimento seja coerente com uma ferramenta usada em sessões de trabalho longas.
Existe uma avaliação gratuita mas não um escalão gratuito. Uma conta verificada por e-mail obtém 30 gerações de imagem até 1024x1024, 50 gerações de texto e 100 gerações de síntese de voz, todas quotas únicas que não se renovam mensalmente. As definições e histórias criadas durante a avaliação transitam se subscrever. Continuar exige um plano pago a partir de 10 dólares por mês, ou a opção de pagamento conforme o uso.
O NovelAI não reclama a propriedade do seu conteúdo e os termos estabelecem que mantém todos os direitos. Contudo, as perguntas frequentes são explícitas ao afirmar que a IA pode produzir material passível de ser considerado protegido, e que rever a saída antes de um uso público ou comercial é da sua responsabilidade. A plataforma declina responsabilidade pelo uso fora do serviço e não oferece indemnização. Dadas as disputas documentadas sobre a proveniência dos dados de treino, os utilizadores comerciais devem formar o seu próprio juízo de risco.
O Anlas é a moeda consumida pela geração de imagens. O Tablet e o Scroll incluem 1 000 por mês e o Opus inclui 10 000, repostos mensalmente até ao montante do escalão apenas se o saldo estiver abaixo dele: não se acumulam. Os utilizadores Opus podem gerar sem gastar Anlas desde que produzam uma imagem de cada vez, sem imagem base, em tamanho Normal ou superior, e mantendo-se em 28 passos ou menos. Todos os escalões beneficiam de 20 % de desconto em compras adicionais de Anlas. Desde o lançamento do V5, os Anlas de assinatura não utilizados são repostos a zero quando a assinatura termina.
Sim, segundo as perguntas frequentes oficiais. As gerações de imagem são por sessão e não são armazenadas nos servidores do NovelAI, e os pedidos, carregamentos, edições e gerações não são registados. Os pedidos são cifrados durante o processamento. A consequência prática é que tem de descarregar tudo o que quiser guardar: recarregar ou sair da página de geração de imagens limpa a fila do histórico sem qualquer forma de a recuperar.
Há seis modelos selecionáveis entre as gerações V5, V4.5 e V4, cada um em variantes Full e Curated. O Curated é treinado sobre um conjunto menor, mais limpo e mais focado, sendo a escolha recomendada para uso geral e para transmissões em direto. O Full recorre a um conjunto de dados mais amplo e menos curado, servindo de recurso quando o Curated não consegue produzir um conceito concreto. O V5 é o mais recente e capaz, mas é o único modelo sujeito aos limites de uso do Opus.
Nenhuma nativa oficial. O NovelAI funciona em qualquer navegador móvel moderno e pode ser instalado como aplicação web progressiva a partir do site. Várias fichas da App Store têm nomes muito parecidos mas são publicadas por programadores terceiros sem relação com a Anlatan.
O Xialong, o carro-chefe atual, oferece 28 672 tokens no site mais uma janela de arrasto de 8 192 tokens, pelo que o contexto utilizável no editor se move entre 28 672 e 36 864 tokens à medida que uma história cresce. O tamanho do contexto depende do escalão, cabendo ao Opus o maior. Note que a página de perguntas frequentes continua a citar números antigos bastante menores, o que contradiz a documentação de assinatura e de modelos; é esta última que reflete os modelos atuais.
Segundo os termos de serviço os utilizadores têm de ter 18 anos ou mais, e esses termos não descrevem qualquer verificação para além da confirmação por e-mail. A cláusula de má conduta abrange comportamentos como revenda e partilha de conta mas não impõe restrição sobre a temática gerada. As predefinições de Undesired Content filtram qualidade de imagem, não conteúdo, e podem ser desativadas. A única regra de conteúdo explícita — nada de NSFW — aplica-se aos carregamentos para a galeria pública voluntária Explore, que são revistos manualmente, e não à geração privada.
Os termos estabelecem que os serviços por assinatura não oferecem reembolso a menos que a empresa o conceda expressamente. Cancelar impede cobranças futuras e o acesso mantém-se até ao fim do período pago. Tenha presente que após cancelar não pode comprar Anlas adicionais, e que os Anlas de assinatura não utilizados são agora repostos a zero quando a assinatura termina.
O V5 foi lançado a 21 de agosto de 2026 nas variantes Curated e Full, trazendo uma compreensão mais apurada da linguagem natural, prompts multilingues alargados, posicionamento de personagens reformulado para até 22 figuras, maior fidelidade, saída com transparência alfa verdadeira e um novo nível de melhoria Max para ampliação. Trouxe igualmente os primeiros limites de uso no escalão Opus, aplicáveis apenas ao V5, porque a arquitetura do modelo é 2,5 vezes maior do que a do V4.5.