API
Modelos NSFW de código aberto na sua GPU ou API hospedada?
Resposta curta: rode pesos abertos por conta própria se você quer controle total e tem, ou vai alugar, uma GPU com memória suficiente, e aceite que instalação, manutenção, controle de conteúdo e exposição jurídica passam a ser trabalho seu. Chame uma API hospedada se prefere enviar uma requisição e receber um arquivo de volta, pagar por execução em créditos e deixar hardware e manutenção de modelo com terceiros. As seções abaixo listam o que cada lado custa de verdade; todo fato externo vem de uma ficha de modelo (model card), licença, README ou termos de um host listados em Fontes, no fim, lidos na data indicada ali.
Fontes externas consultadas em 10 de setembro de 2026; fichas de modelo, licenças e READMEs mudam.
O que “no GitHub” costuma querer dizer
Uma busca por gerador NSFW no GitHub costuma trazer duas coisas diferentes. Uma são os pesos, o modelo treinado em si, em geral publicado no Hugging Face. A outra é o código que carrega esses pesos e os executa: um script de inferência, uma interface web, um grafo de nós. O código costuma ser a parte fácil. Os pesos e a licença que vem com eles é que decidem o que você pode fazer.
Aberto não quer dizer uma coisa só. O FLUX.1 [schnell] é descrito na ficha do modelo como um modelo de 12 bilhões de parâmetros lançado sob Apache 2.0, utilizável para fins pessoais, científicos e comerciais. O irmão dele, o FLUX.1 [dev], fica atrás de uma barreira de download em que você precisa aceitar antes uma licença não comercial. O Stable Diffusion XL base 1.0 é distribuído sob a licença CreativeML Open RAIL++-M, cujo Anexo A lista restrições de uso, e o parágrafo 5 dessa licença exige que você obrigue todas as pessoas a quem permitir o uso do modelo a respeitá-las.
Pesos de vídeo também são publicados. O repositório do Wan2.2 declara que seus modelos são licenciados sob Apache 2.0, e o README acrescenta, com as próprias palavras, “You are fully accountable for your use of the models”. Essa frase é a troca da auto-hospedagem em miniatura.
A linha do hardware no orçamento
Modelos de imagem são a ponta mais leve; é no vídeo que a memória vira o custo decisivo. O README do Wan2.2 diz que o comando de GPU única para o modelo maior de texto para vídeo exige uma GPU com pelo menos 80GB de VRAM, e que o modelo menor, que combina texto e imagem para vídeo, roda com pelo menos 24GB, citando uma RTX 4090 como exemplo. Outros modelos informam outros números, e a página de cada um é o lugar para lê-los.
Comprando essa placa ou alugando por hora, o custo corre enquanto a GPU está reservada, e não só enquanto produz algo que você vai guardar. Uma API hospedada transforma isso em preço por execução: nada é devido enquanto você não está gerando.
Alugar traz junto um segundo livro de regras: o do host. A seção 7 dos termos de serviço do RunPod, atualizados pela última vez em 24 de março de 2026, classifica conteúdo adulto gráfico, imagens e outros produtos adultos como conteúdo não autorizado, e publicar esse tipo de conteúdo pode levar a encerramento imediato e banimento vitalício. Não encontramos nesse documento uma redação separada para o produto serverless dele, então quem planeja montar um ambiente NSFW no RunPod deve ler esses termos antes da ficha do modelo. Outros hosts de GPU escrevem as próprias regras, e elas merecem a mesma leitura.
O trabalho que nenhuma ficha de modelo lista
Tirar a primeira imagem de pesos abertos pode ser rápido. Manter um serviço funcionando é trabalho contínuo: drivers e bibliotecas que precisam concordar entre si, arquivos de pesos enormes para baixar e armazenar, novas versões que mudam o código de carregamento, uma fila assim que chega mais de uma requisição ao mesmo tempo, armazenamento para as saídas e algo que reinicie o processo quando ele cair de madrugada.
Nada disso é difícil isoladamente, e há equipes que gostam disso. É apenas trabalho que a ficha do modelo não menciona e que ainda precisa ser feito, semana após semana, por quem cuida da máquina.
Controle de conteúdo e risco jurídico passam para você
Rodar pesos por conta própria remove todo filtro que você não construiu. Muitas vezes é esse o objetivo, e isso também significa que nada fica entre um prompt e um resultado a menos que você coloque ali. Se outras pessoas usam sua instalação, o operador é você: as regras sobre menores de idade e sobre pessoas reais sem consentimento ficam para você escrever e fazer cumprir, e uma licença no estilo RAIL espera que você repasse as restrições dela aos seus usuários. O que isso significa juridicamente depende de onde você opera, e vale ouvir alguém qualificado antes de abrir um serviço ao público.
Em um serviço hospedado, essas verificações já existem. Na Vellria, sexualizar menores de idade é proibido, e os prompts que uma verificação automática reconhece como fazendo isso são recusados antes que um único crédito saia do saldo; os termos proíbem pessoas reais sem consentimento, e o provedor que hospeda um modelo pode interromper um trabalho pelas próprias regras, com os créditos reembolsados.
Como o lado hospedado aparece no código
O caminho hospedado é uma requisição HTTPS: um id de modelo, um prompt e os parâmetros que esse modelo aceita, enviados com uma chave Bearer que começa com vll_. A API aceita o trabalho, devolve o id dele e você consulta o resultado até ele ficar pronto. Não há pesos para baixar nem GPU para reservar, e um trabalho que falha devolve os créditos sozinho.
Os modelos de imagem, seus ids e preços estão na página da API de imagem NSFW, os modelos de vídeo na página da API de vídeo NSFW, e todos os endpoints estão na referência da API. Para ligar uma primeira requisição a um aplicativo, chamar a API pelo código mostra o passo a passo.
Uma coisa que esta página deliberadamente não diz é se algum modelo do nosso catálogo tem pesos abertos. Entradas do catálogo que compartilham o nome de família com um lançamento publicado são versões diferentes, e não afirmamos nada, em nenhum sentido, sobre os pesos delas.
A decisão, em um parágrafo
Hospede você mesmo quando o requisito é controle: você precisa de um modelo que o catálogo não oferece, quer fazer fine-tuning, as saídas nunca podem sair das suas próprias máquinas, ou você já tem a GPU e as horas para cuidar dela. Use uma API hospedada quando o requisito é resultado: você quer imagens e clipes dentro de um produto nesta semana, seu volume é irregular e você prefere pagar por execução a manter uma placa ocupada. Muitas equipes fazem as duas coisas, e a escolha pode ser refeita sempre que os números mudarem.
Fontes
Todo fato externo acima vem de um destes cinco documentos. Os quatro primeiros são publicados pelos próprios autores dos modelos e foram lidos na data mostrada no topo; os termos do RunPod foram lidos em 12 de setembro de 2026. Os endereços estão em texto simples; abra-os em vez de confiar neste resumo.
Ficha do FLUX.1 [schnell], pela licença, pela contagem de parâmetros e pelos usos permitidos: huggingface.co/black-forest-labs/FLUX.1-schnell
Ficha do FLUX.1 [dev], pela barreira de download e pela licença não comercial: huggingface.co/black-forest-labs/FLUX.1-dev
Licença do Stable Diffusion XL base 1.0, CreativeML Open RAIL++-M, com as restrições de uso do Anexo A: huggingface.co/stabilityai/stable-diffusion-xl-base-1.0/raw/main/LICENSE.md
README do Wan2.2, pela licença Apache 2.0, pela frase sobre responsabilidade e pelos números de VRAM: github.com/Wan-Video/Wan2.2
Termos de serviço do RunPod, seção 7, pela cláusula sobre conteúdo adulto e pelo banimento da conta: runpod.io/legal/terms-of-service
Dúvidas frequentes
Modelos NSFW de código aberto são grátis?
Os pesos podem não custar nada para baixar sob uma licença como a Apache 2.0, mas rodá-los custa: a GPU, a energia ou o aluguel e as horas gastas para mantê-la funcionando têm preço. Alguns pesos também restringem o uso comercial, como faz a licença do FLUX.1 [dev].
Quanta memória de GPU o vídeo auto-hospedado exige?
Depende do modelo. O README do Wan2.2 indica pelo menos 80GB de VRAM para o modelo maior de texto para vídeo em uma GPU única e pelo menos 24GB para o modelo combinado menor. Confira a página de cada modelo antes de comprar ou alugar hardware.
Quem responde pelo que um modelo auto-hospedado produz?
Quem o roda. O README do Wan2.2 diz isso diretamente, e uma licença no estilo RAIL acrescenta restrições de uso que você precisa repassar a qualquer pessoa a quem permita usar o modelo. Onde a lei traça outros limites depende da sua jurisdição, então busque orientação qualificada antes de atender outras pessoas.
Posso trocar a auto-hospedagem por uma API hospedada depois?
Pode. O formato da requisição muda, mas a ideia não: prompt e parâmetros entram, arquivo sai. Mantenha a escolha do modelo e a montagem do prompt em um só lugar do seu código, e alternar entre os dois vira uma mudança pequena.
Posso rodar modelos NSFW em uma GPU alugada no RunPod?
Leia os termos primeiro. Os termos de serviço do RunPod, atualizados pela última vez em 24 de março de 2026, incluem conteúdo adulto gráfico entre o conteúdo não autorizado na seção 7, e não encontramos nesse documento uma exceção separada para o produto serverless. Quando a GPU pertence a outra pessoa, os pesos e a licença deles respondem só a metade da pergunta.
