Saltar al contenido

API

¿Modelos NSFW de código abierto en tu propia GPU o una API alojada?

La respuesta rápida: corre los pesos abiertos tú mismo si quieres control total y tienes, o vas a alquilar, una GPU con memoria suficiente, y acepta que la instalación, el mantenimiento, la moderación y la exposición legal pasan a ser tu trabajo. Llama una API alojada si prefieres mandar una solicitud y recibir un archivo, pagar cada generación con créditos y dejarle a otro el hardware y el mantenimiento del modelo. Las secciones de abajo detallan lo que cuesta de verdad cada lado; cada dato externo sale de una ficha de modelo, una licencia, un README o los términos de un host que figuran en Fuentes, al final, leídos en la fecha que se indica ahí.

Fuentes externas consultadas el 10 de septiembre de 2026; las fichas de modelo, las licencias y los README cambian.

Qué suele significar “en GitHub”

Buscar un generador NSFW en GitHub suele devolver dos cosas distintas. Una son los pesos, el modelo entrenado en sí, casi siempre publicado en Hugging Face. La otra es el código que carga esos pesos y los ejecuta: un script de inferencia, una interfaz web, un grafo de nodos. El código suele ser la parte fácil. Lo que decide qué puedes hacer son los pesos y la licencia que traen consigo.

Abierto no significa una sola cosa. La ficha de FLUX.1 [schnell] lo describe como un modelo de 12 mil millones de parámetros publicado con Apache 2.0, apto para uso personal, científico y comercial. Su hermano FLUX.1 [dev] está detrás de una puerta de descarga en la que primero tienes que aceptar una licencia no comercial. Stable Diffusion XL base 1.0 se distribuye con la licencia CreativeML Open RAIL++-M, cuyo Anexo A enumera restricciones de uso, y el párrafo 5 de esa licencia te obliga a hacer que cumpla con ellas cualquier persona a la que dejes usar el modelo.

También se publican pesos de video. El repositorio de Wan2.2 indica que sus modelos tienen licencia Apache 2.0, y su README agrega, con sus propias palabras: "You are fully accountable for your use of the models". Esa frase resume en miniatura el intercambio de alojar por tu cuenta.

La partida del hardware

Los modelos de imagen están en el extremo liviano; en video, la memoria pasa a ser el costo que decide. El README de Wan2.2 dice que su comando para una sola GPU con el modelo grande de texto a video necesita una GPU con al menos 80GB de VRAM, y que el modelo combinado más pequeño, de texto e imagen a video, corre con al menos 24GB, con una RTX 4090 como ejemplo. Otros modelos dan otras cifras, y la página de cada uno es donde hay que leerlas.

Compres esa tarjeta o la alquiles por hora, el costo corre mientras la GPU está reservada, no solo mientras produce algo que vas a conservar. Una API alojada lo convierte en un precio por generación: mientras no generas, no debes nada.

Alquilar trae un segundo reglamento: el del host. La sección 7 de los términos de servicio de RunPod, actualizados por última vez el 24 de marzo de 2026, nombra el contenido adulto gráfico, las imágenes y otros productos para adultos como contenido no autorizado, y publicar ese contenido puede terminar en la cancelación inmediata y una prohibición de por vida. En ese documento no encontramos una redacción aparte para su producto serverless, así que quien planee usar RunPod para NSFW debería leer esos términos antes que la ficha del modelo. Otros hosts de GPU escriben sus propias reglas, y merecen la misma lectura.

El trabajo que ninguna ficha de modelo menciona

Sacar una primera imagen de unos pesos abiertos puede ser rápido. Mantener un servicio funcionando es permanente: drivers y bibliotecas que tienen que llevarse bien entre sí, archivos de pesos enormes que descargar y guardar, versiones nuevas que cambian el código de carga, una cola en cuanto llega más de una solicitud a la vez, almacenamiento para los resultados y algo que reinicie el proceso cuando se cae de madrugada.

Nada de eso es difícil por separado, y a algunos equipos les gusta. Simplemente es trabajo que la ficha del modelo no menciona y que alguien tiene que hacer semana tras semana: quien opere la máquina.

La moderación y la exposición legal pasan a ser tuyas

Correr los pesos tú mismo quita cualquier filtro que no hayas construido. Muchas veces ese es el objetivo, y también significa que nada se interpone entre un prompt y un resultado salvo lo que pongas ahí. Si otras personas usan tu instalación, el operador eres tú: las reglas sobre menores y sobre personas reales sin su consentimiento te toca escribirlas y hacerlas cumplir, y una licencia de tipo RAIL espera que traslades sus restricciones a tus usuarios. Lo que eso implica legalmente depende de dónde operes, y vale la pena consultar a alguien calificado antes de abrir un servicio al público.

En un servicio alojado esos controles ya existen. En Vellria, sexualizar a menores está prohibido, y los prompts que una verificación automática reconoce como tales se rechazan antes de que salga un solo crédito del saldo; los términos prohíben a personas reales sin su consentimiento, y el proveedor que aloja un modelo puede detener un trabajo según sus propias reglas, con los créditos reembolsados.

Cómo se ve el lado alojado desde el código

La ruta alojada es una solicitud HTTPS: un ID de modelo, un prompt y los parámetros que acepta ese modelo, enviados con una clave Bearer que empieza por vll_. La API acepta el trabajo, devuelve su id y tú preguntas por el resultado hasta que está listo. No hay pesos que descargar ni GPU que reservar, y un trabajo fallido devuelve sus créditos por sí solo.

Los modelos de imagen, sus ID y sus precios están en la página de la API de imágenes NSFW, los de video en la de la API de video NSFW, y cada endpoint en la referencia de la API. Para conectar una primera solicitud a una aplicación, llamar la API desde tu código lo recorre paso a paso.

Hay algo que esta página deliberadamente no dice: si algún modelo de nuestro catálogo tiene pesos abiertos. Las entradas del catálogo que comparten nombre de familia con una versión publicada son versiones distintas, y no afirmamos nada, ni en un sentido ni en el otro, sobre sus pesos.

La decisión, en un párrafo

Aloja por tu cuenta cuando el requisito es el control: necesitas un modelo que el catálogo no ofrece, quieres hacerle fine-tuning, los resultados no pueden salir nunca de tus propias máquinas, o ya tienes la GPU y las horas para cuidarla. Usa una API alojada cuando el requisito es el resultado: quieres imágenes y clips dentro de un producto esta semana, tu volumen es irregular y prefieres pagar por generación antes que mantener ocupada una tarjeta. Muchos equipos hacen las dos cosas, y la decisión se puede tomar de nuevo cada vez que cambian los números.

Fuentes

Cada dato externo de arriba sale de uno de estos cinco documentos. Los primeros cuatro los publican los propios autores de los modelos y se leyeron en la fecha que aparece arriba; los términos de RunPod se leyeron el 12 de septiembre de 2026. Las direcciones van en texto plano: ábrelas en vez de fiarte de este resumen.

Ficha del modelo FLUX.1 [schnell], por su licencia, su cantidad de parámetros y los usos permitidos: huggingface.co/black-forest-labs/FLUX.1-schnell

Ficha del modelo FLUX.1 [dev], por su puerta de descarga y su licencia no comercial: huggingface.co/black-forest-labs/FLUX.1-dev

Licencia de Stable Diffusion XL base 1.0, CreativeML Open RAIL++-M, con las restricciones de uso de su Anexo A: huggingface.co/stabilityai/stable-diffusion-xl-base-1.0/raw/main/LICENSE.md

README de Wan2.2, por su licencia Apache 2.0, la frase sobre la responsabilidad y las cifras de VRAM: github.com/Wan-Video/Wan2.2

Términos de servicio de RunPod, sección 7, por su cláusula sobre contenido adulto y la prohibición de la cuenta: runpod.io/legal/terms-of-service

Preguntas frecuentes

¿Los modelos NSFW de código abierto son gratis?

Descargar los pesos puede no costar nada con una licencia como Apache 2.0, pero correrlos sí cuesta: la GPU, la electricidad o el alquiler y las horas que pasas manteniéndola en marcha. Además, algunos pesos restringen el uso comercial, como hace la licencia de FLUX.1 [dev].

¿Cuánta memoria de GPU necesita el video alojado por tu cuenta?

Depende del modelo. El README de Wan2.2 da al menos 80GB de VRAM para su modelo grande de texto a video en una sola GPU y al menos 24GB para su modelo combinado más pequeño. Revisa la página de cada modelo antes de comprar o alquilar hardware.

¿Quién responde por lo que produce un modelo alojado por tu cuenta?

Quien lo corre. El README de Wan2.2 lo dice sin rodeos, y una licencia de tipo RAIL agrega restricciones de uso que tienes que trasladar a cualquiera a quien dejes usar el modelo. Qué otras líneas traza la ley depende de tu jurisdicción, así que busca asesoría calificada antes de dar servicio a otros.

¿Puedo pasarme más adelante de mi propia instalación a una API alojada?

Sí. Cambia la forma de la solicitud, pero no la idea: entran prompt y parámetros, sale un archivo. Mantén la elección del modelo y la construcción del prompt en un solo lugar de tu código, y moverte entre los dos será un cambio pequeño.

¿Puedo correr modelos NSFW en una GPU alquilada en RunPod?

Primero lee sus términos. Los términos de servicio de RunPod, actualizados por última vez el 24 de marzo de 2026, incluyen el contenido adulto gráfico entre el contenido no autorizado en la sección 7, y en ese documento no encontramos una excepción aparte para su producto serverless. Cuando la GPU es de otro, los pesos y su licencia responden solo la mitad de la pregunta.

Guías relacionadas

Todas las guías

Mira el catálogo antes de gastar nada

Sin suscripción. Agrega créditos y paga solo por lo que usas.

Elige un modelo