Aller au contenu

API

Modèles NSFW open source sur votre GPU, ou API hébergée ?

En bref : faites tourner des poids ouverts vous-même si vous tenez à un contrôle complet et que vous possédez, ou comptez louer, un GPU doté d’assez de mémoire, en acceptant qu’installation, maintenance, modération et exposition juridique deviennent votre affaire. Appelez une API hébergée si vous préférez envoyer une requête et recevoir un fichier, payer chaque rendu en crédits et laisser à d’autres le matériel comme l’entretien des modèles. Les sections suivantes détaillent ce que coûte réellement chaque option ; chaque fait extérieur provient d’une carte de modèle, d’une licence, d’un README ou des conditions d’un hébergeur, recensés dans la rubrique « Sources consultées » en fin de page et lus à la date qui y figure.

Sources externes consultées le 10 septembre 2026 ; les fiches de modèles, les licences et les README évoluent.

Ce que recouvre « sur GitHub », le plus souvent

Chercher un générateur NSFW sur GitHub fait en général remonter deux choses distinctes. D’un côté les poids, c’est-à-dire le modèle entraîné lui-même, publié la plupart du temps sur Hugging Face. De l’autre, le code qui charge ces poids et les exécute : un script d’inférence, une interface web, un graphe de nœuds. Le code est souvent la partie facile. Ce que vous avez le droit de faire dépend des poids et de la licence qui les accompagne.

« Ouvert » ne désigne pas une seule réalité. La carte de FLUX.1 [schnell] le présente comme un modèle de 12 milliards de paramètres publié sous Apache 2.0, utilisable à des fins personnelles, scientifiques et commerciales. Son cousin FLUX.1 [dev] se trouve derrière une barrière de téléchargement qui impose d’accepter d’abord une licence non commerciale. Stable Diffusion XL base 1.0 est distribué sous la licence CreativeML Open RAIL++-M, dont l’annexe A énumère des restrictions d’usage, et le paragraphe 5 de cette licence vous oblige à les faire respecter par quiconque vous laissez utiliser le modèle.

Des poids vidéo sont publiés eux aussi. Le dépôt Wan2.2 indique que ses modèles relèvent de la licence Apache 2.0, et son README ajoute, en toutes lettres, « You are fully accountable for your use of the models ». Cette phrase résume à elle seule le marché de l’auto-hébergement.

Le poste matériel

Les modèles d’image sont le bas de l’échelle ; c’est en vidéo que la mémoire devient le coût déterminant. Selon le README de Wan2.2, la commande sur un seul GPU du plus gros modèle texte en vidéo exige un GPU d’au moins 80 Go de VRAM, tandis que le modèle combiné plus léger, texte et image en vidéo, tourne avec au moins 24 Go, la RTX 4090 étant citée en exemple. D’autres modèles annoncent d’autres chiffres, et c’est sur la page de chacun qu’il faut les lire.

Que vous achetiez cette carte ou la louiez à l’heure, la dépense court tant que le GPU vous est réservé, et pas seulement pendant qu’il produit quelque chose que vous gardez. Une API hébergée convertit cela en prix par rendu : tant que vous ne générez rien, vous ne devez rien.

Louer fait entrer un second règlement en jeu : celui de l’hébergeur. La section 7 des conditions d’utilisation de RunPod, mises à jour le 24 mars 2026, désigne le contenu adulte explicite, les images et les autres produits pour adultes comme des contenus non autorisés, et publier un tel contenu peut valoir une résiliation immédiate et un bannissement à vie. Nous n’avons trouvé dans ce document aucune formulation distincte pour son offre serverless : quiconque envisage une installation RunPod NSFW devrait lire ces conditions avant la carte du modèle. Les autres loueurs de GPU rédigent leurs propres règles, qui méritent la même lecture.

Le travail qu’aucune carte de modèle ne mentionne

Tirer une première image de poids ouverts peut aller vite. Maintenir un service qui fonctionne est un chantier permanent : des pilotes et des bibliothèques qui doivent s’entendre, de lourds fichiers de poids à télécharger et à stocker, de nouvelles versions qui modifient le code de chargement, une file d’attente dès que plusieurs requêtes arrivent en même temps, du stockage pour les sorties, et un mécanisme qui relance le processus quand il tombe en pleine nuit.

Rien de cela n’est difficile pris isolément, et certaines équipes y trouvent du plaisir. C’est simplement un travail que la carte du modèle passe sous silence et qu’il faut pourtant accomplir, semaine après semaine, quand on a la machine à sa charge.

La modération et l’exposition juridique vous reviennent

Faire tourner les poids vous-même supprime tous les filtres que vous n’avez pas construits. C’est souvent le but recherché, et cela veut dire aussi que rien ne s’interpose entre un prompt et une sortie tant que vous ne l’y placez pas. Si d’autres personnes utilisent votre déploiement, l’opérateur, c’est vous : les règles sur les mineurs et sur les personnes réelles sans consentement sont à vous de les écrire et de les faire appliquer, et une licence de type RAIL attend de vous que vous répercutiez ses restrictions sur vos utilisateurs. Ce que cela implique en droit dépend du pays où vous opérez, et mieux vaut consulter une personne compétente avant d’ouvrir un service au public.

Sur un service hébergé, ces garde-fous sont déjà en place. Sur Vellria, sexualiser des mineurs est interdit, et les prompts qu’un contrôle automatique reconnaît comme tels sont rejetés avant qu’un seul crédit ne quitte le solde ; les conditions proscrivent les personnes réelles sans consentement, et le prestataire qui fait tourner un modèle peut stopper une tâche au nom de ses propres règles, crédits remboursés.

Le côté hébergé, vu depuis le code

La voie hébergée tient en une requête HTTPS : un identifiant de modèle, un prompt et les paramètres que ce modèle accepte, envoyés avec une clé Bearer qui commence par vll_. L’API accepte la tâche, renvoie son identifiant, et vous interrogez l’enregistrement jusqu’à ce que le résultat soit prêt. Aucun poids à télécharger, aucun GPU à réserver, et une tâche en échec restitue ses crédits d’elle-même.

Les modèles d’image, leurs identifiants et leurs prix figurent sur la page de l’API d’image NSFW, les modèles vidéo sur celle de l’API vidéo NSFW, et chaque endpoint dans la référence de l’API. Pour brancher une première requête dans une application, appeler l’API depuis votre code vous accompagne étape par étape.

Il y a une chose que cette page s’abstient délibérément d’affirmer : qu’un modèle de notre catalogue ait, ou non, des poids ouverts. Les entrées du catalogue qui partagent un nom de famille avec une version publiée sont des versions différentes, et nous ne prenons position ni dans un sens ni dans l’autre sur leurs poids.

Trancher en un paragraphe

Hébergez vous-même quand le contrôle est l’exigence : il vous faut un modèle absent du catalogue, vous voulez l’affiner, les sorties ne doivent jamais quitter vos machines, ou vous disposez déjà du GPU et des heures nécessaires pour l’entretenir. Passez par une API hébergée quand la production est l’exigence : vous voulez des images et des clips dans un produit cette semaine, votre volume est irrégulier, et vous préférez payer au rendu plutôt que d’occuper une carte en permanence. Bien des équipes font les deux, et la décision peut se reprendre chaque fois que les chiffres changent.

Sources consultées

Chaque fait extérieur cité plus haut provient de l’un de ces cinq documents. Les quatre premiers sont publiés par les auteurs mêmes des modèles et ont été lus à la date indiquée en haut de page ; les conditions de RunPod l’ont été le 12 septembre 2026. Les adresses sont données en texte brut : ouvrez-les plutôt que de vous fier à ce résumé.

Carte du modèle FLUX.1 [schnell], pour sa licence, son nombre de paramètres et ses usages permis : huggingface.co/black-forest-labs/FLUX.1-schnell

Carte du modèle FLUX.1 [dev], pour sa barrière de téléchargement et sa licence non commerciale : huggingface.co/black-forest-labs/FLUX.1-dev

Licence de Stable Diffusion XL base 1.0, CreativeML Open RAIL++-M, avec les restrictions d’usage de son annexe A : huggingface.co/stabilityai/stable-diffusion-xl-base-1.0/raw/main/LICENSE.md

README de Wan2.2, pour sa licence Apache 2.0, la phrase sur la responsabilité et les chiffres de VRAM : github.com/Wan-Video/Wan2.2

Conditions d’utilisation de RunPod, section 7, pour sa clause sur le contenu adulte et le bannissement du compte : runpod.io/legal/terms-of-service

Questions fréquentes

Les modèles NSFW open source sont-ils gratuits ?

Télécharger les poids peut ne rien coûter sous une licence comme Apache 2.0, mais les faire tourner a un prix : le GPU, l’électricité ou la location, et les heures passées à tout maintenir en état de marche. Certains poids limitent en outre l’usage commercial, comme le fait la licence de FLUX.1 [dev].

Combien de mémoire GPU faut-il pour héberger soi-même de la vidéo ?

Tout dépend du modèle. Le README de Wan2.2 indique au moins 80 Go de VRAM pour son plus gros modèle texte en vidéo sur un seul GPU, et au moins 24 Go pour son modèle combiné plus léger. Consultez la page de chaque modèle avant d’acheter ou de louer du matériel.

Qui répond de ce que produit un modèle auto-hébergé ?

Celui qui le fait tourner. Le README de Wan2.2 le dit sans détour, et une licence de type RAIL ajoute des restrictions d’usage que vous devez transmettre à quiconque vous laissez utiliser le modèle. Les autres limites que trace la loi dépendent de votre juridiction : prenez un avis qualifié avant de servir d’autres personnes.

Puis-je passer plus tard de l’auto-hébergement à une API hébergée ?

Oui. La forme de la requête change, pas l’idée : un prompt et des paramètres en entrée, un fichier en sortie. Regroupez le choix du modèle et la construction du prompt à un seul endroit de votre code, et basculer de l’un à l’autre ne demandera qu’une petite modification.

Puis-je faire tourner des modèles NSFW sur un GPU loué chez RunPod ?

Lisez d’abord ses conditions. Celles de RunPod, mises à jour le 24 mars 2026, rangent le contenu adulte explicite parmi les contenus non autorisés dans leur section 7, et nous n’avons trouvé dans ce document aucune exception distincte pour son offre serverless. Quand le GPU appartient à quelqu’un d’autre, les poids et leur licence ne répondent qu’à la moitié de la question.

Guides associés

Tous les guides

Parcourez le catalogue avant de dépenser quoi que ce soit

Pas d’abonnement. Ajoutez des crédits et payez ce que vous utilisez.

Choisir un modèle