Prompts pour générer des vidéos IA sans censure | guide

Écrire des prompts pour générer des vidéos IA sans censure sur Seedance 2.5 : ce qui déclenche l'erreur 80006 et ce qui doit passer par les images de référence.
Savoir écrire des prompts pour générer des vidéos IA sans censure sur Seedance 2.5 commence par savoir où tourne la modération. Elle tourne sur le texte du prompt, sur chaque fichier de référence et sur la vidéo finie, et le champ content_filter achemine une requête entre deux canaux sans rien couper de tout ça. Aucune formulation ne change ces vérifications. Ce que le travail de prompt change, c'est la fréquence à laquelle tu déclenches un refus que tu n'avais pas prévu, ce qui représente une grande part des générations en échec.
Comment écrire des prompts pour générer des vidéos IA sans censure sans déclencher de refus
Tout refus de modération renvoie l'erreur 80006, et le code ne dit pas quelle étape s'est déclenchée. Trois étapes peuvent le lever : le texte, un fichier joint, ou la vidéo sortie de l'autre côté. Un prompt peut être parfaitement propre et produire quand même un 80006 parce que c'est la scène générée qui a été refusée.
Trois catégories sont bloquées à l'intérieur du modèle et aucun réglage ne les atteint :
- les célébrités réelles nommées
- la propriété intellectuelle de tiers
- les contenus illégaux
Tout le reste est une décision de modération prise requête par requête. Les personnes réalistes sont prises en charge et ne demandent aucun indicateur. Les jobs en échec sont remboursés intégralement, donc itérer sur le texte coûte du temps plutôt que des crédits.
Les noms sont le moyen le plus sûr de se faire refuser
Le blocage sur les célébrités est écrit contre des noms, ce qui fait des noms propres la première chose à auditer dans un prompt.
Un acteur vivant, un musicien, un politique, une personnalité publique quelle qu'elle soit : en nommer un fait refuser la requête avant que quoi que ce soit soit généré. Le blocage sur la propriété intellectuelle est plus large et n'a besoin d'aucun nom. Un personnage, un titre de film, un jeu, un costume reconnaissable, une silhouette de véhicule, un logo décrit d'assez près : tout cela peut le déclencher alors que le prompt ressemble à de la simple description.
Les deux blocages se retirent du prompt de la même façon. Remplace le nom par ce qu'il représentait. L'âge, la carrure, les cheveux, les vêtements, la posture, l'expression et l'accent sont de la description, et la description n'est pas ce que visent ces blocages.
Décris ce que la caméra voit
Un détail visuel concret laisse au modèle moins de marge pour inventer quelque chose que la vérification de sortie refusera. Les mots d'ambiance abstraits lui en laissent énormément.
Passe en revue le sujet, l'action, le décor, la lumière et le comportement de la caméra. Chacun de ces points peut être vérifié contre le résultat, ce qui rend une deuxième exécution intentionnelle au lieu d'être une relance au hasard. Un prompt qui dit qu'une silhouette se tourne vers une fenêtre dans une lumière basse d'après-midi pendant que la caméra reste fixe produit une image prévisible. Un prompt qui demande quelque chose de provocant délègue toute la scène au modèle, et ce qu'il décide est ce que la modération juge ensuite.
Garde un nombre d'actions honnête par rapport à la durée que tu fixes. Une génération unique va de 4 à 30 secondes et peut contenir plusieurs plans, donc écris les prompts longs sous forme de temps et dis où tombe la coupe. Cinq secondes portent une action. Quatre actions compressées en cinq secondes arrivent sous forme de bruit, ce qui coûte ensuite une exécution de plus.
Pousse les détails précis dans les images de référence
Tout ce qui est visuel et exact a sa place dans un fichier plutôt que dans une phrase. Une requête accepte jusqu'à 30 images de référence en jpeg, png, webp, bmp, tiff, gif, heic ou heif, chacune sous 30 MB, et elles n'ajoutent aucune seconde facturable.
La vidéo de référence est disponible aussi, jusqu'à 10 clips en mp4 ou mov de 200 MB ou moins, de 2 à 30 secondes chacun et 30 secondes au total, mais elle ajoute bien des secondes facturables, donc va d'abord chercher les images. Tous les médias sont fournis sous forme d'URL HTTP(S) publiques ; les data URI sont rejetées sur toute la plateforme.
Les fichiers de référence sont modérés aux mêmes conditions que le prompt. Une photographie d'une personnalité publique reconnaissable est refusée à cette étape et renvoie le même 80006. Avec 30 images jointes et aucune indication de laquelle l'a causé, coupe le lot en deux et renvoie jusqu'à ce que le fichier fautif apparaisse.
Une fois les images jointes, le prompt devient facultatif et son rôle se resserre sur l'action, la caméra et le rythme. Supprime les phrases qui reprennent ce qu'une photographie montre déjà, puisque deux sources pour un même détail, c'est ainsi que la version écrite écrase discrètement la version visuelle.
Les lignes entre guillemets deviennent de la parole
L'audio est généré dans la même passe que l'image, et couvre la parole, les effets et la musique sur une piste mono. Tout ce qui est entre guillemets revient prononcé.
Écris la réplique exactement comme elle doit s'entendre, puis chronomètre-la à voix haute contre le champ de durée, parce qu'un discours de quarante mots ne rentre pas dans cinq secondes. Quand deux personnages parlent, attribue les répliques dans la phrase environnante pour que l'appariement soit sans ambiguïté. Le son qui n'est pas du dialogue se décrit au lieu d'être mis entre guillemets.
Les dialogues sont vérifiés eux aussi. Un refus sur une requête dont les visuels sont banals mérite une relecture avec les répliques entre guillemets isolées. Pour un clip muet, garde les guillemets entièrement hors du prompt, ou mets generate_audio à false.
Fais tes essais en 480p, livre une fois
Le travail de prompt est structurel, et la structure est entièrement lisible à la résolution la plus basse. Une génération sans clip de référence coûte $0.118589 la seconde en 480p, $0.266824 en 720p et $0.461856 en 1080p.
Ça met un brouillon de cinq secondes à environ $0.59 contre à peu près $2.31 pour le même brouillon en 1080p. Itère en 480p avec la durée et le format d'image que tu comptes livrer, puis lance une fois le texte arrêté à la résolution que tu veux. La génération prend en moyenne de deux à cinq minutes dans les deux cas et interroger l'état pour récupérer le résultat est gratuit.
Le champ prompt tient jusqu'à 20,000 caractères, donc il n'y a aucune raison de compresser. La durée, la résolution, le format d'image et l'audio sont des champs séparés et ne peuvent pas être réglés en écrivant à leur sujet ; demander une vidéo verticale en prose ne sélectionne pas le 9:16.
Questions fréquentes
Un prompt peut-il contourner le filtre de contenu ?
Non. La modération tourne sur le texte, sur les fichiers de référence et sur la sortie, et content_filter sélectionne un canal plutôt que d'en désactiver une partie. Le travail de prompt évite les refus involontaires et ne retire pas les blocages au niveau du modèle.
Quels mots déclenchent le plus souvent l'erreur 80006 ? Les noms propres. Les noms de personnalités publiques réelles et tout ce qui identifie une propriété intellectuelle de tiers sont refusés avant le début de la génération, et ils apparaissent en général dans des prompts que leur auteur jugeait inoffensifs.
Les détails doivent-ils aller dans le prompt ou dans une image de référence ? Les détails visuels exacts ont leur place dans les images de référence, qui acceptent jusqu'à 30 fichiers par requête et n'ajoutent aucune seconde facturable. Le prompt est mieux employé sur l'action, la caméra et le rythme.
Un prompt refusé coûte-t-il quelque chose ?
Non. Les jobs en échec sont remboursés intégralement. Vérifie usage.credits sur la tâche en échec pour confirmer que la réservation a bien été rendue.
En bref
Écrire des prompts pour générer des vidéos IA sans censure se ramène à quelques habitudes plutôt qu'à une astuce de formulation. Retire les noms propres, parce que les noms portent les deux blocages qu'aucun réglage n'enlève. Décris ce que la caméra voit pour que la vérification de sortie ait quelque chose de prévisible à juger. Déplace les détails visuels exacts dans les images de référence, qui sont gratuites, et garde le prompt sur l'action, la caméra et le rythme. Ne mets entre guillemets que les répliques destinées à être prononcées, cale le nombre d'actions sur la durée, et itère en 480p où cinq secondes coûtent environ $0.59.


