NSFW Text to Video: Generieren ohne Referenzfoto
Ein NSFW-Text-to-Video-Lauf hat kein Foto, das abgelehnt werden könnte, und das verschiebt den Ort der Ablehnungen. Hier steht, was der prompt überstehen muss und was eine Sekunde kostet.
Ab $0.07 pro Sekunde, reine 480p-Generierung

Warum sich NSFW Text to Video anders verhält
Bei NSFW Text to Video gibt es keinen Upload, der blockiert werden könnte, die Moderation, die Bild-Workflows stoppt, greift also nie. Die Ablehnungen wandern stattdessen zum prompt und zum gerenderten Ergebnis.
Bild-Workflows sterben beim Upload, sobald eine Person erkannt wird. Eine NSFW-Text-to-Video-Anfrage trägt keine Referenz, diese ganze Klasse von Ablehnungen entfällt also.
Jeder NSFW-Text-to-Video-Job verlangt einen prompt, bis zu 20.000 Zeichen. Referenzgesteuerte Läufe dürfen ihn weglassen, ein reiner Textlauf nicht, und eine Anfrage mit content_filter auf false ebenfalls nicht.
Der prompt selbst und das gerenderte Ergebnis. Ein NSFW-Text-to-Video-Job, der beim Absenden durchgeht, kann Minuten später noch scheitern, wenn die fertigen Frames geprüft werden.
Ohne Referenzbild hält ein NSFW-Text-to-Video-Ergebnis dieselbe Figur nicht über getrennte Generierungen hinweg. Eine Person in Worten zu beschreiben liefert dir einen Typ und kein bestimmtes Gesicht.
Sprache, Effekte und Musik entstehen mit dem Bild. Zeilen in Anführungszeichen in einem NSFW-Text-to-Video-prompt kommen als generierter Dialog zurück und nicht als Stille.
Hier läuft kein Generator. NSFW-Text-to-Video-Läufe finden über die gehostete API statt, abgerechnet pro Sekunde Ausgabe, und jede Zahl weiter unten stammt aus veröffentlichten Parametern.
Was NSFW Text to Video dir gibt und Bild-Workflows nicht
Vier Unterschiede, die man vor der Wahl des Modus kennen sollte.
Nichts hochzuladen
Kein Hosting, keine öffentlichen URLs, keine Formatprüfungen. Eine NSFW-Text-to-Video-Anfrage ist ein einziger JSON-Body, was die häufigste Ursache für Fehler beim Absenden beseitigt.
Freie Wahl des Seitenverhältnisses
Alle sechs Verhältnisse plus adaptiv. Frame-gesteuerte Läufe sind auf adaptiv festgelegt, NSFW Text to Video ist also der einzige Modus, in dem du das Format frei wählst.
Dreißig Sekunden, mehrere Einstellungen
Eine NSFW-Text-to-Video-Generierung läuft bis 30 Sekunden und kann mehrere Einstellungen enthalten. Die Konkurrenz endet bei 15.
Der günstigste Abrechnungsweg
Kein Referenzvideo bedeutet keine zusätzlich abgerechneten Sekunden. Ein NSFW-Text-to-Video-Clip wird allein nach Ausgabelänge berechnet, was ihn zum günstigsten Modus pro fertiger Sekunde macht.
Vier Schritte für NSFW Text to Video
- 1
Die Szene schreiben
Beschreibe Motiv, Bewegung und Kamera in einem prompt. Ein NSFW-Text-to-Video-Modell liest das Ganze, die Reihenfolge zählt also weniger als die Genauigkeit.
- 2
Dialog ergänzen, wenn du willst
Setz gesprochene Zeilen in doppelte Anführungszeichen. Der NSFW-Text-to-Video-Durchgang erzeugt diese Sprache synchron, statt eine stumme Tonspur zu liefern.
- 3
Format, Länge und Auflösung wählen
Eines von sechs Verhältnissen, vier bis dreißig Sekunden, bei 480p, 720p oder 1080p. Keine NSFW-Text-to-Video-Anfrage erreicht auf diesem Modell 4K.
- 4
Absenden und pollen
Zwei bis fünf Minuten. Das Pollen ist kostenlos, und ein fehlgeschlagener NSFW-Text-to-Video-Job wird vollständig erstattet.
Häufige Fragen zu NSFW Text to Video
Anders eingeschränkt. Es gibt kein Referenzfoto, das abgelehnt werden könnte, die Fehlschläge durch Gesichtserkennung, an denen die meisten Bildläufe enden, treten also gar nicht auf. Dafür trägt der prompt das gesamte Risiko, und ein Job kann auch nach der Generierung noch scheitern, wenn das Ergebnis geprüft wird.
Immer. Text ist die einzige Eingabe, der prompt ist also Pflicht und darf bis zu 20.000 Zeichen lang sein. Er ist außerdem bei jeder Anfrage Pflicht, die content_filter auf false setzt, unabhängig vom Modus, und darüber stolpern viele beim Kanalwechsel.
Pro Sekunde Ausgabe, von $0.118589 bei 480p bis $0.461856 bei 1080p. Ohne Referenzvideo gibt es kein zusätzlich abgerechnetes Material, ein zehn Sekunden langer 1080p-Clip liegt also bei rund $4.62 und ein fünf Sekunden langer 480p-Clip bei rund $0.59. Fehlgeschlagene Jobs werden erstattet.
Über getrennte Generierungen hinweg nicht. Worte beschreiben einen Typ und kein Gesicht, jeder Lauf erzeugt also eine andere Person. Wenn Konsistenz zählt, liefere stattdessen Referenzbilder und nimm in Kauf, dass der Upload geprüft wird.
Fehler 80006 ist eine Sicherheitsablehnung, und er sagt bewusst nicht, welche Stufe ausgelöst hat. Ein synchroner 400 ist etwas anderes: Das ist die Schemaprüfung, meist ein falscher Auflösungswert oder ein fehlender prompt, und berechnet wurde nichts. Prüfe, ob eine Task-ID zurückkam, bevor du auf Moderation schließt.
Es leitet die Anfrage zum gleichen Preis über einen weniger restriktiven Kanal und macht den prompt zur Pflicht. Die offizielle Dokumentation nennt das eine Routing-Einstellung und keinen Ausschalter, und die vorgelagerten Richtlinienprüfungen laufen bei jedem NSFW-Text-to-Video-Job weiter.
Namentlich genannte reale Prominente, geistiges Eigentum Dritter und illegale Inhalte. Eine prominente Person in Worten zu beschreiben, statt ein Foto hochzuladen, umgeht das nicht, denn die Sperre sitzt im Modell. Ein abgelehnter Job wird erstattet und nicht teilweise ausgeliefert.
Zwanzigtausend Zeichen, weit mehr als die meisten Szenen brauchen. Ab ein paar hundert Wörtern verwässert zusätzliche Länge das Ergebnis eher, als dass sie es schärft, Genauigkeit schlägt also Menge.
Ja, aber dann ist es kein reiner Textlauf mehr. video_urls hinzuzufügen macht daraus einen Referenzjob, was die Prüfung des hochgeladenen Materials zurückbringt und die Länge des Quellclips auf die Rechnung setzt. Jede Anfrage mit Video wird außerdem mit mindestens fünf Dritteln der Ausgabedauer abgerechnet, eine zwei Sekunden lange Quelle mit fünf Sekunden Ausgabe ergibt also neun abgerechnete Sekunden.
NSFW Text to Video ohne Upload ausführen
Ein prompt, kein Hosting von Referenzen, sechs Seitenverhältnisse, Sekundenpreise und Rückerstattung, wenn ein NSFW-Text-to-Video-Job scheitert.
Verwandt: Seedance 2.5 API