Moin Dennie, wir produzieren KI Videos für Kunden fast täglich, deshalb ein paar ehrliche Punkte: Wasser ist für Videomodelle mit das Schwierigste (Spritzer, Reflexionen, Körper unter der Oberfläche), deshalb würde ich nicht versuchen, den kompletten Kurs generieren zu lassen. Was bei uns funktioniert: 1. Startbild zuerst. Ein richtig gutes Referenzbild mit Nano Banana oder Flux erstellen (Pool, Licht, Gruppe, Stimmung) und dann Image to Video machen statt Text to Video. Das gibt dir 80 Prozent der Kontrolle. 2. Kurze Clips, 3 bis 5 Sekunden, ruhige Kamerabewegung, wenig Action pro Clip. Kling 2.x und Seedance sind bei Wasser aktuell am stabilsten, Veo ist gut aber teuer. Higgsfield ist im Grunde nur ein Zugang zu genau diesen Modellen, also Preis vergleichen. 3. Den Ad dann aus 4 bis 6 Clips schneiden, Text und Voice drüber, fertig. Die Person im Wasser muss nicht 30 Sekunden am Stück laufen. Schick dir gern ein paar Beispiele per DM, wie sowas bei uns aussieht. :)