Erstens, das ist keine Werbung. Dieses Video entstand ziemlich spontan, denn ByteDance hat gerade ein Modell namens Seedance 2.0 veröffentlicht. Meine Haltung zu KI-Modellen ist normalerweise: ach, schon wieder eines, dann werden viele toll klingende Konzepte hochgejubelt, die echte Erfahrung ist mittelmäßig, und ich ziehe weiter. Aber bei diesem Modell dachte ich beim ersten Ansehen des Videos: aha, das geht auch, schau dir das an, und die Präzision ist der Clou, das ist wirklich stark. Dann sah ich, wie Leute online Inhalte produzierten, z.B. dies und das. Ich sage nicht, es sei makellos, aber man spürt deutlich, dass es viel stärker ist als frühere KI-Videos. Da dachte ich, dieses Modell ist nicht banal. Dann konnte auch unsere Firma Inhalte produzieren, ich habe selbst probiert, und mein Eindruck ist: ihr müsst es wirklich selbst ausprobieren. Wenn Anfang 2026 Videogenerierungsmodelle schon dieses Niveau haben, dann ist der traditionelle Film-Workflow endgültig in ein Countdown zum Wegspülen durch eine KI-Welle eingetreten. Ich übertreibe nicht. Schauen wir uns an, wie Videogenerierung heute aussieht. Frühere Videogeneratoren waren schon recht gut und sahen überzeugend aus, aber es gab Punkte, bei denen man sie brechen konnte: großräumige Kamerabewegung, Schnitt-Kontinuität und Bild-Ton-Passung. Schauen wir uns Seedance 2.0 bei diesen drei Schmerzpunkten an. Erstens großräumige Bewegung: Wir ließen unseren KI-Regisseur diesen Text und dieses Bild schreiben, ohne weitere Infos — das ist unser Ergebnis. Ist das nicht beeindruckend? So eine Kamerabewegung kann KI heute generieren. Was, du willst eine noch verrücktere Kamerabewegung? Kein Problem, wir ändern den Prompt und schauen nochmal. Soviel dazu. Früher erkannte man KI-Videos an der gefälschten Kamerabewegung; diese Methode ist im Grunde gescheitert. Zweitens die Schnitte: Frúhere Modelle konnten Schnitte erzeugen, aber sie schnitten um des Schneidens willen, höchstens mal eine Nahaufnahme, dann eine Totale, die Kamerabewegung war nicht verbunden. Schauen wir uns die staggeringste Stelle dieses Modells an: mit einem Satz erzeugtes Video mit Schnitt-Design. Fällt dir auf, es sind nicht nur Nahaufnahmen, es gibt klare Winkelwechsel, es gibt eine Regieabsicht, und die Personen verformen sich nicht. Klingt vielleicht unkonkret; simulieren wir mit einer Aufsicht die Subjektposition. Du siehst, Schnitt hier, hier, hier — wie ein echter Regisseur, der ständig Kameraposition und Winkel ändert, damit du den wichtigen Inhalt besser verstehst. Das ist Regie-Denken. Früher dachte ich, KI erzeugt ein Segment und der Cutter schneidet daraus ein Meisterwerk. Jetzt müssen wir erkennen: sobald so ein Modell reif ist, braucht es keinen Cutter mehr. Es gibt kein Konzept von Aussortieren oder Ausschuss, alles ist brauchbar. Wenn die generierten Schnitte gut genug sind, wozu brauche ich den Schnitt? Ich dachte immer, Schnitt sei emotionaler Ausdruck, ein paar Frames ändern die Stimmung, also muss ein Mensch das machen. Aber jetzt müssen wir uns fragen: woher willst du wissen, dass die Frames, die du einfügst, besser sind als die der KI? Vor allem kann sie unendlich viele Versionen liefern und das schnell. Drittens Bild-Ton-Passung: ein Video ohne Ton verliert stark. Das größte Problem von KI früher war, dass der gelegte Ton fake war, besonders menschliche Stimme plus Umgebungsgeräusche plus Musik wurde unnatürlich. Schauen wir uns dieses Modell an — ganz gut, oder? Früher brauchte SFX und Mischung einen Tag oder länger, weil alles per Hand geklebt wurde; jetzt per Knopfdruck. Aber gute Tonmodelle gibt es in der Branche mittlerweile viele, das wird dich nicht umhauen. Ich will aber von etwas erzählen, das wir zufällig entdeckt haben und das ziemlich unheimlich ist: ich habe bemerkt, wenn ich mein eigenes Gesicht in Seedance 2.0 lade, spricht die KI automatisch mit meiner Stimme. Ich weiß nicht, ob du verstanden hast: ohne Hinweis, ohne Worte, ohne Informationen, und ich habe keine Stimmdatei geliefert, nur mein Gesicht — das ist keine Werbung — und die KI wusste, dass das Gesicht zu meiner Stimme gehört. Ich демонstriere: das ist das Ergebnis aus einem Satz und meinem Foto. Meine Haltung zu KI-Modellen: ach, schon wieder, und das Ganze von vorn… aber das Demovideo dieses Modells hat mich gedacht: aha, findest du das nicht unheimlich? Und am unheimlichsten ist nicht nur meine Stimme, sondern das hochgeladene Foto war so, nur die Fassade des Gebäudes, aber die Kamerabewegung dreht zur anderen Seite des Gebäudes. Wie sieht die andere Seite in der Realität aus? So. Nicht unheimlich? Sie weiß, was hinter mir ist, obwohl ich es nicht gesagt habe. Das bedeutet fast mit Sicherheit, dass Seedance 2.0 sehr viel mit Videos unserer Firma trainiert wurde. Du fragst: haben sie dich um Urheberrecht gefragt? Kurz gesagt, in der Nutzervereinbarung der Plattform, keine Ahnung, vielleicht verbirgt sich eine entsprechende Lizenzklausel, aber ich persönlich habe kein Geld erhalten und wurde nicht kontaktet. Vielleicht sind sie rechtlich im Recht, aber das ist gruselig, oder? Schlimmer noch: wir haben andere Creator getestet, z.B. He Tongxue, und die Konsistenz der Person ist extrem hoch. Der Sand, den wir normalerweise sehen, entsteht durch langsame Verwitterung von Gestein, ein Geschenk der Zeit… naja, vielleicht gibt es bei der Tonqualität von He Tongxues Video noch Raum. Aber wir haben festgestellt, dass Seedance diesmal meine Stimme verwendet, um sie ihm zu verleihen, und viele andere haben sich gewundertlicherweise auch meine Stimme bekommen. Das ist ein bisschen lustig, aber nach dem Lachen müssen wir ernst werden. Ich finde wirklich, wir alle müssen jetzt wachsam werden, denn wir sind ein Fall: eine der ersten Firmen, die alle Daten, besonders Bild- und Ton-Daten, in die Cloud hochgeladen hat, und auch ich als Einzelperson, besonders HD-Inhalte. Du kannst jetzt sehen: wenn die Daten eines Menschen vollständig in den KI-Datensatz gelangen, kann sie zu 100 % jede deiner Gestalten und Stimmen simulieren. Können deine Angehörigen das noch unterscheiden? Ich denke, jetzt verstehst du, warum wir dieses Video machen. Das ist keine kleine technische Innovation, das ist ein Tsunami, der alle bisherigen Workflows und Ablagerungen der Branche wegspülen wird, so beschreibe ich es. Vor dem Schluss noch ein Fall: vor einiger Zeit haben wir ein Video gemacht: KI kann mich ersetzen — was ist dann mein Sinn? Darin haben wir einem Fan mit Tumor bei einem MV geholfen und zwei Jahre an Effekten gearbeitet, aber am Ende merkten wir: je mehr Mühe wir uns geben, desto weniger kommen wir mit dem Tempo der KI mit. Was ich früher lernte, verliert an Wert. 2022/23 haben wir Shot fahrenden Himmels-Züge von Hand in Dutzenden bis Hunderten Stunden gemacht. 2023 machte die KI so ein Ergebnis in Minuten, nicht sehr gut. 2025, zwei Jahre später, zur Mitte, konnte die KI ein sehr starkes Ergebnis liefern. Und heute Seedance 2.0? Wir haben probiert, das ist das jetzige Ergebnis. Reden hilft nicht, ich finde wirklich, du solltest diese KI selbst ausprobieren, um zu verstehen, wie erschreckend sie ist. Sie ist noch nicht die KI, die die Videoindustrie wirklich verändern wird, das sage ich aus tiefstem Herzen, aber die nächste KI, die nächste Version, könnte es sein. Ist das für die Menschheit gut oder schlecht?