Først: dette er ikke en reklame. Jeg optog denne video ret pludseligt, for ByteDance har netop udgivet en model kaldet Seedance 2.0. Min holdning til AI-modeller er normalt: åh åh, endnu en udgivelse, så hypes en masse seje koncepter, så er den faktiske oplevelse ikke så god, så går jeg videre. Men ved denne model, da jeg først så videoen, tænkte jeg: åh, den kan også det — for eksempel kig her. Det vigtige er detaljegraden, ikke? Det er virkelig stærkt. Så så jeg folk online begynde at producere indhold, f.eks. dette og dette. Jeg siger ikke, den er fejlfri, men du kan tydeligt mærke, at den er meget stærkere end tidligere AI-video, ikke? Da tænkte jeg, at denne model ikke er simpel. Så kunne vores firma selv begynde at producere indhold, jeg prøvede selv, og min fornemmelse er: du skal virkelig selv prøve den. Hvis videogenereringsmodeller allerede er på dette niveau i starten af 2026, så føler jeg, at den traditionelle film-workflow for alvor er gået i nedtælling til at blive skyllet væk af en AI-tsunami. Jeg overdriver ikke. Lad os se sammen på, hvad videogenereringsmodeller er i dag. Tidligere videogeneratorer var allerede ret gode og så overbevisende ud, men der var punkter, hvor du kunne bryde dem: storskala kamerabevægelse, klipkontinuitet og lyd-billede-match. Lad os se Seedance 2.0 på disse tre smertepunkter. Først storskala bevægelse: vi bad vores virksomheds AI-instruktør om at skrive denne tekst og dette billede uden andre informationer — og det er vores resultat. Er det ikke fantastisk? Den slags kamerabevægelse kan AI nu generere. Hvad, du vil have en endnu vanvittigere kamerabevægelse? Intet problem, vi ændrer prompten og ser igen. Så det behøver jeg vel ikke sige mere om. Tidligere kunne man kende AI-video på om kamerabevægelsen var falsk; den metode er reelt slået fejl. Nu det andet punkt: klipning. Tidligere modeller kunne lave klip, men gamle klip var sådan: de klippede for at klippe, højst et close-up og så totalbillede, og selve kamerabevægelsen hang ikke sammen. Lad os se det mest bragende ved denne model: klipdesignet i en video genereret ud fra én sætning. Ved ikke om du lagde mærke til det, men der er ikke kun close-ups, der er tydelig vinkelskift, der er instruktør-intention, og personerne deformeres ikke. Måske lyder det utydeligt; lad os bruge et overliggende diagram til at simulere ændringerne af subjekter. Du ser, det klipper her, her, her — som en rigtig instruktør, der hele tiden ændrer kameraets placering og vinkel, så publikum bedre forstår det vigtige indhold. Det er instruktørtænkning. Tidligere tænkte jeg, at AI genererede et klip, og en klipper så klippede det til et værk. Nu skal vi indse: når sådanne modeller modnes, behøves der ikke klippere. Der findes ikke begrebet udskillelse eller spildklip; alt er brugbart. Når de genererede klip er gode nok, hvorfor så klippe? Jeg troede altid, at klipning var et følelsesmæssigt udtryk — indsætter du et par billeder, ændres stemningen, så det skal et menneske gøre. Men nu skal vi stå_ansigt til_ansigt med spørgsmålet: hvordan er du sikker på, at de billeder, du indsætter, er bedre end de billeder, AI indsætter? Især når den kan give dig uendeligt mange versioner, og det hurtigt. Nu det sidste punkt: lyd-billede-match. En video uden lyd mister meget. Det største problem hos tidligere AI var, at den lagte lyd var falsk, især menneskestemme plus omgivelseslyd plus musik sammen føltes unaturligt. Lad os se resultatet af denne model — ret godt, ikke? Tidligere tog SFX og mixing en dag eller mere, hvor man lagde lyd på én ad gangen manuelt; nu kører det med ét klik. Men der er faktisk ret mange gode lydmodeller i branchen nu, så du vil nok ikke synes det er så bragende. Men jeg vil fortælle om noget, vi tilfældigt opdagede, som er lidt uhyggeligt: jeg opdagede, at når jeg lægger mit eget ansigt ind på Seedance 2.0, taler denne AI automatisk med min stemme. Jeg er ikke sikker på, om du forstod, hvad jeg sagde: uden nogen prompt, nogen ord, nogen information, og jeg gav ikke min lydfil, jeg lagde kun mit ansigt ind — det er ikke en reklame — og AI'en vidste, at dette ansigts stemme er min. Lad mig vise det: dette er resultatet, vi genererede med én sætning og mit foto. Min holdning til AI-modeller er: åh åh, endnu en... men denne models demovideo fik mig til at tænke: åh, synes du ikke, det er uhyggeligt? Og det mest uhyggelige er ikke kun min stemme — det foto, vi uploadede, var sådan her, kun bygningens facade, men kigger du på kamerabevægelsen, drejer den rundt til bygningens anden side. Hvordan ser den anden side af vores bygning ud i virkeligheden? Sådan her. Er det ikke uhyggeligt? Den ved, hvad der er bag mig, selvom jeg ikke fortalte det. Det bekræfter stort set én ting: Seedance 2.0 er trænet på rigtig meget video fra vores firma. Du spørger sikkert, bad de om ophavsret? Kort sagt, platformens brugeraftale, ved jeg ikke, måske skjuler der sig en tilsvarende licensklausul, men personligt har jeg ikke modtaget penge eller været kontaktet om licens. Måske er de juridisk dækket, men det er lidt uhyggeligt, ikke? Værre er det, vi testede andre skabere, f.eks. He Tongxue, og du vil se, at karakterkonsistensen er ekstremt høj. Det sand, vi normalt ser, dannes af sten gennem lang tids forvitring, en gave fra tiden... nå ja, måske er der stadig lidt plads til forbedring af lydkvaliteten i He Tongxues video. Men vi opdagede, at Seedance denne gang valgte at bruge min stemme til ham, og mange andre fik også uforklarligt min stemme. Det er lidt sjovt, men efter grin skal vi blive seriøse igen. Jeg synes virkelig, vi alle må vågne nu, for vi er egentlig et case: en af de første til at uploade al information og data, især billede- og lyd-data, til skyen, og også mig som individ, især HD-indhold. Du kan nu se: hvis en persons data kommer fuldt ud i AI'ens datasæt, hvad sker der så? Den kan 100 % simulere enhver form og stemme, du har. Kan din familie skelne det? Jeg tror, du nu forstår, hvorfor vi laver denne video. Det er ikke en lille teknologisk nyskabelse, det er en tsunami, der vil feje alle tidligere workflows og bundfald i branchen væk — sådan vil jeg beskrive den. Før slutningen vil jeg nævne endnu en case: for nylig udgav vi en video — AI kan erstatte mig, hvad er min betydning? I den fortalte vi, hvordan vi hjalp en fan med en tumor med at lave en MV, og brugte to år på effekter, men til sidst opdagede vi, at jo mere vi strittede, jo mere kunne vi ikke følge med AI'ens fremskridt. Det jeg lærte før, mister værdi. I 2022 og 2023 tog det at lave et håndlavet skud med et flyvende tog ti-vis til hundrede-vis af timer. I 2023 kunne AI lave et sådant resultat på få minutter, ikke særlig godt. I 2025, to år senere, på midten, kunne AI lave et meget stærkt resultat. Og hvad med dagens Seedance 2.0? Vi prøvede, og det er dens nuværende resultat. Så der er ikke mere at sige; jeg synes virkelig, du selv skal prøve denne AI-model for bedre at forstå, hvor skræmmende den er. Det er endnu ikke den AI, der for alvor vil ændre videobranchen — det siger jeg af hjertet — men den næste AI, den næste version, måske er det den. Så er det godt eller skidt for menneskeheden?