Først: dette er ikke reklame. Jeg spilte inn denne ganske brått fordi ByteDance akkurat har sluppet en modell som heter Seedance 2.0. Min holdning til AI-modeller er normalt: åh åh, nok en utgivelse, så hypes mange fete konsepter, så er faktisk opplevelse middels, så blar jeg videre. Men denne modellen, da jeg først så videoen, tenkte: åh, den kan også dette — se for eksempel her. Det viktigste er detaljnivået, ikke sant? Det er virkelig imponerende. Så så jeg at folk på nettet begynte å lage innhold, som dette og dette. Jeg sier ikke den er feilfri, men du merker tydelig at den er mye sterkere enn tidligere AI-video, ikke sant? Da tenkte jeg at denne modellen ikke er enkel. Så kunne firmaet vårt begynne å produsere innhold selv, jeg prøvde selv, og inntrykket er: du må virkelig prøve den selv. Hvis videogenereringsmodeller allerede er på dette nivået i starten av 2026, føler jeg at det tradisjonelle film-arbeidet formelt har gått i nedtelling til å skylles bort av en AI-tsunami. Jeg overdriver ikke. La oss se sammen på hvordan videogenereringsmodeller er i dag. Tidligere generatorer var ganske bra og så overbevisende ut, men det fantes punkter hvor du knekkte dem: storskala kamerabevegelse, klippe-kontinuitet og bilde-lyd-match. La oss se Seedance 2.0 på disse tre smertepunktene. Først storskala bevegelse: vi ba AI-regissøren vår skrive denne teksten og dette bildet uten annen info — og her er resultatet. Er ikke dette fantastisk? Slik kamerabevegelse kan AI generere nå. Hva, du vil ha enda rarere kamerabevegelse? Ingenting problem, vi endrer prompt og ser igjen. Så det trenger vel ikke mye mer. Tidligere identifiserte vi AI-video ved om kamerabevegelsen var falsk; den metoden har i hovedsak feilet. For det andre, klipping. Tidligere modeller kunne lage kutt, men gamle kutt var slik: de kuttet for å kutte, høyst close-up og så total, og selve kamerabevegelsen hang sammen. La oss se det mest slående ved denne modellen: kutt-designet i en video generert fra én setning. Vet ikke om du la merke til det, men det er ikke bare close-ups, det er tydelig vinkelskifte, det er regissør-intensjon, og personene deformerer ikke. Kanskje det høres uklart ut; la oss bruke et oversiktsbilde for å simulere subjektendringene. Du ser kutt her, her, her — som en ekte regissør som hele endrer kameraets posisjon og vinkel slik at publikum bedre forstår viktig innhold. Dette er regissør-tenkning. Før trodde jeg AI genererte et klipp og klipperen kuttet det til et mesterverk. Nå må vi innse at når slike modeller modnes, trengs det ikke klippere. Det fins ikke noe begrep om utskilling eller kassaklipp; alt er brukbart. Når de genererte kuttene er gode nok, hvorfor trenger jeg klipping? Jeg trodde alltid klipping var følelsesmessig uttrykk — setter du inn noen bilder, endres stemningen, så det må et menneske gjøre. Men nå må vi spørre: hvordan er du sikker på at bildene du setter inn er bedre enn de AI setter inn? Spesielt siden den kan gi deg uendelig mange versjoner, raskt. Til slutt bilde-lyd-match. En video uten lyd taper mye. Det største problemet med tidligere AI var at lyden som ble lagt på var falsk, spesielt menneskestemme pluss miljølyd pluss musikk ble unaturlig. La oss se resultatet til denne modellen — ganske bra, ikke sant? Tidligere krevde lydeffekt og miksing at man limte én og én ut manuelt, gjerne en dag eller mer; nå er det ett klikk. Men det er ganske mange gode lydmodeller i bransjen, så du vil ikke synes dette er så slående. Men jeg vil fortelle om noe vi tilfeldigvis oppdaget, som er litt skummelt: jeg la merke til at når jeg laster opp mitt eget ansikt til Seedance 2.0, snakker denne AI-en automatisk med min stemme. Er ikke sikker på om du skjønte hva jeg sa: uten noen prompt, noen ord, noen informasjon, og jeg ga ikke stemmefilen min, jeg lastet bare opp ansiktet mitt — ikke noen reklame — og AI-en visste at stemmen til dette ansiktet er min. Jeg demonstrerer: dette er resultatet vi genererte med én setning pluss bildet mitt. Min holdning til AI-modeller: åh åh, nok en... men demovideoen til denne modellen fikk meg til å tenke: åh, er det ikke skummelt? Og det mest skumle er ikke bare stemmen min — bildet vi lastet opp var slik, bare byggets fasade, men ser du på kamerabevegelsen, kan den svinge til byggets andre side. Hvordan er den andre siden av bygget vårt i virkeligheten? Slik. Er ikke det skummelt? Den vet hva som er bak meg selv om jeg ikke fortalte det. Dette bekrefter i praksis én ting: Seedance 2.0 er trent på enorme mengder video fra firmaet vårt. Du spør sikkert: ba de om opphavsrett? Kort fortalt, plattformens brukeravtale, jeg vet ikke, kanskje en lignende lisensklausul er gjemt, men jeg har personlig ikke fått penger eller blitt kontaktet for lisens. Kanskje de er juridisk covered, men det er litt skummelt, ikke sant? Verre er det at vi testet andre skapere, som He Tongxue, og du vil se at karakter-konsistensen er ekstremt høy. Sanden vi vanligvis ser formes av stein gjennom lang forvitring, en gave fra tiden... vel, kanskje det er litt rom for forbedring i lydkvaliteten i He Tongxues video. Men vi oppdaget at Seedance denne gangen valgte å bruke min stemme til ham, og mange andre fikk uforklarlig min stemme. Det er litt morsomt, men etter latteren må vi bli seriøse igjen. Jeg tror virkelig vi alle må våkne nå, for vi er et tilfelle: blant de første til å laste opp all informasjon og data, spesielt bilde- og lyd-data, til skyen, og meg som individ, spesielt HD-innhold. Du kan nå se: hvis en persons data kommer fullt ut i AI-ens datasett, hva skjer? Den kan 100 % simulere enhver form og stemme du har. Kan familien din skille det fra deg? Jeg tror du nå forstår hvorfor vi lager denne videoen. Dette er ikke en liten teknologisk nyskapning, dette er en tsunami som vil skylle bort alle bransjens tidligere arbeidsflyter og avleiringer, slik beskriver jeg det. Før slutten vil jeg gi et tilfelle til: for en stund siden ga vi ut en video — AI kan erstatte meg, hva er min mening? Der fortalte vi hvordan vi hjalp en fan med svulst med å lage en MV, og brukte to år på effekter, men til slutt oppdaget vi at jo mer vi strevde, jo mindre klarte vi å følge AI-ens fremgang. Det jeg lærte før, mister verdi. I 2022 og 2023 tok det titalls til hundrevis av timer å lage for hånd et shot av en flyvende tog. I 2023-laget AI et slikt resultat på minutter, ikke så bra. I 2025, to år senere, på midten, kunne AI levere et veldig sterkt resultat. Og Seedance 2.0 i dag? Vi prøvde, og dette er resultatet nå. Så det er ikke mer å si; jeg tror virkelig du bør prøve denne AI-modellen selv for å bedre forstå hvor skummelt det er. Det er ennå ikke den AI-en som virkelig vil endre videobransjen, det sier jeg av hjertet, men den neste AI-en, neste versjon, kanskje er det den. Er det bra eller dårlig for menneskeheten?