Ten eerste, dit is geen advertentie. Ik nam deze video nogal plotseling op omdat ByteDance net een model genaamd Seedance 2.0 heeft uitgebracht. Mijn houding tegenover AI-modellen is normaal: oh oh weer eentje, dan wordt er een hoop met concepten geschermd, dan valt de echte ervaring tegen, dan sla ik de pagina om. Maar bij dit model dacht ik bij de eerste video: oh, dit kan ook, kijk bijvoorbeeld hier, en het gaat om de precisie, toch? Dit is echt indrukwekkend. Toen zag ik mensen online inhoud gaan maken, zoals dit en dit. Ik zeg niet dat het perfect is, maar je voelt duidelijk dat het veel sterker is dan eerdere AI-video, toch? Toen dacht ik: dit model is niet simpel. Toen kon ook ons bedrijf inhoud gaan maken, ik heb het zelf geprobeerd, en mijn indruk is: je moet het echt zelf proberen. Als video-generatiemodellen in het begin van 2026 al op dit niveau zijn, dan vind ik dat de traditionele film-workflow definitief in een aftelling zit om door een AI-tsunami weggevaagd te worden. Ik blaas het niet op. Laten we samen kijken hoe video-generatiemodellen vandaag zijn. Eerdere generatoren waren al best goed en overtuigend, maar er waren punten waar je ze kon breken: grootschalige camerabeweging, knip-continuïteit en beeld-geluid match. Laten we Seedance 2.0 bekijken op deze drie pijnpunten. Ten eerste grootschalige beweging: we vroegen onze AI-regisseur om deze tekst en dit beeld te schrijven zonder andere info — en dit is het resultaat. Is dit niet verbluffend? Dit soort camerabeweging kan AI nu genereren. Wat, je wilt een nog gekere camerabeweging? Geen probleem, we veranderen de prompt en kijken opnieuw. Dus dat hoeft verder geen uitleg. Eerder herkenden we AI-video aan de valse camerabeweging; die methode is in feite faalt. Ten tweede, montage. Eerdere modellen konden knippen, maar oude knippen waren zo: knippen om te knippen, hooguit close-up en dan wide, en de camerabeweging zelf sloot niet aan. Laten we het meest verbazingwekkende van dit model zien: het montage-ontwerp van een video uit één zin. Ik weet niet of je het zag, maar het zijn niet alleen close-ups, er is duidelijke hoekwisseling, er is regie-intentie, en personagesvervormen niet. Misschien klinkt onduidelijk; laten we een topview gebruiken om de verandering van onderwerpen te simuleren. Je ziet hier, hier, hier geknipt — als een echte regisseur die steeds de camerapositie en hoek verandert zodat het publiek de belangrijke inhoud beter begrijpt. Dat is regie-denken. Eerder dacht ik dat AI een clip genereert en de editor er een meesterwerk van montaagt. Nu moeten we beseffen: als dit soort modellen rijpt is, zijn er geen editors meer nodig. Er is geen concept van selectie of verspilde shots; alles is bruikbaar. Als de gegenereerde sneden goed genoeg zijn, waarom heb ik montage dan nodig? Ik geloofde altijd dat montage emotionele expressie is: voeg enkele frames in en de sfeer verandert, dus moet een mens het doen. Maar nu moeten we deze vraag onder ogen zien: hoe weet je zeker dat de frames die jij invoegt beter zijn dan de frames die AI invoegt? Vooral omdat het je ontelbaar veel versies kan geven, heel snel. Tot slot, beeld-geluid match. Een video zonder geluid verliest veel. Het grootste probleem bij AI vroeger was dat nagesynchroniseerd geluid nep klonk, vooral menselijke stem plus omgevingsgeluid plus muziek samen onnatuurlijk werd. Laten we het resultaat van dit model zien — best goed, toch? Vroeger kostten SFX en mixing een dag of meer omdat alles handmatig werd geplakt; nu is het één klik. Maar er zijn in de industrie nogal wat uitstekende geluidsmodellen, dus dit zal je niet zo verbazen. Maar ik wil iets vertellen dat we per ontdekking vonden en een beetje angstaanjagend is: ik merkte dat als ik mijn eigen gezicht upload naar Seedance 2.0, deze AI automatisch met mijn stem spreekt. Ik weet niet of je begreep wat ik zei: zonder enige prompt, enige woorden, enige informatie, heb ik mijn stembestand niet gegeven, ik uploadde alleen mijn gezicht — dit is geen advertentie — en de AI wist dat de stem van dit gezicht de mijne is. Ik demonstreer: dit is het resultaat dat we met één zin plus mijn foto genereerden. Mijn houding tegenover AI-modellen: oh oh weer eentje... maar de demovideo van dit model deed me denken: oh, vind je dit niet angstaanjagend? En het angstaanjagendste is niet alleen mijn stem — de foto die we uploadden was zo, alleen de voorkant van het gebouw, maar kijk naar de camerabeweging, het kan naar de andere kant van het gebouw draaien. Hoe is de andere kant van ons gebouw in werkelijkheid? Zo. Is dat niet eng? Het weet wat er achter mij is, al heb ik het niet verteld. Dit bevestigt in feite één ding: Seedance 2.0 is zwaar getraind op video van ons bedrijf. Je zult vragen: hebben ze niet om copyright gevraagd? Kort gezegd, in de gebruikersovereenkomst van het platform, ik weet niet, misschien gaat er een soortgelijke licentieclausule schuil, maar persoonlijk heb ik geen geld ontvangen en ben niet benaderd voor licentie. Misschien zijn ze juridisch in orde, maar het is een beetje eng, toch? Erger nog, we testten andere makers, zoals He Tongxue, en je zult zien dat de personage-consistentie superhoog is. Het zand dat we normaal zien ontstaat uit steen door lange verwering, een geschenk van de tijd... tja, misschien is er nog ruimte in de audiokwaliteit van He Tongxues video. Maar we ontdekten dat Seedance dit keer koos voor mijn stem om aan hem te geven, en veel anderen kregen onverklaarbaar ook mijn stem. Het is een beetje grappig, maar na het lachen moeten we weer serieus worden. Ik geloof echt dat we nu wakker moeten worden, want wij zijn een casus: een van de eersten die alle informatie en data, vooral beeld- en geluidsdata, naar de cloud uploadde, en ook ik als individu, vooral HD-inhoud. Je kunt nu zien: als iemands data volledig in de dataset van de AI belandt, wat gebeurt er? Het kan 100 % elke gedaante en stem van je simuleren. Zou je familie het kunnen onderscheiden? Ik denk dat je nu snapt waarom we deze video maken. Dit is geen kleine technische innovatie, dit is een tsunami die alle eerdere workflows en bezinksel van de industrie weg zal vagen — zo omschrijf ik het. Voor het einde nog een casus: een tijdje terug brachten we een video uit — AI kan mij vervangen, wat is mijn betekenis? Daarin vertelden we hoe we een fan met een tumor hielpen een MV te maken, en twee jaar aan effecten werkten, maar uiteindelijk merkten we dat hoe harder we ons best deden, hoe meer we de snelheid van AI's vooruitgang achterhaalden. Wat ik eerder leerde, verliest waarde. In 2022 en 2023 kostte het tientallen tot honderden uren om handmatig een shot van een vliegende trein te maken. In 2023 maakte AI zo'n resultaat in minuten, niet erg goed. In 2025, twee jaar later, in het midden, kon AI een heel sterk resultaat maken. En Seedance 2.0 vandaag? We probeerden het, en dit is het huidige resultaat. Dus praten helpt niet; ik denk echt dat je dit AI-model zelf moet proberen om te begrijpen hoe beangstigend het is. Het is nog niet de AI die de videondustrie echt zal veranderen, dat zeg ik vanuit mijn hart, maar de volgende AI, de volgende versie, zou het kunnen zijn. Is dat goed of slecht voor de mensheid?