Prima cosa, questa non è una pubblicità. Ho registrato questo video in modo abbastanza improvviso perché ByteDance ha appena pubblicato un modello chiamato Seedance 2.0. Il mio atteggiamento verso i modelli AI di solito è: oh oh ne è uscito un altro, poi si gonfia un sacco di concetti clamitosi, poi l'esperienza reale è deludente, poi voltiamo pagina. Ma questo modello, quando all'inizio l'ho visto nel video, ho pensato: oh, questo lo sa fare, per esempio guarda qui, e il punto chiave è la sua finezza, giusto? È davvero impressionante. Poi ho visto che online la gente cominciava a produrre contenuti, tipo questo e questo. Non dico che sia perfetto, ma si sente chiaramente che è molto più forte dei video AI precedenti, vero? A quel punto ho pensato che questo modello non è banale. Poi anche la nostra azienda ha potuto iniziare a produrre contenuti, l'ho provato io, e la mia sensazione è: devi davvero provarlo tu. Se i modelli di generazione video sono già a questo livello all'inizio del 2026, sento che il workflow cinematografico tradizionale è ormai entrato nel conto alla rovescia per essere spazzato via da uno tsunami AI. Non sto esagerando. Guardiamo insieme com'è oggi un modello di generazione video. I modelli di generazione video del passato erano già abbastanza buoni e sembravano convincenti, ma c'erano punti in cui li facevi crollare: ampi movimenti di camera, continuità di montaggio e corrispondenza audio-video. Vediamo Seedance 2.0 su questi tre punti dolenti. Primo, ampio movimento: abbiamo chiesto al regista AI della nostra azienda di scrivere questo testo e quest'immagine senza altre informazioni, ed ecco il risultato. Non è stupendo? Questo tipo di movimento di camera oggi può essere generato dall'AI. Cosa, vuoi un movimento ancora più assurdo? Nessun problema, cambiamo prompt e riguardiamo. Non serve aggiungere molto. Prima distinguevo i video AI dal movimento finto della camera; questo metodo è ormai fallito. Secondo punto, il montaggio. I modelli precedenti sapevano generare tagli, ma i tagli di una volta erano così: tagliavano per tagliare, al massimo un close-up e poi un totale, e il movimento di camera non era collegato. Guardiamo la cosa più sconvolgente di questo modello: il design di montaggio di un video generato da una frase. Non so se hai notato: non sono solo close-up, c'è un chiaro cambio di angolazione, c'è un intento registico, e i personaggi non si deformano. Forse suona poco chiaro; usiamo una vista dall'alto per simulare i cambi di soggetto. Vedi, taglia qui, qui, qui — come un vero regista che cambia di continuo posizione e angolo di camera perché il pubblico comprenda meglio i contenuti importanti. Questo è pensiero registico. Prima pensavo che l'AI generasse una clip e poi il montatore la montasse in un'opera grandiosa. Ora dobbiamo renderci conto che, appena un modello del genere matura, non serviranno più montatori. Non esiste il concetto di scrematura o di scarti, tutto è utile. Se i tagli generati sono abbastanza buoni, perché mi serve il montaggio? Ho sempre creduto che il montaggio fosse espressione emotiva: inserisci qualche frame e l'umore cambia, quindi serve una persona. Ma ora dobbiamo guardarci questa domanda: come fai a essere sicuro che i frame che inserisci siano migliori di quelli che inserisce l'AI? Soprattutto considerando che può darti infinite versioni e molto in fretta. Terzo punto, corrispondenza audio-video. Un video senza suono perde molto. Il problema più grande dell'AI di prima era il suono doppiato finto, soprattutto voce umana più ambiente più musica insieme, poco naturale. Guardiamo il risultato di questo modello — discreto, vero? Devi sapere che una volta gli effetti sonori e il mixing richiedevano di incollare tutto a mano, un giorno o più; ora è un clic. Ma di modelli sonori eccellenti nel settore ce ne sono già diversi, quindi non ti sembrerà così sconvolgente. Però voglio raccontare una cosa che abbiamo scoperto per caso ed è piuttosto spaventosa: ho notato che basta caricare la mia faccia su Seedance 2.0 e questa AI parla automaticamente con la mia voce. Non so se hai capito: senza nessun prompt, nessuna parola, nessuna informazione, non ho fornito il mio file vocale, ho solo caricato la mia faccia — non è una pubblicità — e l'AI sapeva che la voce di quella faccia era mia. Ve lo dimostro: questo è il risultato generato con una frase più la mia foto. Il mio atteggiamento verso i modelli AI è: oh oh un altro... ma il video dimostrativo di questo modello mi ha fatto pensare: oh, non ti sembra spaventoso? E la cosa più spaventosa non è solo la mia voce: la foto che abbiamo caricato era così, solo la facciata dell'edificio, ma guarda il movimento di camera, può ruotare sull'altro lato dell'edificio. Com'è l'altro lato del nostro edificio nella realtà? Così. Non è spaventoso? Sa cosa c'è dietro di me anche se non gliel'ho detto. Questo conferma sostanzialmente una cosa: Seedance 2.0 si è allenato tantissimo sui video della nostra azienda. Chiederai: non ti hanno chiesto il copyright? In breve, nell'accordo utente della piattaforma, non lo so, magari è nascosta una clausola di licenza simile, ma io personalmente non ho ricevuto soldi né sono stato contattato per l'autorizzazione. Magari a livello legale sono a posto, ma è un po' spaventoso, no? Peggio ancora, abbiamo provato altri creator, tipo He Tongxue, e vedrai che la coerenza del personaggio è altissima. La sabbia che vediamo di solito è formata dalla roccia attraverso una lunga weathering, un dono del tempo... vabbè, forse la qualità audio del video di He Tongxue ha ancora margine. Ma abbiamo scoperto che questa volta Seedance ha scelto di usare la mia voce per lui, e tanta altra gente ha inspiegabilmente avuto la mia voce. È un po' buffo, ma dopo aver riso dobbiamo tornare seri. Sento davvero che dobbiamo svegliarci tutti, perché noi siamo un caso: tra i primi a caricare tutte le informazioni e i dati, soprattutto immagini e audio, sul cloud, e anch'io come individuo, soprattutto contenuti HD. Puoi vedere ora: se i dati di una persona entrano tutti nel dataset dell'AI, cosa succede? Può simulare al 100% qualsiasi tua forma e voce. La tua famiglia saprebbe distinguerli? Credo che ora capisci perché facciamo questo video. Non è una piccola innovazione tecnica, è uno tsunami che spazzerà via tutti i workflow e i sedimenti del passato nel settore, lo descrivo così. Prima di chiudere voglio un'altra caso: tempo fa abbiamo pubblicato un video — l'AI può sostituirmi, qual è il mio senso? Lì raccontavamo di aver aiutato un fan con un tumore a fare un MV, abbiamo passato due anni sugli effetti, ma alla fine abbiamo scoperto che più ci impegnavamo e meno riuscivamo a tenere il passo del progresso dell'AI. Quello che ho imparato prima perde valore. Nel 2022 e 2023, fare a mano uno shot di un treno volante richiedeva decine o centinaia di ore. Nel 2023 l'AI produceva un risultato del genere in pochi minuti, non molto bene. Nel 2025, due anni dopo, a metà strada, l'AI poteva produrre un risultato già molto forte. E oggi Seedance 2.0? Abbiamo provato, ecco il risultato attuale. Quindi non serve parlare; credo davvero che dovresti provare tu stesso questo modello AI per capire quanto faccia paura. Non è ancora l'AI che cambierà davvero il settore video, lo dico col cuore, ma la prossima AI, la prossima versione, potrebbe essere quella. È un bene o un male per l'umanità?