Il nuovo prodotto di punta di ByteDance: un'unica ripresa continua di 30 secondi in un solo passaggio, fino a 50 file di riferimento e una colonna sonora che guida ritmo e sincronizzazione labiale. Digita un prompt qui sotto e provalo.
Sviluppatore
ByteDance
Tipo
Testo / immagine / riferimento al video
Audio
Nativo · sincronizzazione guidata dall’audio
Durata
30 s nativi, prolungabile
Lingue
10+ (sincronizzazione labiale)
Riferimenti
Fino a 50 file
Livello qui
Crediti a pagamento
Il nostro verdetto in una riga: la scelta per il long take. Quando il brief richiede un'unica ripresa ininterrotta o un montaggio guidato dalla musica, nient'altro qui raggiunge i 30 secondi.
Seedance 2.5 sfonda il tetto comune a ogni modello video: invece di frammenti da 5 a 15 secondi, genera un'unica ripresa continua di mezzo minuto senza montaggio e senza giunture — presentata in anteprima alla conferenza FORCE di ByteDance a giugno e distribuita entro l'inizio di agosto. Forniscigli un kit completo di asset, oppure dagli una traccia musicale e lascia che sia l'audio a dirigere le riprese. Il Seedance con cui hai creato bozze qui ha appena avuto un fratello maggiore.
Il modello ha completato il rollout alcuni giorni fa, quindi queste sono prime impressioni basate sui nostri rendering di test e sui numeri di lancio di ByteDance — indicate come tali. I benchmark indipendenti descrivono ancora il suo predecessore; li aggiorneremo man mano che saranno disponibili.
• Il piano sequenza di 30 secondi.
Una generazione nativa, non clip assemblate — così il movimento della camera, il personaggio e la luce restano coerenti per l’intero mezzo minuto. L’estensione multi-turn va oltre, e una modalità Ultra-Long da 180 secondi è disponibile in beta upstream.
• Limite di 50 riferimenti a file.
Fino a 30 immagini, 10 clip video e 10 clip audio per generazione — la più grande capacità di riferimento tra tutto ciò che ospitiamo, pensata per team con un vero kit di asset.
• L'audio guida il video.
Fornisci una traccia musicale, vocale o SFX e questa imposta il ritmo, sincronizza i tagli con il beat e sincronizza il labiale — in oltre 10 lingue. Questo inverte il flusso di lavoro abituale: la colonna sonora dirige le riprese.
• Controlli di livello registico.
Modifiche a livello di regione che cambiano parte di un fotogramma senza rigenerare la clip, sostituzioni dello sfondo green screen che mantengono il soggetto e blocking con modelli bianchi per la previz. Sono strumenti di produzione, non slider giocattolo.
• L'asterisco 4K.
Il 4K nativo è stato annunciato lo stesso giorno — per la pipeline Seedance 2.0. Alcune testate lo hanno inserito nella scheda tecnica della 2.5; i tre pilastri dichiarati da ByteDance per la 2.5 sono durata, riferimenti e controllo. Non sceglierlo per un titolo sulla risoluzione.
• Benchmark in sospeso.
Le arene pubbliche continuano a valutare Seedance 2.0. Ogni affermazione sul "nuovo re" questo mese — riguardo a questo modello o ai suoi rivali — è provvisoria finché non arriveranno numeri indipendenti.
• Nessun pranzo gratis upstream.
Sulla piattaforma di ByteDance, la 2.5 è stata lanciata senza alcuna quota gratuita — per abilitarla è necessario un account con fondi. Chiunque pubblicizzi "Seedance 2.5 gratuito e illimitato" sta rivendendo qualcosa, oppure sta mentendo.
• Riprese lunghe, attese lunghe.
Trenta secondi di video nativo sono un rendering impegnativo. Aspettati tempi di generazione di diversi minuti e pianifica i crediti di conseguenza — abbozza sempre prima l'idea sui livelli veloci.
Tutto qui mette alla prova ciò che solo Seedance 2.5 può fare nella nostra gamma: durata, temporizzazione guidata dall'audio e modifiche chirurgiche. Copia, sostituisci le parentesi, esegui il rendering.
"Un'unica ripresa continua a mano: seguiamo una [corriere] da dietro mentre si fa strada tra un affollato mercato notturno, si china sotto la tenda di una bancarella quando inizia a piovere e consegna un pacco a un venditore che sorride. La camera non stacca mai. Riflessi al neon nelle pozzanghere, suono della pioggia in crescendo, chiacchiericcio del mercato per tutto il tempo."
"La camera non stacca mai" ora è un'istruzione che puoi davvero dare. Scrivi l'inquadratura come una frase di azione continua con un inizio, una parte centrale e una fine — il modello mantiene identità e illuminazione perché è una sola generazione, non tre unite insieme.
Carica: una traccia musicale di 30 secondi
"Uno spot di sneaker montato su questa traccia: il prodotto ruota e le riprese di corsa urbana cambiano a tempo, slow motion sui drop di basso, composizione finale del logo sull'ultimo colpo. Palette urbana al crepuscolo, 24 fps."
La traccia caricata non è musica di sottofondo — è l’autorità per il timing del montaggio. Dare un nome a ciò che accade sui beat e sui drop (“cambio sul beat”, “slow motion sui drop”) indica al modello come usare i suoi 30 secondi. Nessun altro modello qui prende indicazioni da una colonna sonora.
Inizia da: una clip che hai già generato
"Solo nel terzo sinistro dell’inquadratura: sostituisci il furgone parcheggiato con un banco di fiori. Tutto il resto — la coppia che cammina, la deriva della camera, l’audio — rimane esattamente com’è."
La modifica a livello di regione significa che un oggetto sbagliato non ti costa più la rigenerazione di un rendering di 30 secondi. Delimita la regione, assegna un nome alla sostituzione e proteggi esplicitamente il resto — è la clausola di protezione a impedire alla modifica di espandersi.
I due nuovi arrivati sono stati rilasciati a pochi giorni di distanza l’uno dall’altro, con Veo come parametro di riferimento consolidato. Stessi prompt per tutti e tre, valutati in base a ciò che pubblicheremmo — in via provvisoria, considerando quanto sono nuovi due di loro. Confrontali tu stesso da una singola casella di prompt.
presentato in anteprima alla conferenza FORCE di Volcano Engine il 23 giugno, prima beta enterprise, distribuzione pubblica completata all'inizio di agosto. Generazione nativa di 30 secondi, 50 riferimenti, sincronizzazione guidata dall'audio. ByteDance ha saltato 2.1–2.4 per segnare il salto. La versione in questa pagina.
il campione in carica dell'arena per testo-in-video e immagine-in-video fino all'inizio del 2026, con audio nativo e coerenza multi-inquadratura. Il livello Fast alimenta le tue bozze giornaliere gratuite su questo sito.
l'era di velocità e prezzo che ha reso Seedance il blocco da schizzi predefinito della community: senza fronzoli, veloce, ovunque. Questa reputazione è il motivo per cui "abbozza su Seedance" è ancora il consiglio fisso in ogni pagina di questo sito.
Il nuovo modello video di punta di ByteDance, presentato in anteprima alla conferenza Volcano Engine FORCE il 23 giugno 2026 e distribuito tra la fine di luglio e l'inizio di agosto. Tre aggiornamenti principali: una clip continua di 30 secondi in un solo passaggio, fino a 50 riferimenti multimodali (30 immagini, 10 video, 10 clip audio) e controlli di produzione più precisi come l'editing a livello di regione. Il numero di versione salta direttamente da 2.0 a 2.5 — ByteDance ha saltato dalla 2.1 alla 2.4 per segnalare un salto generazionale.