GuideModele i analizy9 min czytania

Seedance 2.0: wzorce promptów i sześć zastosowań w wideo AI

Przewodnik twórcy po Seedance 2.0 — wiele wejść referencyjnych, natywny dźwięk, wyjście do 4K, promptowanie ujęciami i sześć przetestowanych promptów w OmniArt.

Zespół OmniArt
Seedance 2.0: wzorce promptów i sześć zastosowań w wideo AI

Seedance 2.0 to model, po który twórcy sięgają, kiedy brief brzmi jak brief reżysera. Przyjmuje tekst, do dziewięciu obrazów, trzy wideo referencyjne i trzy pliki audio w jednym żądaniu, adresowane składnią @image1, @video1 i @audio1. Ten przewodnik omawia gramatykę promptu, którą model szanuje, jego obecne limity w OmniArt oraz sześć przetestowanych zastosowań razem z promptami i wynikami.

Czym jest Seedance 2.0

Seedance 2.0 generuje klipy o długości 4–15 sekund z natywnym dźwiękiem. Wariant Standard sięga 4K; Fast i Mini sięgają 720p. Najważniejsza pozostaje architektura z wieloma referencjami: jedno żądanie może łączyć obrazy, wideo i audio, o ile zawiera co najmniej jedną referencję wizualną.

ParametrWartość
WariantyStandard, Fast, Mini
Rozdzielczość wyjściaStandard: 480p / 720p / 1080p / 4K; Fast i Mini: 480p / 720p
Długość4–15 sekund
Proporcje obrazu21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16
Limit materiałów referencyjnychDo 12 materiałów łącznie; wymagany co najmniej jeden obraz albo wideo
Wejścia obrazuDo 9 (@image1@image9)
Wejścia wideoDo 3; każde 2–15 s przy 24–60 fps, łącznie 15 s (@video1@video3)
Wejścia audioDo 3; każde 2–15 s, łącznie 15 s (@audio1@audio3)
Natywne wyjście audioTak — dialog, efekty, tło akustyczne, muzyka
Tryby zadańVideo, Transition, Reference, Extend, Modify
DostępStandard: Creator i wyżej; Fast i Mini: Starter i wyżej

Dlaczego system wielu referencji ma znaczenie

Większość modeli wideo przyjmuje jedną referencję albo żadnej. Seedance 2.0 przyjmuje cały stos i pozwala przypisać każdej referencji rolę wewnątrz promptu. Użyj @image1 do twarzy postaci, @image2 do kostiumu, @image3 do lokacji, @video1 do ruchu kamery, który chcesz powtórzyć, @audio1 do podkładu muzycznego. Wyjście traktuje każdą z nich jako osobną instrukcję, zamiast uśredniać je w szum.

To praktyczny powód, dla którego podobieństwo postaci utrzymuje się między ujęciami: ta sama referencja @image wchodzi w każde ujęcie na osi czasu, a model używa jej jako kotwicy tożsamości, zamiast za każdym razem wnioskować postać z promptu.

Struktura promptu, która działa

Seedance 2.0 nagradza sześcioczęściową strukturę.

  1. Temat — kto albo co jest na ekranie
  2. Czynność / ruch — co robi
  3. Miejsce / otoczenie — gdzie to się dzieje
  4. Styl wizualny — odniesienia filmowe, paleta, epoka
  5. Prowadzenie kamery — konkretne terminy zdjęciowe
  6. Światło — kierunek, jakość, pora dnia

Dobry prompt szablonowy:

"Subject (with @image1 reference if applicable). Action. Setting. Visual style. Camera direction (specific cinematography term). Lighting detail."

Zapis osi czasu z wieloma ujęciami

Seedance 2.0 reaguje na kolejność ujęć, a nie na znaczniki czasu co do sekundy. Używaj numerowanych ujęć i opisuj każdy moment po kolei.

Shot 1: wide establishing shot, character (in @image1) walks into the scene
Shot 2: medium tracking shot follows them across the room
Shot 3: 360-degree orbit around the table they reach

Przypnij tę samą referencję @image1 do każdego segmentu. Podobieństwo utrzyma się przez całe cięcie.

Uwaga

Seedance 2.5 dokłada sterowanie znacznikami czasu w pełnych sekundach. Nie kopiuj szablonu ze znacznikami z wersji 2.5 do żądania w 2.0 z założeniem, że zakresy będą rządzić czasem; trzymaj się pokazanej wyżej struktury z numerami ujęć.

Dyscyplina tagowania referencji

Krótki zbiór zasad, który się opłaca:

  • Używaj @image1, @image2 do zdjęć twarzy i ujęć produktu.
  • Używaj @video1 do ruchu kamery, który ma zostać skopiowany.
  • Używaj @audio1, kiedy podkład dźwiękowy waży więcej niż domyślne wyjście modelu.
  • Odwołaj się do każdego tagu wprost w tekście. Nie licz na to, że model sam wywnioskuje, która referencja pełni którą rolę.

Sześć przetestowanych zastosowań z promptami

Każdy poniższy prompt przepuściliśmy przez Seedance 2.0. Kolumna wyników opisuje to, co dostaliśmy, a czas generowania mierzyliśmy w wariancie Standard w 720p.

1. Filmowa scena fabularna

"A retired detective in a long dark coat walks through a rain-soaked alley at night. Neon signs reflect red and blue on the wet cobblestones. He pauses, lights a cigarette, and glances over his shoulder. Slow push-in from wide shot to medium close-up. Film noir style, anamorphic lens flare, teal-orange color grading, film grain."

Wynik. Płynny najazd kamery. Przekonujące odbicia deszczu, naturalny ruch płaszcza. Zapalanie papierosa renderuje się bez zniekształceń dłoni. Dźwięk deszczu i miejskiego tła wygenerowany w synchronie. ~70 sekund.

2. Reklama produktu

"A luxury perfume bottle rotates slowly on a black marble surface. Golden liquid catches the light as it turns. Soft particles of gold dust float in the air around it. Macro close-up, slow 360-degree orbit camera. Studio lighting with warm rim light, high-end commercial photography style."

Wynik. Poprawne załamanie światła w szkle i zachowanie cieczy. Naturalny dryf cząstek. Płynny pełny obrót, poprawne kąty światła, widoczna faktura marmuru. ~65 sekund.

3. Teledysk

"A female singer in a flowing red silk dress performs on a rooftop at sunset. City skyline stretches behind her. Wind blows her hair and dress dramatically. She sings with emotional intensity, arms spread wide. Dynamic tracking shot circling around her. Golden hour backlighting, lens flare, vibrant warm tones."

Wynik. Realistyczna fizyka sukni. Płynny obrót jazdą. Twarz pozostaje spójna przez cały obrót. Ruch włosów zgodny z kierunkiem wiatru. Wygenerowana ambientowa ścieżka muzyczna. ~75 sekund.

4. Portret postaci w ruchu

"An elderly Japanese craftsman in a traditional wooden workshop, morning light streaming through paper screens. He slowly lifts a hand-forged ceramic tea bowl, examining it with quiet pride. His weathered hands rotate the bowl gently. Close-up of his hands, then slow tilt up to reveal his face. Wabi-sabi aesthetic, warm natural light, documentary portrait quality."

Wynik. Poprawna liczba palców. Naturalny ruch stawów. Płynne przejście z dłoni na twarz. Realistyczne światło przez papierowe przesłony. Delikatne tło akustyczne warsztatu. Realistyczna faktura skóry. ~80 sekund.

5. Przyroda i krajobraz

"Aerial drone shot gliding over a misty mountain valley at sunrise. Layers of fog roll between emerald green peaks. A winding river reflects the golden morning light below. Eagles soar through the frame at eye level. Smooth forward tracking with slight descent. Epic landscape, volumetric fog, golden hour lighting."

Wynik. Niezależne warstwy mgły tworzą przekonującą głębię. Odbicia w rzece zmieniają się razem z położeniem kamery. Mocna równowaga palety. Mgła wolumetryczna renderuje się czysto. Dźwięk wiatru i ptasich głosów. ~55 sekund — najszybciej z całej szóstki.

6. Anime i fantasy

"An anime warrior princess stands atop a cliff overlooking a burning medieval city at night. Her long silver hair and crimson cape billow in the wind. She draws a glowing blue katana, electricity crackling along the blade. Cherry blossom petals swirl around her. Dynamic low-angle shot with slow push-in. Cel-shading style, vibrant neon accents, dramatic speed lines."

Wynik. Spójne cieniowanie cel przez cały klip. Płynne dobycie katany. Efekt elektryczności wtapia się naturalnie. Niezależnie poruszające się płatki wiśni. Interakcja światła ognia z peleryną. Dramatyczny świst miecza w dźwięku. ~70 sekund.

Typowe błędy i sposoby naprawy

ProblemPrzyczynaNaprawa
Prompt odrzuconySłowa kluczowe dotyczące twarzy albo niejednoznaczne sformułowaniaUsuń wprost opisane twarze; użyj zamiast tego referencji @image
Czarne klatkiZbyt złożony promptOgranicz do jednej czynności na 4–5 sekund; obniż rozdzielczość na czas testu
Twarz postaci zmienia się między ujęciamiBrak spójnej referencjiPrzypnij tę samą referencję @image1 do każdego ujęcia na osi czasu
Dźwięk poza synchronemRozjazd wspólnej dyfuzjiWygeneruj ponownie z wyłączonym dźwiękiem i dołóż podkład osobno
Zniekształcone dłonie albo palceZłożona praca dłoni bez referencjiDodaj obraz referencyjny z pożądanym układem dłoni
Faktura „wygenerowana przez AI”Nadmierne poleganie na słowach kluczowych styluDodaj fizyczne detale — materiały, światło, typ obiektywu

Seedance 2.0 kontra Seedance 1.0

Jeśli używasz wersji 1.0, dystans do 2.0 jest większy, niż sugeruje numer wersji.

Funkcja1.02.0
ArchitekturaOsobne potokiZunifikowany dyfuzyjny Transformer
Wejście obrazu1 opcjonalnedo 9, adresowane przez @tag
Wejście wideoBrakdo 3
Wejście audioBrakdo 3
Natywne wyjście audioNieTak
Maksymalna rozdzielczość1080pDo 4K w wariancie Standard
Długość5–10 s4–15 s
Multi-shotPodstawowyStoryboard na osi czasu ze spójnością między ujęciami
Jakość dłoniCzęste artefaktyZauważalnie lepsza
Edycja wewnątrz wideoNieTak — podmiana postaci lub obiektu

Kiedy wybrać coś innego

Seedance 2.0 nie jest właściwym narzędziem do każdego briefu.

PotrzebaLepszy punkt startu w obecnej przestrzeni
Najtańsze szkice Seedance z natywnym dźwiękiemSeedance 2.0 Mini
Drugi przebieg mocno oparty na referencjach, z wyjściem 2KMiniMax H3
Wyjście 4K z opcjonalnym natywnym dźwiękiemVeo 3.1 Standard albo Fast
Krótkie tekst-wideo bez generowanego dźwiękuSora 2
Tania ogólna iteracja w wielu proporcjach obrazuV6

Ceny w OmniArt

Seedance 2.0 jest wyceniany za sekundę wyjścia w przestrzeni wideo w OmniArt. W 720p wariant Standard kosztuje 14 kredytów za sekundę, Fast 11, a Mini 8. Pięciosekundowy klip kosztuje więc odpowiednio 70, 55 albo 40 kredytów. Standard wymaga planu Creator albo Ultra; Fast i Mini wymagają planu Starter lub wyższego. Plan Ultra zawiera obecnie generowanie plików bez pobierania kredytów, a nie rabat procentowy.

Ostrzeżenie

Uprawnienia do użytku komercyjnego zależą od warunków ścieżki i konta użytych do wygenerowania pliku. Sprawdź aktualne warunki platformy przed publikacją o wysokiej stawce.

Jak zacząć w OmniArt

Seedance 2.0 w wariantach Standard, Fast i Mini siedzi w przestrzeni wideo w OmniArt obok modeli MiniMax H3, Gemini Omni, Happy Horse, Kling, Grok Imagine, Veo 3.1, Sora 2, V6 i innych aktualnych modeli wideo. Dzielą to samo saldo i tę samą historię tworzenia, a każdy model zachowuje własne obsługiwane parametry i limity referencji.

Zacznij od powyższego promptu z filmową sceną fabularną, żeby wyczuć pracę z wieloma referencjami, a potem przejdź do briefu teledyskowego, kiedy zechcesz sprawdzić spójność twarzy w ruchu.

Jeśli wybierasz między Seedance 2.0 a HappyHorse 1.0, porównanie HappyHorse 1 z Seedance 2 przechodzi przez kompromisy ujęcie po ujęciu. Po nowszy przebieg pracy sięgnij do tekstu co zmieniło się w Seedance 2.5 i wybierz stamtąd przewodnik promptowania do konkretnego zadania.

Gotowy, aby tworzyć?

Zacznij generować świetne treści z AI

Zacznij za darmo