Mówiący awatar i synchronizacja ust dla portretów
Złóż za zgodą mówiący portret do bibliotecznego powitania z jednego zdania: ustal twarz, nagraj głos, sprawdź rytm ust poza OmniArt i obejrzyj kadr, który opublikujesz.
Mówiący awatar to portret, który wygląda, jakby mówił. Przydatne zadanie jest wąskie: powitanie biblioteczne, krótka wstawka o produkcie albo wstęp do lekcji z jednego lub dwóch zdań. Ten przewodnik bierze fikcyjną asystentkę biblioteki, Mara Chen, jako przykład planowania. Jej kwestia: Twoja rezerwacja czeka przy ladzie.
W OmniArt portret przygotowujesz w przestrzeni obrazu, a głos generujesz modelem mowy w przestrzeni audio. Publiczny katalog ma modele obrazu, modele wideo i modele mowy. Nie ma w nim osobnego sterowania synchronizacją ust ani mówiącym awatarem, które nakłada scenariusz na kształt ust. Dokończ to zgranie w zewnętrznym edytorze synchronizacji ust, potem obejrzyj plik w kadrze, który opublikujesz. Tło kategorii jest w notatkach o awatarach, notatkach o synchronizacji ust i notatkach o awatarze ze zdjęcia.
Do czego służy mówiący portret
Sięgnij po mówiący portret, gdy twarz niesie przekaz, a ujęcie zostaje blisko. Kwestia Mara działa, bo widz potrzebuje jednego faktu i miejsca, na które patrzy: lady odbioru, a nie wycieczki po budynku. Zaplanuj jedną myśl, jedną twarz i jedno kadrowanie. Ujęcie półek należy do osobnego klipu.
Zdobądź zgodę, zanim ożywisz twarz
Ożywiaj twarz przygotowaną na tę pracę albo twarz prawdziwej osoby, która zgodziła się na dokładnie to użycie. Jeśli Mara opiera się na współpracowniczce, weź pisemne „tak” na portret, na głos i na miejsca, gdzie wrzucisz klip.
Ostrzeżenie
Omiń osoby prywatne, osoby publiczne i głosy klientów, których nie wolno ci naśladować. Gdy wynik jest realistyczną syntetyczną osobą, dodaj ujawnienie, o które prosi platforma docelowa, w podpisie albo na samym obrazie.
Napisz scenariusz i wybierz głos
Pisz na jeden oddech. „Twoja rezerwacja czeka przy ladzie” siada czysto. Przeczytaj kwestię na głos. Jeśli się potykasz, skróć słowa, zanim wygenerujesz.
Wygeneruj głos w przestrzeni audio OmniArt i trzymaj jedno ustawienie głosu przez całość. Przewodnik MiniMax Speech 2.8 omawia ujęcia HD i Turbo oraz interpunkcję. Trzymaj to samo ustawienie od kwestii testowej do finalnej, włącznie z krótką pauzą na każdym końcu.
Uruchom test synchronizacji na jednej krótkiej kwestii
Zanim sięgniesz po zewnętrzne narzędzie, zrób krótki test obrazu w wideo: Mara lekko kiwa albo mruga. Ten test sprawdza światło, ramiona i to, czy twarz zostaje Marą. Nie twierdzi, że usta trafiają w słowa. Model wideo, który przyjmuje obraz, może ruszyć klatkę. Ten ruch nie jest sterowaniem, które wiąże klatki z plikiem głosu.
Weź zatwierdzony głos do edytora synchronizacji ust poza OmniArt i zsynchronizuj tylko to jedno zdanie. Odtwórz w normalnym tempie z dźwiękiem. Usta powinny otworzyć się przy pierwszym słowie i uspokoić, gdy fraza się kończy, a szczęka zostaje przy twarzy.
Jeśli test nie przechodzi, zmień jedno wejście. Weź wyraźniejszą klatkę na wprost, wolniejsze czytanie albo czystszy plik audio. Na przykład odrzuć selfie w trzech czwartych z podbródkiem schowanym, jeśli zasłania dolną wargę: narzędzie synchronizacji może musieć wymyślić brakującą krawędź ust. To kryterium odrzucenia, a nie wynik testu, który wykonaliśmy.
Trzymaj twarz nieruchomo między ujęciami
Mara potrzebuje tych samych oczu, tego samego przedziałka i otwartego kołnierza na klatce, w teście ruchu i w zsynchronizowanym eksporcie. Użyj ponownie zatwierdzonego obrazu. Przewodnik po postaci dotyczy i tego przypadku, choć wykonanie to jedno zdanie.
Zatwierdzona klatka jest na wysokości oczu, z oknem biblioteki za jej lewym ramieniem i niczym na ustach. Okulary przeciwsłoneczne, dłoń przy brodzie, mocne rozmycie i stromy profil chowają kształty, które edytor synchronizacji ust musi odczytać.
Obejrzyj klip w finalnym kadrze
Obejrzyj wyeksportowany plik w kadrze, który opublikujesz. Przy bibliotecznym poście 9:16 ustaw napisy poniżej brody, żeby nie przecinały ust. Sprawdź, czy oczy wciąż spotykają obiektyw po kadrowaniu, czy w głosie nie ma szumu pomieszczenia i czy słowa na ekranie zgadzają się z mówioną kwestią.
Obejrzyj raz dla sensu i raz dla ust. Klatka, która na pauzie wygląda ostro, może wciąż spóźniać się na początku zdania. Trzymaj muzykę pod głosem. Jeśli kadr odcina kołnierz, wróć do zatwierdzonej klatki.
Jak zacząć w OmniArt
Wygeneruj Marę jako oryginalny portret na wprost w przestrzeni obrazu, z obojgiem oczu i ustami odsłoniętymi. Wygeneruj głos z jednego zdania w przestrzeni audio i zapisz to ujęcie. Modelu wideo użyj tylko do krótkiego testu ruchu klatki. Synchronizację ust dokończ w zewnętrznym edytorze, potem obejrzyj finalny kadr z napisami na miejscu, zanim opublikujesz.
Gotowy, aby tworzyć?
Zacznij generować świetne treści z AI