guideHướng dẫn và cách làm5 phút đọc

Trình tạo âm thanh AI: tạo lồng tiếng và nhạc trên OmniArt

Tạo lồng tiếng và nhạc bằng MiniMax, ElevenLabs và Lyria trên OmniArt, sau đó ghép với video và hiệu ứng âm thanh trong trình biên tập.

Đội ngũ OmniArt
Trình tạo âm thanh AI: tạo lồng tiếng và nhạc trên OmniArt

Âm thanh là một nửa của video mà nhiều nhà sáng tạo thường để mặc cho may rủi. Một cảnh quay sẽ mạnh hơn khi lời dẫn, nhạc và hình ảnh cùng theo một brief. Không gian âm thanh của OmniArt hiện tạo giọng nói và nhạc; chưa có mô hình độc lập chuyển văn bản thành SFX, âm thanh môi trường hay foley. Hướng dẫn này nêu rõ bạn có thể tạo gì, cách chọn mô hình và khâu nào vẫn cần trình biên tập riêng.

Giữ các tài sản được tạo trong cùng một dự án vẫn giúp giảm bàn giao. Bạn có thể tạo lời lồng tiếng và nhạc nền, tạo ảnh hoặc video phù hợp, rồi lắp ráp timeline cuối trong một trình biên tập khác.

Bạn có thể tạo gì

Các mô hình âm thanh của OmniArt phục vụ hai công việc:

  • Lồng tiếng — lời dẫn, thoại nhân vật và hội thoại đa ngôn ngữ từ văn bản, với điều khiển thay đổi theo từng mô hình giọng nói.
  • Âm nhạc — bản nhạc hoàn chỉnh hoặc ý tưởng âm nhạc theo thể loại, tâm trạng, nhạc cụ và cấu trúc.

Ghi chú

Một số mô hình video tạo âm thanh gốc như một phần của kết quả. Điều đó khác với trình tạo SFX độc lập: hãy dùng các điều khiển mà mô hình video đã chọn hiển thị và đừng mặc định mọi mô hình đều có âm thanh.

Các mô hình âm thanh trên OmniArt

Mỗi mô hình phù hợp với một công việc khác nhau. Trên OmniArt, bạn chọn theo nhiệm vụ thay vì nền tảng.

Mô hìnhPhù hợp nhất choGhi chú
MiniMax Speech 2.8 HDLồng tiếng và lời dẫn chất lượng caoĐộ rõ cho VO cuối
MiniMax Speech 2.8 TurboBản nháp nhanh và hội thoại số lượng lớnLặp nhanh khi thử lời thoại
Eleven Multilingual v2Lồng tiếng đa ngôn ngữ ổn địnhCách thể hiện nhất quán ở nhiều ngôn ngữ
Eleven v3Màn thể hiện giàu cảm xúcKhi cần phạm vi biểu đạt rộng
Eleven Turbo v2.5Giọng nói độ trễ thấpKịch bản dài và lượt thử nhanh
MiniMax Music 2.6Bản nhạc đầy đủ theo thể loại và tâm trạngNhạc nền và tín hiệu thương hiệu
ElevenLabs MusicBài hát và vòng lặp có cấu trúcTạo nhạc theo từng phần
Google Lyria 3 ProNhạc không lời và điện ảnh chất lượng caoSoạn nhạc cho trailer và video kể chuyện

Chọn HD cho lời dẫn cuối, Turbo để thử nhiều câu thoại và mô hình nhạc cho lớp nền. Bạn có thể đổi mô hình mà không cần di chuyển các tài sản khác trong dự án.

Cách tạo âm thanh từng bước

  1. Chọn Speech hoặc Music trong không gian âm thanh.
  2. Chọn mô hình phù hợp. Dùng mô hình giọng nói cho phần nói và mô hình nhạc cho nhạc nền hoặc bài hát.
  3. Viết brief sản xuất. Với giọng nói, đưa vào kịch bản chính xác và cách thể hiện; với nhạc, mô tả thể loại, tâm trạng, nhạc cụ, nhịp độ và cấu trúc.
  4. Tạo và kiểm tra. Kiểm tra phát âm, nhịp, chuyển đoạn nhạc và khoảng trống cho hội thoại.
  5. Mỗi lần chỉ đổi một biến. Chủ động chỉnh cách thể hiện hoặc cấu trúc thay vì viết lại toàn bộ brief sau mỗi lượt.
  6. Xuất các tài sản đã chọn và ghép với hình ảnh, âm thanh môi trường cùng SFX trong trình biên tập video hoặc âm thanh của bạn.

Kết hợp âm thanh với ảnh và video

Quy trình bàn giao tốt bắt đầu từ brief chung. Với video giải thích không lộ mặt, hãy tạo lời lồng tiếng trước rồi tạo hình ảnh theo nhịp đó. Với video sản phẩm, tạo nhạc nền chừa không gian cho thông điệp và thêm SFX cùng âm thanh môi trường được cấp phép hoặc tự thu trong lúc biên tập.

Mẹo

Xây dựng cấu trúc theo thời lượng lồng tiếng trước khi trau chuốt hình ảnh. Thường dễ cắt các clip được tạo theo lời dẫn ổn định hơn là ép lời dẫn hoàn chỉnh vào bản dựng đã khóa.

Bắt đầu với OmniArt

Bắt đầu bằng một kịch bản ngắn. Tạo hai bản giọng nói có cách thể hiện khác nhau, rồi tạo nhạc nền hỗ trợ cùng tâm trạng. Xuất cả hai, thêm SFX hoặc âm thanh môi trường trong trình biên tập và hoàn thiện bản phối với hình ảnh. Mở không gian âm thanh để tạo lồng tiếng hoặc nhạc, và xem mọi mô hình video AI trong một không gian làm việc nếu brief cũng cần video được tạo.

Sẵn sàng sáng tạo?

Bắt đầu tạo nội dung tuyệt vời bằng AI

Bắt đầu miễn phí