GuideMô hình và insight21 phút đọc

Prompt của MAI-Image-2.6: bốn bài học từ Microsoft

MAI-Image-2.6 của Microsoft vươn lên hạng 2 trên Arena. Phần dùng được lâu hơn của đợt ra mắt này lại là những prompt được công bố kèm theo: bốn cách viết, bốn quy tắc áp dụng được cho mọi mô hình.

Đội ngũ OmniArt
Prompt của MAI-Image-2.6: bốn bài học từ Microsoft

Ngày 10 tháng 8 năm 2026, Microsoft AI công bố MAI-Image-2.6 và cho biết mô hình xếp hạng hai trên bảng xếp hạng văn bản sang ảnh của Arena, tăng +79 Elo so với MAI-Image-2.5 ở mức tổng thể, và riêng phần dựng chữ tăng +91 Elo. Đó là dòng tít, và tít lấy từ bảng xếp hạng thường hết hạn rất nhanh.

Phần có tuổi thọ dài hơn của đợt ra mắt này lại lặng lẽ hơn nhiều: trên các trang của MAI-Image-2, MAI-Image-2.5 và MAI-Image-2.6, Microsoft đã công bố chính những prompt đứng sau các ảnh mẫu. Đây không phải một tập hợp ngẫu nhiên. Đó là bốn cách viết cho mô hình ảnh khác nhau rõ rệt, và mỗi cách đang làm một việc cụ thể: mô tả, nén lại, chỉnh sửa và trích dẫn.

MAI-Image không có trong danh sách mô hình của OmniArt, nên đây không phải bài đánh giá một mô hình bạn chạy được ở đây. Đây là cách đọc tay nghề viết prompt đang bày ra ở đó, bởi tay nghề thì chuyển được. Bốn mẫu bên dưới hoạt động trên bất kỳ mô hình ảnh tốt nào hiện nay, và bài học mỗi lần đều cùng một hình dạng: thứ bạn đặt vào prompt quyết định bạn sẽ nhận về kiểu lỗi nào.

MAI-Image 2, 2.5 và 2.6 đã mang lại gì

Ba đợt ra mắt trong chưa đầy năm tháng, mỗi đợt có trọng tâm khác nhau:

Phiên bảnCông bốCách Microsoft định vịTuyên bố về Arena
MAI-Image-219/03/2026Độ chân thực, chữ trong ảnh, cảnh giàu chi tiết — "làm cùng người sáng tạo"Hạng 3 trong nhóm các dòng mô hình
MAI-Image-2.5Trang mô hìnhChỉnh sửa chính xác, độ đúng của vật liệu, kết quả sẵn cho thiết kế; Pro / tiêu chuẩn / FlashHạng 3 mảng văn bản sang ảnh, tính đến 02/06/2026
MAI-Image-2.610/08/2026Dựng chữ, chân dung và 3D, độ hoàn thiện thương mại và điện ảnhHạng 2 mảng văn bản sang ảnh; +79 Elo so với 2.5

MAI-Image-2.5 cũng tách thành một dòng: 2.5-Pro cho tính nhất quán của vật thể và suy luận thị giác, 2.5 cho việc tạo ảnh kèm chỉnh sửa có kiểm soát, và 2.5-Flash mà Microsoft mô tả là sẵn sàng cho sản xuất với giá chưa tới một nửa mô hình đầu bảng. Trang của 2.5 có biểu đồ "Image Arena Elo so với giá API tiêu biểu cho 1.000 ảnh", cho thấy đội ngũ đang tối ưu điều gì: không chỉ đỉnh chất lượng, mà là chất lượng trên mỗi đồng bỏ ra.

Với 2.6, Microsoft nói vẫn còn phần chưa nêu chi tiết — "từ khả năng làm việc trên nhiều ảnh tham chiếu và neo ngữ cảnh phong phú hơn, cho tới kiểm soát nhiều hơn về suy luận, định dạng và độ phân giải". Chừng nào phần đó chưa ra công khai, đó là tuyên bố lộ trình chứ không phải thông số.

Bài học 1: prompt dài có cấu trúc đặt mỗi dữ kiện vào một ô riêng

Prompt đứng sau ảnh mẫu về độ chân thực trên trang MAI-Image-2.5 dài khoảng 90 từ, và cấu trúc của nó thú vị hơn độ dài:

A young woman in profile on a rooftop, blowing soap bubbles against an overcast sky. She has long straight black hair, windswept slightly, and wears a dark navy double-breasted school uniform jacket with gold buttons and a white collar. She holds a hot pink bubble solution bottle in one hand and a neon lime-green wand to her lips in the other. Five iridescent bubbles of varying sizes float around her.

Behind her: low-rise apartment buildings under a flat gray sky, a black metal railing, and weathered concrete underfoot. Film photography aesthetic.

Một phụ nữ trẻ nhìn nghiêng đứng trên sân thượng thổi bong bóng xà phòng, mặc áo khoác đồng phục màu xanh navy, một tay cầm lọ màu hồng đậm, tay kia cầm que thổi màu xanh chanh neon, phía sau là dãy nhà thấp tầng dưới bầu trời âm u
Ảnh mẫu MAI-Image-2.5 do Microsoft AI công bố. Cả những màu được gọi tên lẫn số lượng bong bóng đều còn nguyên trong kết quả. Nguồn: microsoft.ai.

Hãy đọc lại nó như một biểu mẫu thay vì một đoạn văn. Câu một là chủ thể, dáng, hành động và bầu trời. Câu hai là tóc và trang phục. Câu ba là đạo cụ, mỗi tay một món. Câu bốn là yếu tố đếm được. Rồi một khối có nhãn — Behind her: — gom hết phần bối cảnh, và một chỉ dẫn phong cách hai từ khép prompt lại.

Ba thứ trong cấu trúc này thực sự làm việc:

  • Tên màu thay vì tính từ. "Hot pink", "neon lime-green", "dark navy", "gold", "flat gray". Không phải "sáng", không phải "nhiều màu". Tên màu là ràng buộc mà mô hình có thể đáp ứng hoặc trượt một cách thấy rõ; "vibrant" thì không.
  • Con số thay vì lượng từ mơ hồ. Cụm "Five iridescent bubbles of varying sizes" kiểm tra được, còn "some bubbles" thì không. Trong kết quả đã công bố, con số này giữ đúng — bạn đứng trước ảnh và đếm được, và đó chính là điểm mấu chốt.
  • Bối cảnh có vật chứa riêng. Behind her: rào phần môi trường lại để chi tiết của nó không rò sang phần mô tả chủ thể. Prompt dài hỏng ở chỗ mô hình phải đoán một từ bổ nghĩa thuộc về danh từ nào.

Từ khóa phong cách nằm cuối cùng, sau phần nội dung, nên nó bổ nghĩa cho một cảnh đã được xác định đầy đủ chứ không tự lái bố cục.

Mẹo

Hãy viết prompt dài thành từng ô chứ đừng viết thành văn xuôi: chủ thể và hành động, rồi ngoại hình, rồi đạo cụ, rồi chi tiết đếm được, rồi khối bối cảnh có nhãn, rồi phong cách. Nếu chính bạn không chỉ ra được một từ thuộc ô nào, mô hình cũng không chỉ ra được.

Bài học 2: prompt ngắn mua bố cục bằng một phép so sánh

Thông báo MAI-Image-2 công bố một prompt rất khác — khoảng 30 từ, không thành câu, chỉ là các cụm xếp theo thứ tự quan trọng:

A glacier wall towering like a cathedral interior, deep blue ice with light refracting through layers, tiny human figure at base for scale, cinematic, cold mist in air, hyper-real detail

Hang băng xanh có vòm cuốn chạy sâu vào trong như gian giữa của một thánh đường, với một bóng người nhỏ xíu mặc áo khoác đỏ đứng trong màn sương ở phía cuối
Ảnh mẫu MAI-Image-2 do Microsoft AI công bố. Phép so sánh đang làm phần việc bố cục: băng hiện ra thành vòm, thành cuốn và thành phần cuối được chiếu sáng. Nguồn: microsoft.ai.

Cụm đầu tiên là toàn bộ mẹo. "Like a cathedral interior" không phải trang trí mà là một chỉ dẫn bố cục khoác áo ẩn dụ. Thánh đường kéo theo trần vòm, gian giữa lùi dần vào trong, vòm cuốn, tính đối xứng và ánh sáng đi vào từ phía cuối. Kết quả có đủ cả năm, dựng bằng băng. Mô tả bố cục đó theo lối trực tiếp sẽ tốn ba mươi từ và có lẽ ra cứng hơn.

Nước cờ hữu ích thứ hai là tiny human figure at base for scale. Tỷ lệ là thứ mô hình ảnh đánh mất chắc chắn nhất, vì bản thân kết cấu bề mặt không cho biết nó lớn cỡ nào. Một mốc quy chiếu là con người, được gọi tên và định vị, ghim tỷ lệ lại chỉ bằng bốn từ, và chiếc áo khoác đỏ trong kết quả làm được nhiều việc bố cục hơn bất kỳ lượng "epic, massive, enormous" nào.

Các từ ở cuối — cinematic, cold mist in air, hyper-real detail — là không khí và chỉ dẫn kết xuất, và chúng đứng cuối vì cùng lý do với từ khóa phong cách ở bài học 1.

Vậy nên hai prompt này không phải bản tốt và bản dở của cùng một thứ. Chúng là hai công cụ khác nhau:

Dùng prompt dài có cấu trúc khiDùng prompt ngắn xếp chồng khi
trang phục, đạo cụ hay chi tiết thương hiệu quan trọngbạn muốn một ảnh mạnh rồi mới lặp tiếp
sẽ có người đối chiếu kết quả với đề bàikhông khí quan trọng hơn danh sách vật thể
bạn cần tái tạo lại nó về saubạn đang thăm dò một phong cách hình
số lượng và màu sắc không thể thỏa hiệpmột phép so sánh tốt đủ gánh bố cục

Bài học 3: khi chỉnh sửa, một prompt chỉ nên đổi một thứ

Trang MAI-Image-2.5 minh họa việc chỉnh sửa bằng ba prompt, và điều nổi bật là mỗi prompt đều rất nhỏ:

Change the tote color to orange

Add peonies peeking out the tote

Edit this image to have the woman walking through the streets of New York City

Đây là prompt đầu tiên, trước và sau:

Một chiếc túi tote vải bố màu mộc đặt trên mặt bàn hồng, trước bức tường gạch sơn màu xanh mòng két đậm, dưới nắng gắt
Trước khi sửa. Ảnh gốc do Microsoft AI công bố trên trang MAI-Image-2.5.
Vẫn chiếc túi tote vải bố ở đúng vị trí và đúng ánh sáng đó, nay chuyển sang màu cam tươi, với tường gạch xanh mòng két và bóng đổ giữ nguyên
Sau khi chạy Change the tote color to orange. Bức tường xanh mòng két, mặt bàn hồng, hướng nắng và hình dạng bóng đổ đều còn nguyên; chỉ khung hình hơi chặt hơn. Nguồn: microsoft.ai.

Prompt gồm sáu từ: một động từ, một vật thể được gọi tên, một giá trị đích. Nó không kèm theo yêu cầu đổi phông nền, đổi góc máy hay cải thiện ánh sáng. Chính sự tiết chế đó là kỹ thuật, bởi trong một lần chỉnh sửa, việc khó nhất của mô hình là giữ nguyên chứ không phải thay đổi. Mỗi thứ bạn thêm vào chỉ dẫn là thêm một thứ nữa mà nó có thể quyết định làm lại.

Cũng để ý rằng vật thể được gọi tên. Cụm "the tote" cho mô hình một đối tượng quy chiếu không mơ hồ. Nếu nói "làm nó thành màu cam", mô hình sẽ phải tự chọn giữa cái túi, cái bàn và bức tường.

Prompt thứ ba, đưa nhân vật sang New York, trông là thao tác lớn hơn nhiều, và đúng là như vậy. Nhưng nó vẫn là một thao tác, và vẫn gọi tên thứ phải được giữ lại: "the woman". Một prompt vừa đổi thành phố, vừa đổi trang phục, vừa đổi thời điểm trong ngày sẽ khiến bạn không còn cách nào biết chỉ dẫn nào gây ra kết quả xấu.

Cảnh báo

Một chuỗi chỉnh sửa nhỏ cũng là một chuỗi sai lệch nhỏ. Hãy kiểm lại những chi tiết bạn quan tâm sau từng bước chứ đừng chỉ kiểm ở bước cuối — tông da, hình khối logo và chữ là ba thứ xuống cấp lặng lẽ sớm nhất qua nhiều lượt.

Bài học 4: trích dẫn văn hóa thì rẻ, và chỉ mua được cái cảnh

Prompt ngắn nhất trong số đã công bố chỉ có tám từ:

Chihuahua in Abbey Road album cover with moptop wig

Một con chihuahua lông ngắn màu kem với đôi tai dựng lớn, ngồi trước phông nền đen trơn
Ảnh gốc do Microsoft AI công bố trên trang MAI-Image-2.5.
Một chú chó nhỏ đội tóc giả kiểu moptop màu nâu và đeo kính râm đang băng qua vạch kẻ trên con phố London hai bên là hàng cây, bên trái là chiếc VW Beetle trắng đỗ sẵn, phía sau là xe cộ và người đi bộ của thời kỳ đó
Kết quả. Trích dẫn dựng lại được vạch kẻ, chiếc Beetle trắng, con phố London và những dáng người của thời kỳ ấy — nhưng đúng con chó trong ảnh gốc thì không còn. Nguồn: microsoft.ai.

Tám từ dựng lại một cảnh rất cụ thể: vạch kẻ đường, con đường có hàng cây thu dần về phía xa, chiếc VW Beetle trắng đỗ bên trái, xe cộ thời đó, người đi bộ mặc áo khoác thập niên sáu mươi, và khung hình chính diện phẳng. Viết hết ra sẽ tốn cả một đoạn và nhiều khả năng vẫn sót chiếc Beetle. Microsoft xếp việc này vào mục "kiến thức về thế giới và suy luận", và cách xếp đó là đúng — một trích dẫn ai cũng biết chính là prompt cô đọng nhất có thể dùng.

Nó cũng là thứ khó kiểm soát nhất, và ví dụ này cho thấy chính xác ranh giới nằm ở đâu. Hãy so hai ảnh: ảnh gốc là một con chihuahua màu kem, lông ngắn, tai dựng, trên nền đen. Kết quả là một con chó trắng nâu, lông khác, tỷ lệ khác, tai cũng khác. Trích dẫn đã mua được cái cảnh. Nó không giữ được chủ thể.

Chính sự phân biệt đó mới là bài học dùng được. Lối viết tắt bằng trích dẫn rất tốt để dựng nên một thế giới — một thể loại, một thời kỳ, một quy ước ánh sáng, một cách dàn trang. Nó không đáng tin cho việc giữ nguyên danh tính. Nếu một khuôn mặt, một thú cưng, một sản phẩm hay một bao bì cụ thể buộc phải còn nguyên, yêu cầu ấy thuộc về phần mô tả tường minh hoặc quy trình dùng ảnh tham chiếu, chứ không thuộc về một ám chỉ văn hóa.

Còn hai điều nữa nên nhớ: trích dẫn chỉ hiệu quả khi mô hình biết nó, nên những trích dẫn ít người biết hoặc mang tính vùng miền sẽ lặng lẽ tụt xuống thành kết quả chung chung; và những hình ảnh nổi tiếng kéo theo vấn đề bản quyền mà prompt không giải quyết thay bạn.

Vì sao dựng chữ trở thành con số nổi bật

Trong tất cả những gì thông báo 2.6 nêu ra, con số Microsoft chọn tách riêng lại là về chữ: +91 Elo, cao hơn mức tăng chung +79 Elo. Đó là sự nhấn mạnh có chủ ý, và các ảnh mẫu giải thích vì sao.

Một poster sự kiện với hình minh họa tông tím của ngựa và người cưỡi đang bay qua chướng ngại vật, phía trên là dòng 13, 14, 15 Apr 2026 – Jumping International CSI 8* – Palais des Congrès d'Issy. và phía dưới là tiêu đề lớn màu cam SAINT FLASH
Một ảnh mẫu về chữ của MAI-Image-2 do Microsoft AI công bố. Hãy để ý các ký tự có dấu trong Congrès d'Issy và trật tự phân cấp còn nguyên giữa dòng ngày tháng và tiêu đề. Nguồn: microsoft.ai.

Viết đúng chính tả một tiêu đề mới là nửa dễ. Tấm poster trên còn giữ được một địa danh tiếng Pháp có dấu, một dấu sao trong hạng giải, một chuỗi ngày ngăn bằng dấu phẩy, và quan trọng nhất là trật tự phân cấp: dòng ngày tháng ở vai phụ, tiêu đề giữ vai chính, hình minh họa chiếm hai phần ba phía trên. Một mô hình viết đúng hoàn hảo nhưng cho mọi khối chữ cùng một sức nặng thị giác thì vẫn cho ra một trang không dùng được.

Đây là phần của việc tạo ảnh gần với công việc có trả tiền nhất, và cũng là lý do các trích dẫn đối tác trên trang 2.5 đều xoay quanh nó. Rob Reilly, giám đốc sáng tạo toàn cầu của WPP, gọi độ chính xác của chữ là "một bước đột phá thực sự", bên cạnh khả năng chỉnh sửa bằng ngôn ngữ tự nhiên; Vanessa Salvo của Shutterstock đặt thước đo ở chỗ mô hình có "chuyển được ý định thành kết quả nhất quán, sẵn sàng cho sản xuất" hay không. Bao bì, poster, thực đơn và vật liệu chiến dịch đều hỏng ở phần chữ trước khi hỏng ở độ chân thực.

"Hạng 2 trên Arena" nói lên điều gì và không nói lên điều gì

Kết quả Arena là so sánh sở thích của con người theo lối ẩn danh, nên một bước nhảy Elo lớn thực sự là tín hiệu cho thấy người ta thích kết quả của nó hơn trên một tập prompt hỗn hợp. Đó là kết quả thật, và +79 Elo trong khoảng hai tháng là mức tăng nhanh.

Nhưng nó cũng chỉ là một con số tổng hợp duy nhất. Thông báo của Microsoft không công bố Elo theo từng hạng mục, khoảng tin cậy, quy mô tập prompt, hay tên mô hình đứng trên nó. Tính đến ngày 14 tháng 8 năm 2026, vài thứ mà một đội cần trước khi chốt quy trình vẫn chưa được công bố:

  • Giá API trên mỗi ảnh cho mức 2.6
  • Độ phân giải gốc và độ phân giải tối đa
  • Số liệu độ trễ khi tạo và khi chỉnh sửa
  • Khả năng dùng nhiều ảnh tham chiếu và neo ngữ cảnh được mô tả là "sắp có"
  • Báo cáo kỹ thuật đứng sau các chênh lệch Elo

Ghi chú

Một thứ hạng tổng thể trên Arena không cho bạn biết mô hình đó có hợp với công việc cụ thể của bạn không. Bao bì nhiều chữ bằng hệ chữ viết không phải Latinh, một khuôn mặt phải lặp lại giống nhau qua mười hai cảnh, và một vật liệu nền trong suốt cho giao diện game là ba bài kiểm tra khác nhau, và một mô hình hoàn toàn có thể dẫn đầu ở điểm tổng mà vẫn thua bất kỳ bài nào trong đó.

Cách đọc trung thực về 2.6 thì hẹp nhưng vẫn hữu ích: Microsoft đang lặp dòng mô hình này rất nhanh, và hướng phần tăng thêm vào kết quả thương mại — chữ, chân dung, sản phẩm, thương hiệu — thay vì vào tính hoành tráng.

Chạy bốn mẫu này trên OmniArt

Hiện MAI-Image chưa có trong không gian tạo ảnh của OmniArt. Các mẫu prompt thì có, và chúng không phụ thuộc mô hình. Hãy chọn theo việc đề bài của bạn thực chất thuộc kiểu nào trong bốn kiểu:

MẫuDùng cho việc gìĐiểm khởi đầu thực tế trên OmniArt
Prompt dài có cấu trúcĐề bài mà trang phục, đạo cụ, màu và số lượng đều bị soiGPT Image 2
Prompt ngắn xếp chồng kèm phép so sánhẢnh đơn mang chất điện ảnh và việc thăm dò không khíSeedream 5.0 Pro
Chỉnh sửa mỗi lượt một thay đổiĐổi màu sản phẩm, thêm chi tiết, dời bối cảnh có kiểm soátNano Banana 2
Trích dẫn viết tắt kèm mô tả danh tính rõDựng bối cảnh mà chủ thể phải giữ nguyênSeedream 5.0 Pro với ảnh tham chiếu
Lặp giá rẻ trước khi chốtThử cấu trúc prompt với chi phí thấpQwen Image

Một bài tập hữu ích: lấy prompt sân thượng ở trên, chạy nguyên bản một lần, rồi chạy lại lần nữa với các màu được thay bằng tính từ ("a pink bottle", "a green wand") và con số được thay bằng "some bubbles". Khoảng cách giữa hai kết quả chính là giá trị của cấu trúc, đo trên mô hình của bạn chứ không phải trong thư viện ảnh của trang ra mắt.

Muốn xem một cuộc đối đầu mới về dàn trang và độ chân thực, hãy đọc GPT Image 2 với Nano Banana 2. Về tính nhất quán dẫn dắt bằng ảnh tham chiếu, hướng dẫn ra mắt Seedream 5.0 Pro trình bày đầu vào và các nút điều khiển của nó, còn hướng dẫn Qwen Image là lối đi chi phí thấp cho các bản nháp đầu. Nếu muốn một bài phân tích ra mắt tương đương, Grok Imagine Image 2.0 đưa ra tuyên bố Arena tương tự trong cùng tuần.

Câu hỏi thường gặp

MAI-Image-2.6 là gì?

MAI-Image-2.6 là mô hình văn bản sang ảnh của Microsoft AI, công bố ngày 10 tháng 8 năm 2026. Microsoft cho biết mô hình xếp hạng hai trên bảng xếp hạng văn bản sang ảnh của Arena, tăng +79 Elo so với MAI-Image-2.5 và tăng +91 Elo ở phần dựng chữ.

MAI-Image-2.6 khác MAI-Image-2.5 ở chỗ nào?

Microsoft mô tả mức cải thiện ở mọi hạng mục Arena được đo, nhấn mạnh phần dựng chữ, chân dung và 3D, cùng kết quả thương mại và chân thực hoàn thiện hơn trong các việc về sản phẩm, thương hiệu và điện ảnh. Đầu vào nhiều ảnh tham chiếu, neo ngữ cảnh phong phú hơn và khả năng kiểm soát suy luận, định dạng, độ phân giải được mô tả là sắp có, chưa kèm chi tiết công bố.

Dùng MAI-Image-2.6 ở đâu?

Theo thông báo của Microsoft, mô hình dùng được cho việc tạo ảnh từ văn bản trên Arena, có mặt trên MAI Playground vào cuối tuần đó, rồi triển khai dần trên Microsoft Foundry và các sản phẩm khác.

OmniArt có MAI-Image không?

Không. Danh sách mô hình ảnh của OmniArt không có MAI-Image. Các mẫu prompt trong bài này không phụ thuộc mô hình và chạy được trên những mô hình ảnh mà OmniArt cung cấp.

Dòng MAI-Image-2.5 gồm những gì?

Ba biến thể: MAI-Image-2.5-Pro cho tính nhất quán của vật thể và suy luận thị giác, MAI-Image-2.5 cho việc tạo ảnh chất lượng cao kèm chỉnh sửa có kiểm soát, và MAI-Image-2.5-Flash được mô tả là sẵn sàng cho sản xuất với giá chưa tới một nửa mô hình đầu bảng.

Các mẫu prompt này có dùng được cho mô hình khác không?

Có. Tên màu, số lượng nêu rõ, khối bối cảnh được rào riêng, mốc quy chiếu tỷ lệ, mỗi lượt sửa một thay đổi, và một phép so sánh gánh bố cục đều là kỹ thuật viết prompt phổ quát. Thứ khác nhau giữa các mô hình là mức độ tuân thủ ổn định của từng kỹ thuật, và điều đó đáng thử trên chính mô hình bạn dùng.

Bắt đầu trên OmniArt

Hãy mở không gian tạo ảnh của OmniArt và chạy một đề bài qua hai trong bốn mẫu ở trên — một bản dài có cấu trúc và một bản ngắn xếp chồng của cùng ý tưởng. Giữ nguyên chủ thể và chỉ đổi hình thức của prompt. Riêng phép so sánh đó sẽ nói với bạn nhiều điều về mô hình của mình hơn bất kỳ thứ hạng nào.

Từ đó, hãy coi việc chỉnh sửa là một phần việc riêng: duyệt một ảnh trước, rồi mỗi prompt chỉ đổi một thứ, và kiểm lại những chi tiết bạn quan tâm sau từng lượt. OmniArt gom các mô hình ảnh, video, âm thanh và nhạc vào cùng một không gian, nên một ảnh tĩnh đã duyệt có thể đi thẳng sang phần chuyển động mà không phải đổi công cụ — và khi một mô hình mới xứng đáng có mặt trong danh sách, cách viết prompt bạn đã luyện sẽ đi theo cùng.

Sẵn sàng sáng tạo?

Bắt đầu tạo nội dung tuyệt vời bằng AI

Bắt đầu miễn phí