Blog

Các phương pháp hay nhất với Seedance 2.5: hướng dẫn thân thiện cho người mới

· Đội ngũ BLOCKLORE

Seedance 2.5 là mô hình video AI mới nhất của ByteDance. Nó có thể tạo tới 30 giây video trong một lần chạy, kèm âm thanh được tạo đồng thời, và cho phép bạn đưa vào ảnh tham chiếu, đoạn clip cùng âm thanh để giữ đúng một nhân vật, phong cách hay chuyển động máy quay cụ thể. Đó là rất nhiều sức mạnh, và rất dễ dùng chưa hết công suất (gõ một dòng mơ hồ rồi hy vọng) hoặc quá tải nó (nhồi vào 40 tham chiếu cùng một đoạn văn khổng lồ). Đây là cách để có kết quả tốt, nhất quán trên BLOCKLORE mà không cần một quy trình sản xuất chuyên nghiệp.

1. Mô tả từng cảnh một

Hãy viết prompt như cách bạn mô tả một cảnh quay cho người vận hành máy quay: ai xuất hiện, họ làm gì, ở đâu, và máy quay di chuyển ra sao. Tránh nhồi nhiều cảnh hay nhiều ý tưởng vào một prompt; mô hình xử lý một cảnh tập trung tốt hơn nhiều so với một cảnh lộn xộn.

Ví dụ: "Cận cảnh trung bình một người phụ nữ mặc áo mưa vàng đi bộ trên con phố mưa về đêm. Cô dừng lại, ngước nhìn một biển hiệu neon và mỉm cười. Máy quay lia chậm theo cô."

2. Dùng một vài tham chiếu, gắn nhãn rõ ràng

Seedance 2.5 chấp nhận các tham chiếu (ảnh, đoạn video ngắn, âm thanh) và cho phép bạn gắn nhãn từng cái bằng @Image1, @Video1, @Audio1, v.v. ngay trong nội dung prompt. Bạn không cần lấp đầy mọi ô - 3 đến 5 tham chiếu được chọn kỹ (một gương mặt, một bộ trang phục, một địa điểm) thường cho kết quả ổn định hơn một đống lớn không được gắn nhãn. Điều quan trọng là nêu rõ mỗi tham chiếu dùng để làm gì, vì mô hình không thể tự đoán chính xác.

"@Image1 thể hiện gương mặt và áo khoác của nhân vật, giữ nguyên hai chi tiết này. @Image2 là nội thất quán cà phê, dùng nó cho bối cảnh."
"Dùng @Image1 cho gương mặt nhân vật. Dùng @Image2 cho áo khoác da của anh ấy. Dùng @Image3 cho ánh sáng và tông màu."

3. Đừng mặc định dùng trọn 30 giây

Một đoạn clip dài nghe có vẻ hấp dẫn, nhưng thời lượng mô hình phải lấp đầy càng nhiều thì càng dễ xảy ra sai lệch chi tiết - gương mặt thay đổi nhẹ, một vật thể biến mất. Hãy bắt đầu với đoạn ngắn hơn (5-10 giây) cho những gì có nhiều chi tiết hoặc một diện mạo cụ thể bạn muốn giữ nguyên, và chỉ dùng trọn 30 giây khi hành động thực sự cần nhiều không gian đến vậy, như một cảnh có mở đầu, diễn biến và kết thúc rõ ràng.

30 giây video là khoảng thời gian dài để AI phải đoán ý bạn muốn gì. Nếu prompt của bạn chỉ đơn giản là "Một người đàn ông đi bộ trên phố", mô hình có thể cho anh ta đi bộ năm giây rồi bất ngờ nhào lộn ra sau.

Prompt ví dụ: "Dùng @Image1 cho nhân vật chính. Khung hình 16:9, cảnh lia máy điện ảnh mượt mà. 0-10s: Nhân vật đi trong một con hẻm tối, mưa, được chiếu sáng bởi biển hiệu neon. 11-20s: Anh dừng lại, quay về phía máy quay và lấy một tấm bản đồ từ túi áo. 21-30s: Máy quay từ từ đẩy vào cận cảnh gương mặt anh khi anh có vẻ bối rối. Âm thanh: tiếng mưa rơi, bước chân nặng nề, không nhạc nền. Giữ nguyên nghiêm ngặt gương mặt từ @Image1."

4. Viết cho cả âm thanh, không chỉ hình ảnh

Vì âm thanh được tạo cùng lúc với video, hãy mô tả cả những gì bạn muốn nghe, không chỉ những gì bạn muốn thấy. Nếu bỏ qua âm thanh trong prompt, bạn đang phó mặc nó cho may rủi. Hãy nêu rõ lời thoại, tiếng động môi trường, nhạc nền, hoặc ghi rõ "không nhạc nền" nếu muốn một cảnh yên tĩnh, tự nhiên.

"Âm thanh: tiếng mưa rơi trên vỉa hè, tiếng xe cộ ở xa, tiếng bước chân trên nền bê tông ướt, không nhạc nền."
"Đồng bộ chuyển động máy quay theo nhịp điệu trong @Audio1. Khi tiếng bass mạnh vang lên ở 0:15, thực hiện một cú lia máy nhanh sang phải."

5. Dựng cảnh dài bằng cách nối tiếp, không nhồi vào một prompt

Nếu bạn muốn kể một câu chuyện dài hơn, đừng cố nhồi toàn bộ kịch bản vào một yêu cầu duy nhất. Hãy tạo đoạn clip đầu tiên, rồi dùng nó làm nền cho một lượt nối tiếp - một lượt tạo tiếp theo, chảy tiếp từ đoạn trước, giữ nguyên nhân vật và bối cảnh. Cách này giúp mỗi prompt riêng lẻ luôn tập trung và cho bạn một điểm dừng để xem lại trước khi tiếp tục.

Prompt nối tiếp: "Tiếp tục từ đoạn clip trước. Cùng nhân vật, cùng con phố, cùng phong cách hình ảnh. Giờ cô băng qua đường và bước vào quán cà phê."

6. Sửa lỗi nhỏ bằng chỉnh sửa, không tạo lại toàn bộ

Nếu một đoạn clip gần như đúng nhưng có một chi tiết bị sai - một đạo cụ sai, một vật thể nền, một bàn tay bị méo - bạn không cần tạo lại toàn bộ từ đầu. Seedance 2.5 hỗ trợ chỉnh sửa nhắm vào một phần cụ thể của clip có sẵn trong khi giữ nguyên phần còn lại. Trong prompt, hãy tham chiếu đến clip gốc, nói rõ những gì cần giữ nguyên, và chỉ mô tả thay đổi bạn muốn.

"Chỉnh sửa video trước đó. Giữ nguyên nhân vật, chuyển động máy quay và hậu cảnh. Chỉ thay chiếc cốc trên bàn bằng một ly nước."

Với những chỉnh sửa theo mốc thời gian cụ thể, bạn cũng có thể chia clip thành các khoảng thời gian trong prompt (như "0-5s" và "5-10s") và mô tả điều gì nên xảy ra hoặc thay đổi trong mỗi khoảng, thay vì chỉnh sửa toàn bộ clip cùng lúc.

"Giữ nguyên hoàn toàn 0-20s. Từ 21-30s, đổi hành động của nhân vật thành nhìn vào điện thoại thay vì nhìn lên bầu trời."

7. Lưu lại những gì hiệu quả

Khi một lượt tạo bắt đúng diện mạo nhân vật hoặc ánh sáng của một cảnh, hãy lưu lại ảnh tĩnh hoặc clip đó. Bạn có thể dùng lại nó làm tham chiếu cho các prompt sau này để giữ sự nhất quán xuyên suốt dự án, thay vì mô tả lại mọi thứ từ đầu mỗi lần.

Tóm tắt nhanh

Hãy giữ prompt tập trung vào một cảnh, dùng một vài tham chiếu được gắn nhãn tốt thay vì quá nhiều, đừng lạm dụng độ dài tối đa của clip, mô tả cả âm thanh, nối tiếp thay vì nhồi nhét, chỉnh sửa thay vì tạo lại, và lưu lại những kết quả tốt nhất để dùng làm tham chiếu sau này. Cũng như hầu hết công cụ AI khác, Seedance 2.5 thưởng cho việc lặp lại - hãy chuẩn bị tinh chỉnh một cảnh qua vài lần thử thay vì kỳ vọng đúng ngay lần đầu.

Xem thêm từ blog