Các công cụ video AI có thể đưa một ý tưởng lên màn hình nhanh chóng, nhưng người mới có thể cần luyện tập để mô tả chuyển động, giữ cho đối tượng nhất quán và điều chỉnh nhịp độ hành động rõ ràng. Một chút lên kế hoạch trước khi tạo sẽ giúp quy trình sáng tạo có định hướng hơn. Nếu bạn muốn học cách tạo video AI từ văn bản hoặc hình ảnh, hãy bắt đầu với một quy trình làm việc đơn giản. Với Kling Video 3.0, bạn có thể đưa một ý tưởng đi qua các bước tạo, xem lại và tinh chỉnh.
Cách làm video AI từng bước
Một bản render đầu tiên tốt bắt đầu trước khi bạn nhấn Generate. Quyết định điều mà người xem nên chú ý đầu tiên và điều sẽ thay đổi trong vài giây tiếp theo. Trong Kling Video 3.0, bạn có thể bắt đầu từ một ý tưởng được viết hoặc một hình ảnh tham chiếu, rồi định hình phần còn lại của đoạn clip xung quanh cảnh quay đó.
Bước 1: Lên kế hoạch cho cảnh quay của bạn và chọn điểm bắt đầu
Chọn text-to-video khi bạn chỉ có một ý tưởng hoặc kịch bản. Nếu bạn đã có ảnh sản phẩm, hình minh họa, tài liệu tham chiếu nhân vật hoặc hình ảnh khác, một công cụ image-to-video cung cấp cho bạn nền tảng trực quan cho cảnh quay.
Sau đó, xác định chính cú máy:
- Ai hoặc điều gì là chủ thể chính? Chọn một điểm tập trung rõ ràng, chẳng hạn như một chiếc ba lô da cho quảng cáo thương mại điện tử, một nhân vật hoạt hình hoặc một chiếc xe cổ điển.
- Nên có điều gì xảy ra? Tập trung vào một hành động chính, chẳng hạn như một đầu bếp rắc muối lên món ăn hoặc một vận động viên chạy vượt qua vạch đích.
- Cảnh diễn ra ở đâu? Hãy đặt hành động trong một bối cảnh cụ thể, chẳng hạn như một studio ngập nắng ở Austin hoặc một con phố thành phố trong đêm mưa.
- Cảnh quay nên trông và chuyển động ra sao? Thiết lập khung hình, chuyển động máy quay và ánh sáng, chẳng hạn như cận cảnh với cú đẩy chậm vào hoặc góc máy rộng dưới ánh đèn ấm phía trên.
- Người xem nên nghe gì? Chỉ thêm lời thoại, tiếng ồn môi trường hoặc hiệu ứng âm thanh khi chúng hỗ trợ cảnh.
Bước 2: Viết lời nhắc video AI rõ ràng
Khi cảnh đã được lên kế hoạch, hãy cung cấp cho trình tạo video AI của bạn đủ chi tiết để hiểu cả hình ảnh và âm thanh. Một công thức lời nhắc thực tiễn là:
- Cảnh + Đối tượng + Chuyển động + Âm thanh + Phong cách / Cảm xúc / Máy quay
- Giữ cho từng phần cụ thể:
- Cảnh và đối tượng: Thiết lập địa điểm, đối tượng chính và các chi tiết hình ảnh quan trọng.
- Chuyển động: Hãy mô tả hành động của chủ thể trước, sau đó thêm chuyển động của camera hoặc bố cục khung hình.
- Hội thoại: Sử dụng "Câu" + Cảm xúc + Tốc độ nói + Tông giọng + Nhãn nhân vật. Ví dụ, [Rider, calmly] nói, "Bờ biển trông khác khi hoàng hôn."
- Hiệu ứng âm thanh và bầu không khí: Đặt tên nguồn âm thanh và hành động, chẳng hạn như [Motorcycle] tăng tốc + [Sound Effect: engine rumble]. Đối với âm thanh nền, hãy thêm bối cảnh, các yếu tố âm thanh và cảm giác không gian, chẳng hạn như gió biển, sóng xa hay tiếng vọng giao thông.
- Nhạc hoặc giọng hát: Nếu cảnh cần, hãy chỉ rõ thể loại, nhạc cụ hoặc phong cách hát, và cảm xúc.
Đối với text-to-video, hãy bao gồm đủ chi tiết để thiết lập toàn bộ cảnh. Đối với image-to-video, hình ảnh tham chiếu đã cung cấp phần lớn diện mạo và bố cục, vì vậy bạn có thể tập trung nhiều hơn vào chuyển động, hành vi của camera và âm thanh.
Một prompt hoàn chỉnh có thể trông như sau:
"Chuyến đi giờ vàng dọc Đường cao tốc Bờ biển Thái Bình Dương. [Rider] di chuyển trên một chiếc mô tô cổ điển khi máy quay lùi lại trong góc máy trung phía trước. Ánh nắng ấm phản chiếu trên mặt đường. [Rider, thư thái, giọng chậm] nói: \"Không gì vượt qua được đoạn bờ biển này.\" [Motorcycle] tăng tốc + [Sound Effect: tiếng gầm động cơ trầm hơn]. Gió biển và tiếng sóng đại dương xa xa lấp đầy phông nền với cảm giác thoáng đãng ngoài trời. Tâm trạng điện ảnh, thư thái."
Định dạng này giữ cho chỉ dẫn hình ảnh rõ ràng và dành cho lời thoại, hiệu ứng âm thanh cùng âm cảnh các dấu hiệu riêng, giúp phần âm thanh cảm thấy gắn kết hơn với những gì diễn ra trên màn hình.
Bước 3: Thiết lập Chuyển động, Thời lượng và Âm thanh
Hãy nghĩ về khoảng thời gian trên màn hình mà hành động thực sự cần. Nếu người lái chỉ quay về phía máy quay, một cú máy có thể là đủ. Nếu bạn cũng muốn cận cảnh bánh xe, góc nhìn từ người lái và một cảnh mở rộng hơn, hãy dành cho những khoảnh khắc đó các cú máy riêng để mỗi khoảnh khắc có đủ thời gian ghi dấu.
Với Kling VIDEO 3.0, bật Multi-Shot cho phép mô hình lập kế hoạch chuyển cảnh, bố cục khung hình và thay đổi góc camera từ prompt của bạn. Nếu bạn muốn kiểm soát chuỗi tốt hơn, hãy chọn Custom Multi-Shot, cho phép bạn kiểm soát chính xác nội dung và thời lượng của từng cảnh quay.
Ví dụ: Xây dựng một chuỗi ngắn với Custom Multi-Shot
Giả sử bạn muốn tạo một chuỗi xe máy ngắn cho chiến dịch mạng xã hội. Sau khi bật Multi-Shot, mở Custom Multi-Shot và chia ý tưởng thành một vài cảnh quay riêng biệt:
Hướng cảnh quay | |
Cảnh quay 1 | Cảnh quay góc thấp, góc rộng phía sau, bám theo người lái khi họ tiến về phía trước. |
Cảnh 2 | Cận cảnh góc thấp từ bên hông, một cảnh quay chi tiết bánh xe mô tô. |
Cảnh 3 | Góc nhìn người thứ nhất từ người lái, với tay lái và bảng đồng hồ hiện rõ phía trước. |
Cảnh 4 | Cảnh trung bình chính diện, máy quay lùi ở phía trước chiếc mô tô, mũ bảo hiểm của người lái hướng về camera. |
Cảnh 5 | Cảnh quay theo dõi ngang tầm mắt từ bên hông với chuyển động ngang nhẹ. |
Cảnh 6 | Cảnh rộng góc cao với cú nghiêng nhẹ xuống. Máy quay nâng lên khi chiếc xe máy chạy sâu hơn vào cánh đồng tuyết, để lại những vệt đường uốn lượn trên nền tuyết trắng tinh, với những khu rừng phủ tuyết ở hai bên. |
Hình ảnh | |
| |
Video | |
Giữ mỗi cảnh tập trung vào một ý tưởng thị giác, sau đó điều chỉnh độ dài của nó để phù hợp với lượng hành động. Cách tiếp cận này hoạt động hiệu quả với các video thương hiệu ngắn, clip du lịch và quảng cáo mạng xã hội cần nhiều nhịp hình ảnh trong cùng một chuỗi.
Nếu cảnh của bạn bao gồm hội thoại hoặc âm thanh môi trường, hãy thêm các hướng dẫn đó trước khi tạo. Native Audio hỗ trợ hội thoại theo từng nhân vật và nhiều ngôn ngữ. Kling VIDEO 3.0 cũng hỗ trợ các phương ngữ và giọng điệu chân thực.
Bước 4: Tạo và xem lại video AI của bạn
Bây giờ hãy tạo đoạn clip đầu tiên của bạn. Các ví dụ bên dưới ghép từng đầu vào với kết quả tương ứng, vì vậy bạn có thể so sánh những gì bạn yêu cầu với những gì xuất hiện trên màn hình.
Văn bản thành video:
Gợi ý |
| Sân hiên ngoài trời của một biệt thự châu Âu, bên cạnh chiếc bàn ăn phủ khăn bàn ca-rô xanh lam và trắng, một cô gái da trắng trẻ tuổi mặc áo thun tay ngắn sọc xanh trắng và quần short kaki, thắt dây lưng nâu, ngồi chân trần đối diện một chàng trai da trắng trẻ tuổi mặc áo phông trắng. Máy quay thu phóng lại gần, người phụ nữ xoay ly nước trái cây, đôi mắt hướng về khu rừng xa và nói "Những hàng cây này sẽ chuyển sang màu vàng trong một tháng nữa, phải không?". Cận cảnh người đàn ông, anh cúi đầu và nói, "nhưng mùa hè năm sau chúng sẽ lại xanh thôi.". Sau đó người phụ nữ quay đầu lại, mỉm cười với người đàn ông đối diện và nói, "Anh lúc nào cũng lạc quan như vậy à? Hay chỉ là về mùa hè thôi?". Sau đó người đàn ông ngẩng đầu lên, nhìn người phụ nữ và nói, "Chỉ về những mùa hè có em thôi." |
Video |
Hình ảnh thành video:
Gợi ý | ||
Máy quay từ từ di chuyển vòng ra phía trước cô gái, sau đó cô ngẩng đầu lên và mỉm cười ấm áp với máy quay, như thể gặp lại một người bạn cũ sau nhiều năm. | ||
Khung hình bắt đầu | ||
Tham chiếu nhân vật | ||
Video | ||
Khi bạn đã có kết quả trên màn hình, hãy xem lại nó với một vài chi tiết cần ghi nhớ:
- Hành động chính: Đối tượng có thực hiện rõ ràng chuyển động dự định không?
- Subject Consistency: Các đặc điểm khuôn mặt chính, trang phục hoặc chi tiết sản phẩm có giữ được sự nhất quán không?
- Camera Movement: Camera có di chuyển mượt mà theo hướng bạn mô tả không?
- Visual Changes: Các thay đổi về ánh sáng, chuyển động phông nền và những biến đổi trong cảnh khác có mang lại cảm giác tự nhiên không?
- Audio Timing: Đối thoại và tín hiệu âm thanh có khớp với hành động trên màn hình không?
- Overall Pacing: Hành động trong clip có đủ thời gian để phát triển không?
Bước 5: Tinh chỉnh và xuất video của bạn
Kết quả đầu tiên giúp bạn có một điểm xuất phát rõ ràng để tinh chỉnh. Hãy thay đổi phần yếu nhất trước, chẳng hạn như hành động, hướng camera, nhịp thời gian hoặc tài liệu tham chiếu, sau đó tạo một phiên bản khác và so sánh sự khác biệt. Khi đoạn clip hoạt động đúng như mong muốn, hãy xuất phiên bản cuối cùng cho quy trình chỉnh sửa hoặc xuất bản của bạn.
Cách đạt được kết quả tốt hơn từ việc tạo video bằng AI
Những thay đổi nhỏ trong thiết kế cảnh quay có thể giúp lần tạo tiếp theo dễ kiểm soát hơn. Hãy tập trung vào hành động, các chi tiết cần được giữ nhất quán và cách máy quay di chuyển trong cảnh.
Giữ tập trung cho từng cảnh quay
Xây dựng mỗi cảnh quay xoay quanh một chủ thể chính và một hành động rõ ràng. Chẳng hạn, một đoạn clip sản phẩm ngắn có thể chỉ cần một cú lộ diện chậm và một chuyển động máy duy nhất. Nếu ý tưởng bao gồm nhiều hành động hoặc nhịp kể chuyện, hãy chia nó thành những cảnh quay ngắn hơn để mỗi khoảnh khắc có đủ không gian thể hiện rõ ràng.
Giữ nhân vật và các yếu tố hình ảnh nhất quán
Hãy xác định những chi tiết không được phép thay đổi trước khi bạn tạo cảnh tiếp theo. Đối với một nhân vật xuất hiện lặp lại, điều đó có thể bao gồm khuôn mặt, kiểu tóc và áo khoác. Khi làm việc với một sản phẩm, hãy chú ý kỹ hơn đến logo, màu bao bì và hình dạng nhãn. Việc tái sử dụng cùng một hình ảnh tham chiếu có thể giúp những chi tiết đó được giữ nguyên khi chuyển sang một góc máy hoặc phông nền mới.
Kiểm soát chuyển động và hướng máy quay
Hãy xem chủ thể và máy quay như hai phần riêng biệt của cảnh quay. Hãy viết hành động trước, chẳng hạn như "chiếc xe rời mép đường", rồi thêm một chuyển động máy quay, ví dụ "theo dõi song song với xe". Nếu bạn yêu cầu một động tác tiến sát, lia máy và theo dõi trong cùng vài giây, cảnh quay có thể nhanh chóng trở nên rối rắm hoặc mất định hướng ban đầu.
Chỉ thêm âm thanh khi nó hỗ trợ cho cảnh quay
Hãy thêm âm thanh khi cảnh có điều đáng để nghe. Một cảnh quay quán cà phê có thể chỉ cần tiếng ly tách chạm nhau và tiếng trò chuyện khẽ trong phòng. Một cảnh cận sản phẩm có thể không cần âm thanh tạo sinh nào nếu bạn định thêm nhạc ở giai đoạn hậu kỳ sau này. Với thoại, hãy giữ câu nói đủ ngắn để phù hợp với hành động và độ dài của đoạn clip.
Bạn nên biết gì về bản quyền video AI?
Khi bạn tạo video AI, vấn đề bản quyền thường được gói gọn trong một câu hỏi: những phần nào đến từ công việc sáng tạo của chính bạn, và những phần nào đến trực tiếp từ hệ thống AI? Sự phân biệt đó rất quan trọng nếu bạn dự định xuất bản, cấp phép hoặc tái sử dụng video cuối cùng.
- Cảnh quay do AI tạo ra không tự động trở thành tác phẩm có bản quyền của bạn: Bạn có thể viết một lời nhắc chi tiết và hướng dẫn cảnh quay sát sao, nhưng AI vẫn là bên tạo ra biểu đạt thị giác cuối cùng. Chỉ riêng lời nhắc thường không cho bạn đủ quyền kiểm soát sáng tạo để tuyên bố bản quyền đối với những phần được tạo ra đó. Quy tắc bản quyền có thể khác nhau theo khu vực và nền tảng. Luôn kiểm tra các luật áp dụng trước khi sử dụng cho mục đích thương mại.
- Tác phẩm sáng tạo của riêng bạn vẫn có thể được bảo vệ: Nếu bạn thêm cảnh quay gốc, đồ họa, thuyết minh, chỉnh sửa, sắp xếp hoặc các lựa chọn sáng tạo khác, bản quyền có thể bao phủ những phần do con người tạo ra đó. Điều này càng trở nên quan trọng khi bạn kết hợp nhiều đoạn clip AI thành một video lớn hơn và tự định hình cấu trúc cuối cùng.
- Tài liệu nguồn có bản quyền vẫn giữ nguyên sự bảo vệ ban đầu: Nếu bạn sử dụng ảnh, minh họa, âm nhạc hoặc video của người khác như một phần trong quy trình làm việc AI của mình, việc tạo ra một đoạn clip mới không xóa bỏ các quyền gắn với tài liệu nguồn đó. Giấy phép, sự cho phép, tình trạng thuộc phạm vi công cộng hoặc cơ sở pháp lý khác có thể vẫn được áp dụng.
- Vật liệu do AI tạo ra cũng quan trọng trong quá trình đăng ký: Nếu video hoàn chỉnh của bạn bao gồm một lượng đáng kể nội dung do AI tạo ra, yêu cầu bản quyền nên tập trung vào những phần bạn tự mình tạo ra và xác định riêng các phần do AI tạo ra.
Kết thúc
Khi bạn biết cách tạo video AI, việc định hình từng bước theo kết quả mong muốn sẽ trở nên dễ dàng hơn. Những prompt rõ ràng, tư liệu tham chiếu mạnh mẽ và một vài tinh chỉnh có chủ đích có thể giúp bạn đưa cảnh quay đến gần hơn với ý tưởng ban đầu. Kling Video 3.0 mang Multi-Shot, Native Audio và tính nhất quán dựa trên tham chiếu vào cùng một quy trình làm việc, mang đến những cách thực tế để truyền tải một ý tưởng từ prompt đầu tiên đến lần tạo cuối cùng.
Câu hỏi thường gặp
Làm thế nào tôi có thể tạo video AI với khuôn mặt của mình?
Bạn có thể bắt đầu với một bức chân dung rõ nét, được chiếu sáng tốt và sử dụng nó làm tham chiếu hình ảnh cho nhân vật bạn muốn tạo hoạt ảnh. Nếu bạn muốn thay thế một khuôn mặt trong ảnh hoặc video hiện có, một quy trình face swap cung cấp cho bạn lựa chọn tập trung hơn. Đối với một cảnh được tạo mới, hãy giữ tham chiếu rõ ràng và mô tả chuyển động, hướng camera cùng bối cảnh trong prompt.
Video do AI tạo có cần nhãn công bố không?
Một số nền tảng yêu cầu công bố khi AI tạo ra hoặc thay đổi đáng kể nội dung chân thực. Chẳng hạn, YouTube yêu cầu nhà sáng tạo tiết lộ các video AI tạo ra hoặc chỉnh sửa có tính chân thực cao thông qua thiết lập sử dụng AI của mình. Những chỉnh sửa hình ảnh nhỏ và nội dung rõ ràng phi thực tế thường tuân theo các quy tắc khác, vì vậy hãy kiểm tra chính sách của nền tảng trước khi xuất bản.
Tôi tạo video AI miễn phí như thế nào?
Một số nền tảng video AI cung cấp quyền truy cập miễn phí giới hạn hoặc tín dụng khởi động, có thể đủ để thử nghiệm prompt và so sánh văn bản-thành-video với hình ảnh-thành-video. Hãy kiểm tra gói hiện tại trước khi thực hiện dự án lớn hơn, vì giới hạn tín dụng, độ dài video và tùy chọn đầu ra có thể thay đổi.
Tại sao video AI của tôi trông không nhất quán?
Những bất nhất về hình ảnh thường xuất hiện khi một cảnh yêu cầu mô hình xử lý quá nhiều thay đổi cùng lúc. Chuyển động phức tạp, nhiều hành động cạnh tranh hoặc một tham chiếu yếu có thể khiến các chi tiết như quần áo, phông nền hoặc các đặc điểm khuôn mặt bị lệch giữa các thời điểm. Đơn giản hóa hành động và sử dụng một tham chiếu hình ảnh rõ ràng hơn thường mang lại cho mô hình một định hướng ổn định hơn.




