Nền tảng sáng tạo video AI PixTV AI chính thức ra mắt ngày 14 tháng 9. Nền tảng gộp ba nhóm mô hình văn bản, hình ảnh, video cùng công cụ viết kịch bản, quản lý tư liệu và dựng phim vào một không gian làm việc duy nhất, với giao diện chính là một canvas có thể mở rộng vô hạn. Trang chủ www.pixtv.ai đã mở cửa sử dụng, hướng tới người sáng tạo phim ảnh và truyện tranh động, đội ngũ marketing thương hiệu, studio độc lập và các nhà sản xuất nội dung chuyên nghiệp.

Các mô hình được tích hợp trong đợt đầu gồm GPT 6, Opus 5, GPT Image 2.5 và Seedance 2.5, cùng một loạt mô hình chuyên biệt cho từng tác vụ cụ thể. Theo trang sản phẩm, phía hình ảnh liệt kê hai phiên bản Sunburst và Flare của GPT Image 2.5, cùng Nano Banana Pro, Seedream 5.0 Pro; phía video có Seedance 2.5, MiniMax H3 Max, Happy Horse 1.1. Nền tảng cho biết toàn bộ các mô hình này đều kết nối trực tiếp chính thức, không bị giảm cấu hình.
Từ so mô hình đến so quy trình
Trong hai năm qua, cuộc cạnh tranh trong lĩnh vực video AI chủ yếu xoay quanh từng mô hình riêng lẻ: hình ảnh có đủ chân thực không, chuyển động nhân vật có tự nhiên không, một cảnh quay được bao lâu, tư liệu tham chiếu có được hiểu chính xác không. Mô hình càng cập nhật nhanh, năng lực trong tay người sáng tạo càng nhiều, nhưng rắc rối mới cũng theo đó xuất hiện — một tác phẩm phải trải qua kịch bản, thiết kế hình ảnh, tạo cảnh quay, âm thanh và dựng phim, mỗi khâu dùng một nền tảng riêng, ở giữa phải liên tục tải lên và sắp xếp phiên bản để kết nối.

Giải pháp mà PixTV đưa ra là gộp các khâu này vào một quy trình duy nhất. Người dùng có thể bắt đầu từ một ý tưởng câu chuyện, hoặc nhập trực tiếp tư liệu có sẵn, rồi tiếp tục làm văn bản, hình ảnh, video, âm thanh, âm nhạc và dựng phim trong cùng một dự án. Ở đây, mô hình đóng vai trò là năng lực có thể gọi ra bất cứ lúc nào.
Canvas là giao diện chính
Infinite Canvas — canvas vô hạn — là hình thái sản phẩm cốt lõi của PixTV. Người sáng tạo thêm các nút văn bản, hình ảnh, video, âm thanh và dựng phim lên canvas, tự do sắp xếp xoay quanh nhân vật, bối cảnh, cảnh quay và tư liệu. Kịch bản câu chuyện có thể đặt cạnh thiết lập nhân vật, một ảnh tham chiếu có thể được phát triển tiếp thành cảnh quay động, kết quả tạo ra vẫn nằm trong cùng dự án để tiếp tục chỉnh sửa.

Tương tác trên canvas lần này được thiết kế lại: không gian làm việc theo kiểu không gian hóa, hỗ trợ kéo thả, thu phóng và gom nhóm nút, kèm hiệu ứng chuyển động chi tiết. Thiết kế này nhắm tới các dự án nhiều nhân vật, nhiều bối cảnh, nhiều cảnh quay như phim ngắn AI, truyện tranh động, phim quảng cáo và MV — canvas vừa là cửa ngõ tạo sinh, vừa là bàn làm việc để tổ chức ý tưởng và thúc đẩy sản xuất.
Chọn mô hình xoay quanh tác phẩm
Ở giai đoạn ý tưởng và kịch bản thì dùng mô hình văn bản để sắp xếp câu chuyện và nhân vật, đến giai đoạn phát triển hình ảnh thì đổi sang các mô hình hình ảnh khác nhau để thử bố cục, nhân vật và bối cảnh, khi vào sản xuất video thì chọn mô hình video theo yêu cầu của từng cảnh quay — đây là cách dùng điển hình mà PixTV mô tả. Điều nền tảng nhấn mạnh là giá trị của đa mô hình nằm ở chỗ vẫn đạt được hiệu năng ổn định, đầy đủ trong một môi trường thống nhất, còn số lượng mô hình tự nó không phải là điểm bán hàng.

Toàn bộ chuỗi quy trình được nền tảng tóm gọn thành: ý tưởng, kịch bản, thiết lập hình ảnh, hình ảnh, video, âm thanh và âm nhạc, dựng phim, thành phẩm. Tư liệu và bối cảnh sáng tạo được giữ lại xoay quanh cùng một tác phẩm, nhờ đó giảm bớt thao tác lặp lại khi chuyển đổi giữa các nền tảng.
Giá cả và ưu đãi ra mắt
PixTV tung ra ưu đãi có thời hạn trong dịp ra mắt, gói trả theo năm được giảm tối đa khoảng 41%. Trang giá hiển thị, sau khi quy đổi theo năm, gói Starter là 8,33 USD/tháng (100 USD/năm), gói Pro là 41,67 USD/tháng (500 USD/năm), gói Max là 166,67 USD/tháng (2.000 USD/năm), gói Ultra là 416,67 USD/tháng (5.000 USD/năm); mức giảm giá của bốn gói lần lượt là 17%, 31%, 32% và 41%, ngoài ra còn có hình thức trả theo tháng và mua điểm.

Ưu đãi này nhắm vào chi phí thử sai. Trong sản xuất video, một cảnh quay ưng ý thường phải qua nhiều vòng chỉnh bố cục, chuyển động và phong cách, giá mỗi lần gọi mô hình quyết định trực tiếp việc người sáng tạo có thể thử bao nhiêu phương án. Hướng đi của nền tảng là giảm chi phí mỗi lần thử, để ngân sách được dành nhiều hơn cho việc so sánh phương án và trau chuốt nội dung.
Từ một tác phẩm đến sản xuất liên tục
Sản xuất nội dung mang tính liên tục. Nhân vật truyện tranh động phải xuất hiện lặp lại trong nhiều tình tiết khác nhau, thương hiệu cần tích lũy tư liệu sản phẩm và phong cách hình ảnh lâu dài, còn bản thân người sáng tạo cũng dần hình thành hệ thống nhân vật, kho bối cảnh và ngôn ngữ cảnh quay riêng. PixTV gộp việc tạo dự án, lịch sử tạo sinh và quản lý tư liệu vào cùng một hệ thống, nhân vật, bối cảnh, phong cách và âm thanh đã tạo trước đó được lưu lại trong tài khoản để phục vụ các dự án sau.

Theo PixTV, đây là ranh giới để video AI chuyển từ “công cụ tạo sinh” sang “nền tảng sản xuất”: mô hình giải quyết vấn đề của một lần tạo sinh, còn nền tảng phải giải quyết việc làm sao giúp người dùng liên tục làm ra tập hai, tập ba. Với người dùng sản xuất nội dung hằng ngày, tiêu chuẩn đánh giá một nền tảng đang trở nên cụ thể hơn: có giảm được số công cụ phải chuyển qua lại không, có giữ được bối cảnh sáng tạo không, mô hình mới nhất có nhanh chóng vào được dự án hiện có không, và cuối cùng có giúp hoàn thành tác phẩm nhanh hơn không.
Khi “tạo ra một cảnh quay tốt” dần trở thành năng lực cơ bản, giai đoạn tiếp theo cần giải quyết là tổ chức hàng chục cảnh quay, nhân vật, âm thanh và ý tưởng thành một tác phẩm hoàn chỉnh. Lần ra mắt này, PixTV đặt cược vào tầng đó.
Nguồn tham khảo: Thông báo chính thức của PixTV AI, CocoLoop, trang giá chính thức của PixTV; danh sách mô hình tích hợp, tính năng canvas vô hạn và giá bốn gói trả theo năm đã được đối chiếu từng mục với tài liệu chính thức.