Agnes Video ra mắt gói miễn phí, bản chính thức giá 1,5 USD/phút

Ngày 26 tháng 8, dòng Agnes Video 2.5 chính thức ra mắt trên nền tảng sáng tạo Pavo, trong đó phiên bản Flash hoàn toàn miễn phí, quá trình tạo video không tiêu tốn điểm.

Giới hạn của gói miễn phí được đặt ra khá thực tế: độ phân giải 720p, mỗi đoạn video dài 4 đến 12 giây, tối đa 3 yêu cầu mỗi phút. Bản chính thức 2.5 áp dụng cơ chế tính điểm, nền tảng tặng 200 điểm mỗi ngày, mỗi giây video tạo ra tốn 2 điểm, một đoạn dài tối đa 100 giây, độ phân giải có thể đẩy lên 2K. Quy đổi ra thì hạn mức miễn phí mỗi ngày tạo được khoảng 100 giây tư liệu (200 chia 2, tính sơ bộ), tương đương lượng nội dung của một đoạn phim ngắn. Giá tham chiếu phía API là 1,5 USD mỗi phút.

Tăng 165 điểm đổi được bao nhiêu lần thắng

Theo công bố chính thức của Agnes, điểm Elo trên bảng xếp hạng đánh giá mù của Artificial Analysis đã tăng từ 917 lên 1082, tức tăng 165 điểm.

Thang đo Elo rất dễ bị hiểu đơn giản là "điểm càng cao càng tốt" rồi bỏ qua, nhưng bản chất nó dùng để tính tỷ lệ thắng. Theo công thức chuẩn tính sơ bộ, chênh lệch 165 điểm tương ứng với tỷ lệ thắng khoảng 72% — đặt vào bối cảnh đánh giá mù, nghĩa là khi đặt sản phẩm cùng chủ đề của phiên bản mới và cũ cạnh nhau cho người dùng chọn, phiên bản mới sẽ được chọn khoảng 7 trên 10 lần. Mức chênh lệch này không nhỏ, thường tương ứng với một thế hệ mô hình mới chứ không phải bản vá nhỏ.

Tuy nhiên, thành tích trên bảng xếp hạng và khả năng sử dụng thực tế là hai chuyện khác nhau. Elo đo lường mức độ ưa thích cảm quan đối với từng đoạn video riêng lẻ, không đo được tốc độ suy giảm của khả năng bám sát prompt trong các cảnh quay dài, cũng không đo được liệu nhân vật có giữ được sự nhất quán qua các lần tạo liên tiếp hay không — mà hai điều này mới chính là điểm nghẽn thực sự đối với người làm phim ngắn.

Nền tảng đảm nhận luôn cả khâu phân cảnh

Logic sản phẩm của Pavo không nằm ở bản thân mô hình, mà ở việc nó chia nhỏ toàn bộ quy trình. Người dùng chỉ cần đưa ra một yêu cầu ban đầu bằng một câu, nền tảng sẽ tự động tạo ra yêu cầu chi tiết, đề cương, thiết kế nhân vật - bối cảnh - đạo cụ, hình ảnh thiết kế tương ứng, phân cảnh, khung hình chính, và cuối cùng mới là video theo từng phân cảnh; mỗi bước hoàn thành đều cần người dùng xác nhận rồi mới tiếp tục bước sau.

Lợi ích thực tế của thiết kế này là tiết kiệm chi phí. Nếu tạo ra cả một đoạn phim hoàn chỉnh trong một lần, chỉ cần một khâu nào đó bị lệch là phải làm lại toàn bộ, và chi phí làm lại đều dồn vào bước tốn kém nhất — tạo video. Khi được chia thành các mốc có thể nghiệm thu từng bước, nếu có vấn đề chỉ cần quay lại đúng bước đó để chạy lại, còn các tài sản đã được xác nhận trước đó vẫn giữ nguyên — đối với hạn mức 100 giây mỗi ngày của gói miễn phí, sự khác biệt này quyết định trực tiếp việc có thể thực sự làm ra sản phẩm hay không.

Miễn phí được duy trì bao lâu

Trong tất cả các dạng nội dung do AI tạo ra, video là loại có chi phí đơn vị cao nhất — số khung hình cần tạo cho một giây hình ảnh hoàn toàn không cùng cấp độ với một đoạn văn bản. Trong bối cảnh đó, việc "hoàn toàn miễn phí" về cơ bản đều là cửa sổ thu hút người dùng mới.

Gộp ba giới hạn lại thì trần chi phí bị khóa rất chặt: 720p khống chế năng lực tính toán trên mỗi khung hình, 4 đến 12 giây khống chế thời lượng mỗi lần tạo, 3 yêu cầu mỗi phút khống chế tần suất đồng thời. Nhân ba yếu tố này lại, sản lượng lý thuyết tối đa mỗi giờ của một người dùng cũng chỉ khoảng 180 đoạn phim ngắn, và đều là những đoạn video độ phân giải thấp. Nền tảng hiểu rõ mình đang trợ giá cho cái gì, và cũng hiểu rõ trần của khoản trợ giá đó nằm ở đâu.

Khoảng cách năng lực giữa bản Flash và bản chính thức đã đánh dấu rất rõ điểm trả phí: 720p so với 2K, 12 giây so với 100 giây. Muốn làm ra sản phẩm đủ chất lượng để phát hành, sớm muộn gì cũng phải vượt qua ngưỡng đó. Kiểu định giá này thường đi theo ba bước — trước tiên miễn phí để kéo người dùng hoạt động, sau đó thắt chặt hạn mức miễn phí, cuối cùng chuyển các năng lực hữu ích vào gói trả phí; hiện tại vẫn đang ở bước đầu tiên.

Có một thông tin hiện chưa thể xác định: 3 yêu cầu mỗi phút là giới hạn tốc độ của giao diện API, còn thời gian chờ thực tế phụ thuộc vào dung lượng xử lý đồng thời ở phía backend của nền tảng, phía chính thức chưa công bố con số cụ thể, người dùng chỉ có thể tự trải nghiệm để biết.

Nguồn tham khảo: Thông báo nền tảng Pavo, QbitAI, CocoLoop, KuCoin News; hạn mức miễn phí, mức tiêu hao điểm và giá API được đối chiếu chéo theo các nguồn; tỷ lệ thắng là ước tính của biên tập viên.