
Hiện tại, video Sora 2 có thể dài tối đa 20 giây cho mỗi clip được tạo trong API chính thức của OpenAI và Sora Video Editor. OpenAI cũng hỗ trợ các phần mở rộng video tối đa 20 giây mỗi phần, với tối đa sáu phần mở rộng, cho tổng thời lượng sau khi ghép lên tới 120 giây. Đối với Sora 2 API, CometAPI hỗ trợ 20 giây và 2K.

Bạn không thể hợp pháp “mở khóa” Sora 2 Pro trong giao diện web của OpenAI nếu không đi theo con đường chính thức (ChatGPT Pro hoặc quyền truy cập OpenAI API). Tuy nhiên, có các lựa chọn hợp pháp để có được kết quả cấp Pro của Sora mà không cần mua ChatGPT Pro: (1) gọi trực tiếp mô hình Sora 2 Pro thông qua Video API của OpenAI và trả phí theo mức sử dụng; (2) sử dụng các nền tảng tổng hợp API thương mại (ví dụ: CometAPI) hoặc các nền tảng SaaS bán lại hoặc định tuyến các lệnh gọi Sora 2/2 Pro; hoặc (3) sử dụng các dịch vụ tổng hợp API bên thứ ba được ủy quyền (chúng yêu cầu tài khoản/phí riêng).

Sora — họ mô hình sinh video của OpenAI và ứng dụng sáng tạo đi kèm — đã nhanh chóng thay đổi kỳ vọng về việc một ảnh tĩnh đơn lẻ có thể trở thành gì. Trong năm qua, các mô hình của Sora (đặc biệt là sora-2 và sora-2-pro) và ứng dụng Sora dành cho người dùng đã bổ sung các tính năng hỗ trợ rõ ràng việc bắt đầu kết xuất từ một hình ảnh được tải lên và tạo ra các đoạn video ngắn, mạch lạc thể hiện chuyển động, hành vi của máy quay và âm thanh thuyết phục. Hệ thống có thể chấp nhận các tham chiếu hình ảnh và tạo ra một video ngắn, hoặc làm chuyển động các thành phần từ hình ảnh đó, hoặc dùng hình ảnh như một gợi ý thị giác trong một cảnh mới được tạo. Đây không phải là các hoạt hình “frame-to-frame” theo nghĩa truyền thống; mà là các bản kết xuất tạo sinh hướng tới tính liên tục và tính hợp lý về mặt vật lý, thay vì các keyframe được dựng thủ công.

Sora 2 — mô hình chuyển văn bản thành video thế hệ thứ hai của OpenAI — không chỉ nâng tầm độ chân thực hình ảnh: nó còn coi âm thanh là một thành phần hạng nhất. Đối với các nhà sáng tạo nội dung, nhà tiếp thị, nhà giáo dục và nhà làm phim độc lập muốn những video AI ngắn, giàu cảm xúc, Sora 2 thu gọn chuỗi xử lý âm thanh/video nhiều bước trước đây thành một quy trình duy nhất có thể điều khiển bằng prompt.

Trong bối cảnh trí tuệ nhân tạo đang phát triển nhanh chóng, Sora 2 của OpenAI đã nổi lên như một công cụ đột phá trong việc tạo video. Ra mắt vào tháng 9

Sora 2 là một trong những sản phẩm AI phát triển nhanh nhất năm 2025: hệ thống tạo video + âm thanh thế hệ tiếp theo từ OpenAI, sản xuất các đoạn phim ngắn

Sora 2 của OpenAI đã thay đổi cách người sáng tạo nghĩ về video dạng ngắn: nó tạo ra các clip chuyển động, đồng bộ hóa môi, chân thực về mặt vật lý từ văn bản và hình ảnh, và —

Sora-2-pro là mô hình tạo video+âm thanh chủ lực của OpenAI, được thiết kế để tạo ra các video clip ngắn, chân thực với lời thoại đồng bộ, hiệu ứng âm thanh và mô phỏng vật lý/thế giới mạnh mẽ hơn so với các mô hình video trước đây. Sora-2-pro được định vị là phiên bản "Pro" chất lượng cao hơn, dành cho người dùng trả phí và thông qua API để tạo video theo chương trình. Mô hình này nhấn mạnh khả năng điều khiển, tính nhất quán về mặt thời gian và đồng bộ hóa âm thanh cho các ứng dụng điện ảnh và xã hội.