
01·Thư viện
AI chuyển giọng nói thành văn bản và đề xuất cắt khoảng lặng, từ đệm
Studio trên trình duyệt với timeline nhiều track, B-roll và nhiều clip
Dọc 9:16, render bằng Remotion từ cùng các thành phần với bản xem trước trong trình dựng
Default, Karaoke, Bold Yellow, Word Pop và Emoji Keyword
Whisper, Deepgram và Gemini, chuyển đổi bằng cấu hình thay vì sửa mã
LazyCut là trình dựng video ngắn bằng AI do iReadCustomer tự phát triển. Người dùng tải lên cảnh quay thô — clip nói trước camera, podcast, quay màn hình hay phát lại livestream — và AI sẽ chuyển giọng nói thành văn bản, đề xuất cắt khoảng lặng và từ đệm, thêm phụ đề động theo từng từ, đồng thời đặt emoji, hiệu ứng âm thanh và meme. Mọi thứ vẫn chỉnh sửa được trong studio trên trình duyệt với timeline nhiều track, và bản dựng hoàn chỉnh được xuất thành video dọc 9:16 (1080×1920) cho TikTok, Reels và Shorts.
Biến một đoạn quay nói trước camera thành video ngắn dọc gọn gàng đòi hỏi thời gian và kỹ năng: cắt khoảng lặng, bỏ từ đệm và những đoạn nói vấp, căn khung 9:16 và thêm phụ đề. Lựa chọn trước đây là tự dựng hoặc thuê người dựng. Bài toán: để AI làm toàn bộ lượt dựng đầu tiên từ cảnh quay thô, trong khi mọi quyết định của AI vẫn xem lại và điều chỉnh được trước khi render.

Trung tâm của hệ thống là EDL (Edit Decision List), một tài liệu JSON là nguồn sự thật duy nhất: AI đề xuất chỉnh sửa trên đó, người dùng điều chỉnh, và bộ render đọc cùng một tệp.
Toàn bộ logic dựng nằm trong các gói dùng chung không gắn với hạ tầng, và mọi nhà cung cấp bên ngoài đều nằm sau adapter thay thế được. Ứng dụng web là Next.js trên Vercel; phần xử lý chạy trên worker DigitalOcean với Postgres và Drizzle, Spaces cho media, cùng hàng đợi Redis và BullMQ.
Worker tách âm thanh bằng FFmpeg, chuyển giọng nói theo từng từ kèm thời gian, tìm khoảng lặng và từ đệm, rồi để một LLM — Claude, GPT hoặc Gemini — lên kế hoạch cắt, căn theo ranh giới từ để tên người không bị cắt giữa chừng. Sau đó nó đặt emoji vào từ khóa, hiệu ứng âm thanh ở chỗ chuyển cảnh và một hai meme, theo cách cho kết quả nhất quán và gỡ bỏ được.
Trình dựng trên trình duyệt kiểu CapCut mở toàn bộ đoạn quay trước: các điểm cắt AI đề xuất được tô sáng trên timeline để giữ hay cắt từng đoạn, danh sách phụ đề chia thành các đoạn có nhãn như đoạn tốt, đoạn hỏng, khoảng lặng hay từ đệm, bấm vào là nhảy đến vị trí đó trong bản xem trước. Timeline nhiều track cho phép đặt B-roll và chỉnh vị trí, kích thước.
Remotion render video 1080×1920 trên worker từ cùng các thành phần với bản xem trước, nối các điểm cắt chính xác từng khung hình để không xuất hiện nháy một khung giữa các đoạn, và nạp phông IBM Plex Sans Thai vào bản xuất.
Công đoạn tự động căn khung (Auto-reframe) đã được nối vào pipeline nhưng vẫn tắt cho đến khi bộ theo dõi khuôn mặt vượt qua bài kiểm tra render thật, còn hệ thống tín dụng và thanh toán đã xây xong nhưng chưa bật.
Studio web và worker xử lý đang chạy trên production.
Tải lên clip nói trước camera, podcast hay quay màn hình, AI sẽ chuyển giọng nói thành văn bản, đề xuất điểm cắt và thêm phụ đề trong một lượt.
Điểm cắt, phụ đề, emoji, hiệu ứng âm thanh và meme đều chỉnh hoặc xóa được trong studio, và không có gì bị cắt cho đến khi người dùng duyệt.
Phụ đề chạy theo lời nói từng từ với năm kiểu, chỉnh được phông chữ và vị trí, và tiếng Thái hiển thị đúng trong bản xuất.
Xuất video dọc 1080×1920 cho TikTok, Reels và Shorts.
Dọc 9:16, render bằng Remotion từ cùng các thành phần với bản xem trước trong trình dựng
Default, Karaoke, Bold Yellow, Word Pop và Emoji Keyword
Whisper, Deepgram và Gemini, chuyển đổi bằng cấu hình thay vì sửa mã
Thư viện

01·Thư viện
Studio trên trình duyệt với timeline nhiều track, B-roll và nhiều clip

02·Thư viện
Xuất video dọc 9:16 (1080×1920); giao diện tiếng Thái và tiếng Anh

03·Thư viện
Liên hệ chúng tôi