
01·项目图库
AI 转录并建议剪掉静音与口头禅
浏览器剪辑室:多轨时间线、B-roll 与多段素材
竖屏 9:16,使用 Remotion 以与编辑器预览相同的组件渲染
Default、Karaoke、Bold Yellow、Word Pop 和 Emoji Keyword
Whisper、Deepgram 和 Gemini,通过配置切换,无需改代码
LazyCut 是 iReadCustomer 自主研发的 AI 短视频剪辑工具。用户上传原始素材——口播视频、播客、录屏或直播回放——AI 会转录语音、为静音和口头禅给出剪辑建议、添加逐词动态字幕,并自动放置表情、音效和梗图。所有内容都可在带多轨时间线的浏览器剪辑室中继续编辑,成片导出为 9:16 竖屏视频(1080×1920),适用于 TikTok、Reels 和 Shorts。
把一段口播录像剪成紧凑的竖屏短视频,既费时又需要技巧:剪掉冷场、删去口头禅和说错的片段、按 9:16 构图并添加字幕。过去的选择只有自己动手剪,或花钱请人剪。我们的任务是让 AI 从原始素材完成整个初剪,同时在渲染前让 AI 的每个决定都可审阅、可调整。

系统的核心是 EDL(剪辑决策列表),一个作为唯一事实来源的 JSON 文档:AI 对它提出修改,用户进行调整,渲染器读取同一个文件。
所有剪辑逻辑都位于不依赖基础设施的共享包中,每个外部服务都位于可替换的适配器之后。Web 应用是运行在 Vercel 上的 Next.js,处理任务运行在 DigitalOcean 的 Worker 上,配合 Postgres 与 Drizzle、用于存储媒体的 Spaces,以及 Redis 和 BullMQ 任务队列。
Worker 用 FFmpeg 提取音频,逐词转写并记录时间,找出静音和口头禅,再由 LLM(Claude、GPT 或 Gemini)规划剪辑,剪辑点对齐词语边界,避免把人名剪断。随后在关键词上放置表情、在剪辑衔接处加入音效,并放入一到两个梗图,结果确定且可移除。
类似 CapCut 的浏览器编辑器先打开完整素材:AI 建议剪掉的部分在时间线上高亮,可逐段选择保留或剪掉;字幕列表按段落划分,并标注好片段、坏片段、冷场或口头禅,点击即可跳到预览中的对应位置。多轨时间线可放置 B-roll,并调整位置和大小。
Remotion 在 Worker 上以与编辑器预览相同的组件渲染 1080×1920 视频,按帧精确拼接剪辑,避免剪辑之间出现一帧闪烁,并在导出文件中加载 IBM Plex Sans Thai 字体。
自动重构图(Auto-reframe)环节已接入流水线,但在人脸追踪通过真实渲染测试之前保持关闭;额度与计费引擎已经完成,但尚未启用。
Web 剪辑室和处理 Worker 已在生产环境运行。
上传口播视频、播客或录屏,AI 会一次完成转写、提出剪辑建议并添加字幕。
剪辑点、字幕、表情、音效和梗图都可以在剪辑室中调整或删除,在用户批准之前不会剪掉任何内容。
字幕随语音逐词呈现,提供五种样式,字体和位置可调,泰语在导出文件中也能正确显示。
导出 1080×1920 竖屏视频,适用于 TikTok、Reels 和 Shorts。
竖屏 9:16,使用 Remotion 以与编辑器预览相同的组件渲染
Default、Karaoke、Bold Yellow、Word Pop 和 Emoji Keyword
Whisper、Deepgram 和 Gemini,通过配置切换,无需改代码
项目图库

01·项目图库
浏览器剪辑室:多轨时间线、B-roll 与多段素材

02·项目图库
导出 9:16 竖屏(1080×1920);泰英双语界面

03·项目图库
联系我们