用文字剪视频 · 本地优先

把剪口播视频,
从「拖时间轴」
变成 改一篇文稿

导入视频,自动转写成带时间戳的字幕。之后你面对的不再是密密麻麻的轨道, 而是一篇可勾选、可编辑的文稿——留下的句子=成片,划掉的句子=删除。 AI 先帮你挑一遍,你说了算,一键导出。

🎯 句子级剪辑,而非帧级
🤖 AI 只建议,你拍板
💻 数据留本机,非破坏性
1导入视频 2自动转写 3AI 建议 4勾选确认 5导出成片
为什么做这件事
剪口播视频,真正的判断从来不是「这一帧要不要留」
而是「这句话要不要留」

口播、访谈、演讲、课程——这类以「说话」为主的视频,内容都写在字幕里。 可传统时间轴剪辑,逼你在波形上反复拖动、试听、定位,把一个「读文稿」就能做的决定, 变成了一次次机械的手部操作。效率低,也累。

我们换了个思路:字幕才是视频真正的索引。 把视频摊成一篇可读、可勾选的文稿,你像审稿一样决定去留,机器负责把这些决定精确落到时间线上。 判断回归内容,操作交给工具。

⏱ 传统时间轴

  • 在波形里找那句话在哪
  • 反复拖动、放大、试听
  • 手动对齐每一个切口
  • 删口癖、剪重复全靠肉眼
  • 改一版重来一遍

📝 用文字剪

  • 整篇文稿一眼扫完
  • 勾选=留,取消=删
  • 切口由系统精确落位
  • 口癖/重复 AI 自动标出
  • 多套剪法并存、随时切换
四步走完

导入到成片,全程只跟文字打交道

拖入视频后,转写、AI 初筛自动完成;你只做最值钱的那一步——决定留什么。

📥
STEP 01

导入视频

拖进一个本地视频,或粘贴文件路径。原始视频只读不改,全程非破坏性。

🎙️
STEP 02

自动转写

生成带词级时间戳的字幕,每个字都能对回视频的精确时刻。转写过的文件下次不重转。

STEP 03

AI 初筛

寒暄、口癖、重复句默认帮你取消勾选,并在每行给出删除理由——你只需复核,不用从零挑。

🎬
STEP 04

确认导出

勾选、改字、调顺序,边改边试听。满意后一键导出 MP4 + 重排字幕。

能做什么

不只是「删句子」,而是一套完整的成片工作台

从粗剪到精修,从单句微调到整片重排,一个界面里全部搞定。

文字即时间轴

勾选=保留,取消=划线灰显的删除;文本能直接改,改动与勾选自动保存,永不丢。

🔀

成片 / 原片双模式

默认只播「保留」的内容,进度条走成片时间轴;一键切回原片对照,点删掉的句子可单句试听、决定要不要捞回。

✂️

句内微调到词

展开词块面板,点一个词就删/恢复一个词;波形上的切点竖线可鼠标拖动,每次调整自动做「接缝试听」。

🌬️

一键剪气口

自动检测句内「呃 / 嗯 / 唉」和紧邻重复("我们要我们要"),标红提示,全片一键批量清理,每处可单独恢复。

🗺️

长视频内容地图

AI 通读全片,把主题和背景/案例分开,每个主题给出时长与建议成片长度;一键把某个主题变成独立成片。

金句候选

AI 在主题里挑 3–5 个「能单句立住」的金句并说明理由,你决定置顶/保留/弃用;任意句子也能手动点⭐自选。

⏱️

时长预算

实时显示 目标 / 预计 / 差额;超支时给「可删清单」,只建议、绝不静默删,锁定的金句永不进删除列表。

🔎

字幕质检 + AI 复核

标出转写里可能听错的词,AI 结合上下文判断:确定的自动改(可整批撤销),拿不准的高亮留人工,宁漏改不错改。

🔁

批量纠错闭环

改对一个词,系统提示「其他句还有 N 处,一起换?」,并可把正词存进词典——改一次,以后不再错

↕️

拖拽调序

抓住句首把手上下拖,金句提前、结论前置随便排;同一句可重复出现做强调,导出严格按你排的顺序。

📄

从文稿反算成片

把排好的成片文字直接粘进来,系统按原话对回视频自动生成方案;错字/标点自动容错,原片没有的改写只提醒、绝不硬凑。

🗂️

多套剪法并存

同一个项目里,完整精剪 / 主题切片 / 金句混剪各存一份,方案条上一键切换,互不覆盖。

三种 AI 玩法

同一段素材,三种成片思路

AI 挑段的方式可以切换。它永远只从你已有的句子里选,不会凭空编造内容或时间。

Mode 01

口播精剪

逐句给保留 / 删除建议,优先删停顿、口癖、重复。适合快速把一条口播修干净。

逐句建议
今天讲三个实用技巧
呃……我想想啊
第一个,也是最关键的
这个这个……就是
Mode 02

主题切片

长视频按主题拆条,每个主题给出时长与最佳切片。一条长演讲,拆成好几条能单发的短片。

按主题拆条
① 开场与背景
2:10
② 核心方法
5:40
③ 真实案例
3:25
④ 行动建议
2:55
Mode 03

金句混剪

把金句提到最前做 HOOK,主体铺陈,结尾再重复强调(ECHO)。为传播而生的乱序成片,还附标题建议。

HOOK → BODY → ECHO
HOOK 90% 的人第一步就做错了
BODY 正确的做法应该是……
BODY 我自己试了三个月,发现
ECHO 记住,第一步千万别错
适合谁 · 什么场景

只要视频里「说的话」是重点,它就帮得上

越是以语言为主、越是长的内容,用文字剪的效率优势越明显。

🎤

口播博主 / 自媒体

一条几分钟的口播,删掉废话口癖、提炼金句,几分钟出干净成片。

📚

知识 / 课程内容

长课程按主题切片,一次录制拆成一系列可单发的知识短片。

💬

访谈 / 播客

长对话通读全片、定位重点段落,抓出可传播的高光片段。

🎓

演讲 / 分享回放

把一场长演讲的精华浓缩成短片,金句前置,为社交平台重新组织节奏。

可以放心的地方

四条底线,决定了你能信任它

💻

本地优先

项目、字幕、剪辑决策、成片都存在你自己电脑里;只把音频发去做转写。视频不上云,重启不丢。

🙋

AI 只建议,你拍板

AI 的每个判断都能被你一键推翻;它只能从你已有的句子里选,不会生成或改动任何时间戳。

🛡️

非破坏性

全程不修改原始视频,所有决定都可回退。删错的句子随时勾回来,改坏的方案切回上一套。

🔗

可追溯

成片里的每一段都能追回到原始句子。内部用结构化数据,字幕只是导入导出的格式。

两种用法

一套引擎,人和 AI 都能开

网页版用来人工精修,命令行用来让脚本 / AI 批量驱动——两边产物互通,可以来回接力。

给人用

网页版工作台

浏览器里拖入视频,边看边改。播放器、字幕行、AI 面板、质检、预算、导出全在一个页面。

  • 拖入即用,勾选与改动自动保存
  • 成片/原片对照、句内微调、接缝试听
  • 主题地图、金句候选、时长预算一站式
  • 提示词可视化编辑,随时调 AI 口味
给 AI / 批处理用

无头命令行

同一套引擎的 CLI,适合脚本或 AI 批量跑。产物与网页版共用工作区,可来回接力。

# 一条命令跑完整流程:转写 → AI 选段 → 导出 pe run a.mp4 b.mp4 --brief "保留高光,删口癖重复" # 或分步来:转写 / 选段 / 浏览器确认 / 导出 pe transcribe · pe select · pe review · pe export