i-hate-editing
开源的本地优先 AI 视频编辑工具,让用户可以直接丢进原始素材、拿回可直接发布的成片
i-hate-editing 是一个开源的本地优先 AI 视频编辑工具,让用户可以直接丢进原始素材、拿回可直接发布的成片。它的核心理念是LLM 不需要观看视频,整个剪辑流程完全基于音频分析而非视觉识别,使用本地运行的 whisper.cpp 完成语音转写,素材从不离开用户的电脑,支持 macOS 和 Linux 系统。
核心功能
第一,静默检测与词 onset 定位驱动的智能切片。工具不靠逐帧浏览时间轴来寻找剪辑点,而是通过检测音频中的静默区间和词语起始点来判断在哪里断句,这种方式既能保持语义的完整性,又比手动拖动时间轴精确得多。第二,缝合点重转写机制。工具会在每个切口周围重新转写一小段音频窗口,从而捕捉重复词和句子中段的剪辑,确保听起来自然流畅。第三,带校对门控的字幕生成。字幕在手机小屏上仍然可读,且必须通过校对检查才会随视频发出,避免出现错字和乱码。第四,真实页面捕获与动态高亮。工具截取实际页面内容作为竖屏静态图,然后模拟滚动、缩放和高亮操作,高亮的是用户真正说到的内容行,而非模拟截图。第五,音效智能匹配与峰值对齐。由 AI 判断音效放置的时机,并将音效峰值与对应视频峰值对齐,使短音效窗口真正可闻,不会被背景音乐淹没。第六,多平台格式一次性输出。从同一素材自动生成主视频、平台裁剪版本、排名封面图和后期制作说明,无需手动重复导出。
技术实现
整个流程采用纯本地架构,音频转写基于 whisper.cpp 运行,不调用任何云端 STT 接口,原始素材不离开本地机器,有效保护内容隐私。所有机械性、重复性的工作(切片、转写、字幕生成、音效对齐、多格式导出)全部由脚本自动化执行,AI 仅在需要审美判断的时刻介入,包括剪辑点选择、字幕高亮行判断、音效放置意图判定,以及封面图排序。系统支持多种主流视频平台格式同时导出,可从一次素材输入,自动完成转写、切片、字幕生成、音效匹配,最终输出 Instagram Reels、YouTube Shorts、Twitter 视频、TikTok 视频等多平台适配版本。
快速上手
安装方式支持 skills.sh 一键安装(一条命令完成 Agent 技能注册)或从 GitHub 手动克隆并配置本地工具链。准备工作只需将原始素材放入指定文件夹,然后通过 Claude 等 AI 代理发送编辑指令即可。整个过程无需学习 Premiere 或 Final Cut Pro,适合希望专注内容本身而非剪辑技术的创作者。
适用人群
该工具面向不希望在剪辑上花费大量时间的视频内容创作者,特别是 YouTube 教程和解释视频的创作者。它能显著缩短从拍摄到发布的工作流耗时,尤其适合需要频繁更新内容但不想在后期制作上投入过多精力的独立创作者和小型内容团队。
评论与建议
登录 后参与评论或提建议