拓冰建站拓冰建站
首页 / 资讯中心 / 正文

告别逐帧截图:用 extract-video-ppt 快速提取视频中的 PPT 并一键导出 PDF

告别逐帧截图用 extract-video-ppt 快速提取视频中的 PPT 并一键导出 PDF【免费下载链接】extract-video-pptextract the ppt in the video项目地址: https://gitcode.com/gh_mirrors/ex/extract-video-ppt如果你还停留在看网课 不停暂停 截图 给图片起名的手工时代那么这篇关于 extract-video-ppt 的文章值得读完。它是一款能从视频中自动识别并提取 PPT 页面、一键导出 PDF 的开源工具装好之后全程只需要一条命令剩下的事情交给算法。 开场那个对着视频截了 200 张图的人上周同事小周被一节 45 分钟的培训录像折磨得不轻。他抱着一台电脑像回放慢镜头一样暂停截图切到文件夹重命名再切回来继续播放。四十分钟的片子他花了一个多小时才整理完结果第二天发现漏截了两页页码还对不上。这个故事是不是有点眼熟看网课记笔记、整理会议录像、把直播回放变成可检索的资料——凡是要把视频里出现的页面抠出来多数人第一反应都是手动截图。不是不能做是太浪费时间还容易出错。手动截图的命门在于你得先知道关键页面什么时候出现而注意力一旦跑神就全错过了。有没有可能让程序替我们盯屏幕有。这就是 extract-video-ppt 存在的理由。 先花 30 秒认识它这到底是个什么工具用一句话概括extract-video-ppt 会自动盯着视频里的画面一旦发现 PPT 换了新的一页就把它截下来最后把所有截到的页面拼成一份 PDF 给你。它做的其实是两件事的合体一是识图判断前后两帧画面是否发生了实质性变化二是归档把选中的帧按顺序导出为 PDF。这两个能力分别对应项目里的 compare.py 和 images2pdf.py主流程写在 video2ppt.py 里想深挖原理的同学可以直接翻开源码看。你不需要懂这些细节也能用。你只需要记住一个命令evp。️ 5 分钟跑通第一次装好 把 demo 变成 PDF安装方式挑最简单的来一条pip命令搞定pip install extract-video-ppt想从源码折腾的话先克隆仓库再本地安装也行git clone https://gitcode.com/gh_mirrors/ex/extract-video-ppt cd extract-video-ppt python setup.py install装完先别急着找自己的视频项目自带的 demo 文件夹 里已经准备好了全套示例一段演示视频demo.mp4、它的源文件demo.pptx、以及一份提取好的demo.pdf。直接拿它跑一遍5 分钟就能看到完整效果evp --similarity 0.6 --pdfname demo.pdf ./demo ./demo/demo.mp4命令的意思是把demo/demo.mp4里符合条件的关键帧提取出来命名为demo.pdf放进./demo目录。跑完去 demo 文件夹看一眼如果多了一本 PDF恭喜你已经在用了。效果如何从demo.pdf翻看里面正是视频里每一页 PPT 的完整画面——省掉的那 200 次手动截图程序替你完成了。 后台在发生什么它是怎么认出这一页是新 PPT的你可能好奇它凭什么知道该截哪一帧直接看演示效果感受会更直观。下图是项目里自带的帧分析示例图片左上角标注着这一帧的帧时间和与上一帧的相似度原理说出来其实不复杂拆开就三步抽帧程序不是一帧一帧傻看那样太慢而是按每秒一次的节奏采样把视频变成一系列快照。比相似度拿相邻两张快照做对比算出一个 0 到 1 之间的相似度数值。完全相同的画面是 1.0差别越大数值越低。做取舍相似度一旦低于某个阈值就说明这页变了是新内容于是把这一帧保存下来当作新一页 PPT。这套对比逻辑就写在 compare.py 里。有意思的是它用的不是复杂的深度学习模型而是经典的图像直方图算法——把画面压缩后统计颜色分布分布差得越多相似度越低。好处是轻量、快普通电脑跑起来毫无压力。为什么能滤掉伪变化因为讲师的手势、鼠标晃动通常不会改变整页的颜色分布而换页是整体画面的剧变。算法认的是整页变了没有而不是画面动没动。 学会读产出时间戳和相似度就藏在文件名里跑完一次提取你可能会在中间目录看到一批这样的文件frame00:00:09-0.5.jpg frame00:00:15-0.62.jpg文件名本身就是信息前半段是这一页出现的时间点后半段是它和上一帧的相似度。这意味着你不光得到了 PPT 内容还免费拿到了一份每一页在第几分钟出现的目录——整理笔记、跳转回看、给页码排顺序都变得有据可查。最终生成的 PDF 也延续了这个贴心设计。images2pdf.py 在拼 PDF 时会在每一页的上方加一行标题栏把帧文件名写进去。换句话说你拿到的不只是一本图集而是一本自带时间轴的演示文稿。如果你感兴趣甚至可以不把它当PPT 提取器而是当视频转 PDF工具用——README 里作者自己也调侃了这一点。️ 三个旋钮想让结果更合你意改这里就够了对新手来说这个工具总共只有三个值得关心的参数把它想成面板上的三个旋钮就行。旋钮一--similarity控制多疑程度。默认 0.6。数值越高程序越敏感稍微有点变化就当作新页数值越低它越淡定只有大换页才出手。举两个例子视频里 PPT 带很多小动画、一段话一个字一个字蹦出来可以调到 0.40.5避免把动画过程当成新页。录屏里穿插了讲师的窗口画面、弹窗之类的内容想连这些变化也抓下来就往 0.7 以上调。记住一个判断口诀抓多了就调低漏了就调高。旋钮二--start_frame和--end_frame圈定处理范围。格式是时:分:秒。比如只看前半小时就写--start_frame 00:00:00 --end_frame 00:30:00。视频太长、电脑吃紧或者你只想要中间某一段的时候这两个参数能帮你省下大量处理时间。旋钮三--pdfname定制输出文件名。默认叫output.pdf有洁癖的可以直接指定比如--pdfname 课程笔记.pdf。三条命令拼起来的完整姿势长这样evp --similarity 0.6 --pdfname my_ppt.pdf --start_frame 00:05:00 --end_frame 00:20:00 ./output ./video.mp4翻译成人话从第 5 分钟处理到第 20 分钟相似度 0.6输出名为 my_ppt.pdf。 真实场景网课、会议录像和个人知识库参数聊完说点更实在的——这东西到底能在哪些地方帮上忙。在线学习党。很多课程视频没有配套讲义想复习只能反复拖动进度条。现在把视频交给 extract-video-ppt几分钟后你就得到一份按时间顺序排列的讲义 PDF翻页复习、截图发笔记效率完全不在一个量级。打工人整理会议录像。会议录屏动辄一两个小时回看成本极高。用--start_frame圈出重点段落跑一遍关键提案的页面自动落在 PDF 里开会纪要的配图直接就有素材了。个人知识库的搬运工。常年收藏技术分享视频的人最头疼的就是看过等于没存。把视频过一遍提取PDF 入库时间戳还帮你标记了内容位置以后想找某个知识点翻 PDF 比翻视频快得多。处理多个视频也不麻烦一句循环搞定for v in *.mp4; do evp --pdfname ${v%.mp4}.pdf ./out_${v%.mp4} $v; done 排雷区新手容易踩的三个坑坑一start_frame写晚于视频总时长。程序会直接报错退出提示视频时长不支持所以先确认一下视频多长再圈范围。坑二源视频太糊。算法再好也架不住 360p 的鬼影画质PPT 里的字都看不清时提取出来自然也是糊的。建议使用 720p 及以上的录屏效果差别立竿见影。坑三误以为临时文件是垃圾。处理过程中会生成一个.extract-video-ppt-tmp-data中间目录你可能会担心它越积越大。其实不用管——程序跑完会自动清理临时目录里的 jpg 只是加工中的半成品最终成品 PDF 已经复制到你的输出目录了。 最后说一句动手吧从盯屏幕截一晚上到泡杯茶等一分钟差的只是一次pip install的距离。这个工具没什么学习曲线唯一需要你做的决定是下一个视频要不要试试建议你现在就做三件事pip install extract-video-ppt拿 demo 文件夹里的示例视频跑一遍看看 PDF 长什么样找一个你早就想整理、但一直没动工的视频把第一份自动讲义做出来半小时后你就会发现原来那些被手动截图偷走的时间本来可以花在更有意义的事情上。【免费下载链接】extract-video-pptextract the ppt in the video项目地址: https://gitcode.com/gh_mirrors/ex/extract-video-ppt创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门