news 2026/8/24 16:20:14

把视频提取PPT交给 extract-video-ppt:五分钟出一份干净 PDF

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
把视频提取PPT交给 extract-video-ppt:五分钟出一份干净 PDF

把视频提取PPT交给 extract-video-ppt:五分钟出一份干净 PDF

【免费下载链接】extract-video-pptextract the ppt in the video项目地址: https://gitcode.com/gh_mirrors/ex/extract-video-ppt

extract-video-ppt 只干一件事:把视频提取PPT,顺手拼成一份 PDF。省掉你逐页截图、改名、归档的重复劳动,页面内容真换了它才自动截下来,最后给一份干净、能直接打印的 PDF。复习录播课、整理会议录屏,都是立刻省事的活儿。

先看看跑完长什么样

✅ 跑完你会得到一份横向排版的 PDF:一页就是一张 PPT 画面,页面上方还印着这帧文件名(带时间点),方便回头定位是哪一段。直接打开复习、打印、发给同学都没问题。这份 PDF 就是视频提取PPT的全部成果,下面这页来自项目示例视频:

它凭什么做到

它像相册自动去重:大约每秒抽一帧,和上一帧比颜色分布,差别够大才算新的一页存下来,否则跳过。--similarity就是决定存不存的那个"差别门槛",后面调参基本就是动它。核心逻辑都在video2ppt/目录:video2ppt.py管逐帧扫描,compare.py管相似度计算,images2pdf.py管拼 PDF。

五分钟跑通第一条命令

装一行、跑一行,全程不超过五分钟。先安装(需要 Python 3.6 以上):

pip install extract-video-ppt

更习惯从源码装的话,先把仓库 clone 到本地,再执行python setup.py install

git clone https://gitcode.com/gh_mirrors/ex/extract-video-ppt

装完运行evp --help,看到帮助信息说明环境没问题。第一条运行命令长这样(以 my_video.mp4 为例):

evp --similarity 0.6 --pdfname lecture.pdf ./output ./my_video.mp4
  • ./my_video.mp4:必填 —— 要处理的视频文件
  • ./output:必填 —— 结果存放目录,不存在会自动建
  • --similarity:0.6 —— 和上一帧相似度低于它就保存这帧,也就是"换页敏感度"
  • --pdfname:output.pdf —— 输出 PDF 的文件名
  • --start_frame:00:00:00 —— 从第几秒开始处理
  • --end_frame:INFINITY(到结尾) —— 处理到第几秒为止

跑的时候屏幕会实时刷处理百分比,结束后去输出目录拿 PDF 就行。项目里备好了 demo/ 目录,内有示例视频和成品 PDF,先拿它练手最稳。

几个旋钮,决定输出质量

调旋钮其实就三件事:敏感度、时间范围、命名。

  • --similarity:0.6 —— 换页敏感度的核心,结果不对劲就先动它
  • --start_frame/--end_frame:00:00:00 / 到结尾 —— 长视频用它圈出核心时间段,省时间
  • --pdfname:output.pdf —— 每个视频起个独立的 PDF 名字,方便归档

阈值调优的几个经验值,按场景对号入座:

  • 动画、转场多的演示:0.4~0.5,带入场动画的页容易被漏
  • 普通讲课录像:0.6~0.7 就够了,激光笔晃一晃也不容易误存
  • 几乎静止的录屏:0.8 以上,只留大改动,免得整份 PDF 全是长得像的页

卡住了?先看这几条

⚠️ 卡住的情况基本就这四种,对着查。

Q:PDF 里全是几乎一样的页面,怎么办?A:--similarity设高了。先把值降到 0.5 重跑一次,漏页就再往下降。

Q:提示 start >= end can not work?A:起止时间写反了。把--start_frame改得比--end_frame小再跑。

Q:弹出 Please check if the video url is correct?A:视频路径不对或文件读不出来。确认文件确实存在,换成 MP4、AVI 这类常见格式再试。

Q:中途被强退,残留一个 .extract-video-ppt-tmp-data 目录?A:那是存中间截图的临时目录,正常跑完会自动清掉。强退残留不影响下次运行,手动删掉即可。

视频多的话,写个简单循环逐个跑,每个视频出一份 PDF;单集超过两小时的,按时间段拆成两段分别提取,再用合并工具把两份 PDF 拼起来,中途断了也只损失一小段。省下的截图和归档时间,可以拿回去真正复习内容。挑一段带 PPT 讲解的视频,敲下你的第一条 evp 命令。

【免费下载链接】extract-video-pptextract the ppt in the video项目地址: https://gitcode.com/gh_mirrors/ex/extract-video-ppt

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/24 16:17:25

向量分析与张量入门:从梯度、散度到应力张量的工程实践

如果你是一名物理、工程或计算机专业的学生,或者是一位需要处理空间数据、场论问题的工程师,当听到“向量分析”、“场论”、“张量”这些词时,是不是既感到它们无比重要,又觉得概念抽象、公式繁多,不知从何下手&#…

作者头像 李华
网站建设 2026/8/24 16:16:33

智能体持续学习防遗忘机制:从EWC到经验回放的工程实践指南

在实际的人工智能研究和工程实践中,智能体(Agent)框架的设计与实现是一个核心挑战。一个理想的智能体不仅需要具备强大的初始学习能力,更需要能够在动态环境中持续学习新知识,同时避免在学习新任务时遗忘旧技能。这种能…

作者头像 李华
网站建设 2026/8/24 16:15:41

[操作系统]一条-r参数之差:从Windows CMD到操作系统底层的层层递进

为什么Windows CMD的 move 指令中不需要加 -r 参数?原因如下: 1. move 指令默认支持对文件夹及其内部所有子文件、子文件夹的整体移动(即递归操作),无需额外参数开启递归功能。 2. -r 参数常见于Linux系统的 mv 等指…

作者头像 李华
网站建设 2026/8/24 16:14:18

Wand-Enhancer 完整指南:本地修补 WeMod,把锁住的功能拿回来

Wand-Enhancer 完整指南:本地修补 WeMod,把锁住的功能拿回来 【免费下载链接】Wand-Enhancer Advanced UX and interoperability extension for Wand (WeMod) app 项目地址: https://gitcode.com/GitHub_Trending/we/Wand-Enhancer 周末想给正在打…

作者头像 李华
网站建设 2026/8/24 16:10:49

零代码AI工具实战:用扣子编程快速构建个性化错题练习网页

零代码打造错题专练网页:普通人也能自制的AI学习工具 你是不是也遇到过这样的烦恼?孩子或学生有一大堆错题,整理起来费时费力,想针对性练习却找不到合适的工具。市面上的学习软件要么功能太复杂,要么需要付费&#xff…

作者头像 李华
网站建设 2026/8/24 16:08:47

Fine-Tuned Large Language Models for Logical Translation: Reducing Hallucinations with Lang2Logic

文章总结与翻译 一、主要内容 本文针对大型语言模型(LLMs)在自然语言到形式逻辑翻译任务中存在的幻觉问题(生成错误输出),提出了一种名为Lang2Logic的新型框架。该框架的核心目标是将英文自然语言语句准确转换为合取范式(CNF),为可满足性求解(SAT)等逻辑推理任务提…

作者头像 李华