VideoDevour - 视频吃进去,图文报告吐出来

VideoDevour - 视频吃进去,图文报告吐出来


扔一段视频进去,自动出带章节配图的 Markdown 报告,网课笔记/会议纪要/内容素材一站搞定

给它一段视频,它还你一份图文报告。

Datawhale 出品,名字很直白——"吃掉视频"。扔一个视频进去(网课、会议录像、教程都行),自动输出带章节、配图、文字的 Markdown 报告。

怎么做到的?四步流水线

步骤做什么技术
语音转写精准转录 + 说话人分离 + 毫秒级时间戳FunASR Paraformer V2
大纲生成LLM 分析转写文本,自动生成层级大纲DeepSeek 等任意 LLM
关键帧筛选视频切片 → 提帧 → 去重 → VLM 评分选最佳帧FFmpeg + Sentence Transformers + VLM
报告输出图文大纲 → LLM 润色扩写 → 最终报告LLM 二次精修

不挑视频,三个场景直接用

  • 学习笔记:网课/教程视频自动整理成带章节配图的笔记
  • 会议纪要:会议录像 → 带摘要和关键画面的结构化记录
  • 内容素材:从长视频里自动提取关键片段和图片,二次创作省大量时间

技术栈干净

Python + FastAPI 后端 + React 前端,自带 Web 界面。ASR 用 FunASR(阿里开源,中文很强),LLM/VLM 可自己换(默认 DeepSeek + 豆包,改个配置就行)。MIT 开源。

GitHub: https://github.com/datawhalechina/video-devour

12900举报0子龙•26天前
点击获取 ^_^
被收录:

暂无评论