会议视频转写为 Markdown 笔记
🎯 目标
将 .mp4 会议视频,离线、稳定、无网络依赖地转换为结构清晰的 .md 会议记录,并存放在指定文件夹。
📌 核心痛点回顾
| 问题 | 说明 |
|---|---|
| MarkItDown 在线依赖 | 因版本老旧,强制依赖 OpenAI 在线接口,国内网络必然报错 WinError 10060 连接超时 |
| 本地参数失效 | 无法识别本地离线语音参数,所有 --local-whisper 类命令均失效 |
✅ 最终可行方案(稳定离线版)
1. 准备工作
| 依赖 | 说明 |
|---|---|
| Python 3.12 | 已安装 |
| ffmpeg | 处理视频音频,已安装 |
| openai-whisper | 离线语音转写 |
安装 Whisper:
py -3.12 -m pip install openai-whisper
2. 一键转换脚本
在桌面新建 run.py,写入以下代码:
import whisper
# 加载本地模型(完全离线,无网络依赖)
model = whisper.load_model("base")
# 转写视频(指定中文识别)
result = model.transcribe(
r"C:\Users\admin\Desktop\2021-09-08 18.24.35 850371713\meeting_01.mp4",
language="zh"
)
# 生成 Markdown 文件到指定目录
with open(r"C:\Users\admin\Desktop\output\meeting_01.md", "w", encoding="utf-8") as f:
f.write("# 会议语音转文字\n\n")
f.write(result["text"])
3. 运行命令
py -3.12 "C:\Users\admin\Desktop\run.py"
📝 关键细节说明
模型下载
首次运行会自动下载 base 模型(约 139MB),下载完成后提示 FP16 is not supported on CPU 为正常警告,不影响转写。
输出结果
转写完成后,文件将自动生成在 C:\Users\admin\Desktop\output\meeting_01.md。
后续优化
如果需要更结构化的 Markdown 格式,可对生成的 .md 文件再用 markitdown 做二次美化:
py -3.12 -m markitdown "C:\Users\admin\Desktop\output\meeting_01.md" -o "C:\Users\admin\Desktop\output\meeting_final.md"
💡 避坑总结
| 坑点 | 原因 | 解决办法 |
|---|---|---|
WinError 10060 |
MarkItDown 老版本强制连 OpenAI | 改用 Whisper 本地离线转写 |
unrecognized arguments |
MarkItDown 版本不支持本地参数 | 放弃命令行参数,改用 Python 脚本方式 |
| 模型校验和错误 | 缓存损坏 | 删除 C:\Users\admin\.cache\whisper 文件夹 |
浙公网安备 33010602011771号