会议视频转写为 Markdown 笔记

🎯 目标

.mp4 会议视频,离线、稳定、无网络依赖地转换为结构清晰的 .md 会议记录,并存放在指定文件夹。


📌 核心痛点回顾

问题 说明
MarkItDown 在线依赖 因版本老旧,强制依赖 OpenAI 在线接口,国内网络必然报错 WinError 10060 连接超时
本地参数失效 无法识别本地离线语音参数,所有 --local-whisper 类命令均失效

✅ 最终可行方案(稳定离线版)

1. 准备工作

依赖 说明
Python 3.12 已安装
ffmpeg 处理视频音频,已安装
openai-whisper 离线语音转写

安装 Whisper:

py -3.12 -m pip install openai-whisper

2. 一键转换脚本

在桌面新建 run.py,写入以下代码:

import whisper

# 加载本地模型(完全离线,无网络依赖)
model = whisper.load_model("base")

# 转写视频(指定中文识别)
result = model.transcribe(
    r"C:\Users\admin\Desktop\2021-09-08 18.24.35 850371713\meeting_01.mp4",
    language="zh"
)

# 生成 Markdown 文件到指定目录
with open(r"C:\Users\admin\Desktop\output\meeting_01.md", "w", encoding="utf-8") as f:
    f.write("# 会议语音转文字\n\n")
    f.write(result["text"])

3. 运行命令

py -3.12 "C:\Users\admin\Desktop\run.py"

📝 关键细节说明

模型下载

首次运行会自动下载 base 模型(约 139MB),下载完成后提示 FP16 is not supported on CPU 为正常警告,不影响转写。

输出结果

转写完成后,文件将自动生成在 C:\Users\admin\Desktop\output\meeting_01.md

后续优化

如果需要更结构化的 Markdown 格式,可对生成的 .md 文件再用 markitdown 做二次美化:

py -3.12 -m markitdown "C:\Users\admin\Desktop\output\meeting_01.md" -o "C:\Users\admin\Desktop\output\meeting_final.md"

💡 避坑总结

坑点 原因 解决办法
WinError 10060 MarkItDown 老版本强制连 OpenAI 改用 Whisper 本地离线转写
unrecognized arguments MarkItDown 版本不支持本地参数 放弃命令行参数,改用 Python 脚本方式
模型校验和错误 缓存损坏 删除 C:\Users\admin\.cache\whisper 文件夹
posted @ 2026-04-27 15:12  okkk!!!  阅读(78)  评论(0)    收藏  举报