【开源】小奥录音一键包:纯私有化部署运行、支持录音、摘要、音字同步、说话人识别应有尽有
一、介绍
上个周末,天气预报是17级的超强台风天,结果实际上确跟上海插肩而过。而我在家手搓了一个录音工具,取名:OddMinutes,中文名称:小奥录音。
这个周末,天气预报小雨,局部地区雷阵雨,结果五角场被淹了、国金中心都漏水了。而我折腾了一个周末,整理了一个Windows绿色免安装的版本。让不懂代码的程序员也可以下载后一键运行小奥录音。
同时上线了一个 demo,具体可看这里:https://minutes.oddmeta.net
不废话,直接上介绍。
二、下载
三、运行
- 双击
oddminutes-standalone.7z解压到任意目录。 - 双击
OddMinutes\create_shortcut.bat创建桌面快捷方式。 - 双击
OddMinutes\OddMinutes.exe运行。
第一次运行时,会自动初始化数据库、创建数据库迁移文件、执行数据库迁移、创建超级用户、创建默认环境变量。
四、功能介绍
主界面如下:

创建会议
点击左上角的“创建会议”按钮,即可创建一个会议。

开始录音
点击开始录音,系统会跳出来一个提示框,让你选择要录制的音频。在这里通常需要:
- 勾选“同时分享系统音频”
- 选择“分享”

系统音频录的就是远端的音频。如果你不勾选“同时分享系统音频”的话,那远端其他人说的话是不会录制下来的。

正常情况下一个会议多数场景下是本地+远端,本地是你自己(你说的话要录下来),远端是其他人(其他人说的话也要录下来)。当然也有一些场景是大家坐在一起、面对面的沟通和交流,在这种情况下可不需要勾选"同时分享系统音频"。

停止录音
当会议结束了,点击停止录音。这样后端会自动开始做音频的合成、转换,并递交到 ASR 服务器,将音频转换为文字。
当 ASR 服务器返回文字后,系统会自动在界面上显示文字。

ASR转写
当 ASR 服务器返回文字后,系统会自动在界面上显示文字。
生成AI摘要
在将音频转换为文字后,点击生成AI摘要,系统会自动开始做 AI摘要。
小奥录音内置的几种常见会议的摘要模板,选择不同的模板,可生成不同格式的摘要。

音字对照回听/回看
转写好的文字,在转录界面,可进行音字对照的回听/回看操作。
- 回听:点文字播放对应文字的音频。
- 回看:点音频跳转到对应的文字。

五、系统设置
1. ASR 模型设置
最重要的设置之一
转录设置:这里需要你自己配置 ASR的服务器地址、API Key、模型名称
推荐使用 OddAsr 本地化部署,这样无需联网、安全、无任何费用。
(对硬件有一定的要求)
我提供了一个 demo 用的 OddAsr:
https://asr.oddmeta.net
注:十年前的老笔记本,请勿跑长音频的转录,超过2分钟的音频就大概率会转写超时。
当然,有钱的可以购买 ASR语音模型API,小奥录音可以支持所有兼容 OpenAI API的大模型,基本上,市面上所有的 ASR 模型 提供商都支持 OpenAI API 接口。

2. LLM 模型设置
最重要的设置之二
摘要摘要设置:这里需要你自己配置 LLM的服务器地址、API Key、模型名称
推荐使用 llama.cpp/Ollama 本地化部署,这样无需联网、安全、无任何费用。
(对硬件有一定的要求)
我提供了一个 demo 用的、来自硅基流动的免费 LLM 模型(Qwen3-8B,注册即可免费使用,支持 OpenAI API 接口,性能稳定,不想自己本地部署LLM模型的,可以趁他们还让白嫖,先免费用起来再说)。
当然,有钱的可以购买大参数的 LLM 模型API(免费的8B模型AI摘要的效果总是差强人意),小奥录音可以支持所有兼容 OpenAI API的大模型,基本上,市面上所有的 LLM 提供商都支持 OpenAI API 接口。

3. 模板设置
小奥录音内置了几种不同类型的会议的AI摘要的模板。并可支持用户自定义修改,或者自定义增加你需要的模板。

4. 音频设备
你可以选择要录制的音频设备。默认是麦克风。其中“系统音频”设备是录制远端的音频。
5. 外观主题
小奥录音提供现代亮色、科技暗色、温暖办公、专注暗色四种主题,你可以根据自己的喜好选择不同的主题。
6. 导入音频文件
点击左下角的“导入”按钮,可以将你已有的音频文件导入到小奥录音。
导入后该音频可以跟在小奥录音上录制的音频一样进行转文本,区分发言人,进行音字对照的回听回看,进行AI摘要处理。
支持导入各种常见的音频文件格式:
- MP3
- WAV
- AIFF
- FLAC
- OGG

7. 系统通知
点击左下角的通知按钮,可以查看最近的系统通知列表,以便对小奥录音当前、历史的运行情况有一个详细的了解。

8. 系统设置
点击左下角的“系统设置”按钮,可以查看和修改小奥录音的系统设置。
六、注意
本项目本身不提供ASR和LLM的模型及推理。需要你自己安装部署一下 ASR 模型和 LLM 模型。
- ASR 模型: 推荐使用 OddASR 本地化部署。如果不想自己本地安装ASR模型,也可以购买 阿里云百炼、小米MiMo、阶跃星辰、火山引擎等的ASR模型API。
- LLM 模型: 推荐自行 llama.cpp/Ollama本地化部署。如果不想自己本地安装部署LLM模型,同样也可以选择购买任意支持 OpenAI 兼容接口的LLM模型(市面上所有LLM服务商都支持)。
OddASR 本地化部署
请参考文档:OddASR 本地化部署
llama.cpp/Ollama 本地化部署
请参考文档:llama.cpp/Ollama 本地化部署
小奥录音绿色免安装、一键运行包,折腾一整天,终于可以来一个版本了。这个周末,天气预报小雨,局部地区雷阵雨,结果五角场被淹了、国金中心都漏水了。而我折腾了一个周末,整理了一个Windows绿色免安装的版本。让不懂代码的程序员也可以下载后一键运行小奥录音。
浙公网安备 33010602011771号