08 2026 档案
摘要:今天周末在家无事,我把 Audio8 的两个模型(`Audio8 0.1B ONNX INT8`,`Audio8 0.6B ONNX INT4`)给整合了一下到 [OddTTS](https://oddmeta.net/docs/oddtts "OddTTS"),并在我的笔记本上跑了一下,感觉效果还可以
阅读全文
摘要:
在过去的这三个星期里,小奥录音的更新,涵盖新功能、体验优化、问题修复和代码重构四大方面。
阅读全文
在过去的这三个星期里,小奥录音的更新,涵盖新功能、体验优化、问题修复和代码重构四大方面。
阅读全文
摘要:前阵子公司一位大佬跟我推荐了一下 [Qwen3-ASR],平时在公司忙成狗也没时间来测试,周末回家给整合了一下到 [OddASR],并简单的测试了一下。
阅读全文
摘要:
考虑到 OddTTS 实际也就是国内偶尔有人会用一下,于是我就动手把模型下载部分的逻辑整个重写了一下,同时加入 HuggingFace 和 ModelScope 的下载,先用 HuggingFace 去下载,如果下载失败再 fallback 到 ModelScope 下载。
阅读全文
考虑到 OddTTS 实际也就是国内偶尔有人会用一下,于是我就动手把模型下载部分的逻辑整个重写了一下,同时加入 HuggingFace 和 ModelScope 的下载,先用 HuggingFace 去下载,如果下载失败再 fallback 到 ModelScope 下载。
阅读全文
摘要:
最近两个周末,一边改 OddASR,一边陆陆续续的用 OddASR 再来一点点完善小奥录音的各项功能,今天向pypi发布了个阶段性的版本 `v0.1.10` 。然后这里汇总一下与上个版本相比做的一些修改、调整与完善,简单讲的话主要就是:围绕实时字幕、导出功能、说话人识别、AI纪要等核心体验进行了一些升级。具体看下面。
阅读全文
最近两个周末,一边改 OddASR,一边陆陆续续的用 OddASR 再来一点点完善小奥录音的各项功能,今天向pypi发布了个阶段性的版本 `v0.1.10` 。然后这里汇总一下与上个版本相比做的一些修改、调整与完善,简单讲的话主要就是:围绕实时字幕、导出功能、说话人识别、AI纪要等核心体验进行了一些升级。具体看下面。
阅读全文
摘要:
本次更新的核心工作集中在**说话人分离(Speaker Diarization)**的配置化与请求级可控上,同时围绕**实时转写首字时延 / 返回速度**、**低配硬件可运行性**、**Web 前端体验**做了多处优化,并修复了 WebSocket 在 HTTPS 环境下的兼容性问题。
阅读全文
本次更新的核心工作集中在**说话人分离(Speaker Diarization)**的配置化与请求级可控上,同时围绕**实时转写首字时延 / 返回速度**、**低配硬件可运行性**、**Web 前端体验**做了多处优化,并修复了 WebSocket 在 HTTPS 环境下的兼容性问题。
阅读全文
摘要:如果你在找一个**中文准确率高于 Whisper、且兼容 OpenAI API、可私有化部署**的语音识别服务,OddASR v2.5.1 值得一试
阅读全文
浙公网安备 33010602011771号