08 2026 档案

摘要:今天周末在家无事,我把 Audio8 的两个模型(`Audio8 0.1B ONNX INT8`,`Audio8 0.6B ONNX INT4`)给整合了一下到 [OddTTS](https://oddmeta.net/docs/oddtts "OddTTS"),并在我的笔记本上跑了一下,感觉效果还可以 阅读全文
posted @ 2026-08-29 19:13 程序员老奥 阅读(17) 评论(0) 推荐(0)
摘要:OddMinutes 小奥录音更新:支持摘要编辑、修复实时字幕功能异常、合并会议纪要报错等在过去的这三个星期里,小奥录音的更新,涵盖新功能、体验优化、问题修复和代码重构四大方面。 阅读全文
posted @ 2026-08-23 10:50 程序员老奥 阅读(12) 评论(0) 推荐(0)
摘要:前阵子公司一位大佬跟我推荐了一下 [Qwen3-ASR],平时在公司忙成狗也没时间来测试,周末回家给整合了一下到 [OddASR],并简单的测试了一下。 阅读全文
posted @ 2026-08-22 20:00 程序员老奥 阅读(8) 评论(0) 推荐(0)
摘要:OddTTS 更新:语音模型下载优化,同时支持 HuggingFace 与 ModelScope 源考虑到 OddTTS 实际也就是国内偶尔有人会用一下,于是我就动手把模型下载部分的逻辑整个重写了一下,同时加入 HuggingFace 和 ModelScope 的下载,先用 HuggingFace 去下载,如果下载失败再 fallback 到 ModelScope 下载。 阅读全文
posted @ 2026-08-15 22:55 程序员老奥 阅读(7) 评论(0) 推荐(0)
摘要:小奥录音更新:实时字幕500ms、说话人分离优化、导出pdf、加入安全认证等最近两个周末,一边改 OddASR,一边陆陆续续的用 OddASR 再来一点点完善小奥录音的各项功能,今天向pypi发布了个阶段性的版本 `v0.1.10` 。然后这里汇总一下与上个版本相比做的一些修改、调整与完善,简单讲的话主要就是:围绕实时字幕、导出功能、说话人识别、AI纪要等核心体验进行了一些升级。具体看下面。 阅读全文
posted @ 2026-08-09 00:28 程序员老奥 阅读(12) 评论(0) 推荐(0)
摘要:OddASR v2.5.5 版本更新:支持指定最大说话人分离数量、优化时延本次更新的核心工作集中在**说话人分离(Speaker Diarization)**的配置化与请求级可控上,同时围绕**实时转写首字时延 / 返回速度**、**低配硬件可运行性**、**Web 前端体验**做了多处优化,并修复了 WebSocket 在 HTTPS 环境下的兼容性问题。 阅读全文
posted @ 2026-08-08 00:59 程序员老奥 阅读(12) 评论(0) 推荐(0)
摘要:如果你在找一个**中文准确率高于 Whisper、且兼容 OpenAI API、可私有化部署**的语音识别服务,OddASR v2.5.1 值得一试 阅读全文
posted @ 2026-08-01 21:30 程序员老奥 阅读(22) 评论(0) 推荐(0)