[设计中] 最近在对接tts provider,但是它们都有自己的协议和字段,正在为其封装一套通用sdk

设计中

TTS VoiceInfo 字段:

 ```python
   @dataclass
   class VoiceInfo:
       # 核心标识
	   id: str 						# 系统内部ID
       voice_id: str              # voice_id, 调用 API 时使用
       name: str            # 可读名称, 如 "Steady Executive"

       # 语言 & 区域, 这里考虑到一个音色它支持多语言,或者一个语言下支持多方言。
       languages: list[str]        # ISO 639-1, 如 "zh", "en", "ja"
       locales: list[str] | None   # 方言/区域, 如 "zh-CN", "zh-HK", "en-AU"

       # 声纹特征
       gender: str          # "male" / "female"
       age_group: str       # "child", "youth", "adult", "elderly"

       # 风格描述
       style: list[str]     # 如 ["professional", "warm", "authoritative"]
       description: str     # 自然语言描述

       # 使用场景
       best_for: list[str]  # 如 ["narration", "news", "documentary"]

       # 来源
       source: str          # "system" / "voice_cloning" / "voice_generation"
	   provider: str      # "minimax" / "aliyun" / ......
posted @ 2026-07-25 15:16  LiusCraft  阅读(8)  评论(0)    收藏  举报