listenhub-tts

Featured

使用 ListenHub API 将文本转换为语音(TTS)。支持三种模式:快速合成(/v1/tts)、 多角色脚本(/v1/speech)、长文本流式合成(/v1/flow-speech/episodes)。 音色未指定时自动获取音色列表供用户选择,默认使用 chat-girl-105-cn(晓曼)。 Use when user says: "tts", "text to speech", "语音合成", "文字转语音", "朗读", "生成语音", "生成音频", "转音频", "text to audio"

AI & Automation 235 stars 32 forks Updated 5 days ago MIT

Install

View on GitHub

Quality Score: 95/100

Stars 20%
79
Recency 20%
100
Frontmatter 20%
70
Documentation 15%
100
Issue Health 10%
50
License 10%
100
Description 5%
100

Skill Content

# ListenHub TTS: 文本转语音 使用 ListenHub OpenAPI 将文本转换为语音。支持三种合成模式,覆盖从短文本到长文本的全场景。 ## API 信息 - **Base URL:** `https://api.marswave.ai/openapi` - **认证:** `Authorization: Bearer $LISTENHUB_API_KEY`(从环境变量读取) - **前置检查:** 调用任何 API 前先确认 `LISTENHUB_API_KEY` 环境变量已设置,未设置则提示用户配置 ## 音色选择流程 ### 用户已明确指定音色 直接使用用户指定的 speakerId,跳过选择流程。 ### 用户未指定音色 1. 调用 `GET /v1/speakers/list?language=zh` 获取可用音色列表 2. 按 AskUserQuestion 展示音色列表供用户选择,格式如下: - 默认选中 `chat-girl-105-cn`(晓曼 dxqqq) - 列表展示:`{name}({gender},{speakerId})` - 附带每个音色的 demoAudioUrl 供参考 3. 用户确认后使用选定的 speakerId ### 默认音色 | 字段 | 值 | |------|-----| | speakerId | `chat-girl-105-cn` | | 名称 | 晓曼 dxqqq | ## 三种合成模式 ### 模式一:快速合成(短文本,单音色) **适用场景:** 短文本(< 1000 字),单音色,需要低延迟 **接口:** `POST /v1/tts` **请求体:** ```json { "text": "要合成的文本", "speakerId": "chat-girl-105-cn", "format": "mp3", "sampleRate": 24000, "speed": 1.0 } ``` | 参数 | 类型 | 必填 | 说明 | |------|------|------|------| | text | string | 是 | 要合成的文本 | | speakerId | string | 是 | 音色 ID | | format | string | 否 | 输出格式,默认 `mp3` | | sampleRate | int | 否 | 采样率,默认 `24000` | | speed | float | 否 | 语速,默认 `1.0`,范围 `0.5 ~ 2.0` | **响应:** 直接返回 MP3 二进制流(`Content-Type: audio/mpeg`) **调用示例:** ```bash curl -X POST "https://api.marswave.ai/openapi/v1/tts" \ -H "Authorization: Bearer $LISTENHUB_API_KEY" \ -H "Content-Type: application/json" \ -d '{"text": "你好世界", "speakerId": "chat-girl-105-cn"}' \ -o output.mp3 ``` ### 模式二:多角色脚本合成 **适用场景:** 多角色对话、播客、有声书片段,需要不同音色交替朗读 **接口:** `POST ...

Details

Author
smallnest
Repository
smallnest/goal-workflow
Created
3 months ago
Last Updated
5 days ago
Language
HTML
License
MIT

Similar Skills

Semantically similar based on skill content — not just same category

AI & Automation Listed

fish-tts

使用 Fish Audio API 把文字转成语音(TTS):朗读文本、生成配音/旁白、制作有声内容、把文章/台词/字幕/脚本转成 mp3/wav/pcm/opus 音频文件。当用户要求"文字转语音"、"语音合成"、"朗读这段话"、"把这段文字变成音频/MP3"、"配音"、"AI 语音"、"有声书"或任何需要把文本变成人声文件的需求时,都使用本技能——即使用户没有提到 Fish Audio 或 API。当用户要求带情绪/带感情/用某种语气朗读、想控制语音情绪(开心、生气、悲伤等)、加笑声/叹气/停顿等效果时也使用本技能。本技能自带零依赖 Python 脚本和 config.json,允许用户配置 API key、TTS 模型(s2.1-pro / s2.1-pro-free / s2-pro / s1)、默认音色(reference_id)以及格式、码率、语速、音量、延迟等全部常用参数;支持在文本中插入情绪与语气标记(S2 系列用 `[方括号]` 自由自然语言、s1 用 `(圆括号)` 英文固定标签)控制语音表现力。

0 Updated today
Sallyn0225
AI & Automation Solid

wjs-voicedrop-reading-aloud

Use when the user wants text turned into an audiobook / read aloud — they give a passage, a file, a URL, or a VoiceDrop article and want an mp3 narration with expressive voices. Triggers — "做成有声书", "朗读出来", "读给我听", "念出来", "read aloud", "/wjs-voicedrop-reading-aloud".

123 Updated today
jianshuo
AI & Automation Featured

doubao-tts

Generate high-quality speech audio using Doubao (豆包/Volcengine) TTS API. Use this skill when the user asks to generate audio, podcasts, voiceovers, or text-to-speech output.

954 Updated 1 weeks ago
xvirobotics