声声工坊

7小时前发布 1 0 0

声声工坊(Sssay)是一款轻量化AI语音合成TTS工具,主打高效声音克隆、语音生成与声音识别。声声工坊提供一套中文声音生产工具:上传或录制 5-15 秒参考音频即可生成相近音色,也可以通过 Prompt 创建新音色;支持方言/风格短提示、流式与非流式 TTS、声音识别、SRT/VTT 字幕和时间轴导出。

语言:
zh
收录时间:
2026-08-31
声声工坊声声工坊

声声工坊提供高相似度声音克隆、Prompt 音色创建、流式语音生成和声音识别,一小段干净人声就能开始。

数据统计

相关导航

DubbingX智声云配

DubbingX智声云配

DubbingX智声云配是一款AI配音和AI语音生成工具,由智声悦和(杭州)科技有限公司推出。DubbingX智声云配专注于多情绪、高拟真语音生成及跨平台应用,为用户提供文本转语音、音频编辑、语音转换、歌声转换及音色克隆等多种功能。DubbingX智声云配集成了近【2500种细分情绪语态】,凭借高度拟真的声音表现能力,可以广泛适用于游戏、动画、影视、有声书、机器人、虚拟人等场景,全面满足您的业务与产品所需。
GPT-SoVITS

GPT-SoVITS

零样本文本到语音(TTS): 输入5秒的声音样本,即刻体验文本到语音转换。 少样本TTS: 仅需1分钟的训练数据即可微调模型,提升声音相似度和真实感。 跨语言支持: 支持与训练数据集不同语言的推理,目前支持英语、日语和中文。 WebUI工具: 集成工具包括声音伴奏分离、自动训练集分割、中文自动语音识别(ASR)和文本标注,协助初学者创建训练数据集和GPT/SoVITS模型。 介绍视频 https://www.bilibili.com/video/BV12g4y1m7Uw/ 来自B站up主:花儿不哭