OpenVoiceOS

OpenVoiceOS

OpenVoiceOS 是一个社区支持的 Linux 发行版,专门用于展示开源语音 AI 在各种设备上的强大功能 。它基于 Raspberry Pi,旨在为智能家居和机器人控制提供语音控制能力 。OpenVoiceOS 提供了详细的安装、配置和使用说明,包括如何在 Raspberry Pi 上安装和配置系统、训练自己的语音助手以及添加语音控制功能等。此外,OpenVoiceOS 还提供了一个基于云的语音识别服务,用户可以使用该服务来处理和识别来自语音助手的请求。该系统支持多种语言,包括英语、法语、西班牙语、葡萄牙语、德语等。总之,OpenVoiceOS 是一个实用的工具,可帮助用户将语音控制添加到他们的项目中,无论是构建智能家居还是机器人,都可以实现更好的交互和控制 。
10
clone-voice

clone-voice

这是一个声音克隆工具,可使用任何人类音色,将一段文字合成为使用该音色说话的声音,或者将一个声音使用该音色转换为另一个声音。 使用非常简单,没有N卡GPU也可以使用,下载预编译版本,双击 app.exe 打开一个web界面,鼠标点点就能用。 支持 中、英、日、韩、法、德、意等16种语言,可在线从麦克风录制声音。 为保证合成效果,建议录制时长5秒到20秒,发音清晰准确,不要存在背景噪声。 英文效果很棒,中文效果还凑合。
10
Wunjo

Wunjo

一个高级语音和Deepfake神经网络工具。功能: * 可以合成和克隆英语、俄语和中文的声音,同时支持实时语音识别。 * 能深度伪造面部和嘴唇动画,并使用一张照片进行人脸交换。 * 通过文本提示改变视频,进行分割和修饰。 * 具有语音合成、声音克隆、实时语音识别、多对话创建、视频到视频转换、深度伪造动画、AI修饰工具、自动分割掩码等功能。 * 支持英语、俄语、中文和西班牙语等多种语言。 * 适用于初学者和专业人士。 * 保护用户隐私。 * 应用于广告配音、游戏角色配音、有声书朗读和深度伪造项目等应用场景。 * 需要Python 3.10和ffmpeg作为运行环境。 * 由Wladislav Radchenko进行开发和维护。
10
视频翻译配音

视频翻译配音

一个免费开源用于编辑和配音视频字幕的工具。用户在生成字幕后,可以轻松地修改它们,并重新生成配音。该工具提供了多种由edgeTTS提供的配音角色,并支持openai的TTS模型配音。此外,它还集成了google、chatGPT、DeepL、Baidu、DeepLX、Gemini和tencent等多种语音识别和翻译工具,以提供全面的服务。除了视频翻译和配音工具,该网站还提供了其他相关的开源项目,如声音克隆工具、语音识别工具和人声背景乐分离工具等。
10
字幕组机翻小助手软件版

字幕组机翻小助手软件版

解决2个问题: (备注:如果你对字幕质量要求很高,想要信达雅,最好还是雇人翻译。机器翻译的准确度区间 50%~85%) 软件分为两个版本: 重要说明:专业版的”无上限”指的是软件本身不做任何使用量的限制(免费版会做限制,参考上一段说明) “无上限”和服务商没有任何关系,”无上限”不等于免费, 服务商该怎么计费还是怎么计费,服务商怎么收费不会受到软件是”免费版”还是”专业版”的影响。 举个实际例子,阿里云的语音转文字服务,每天的免费额度是2小时(有效期3个月) 假设你连续5天,每天都把2小时的免费额度用完, 那么在第6天,虽然阿里云的免费额度还有,但是软件的免费版10小时已经到了,就会提示无法继续使用了。 除非等到下个月1号重置,或者随便买一个专业版(比如7天的专业版) 就可以继续使用了。 查看表格: 免费额度和价格 说明:所有语音转文字服务商都支持”任务历史”功能, 意思是只要文件成功传给服务商,服务商开始处理了,那么就可以关掉软件,不需要一直开着。 过一阵子再回来看任务做完没 基本概念: 推荐先申请 百度 ,因为免费额度无限,而且注册流程较快,无需等待人工审核,照着”使用教程”一步步
10