Insanely Fast Whisper 一个使用OpenAI的Whisper Large v2进行语音识别的脚本,能够在短短10分钟内转录300分钟的音频 。该项目的目标是提供一个简单的入口来运行推理和微调Whisper,用于自动语音识别(ASR) 。该项目还提供了一个CLI(命令行界面),可以在终端上进行100多种语言的数据翻译和转录 。 10 AI语音识别-音转文# AI开源项目# AI编程
AudioSep 功能特点: 分离任何你描述的音频:AudioSep 具备先进的音频分离算法,可以将输入的音频文件中的不同声音源分离出来。你只需描述想要分离的声音类型或源音,AudioSep 就能够根据描述进行准确分离。 官方实现:AudioSep 是由官方团队开发和维护的,因此可以保证其质量和功能的稳定性。 开源许可证:AudioSep 使用的是 MIT 开源许可证,这意味着你可以自由使用、修改和分发该工具。 易于使用:无论你是专业的音频处理人员还是新手,AudioSep 都提供了简单易用的界面和指令,让你能够快速上手并进行音频分离操作。 高度可定制:AudioSep 提供了丰富的参数和选项,可以根据你的需求进行各种调整和定制,以获得最佳的分离效果。 10 AI语音合成# AI开源项目# AI编程
ChatGLM2-Voice-Cloning 声音克隆和对话交互。它允许用户与喜欢的角色进行沉浸式对话,通过使用ChatGLM2模型和SadTalker模型来生成对话内容,并结合声音克隆技术实现角色的真实声音 10 AI声音克隆# AI开源项目# AI编程
MyShell MyShell 是一个去中心化的AI Agent生成平台,用于发现、创建和托管AI Agent智能体机器人。借助自主研发的自动语音识别(ASR)和文本转语音(TTS)能力模型,只需几秒钟即可将您的想法转化为 AI Agent智能体机器人。 10 AI语音识别-音转文# Agent工具# Agent智能体# AI 聊天问答
OpenVoiceOS OpenVoiceOS 是一个社区支持的 Linux 发行版,专门用于展示开源语音 AI 在各种设备上的强大功能 。它基于 Raspberry Pi,旨在为智能家居和机器人控制提供语音控制能力 。OpenVoiceOS 提供了详细的安装、配置和使用说明,包括如何在 Raspberry Pi 上安装和配置系统、训练自己的语音助手以及添加语音控制功能等。此外,OpenVoiceOS 还提供了一个基于云的语音识别服务,用户可以使用该服务来处理和识别来自语音助手的请求。该系统支持多种语言,包括英语、法语、西班牙语、葡萄牙语、德语等。总之,OpenVoiceOS 是一个实用的工具,可帮助用户将语音控制添加到他们的项目中,无论是构建智能家居还是机器人,都可以实现更好的交互和控制 。 10 AI语音识别-音转文# AI开源项目# AI编程
clone-voice 这是一个声音克隆工具,可使用任何人类音色,将一段文字合成为使用该音色说话的声音,或者将一个声音使用该音色转换为另一个声音。 使用非常简单,没有N卡GPU也可以使用,下载预编译版本,双击 app.exe 打开一个web界面,鼠标点点就能用。 支持 中、英、日、韩、法、德、意等16种语言,可在线从麦克风录制声音。 为保证合成效果,建议录制时长5秒到20秒,发音清晰准确,不要存在背景噪声。 英文效果很棒,中文效果还凑合。 10 AI声音克隆# AI开源项目# AI编程
Amphion Amphion是一个开源工具包,可实现语音、声音和歌唱功能。除了文字转语音功能,它还能将一首歌的声音换成另一个歌手的声音,并支持声音转换、歌声合成、文本到音频、文本到音乐等功能。 10 AI语音合成# AI开源项目# AI编程
Wunjo 一个高级语音和Deepfake神经网络工具。功能: * 可以合成和克隆英语、俄语和中文的声音,同时支持实时语音识别。 * 能深度伪造面部和嘴唇动画,并使用一张照片进行人脸交换。 * 通过文本提示改变视频,进行分割和修饰。 * 具有语音合成、声音克隆、实时语音识别、多对话创建、视频到视频转换、深度伪造动画、AI修饰工具、自动分割掩码等功能。 * 支持英语、俄语、中文和西班牙语等多种语言。 * 适用于初学者和专业人士。 * 保护用户隐私。 * 应用于广告配音、游戏角色配音、有声书朗读和深度伪造项目等应用场景。 * 需要Python 3.10和ffmpeg作为运行环境。 * 由Wladislav Radchenko进行开发和维护。 10 AI声音克隆# AI开源项目# AI编程
TTS-Voice-Wizard TTS语音向导是一种工具,允许用户通过微软Azure语音识别和TTS将语音转换为文本,然后再转换回语音 10 AI语音识别-音转文# 文本转语音# 语音生成# 语音转文本
视频翻译配音 一个免费开源用于编辑和配音视频字幕的工具。用户在生成字幕后,可以轻松地修改它们,并重新生成配音。该工具提供了多种由edgeTTS提供的配音角色,并支持openai的TTS模型配音。此外,它还集成了google、chatGPT、DeepL、Baidu、DeepLX、Gemini和tencent等多种语音识别和翻译工具,以提供全面的服务。除了视频翻译和配音工具,该网站还提供了其他相关的开源项目,如声音克隆工具、语音识别工具和人声背景乐分离工具等。 10 AI声音克隆# AI开源项目# AI编程
星野 星野app是MiniMax推出的一款功能强大的AI聊天机器人和智能对话工具,旨在为用户提供沉浸式的AI角色扮演体验,成为你在平行世界中的知心朋友、情感寄托。星野通过有趣的开放剧情和逼真的AI聊天,让你体验真正的聊天互动,无论是日常闲聊或语音聊天,星野ai都能满足你的需求。 10 AI语音合成# AI 应用软件# AI 聊天问答# AI 虚拟陪伴