Wunjo

6小时前发布 1 0 0

一个高级语音和Deepfake神经网络工具。功能: * 可以合成和克隆英语、俄语和中文的声音,同时支持实时语音识别。 * 能深度伪造面部和嘴唇动画,并使用一张照片进行人脸交换。 * 通过文本提示改变视频,进行分割和修饰。 * 具有语音合成、声音克隆、实时语音识别、多对话创建、视频到视频转换、深度伪造动画、AI修饰工具、自动分割掩码等功能...

语言:
zh
收录时间:
2026-08-31

一个高级语音和Deepfake神经网络工具。功能: * 可以合成和克隆英语、俄语和中文的声音,同时支持实时语音识别。 * 能深度伪造面部和嘴唇动画,并使用一张照片进行人脸交换。 * 通过文本提示改变视频,进行分割和修饰。 * 具有语音合成、声音克隆、实时语音识别、多对话创建、视频到视频转换、深度伪造动画、AI修饰工具、自动分割掩码等功能。 * 支持英语、俄语、中文和西班牙语等多种语言。 * 适用于初学者和专业人士。 * 保护用户隐私。 * 应用于广告配音、游戏角色配音、有声书朗读和深度伪造项目等应用场景。 * 需要Python 3.10和ffmpeg作为运行环境。 * 由Wladislav Radchenko进行开发和维护。

数据统计

相关导航

Khoj

Khoj

Khoj是一个开源AI个人助手,通过分析您的个人文本或图像数据来提供服务。您可以选择自行托管Khoj,并开始进行搜索、与您的文档、Markdown、PDF笔记进行交互。Khoj致力于帮助您更有效地利用您的数据。 目标用户: 需要管理和搜索个人知识库的人群,希望通过与组织、Markdown、PDF笔记进行交互来提高工作效率的人群。 产品优势: 1. 快速且准确的语义搜索 2. 与各类文档、Markdown、PDF笔记的交互功能 3. 自定义插件扩展功能,满足用户个性化需求
UniControl

UniControl

UniControl 是 Salesforce 公司开发的一个开源项目,它是一个统一可控的视觉生成模型。 功能特点: 统一视觉生成:UniControl 提供了一个统一的框架来进行视觉生成任务,例如图像生成、图像编辑、图像风格转换等。它为用户提供了强大的图像生成能力。 可控生成:UniControl 具有可控的生成能力,用户可以通过输入不同的控制参数来控制生成的图像风格、内容或其他特征。这使用户可以根据自己的需求进行个性化的图像生成。 开源项目:UniControl 是一个开源项目,意味着用户可以自由地访问、使用和贡献代码。这使得开发者可以更加灵活地使用和扩展 UniControl。
视频翻译配音

视频翻译配音

一个免费开源用于编辑和配音视频字幕的工具。用户在生成字幕后,可以轻松地修改它们,并重新生成配音。该工具提供了多种由edgeTTS提供的配音角色,并支持openai的TTS模型配音。此外,它还集成了google、chatGPT、DeepL、Baidu、DeepLX、Gemini和tencent等多种语音识别和翻译工具,以提供全面的服务。除了视频翻译和配音工具,该网站还提供了其他相关的开源项目,如声音克隆工具、语音识别工具和人声背景乐分离工具等。