dot

dot

dot是一个开源的深度伪造工具包,用于生成逼真的深度伪造视频和图像。该工具包是由Sensity AI开发的,可以在GitHub上免费下载和使用 。使用dot需要安装一些依赖库,如conda和pip,以及下载一些模型文件 。该工具包是基于多个开源项目构建的,包括first-order-model、avatarify-python、SimSwap和GPEN等 。Sensity AI是一个人工智能公司,其GitHub页面上还有其他的开源项目 。如果使用dot,需要遵守其所依赖的开源库的许可证 。
20
OpenVoiceOS

OpenVoiceOS

OpenVoiceOS 是一个社区支持的 Linux 发行版,专门用于展示开源语音 AI 在各种设备上的强大功能 。它基于 Raspberry Pi,旨在为智能家居和机器人控制提供语音控制能力 。OpenVoiceOS 提供了详细的安装、配置和使用说明,包括如何在 Raspberry Pi 上安装和配置系统、训练自己的语音助手以及添加语音控制功能等。此外,OpenVoiceOS 还提供了一个基于云的语音识别服务,用户可以使用该服务来处理和识别来自语音助手的请求。该系统支持多种语言,包括英语、法语、西班牙语、葡萄牙语、德语等。总之,OpenVoiceOS 是一个实用的工具,可帮助用户将语音控制添加到他们的项目中,无论是构建智能家居还是机器人,都可以实现更好的交互和控制 。
10
clone-voice

clone-voice

这是一个声音克隆工具,可使用任何人类音色,将一段文字合成为使用该音色说话的声音,或者将一个声音使用该音色转换为另一个声音。 使用非常简单,没有N卡GPU也可以使用,下载预编译版本,双击 app.exe 打开一个web界面,鼠标点点就能用。 支持 中、英、日、韩、法、德、意等16种语言,可在线从麦克风录制声音。 为保证合成效果,建议录制时长5秒到20秒,发音清晰准确,不要存在背景噪声。 英文效果很棒,中文效果还凑合。
10
StreamDiffusion

StreamDiffusion

StreamDiffusion是一种专门为实时图像生成服务设计的扩散模型管道,显著地提升了实时图像生成的性能。 在模型和输出帧率方面,它支持SD-turbo模型,1步,t2i每秒帧率106,i2i每秒帧率93。同时,它也支持LCM-LoRA+KohakuV2模型,4步,t2i每秒帧率38,i2i每秒帧率37。 其主要特点包括: 1. 通过高效的批处理操作实现数据处理流程的优化。 2. 改进的指导机制可以最大程度地减少计算冗余。 3. 通过先进的过滤技术提高GPU利用效率。 4. 有效管理输入和输出操作,实现更顺畅的执行。 5. 优化缓存策略以加速处理。 6. 利用各种工具进行模型优化和性能提升。 这些特点使得StreamDiffusion成为一种高效、实时的图像生成服务扩散模型管道。
10