DeepFaceLab

7小时前发布 1 0 0

提供易于使用的界面,用于创建高质量的深度伪造视频

语言:
zh
收录时间:
2026-08-31
DeepFaceLabDeepFaceLab

提供易于使用的界面,用于创建高质量的深度伪造视频

数据统计

相关导航

SillyTavernAI角色聊天界面

SillyTavernAI角色聊天界面

SillyTavern(或简称 ST)是一个本地安装的用户界面,允许您与文本生成 LLM、图像生成引擎和 TTS 语音模型进行交互。 一个可以本地部署的虚拟角色聊天软件,支持多种虚拟角色,也可以自己创造角色,后台可以连多种不同LLM,比如OpenAI、Claude、Llama等,支持TTS(文字转语音) 支持中文、英文、日文、韩文等多语言 由于 SillyTavern 只是一个界面,您需要访问 LLM 后端才能进行推理。您可以使用 AI Horde 进行即时聊天。除此之外,我们还支持许多其他本地和基于云的 LLM 后端:兼容 OpenAI 的 API、KoboldAI、Tabby 等等。您可以在 文档 中了解更多关于我们支持的 API 的信息。 硬件要求极低:任何支持 NodeJS 18 或更高版本的设备均可运行,(电脑端、手机端均可运行下载) 如果您打算在本地机器上进行 LLM 推理,我们建议您使用 3000 系列 NVIDIA 显卡,并至少配备 6GB VRAM。更多详情,请查看您后端的文档。 SillyTavern 围绕”AI角色卡片”的概念构建。角色卡片是一系列设定 LLM 行
GPT-Pilot

GPT-Pilot

GPT-Pilot不仅仅是一个简单的AI工具,而是一个能够从头到尾执行整个开发流程的全能助手。从零开始,它能够独立编写代码、配置开发环境、管理任务,甚至解决复杂的开发问题。 在编码环节,GPT-Pilot具备强大的自动化编码能力。无论是前端、后端还是数据库代码,它都能快速生成,大大提高了开发效率。 在开发过程中,GPT-Pilot与开发者的交流是一大亮点。你可以告诉它想要创建的应用类型,它会通过对话方式澄清需求,并确保开发方向与预期一致。此外,它还能自动设置和调整开发环境,处理各种任务和配置,甚至自动安装所需的库和工具。 更令人惊叹的是,GPT-Pilot不仅能编写代码,还能根据开发者描述创建明确的产品和技术要求。在整个开发过程中,它都会分阶段完成项目,并及时寻求反馈,以确保项目进展顺利。 当然,开发过程中难免会遇到问题。GPT-Pilot同样具备强大的调试和问题解决能力。当遇到难题时,它会主动与开发者交流,共同寻找解决方案。 为了更好地服务于开发者,GPT-Pilot还推出了VS Code扩展。这使得它不仅仅是一个简单的自动完成或帮助工具,而是一个能够真正与开发者合作、共同完成开发任
HierVST

HierVST

HierVST 是一种分层自适应零样本语音风格转换模型,它具备以下功能特点: 零样本语音风格转换:HierVST 可以在没有目标说话者语音数据的情况下,将一个新的说话者的语音风格转换为目标风格。这意味着即使没有目标说话者的语音样本,HierVST 也可以生成具有目标风格的语音。 分层自适应结构:HierVST 使用分层自适应生成器,逐步生成音高表示和波形音频,从而实现逐步转换语音的能力。这种结构让模型能够适应新的语音风格,并逐步进行转换。 自监督表示学习:HierVST 仅使用语音数据集进行训练,而无需使用文本转录。它采用了层次变分推断和自监督表示学习的方法,提高了模型在音频表示上的性能。 性能优于其他模型:在零样本语音风格转换场景中,HierVST 的实验结果表明其性能优于其他 VST 模型,如 AutoVC、VoiceMixer、DiffVC、Speech Resynthesis 和 YourTTS。
FreeU

FreeU

FreeU是一个开源项目,该项目由ChenyangSi创建。它的目标是在Diffusion U-Net中提供免费的资源。 Diffusion U-Net是一个用于图像分割的深度学习模型。它基于U-Net架构,并通过将扩散过程与传统的卷积神经网络相结合,提供了更好的图像分割结果。 FreeU项目允许开发人员免费访问和使用Diffusion U-Net,无需支付任何费用。这为开发人员提供了方便和实惠的方式来学习和应用图像分割技术。
Buzz:离线开源免费语音转文字(字幕) 翻译站点

Buzz:离线开源免费语音转文字(字幕) 翻译站点

Whisper 是一种通用语音识别模型。它利用各种大型数据集上的音频进行训练,也是一个多任务模型,可以执行多语言语音识别以及语音翻译和语言识别。 在第一次使用 Buzz 的时候,会下载 Whisper 的模型,根据不同的质量要求,模型尺寸也非常可观: Whisper模型存储在~/.cache/wilsper中。 Whisper.cpp模型存储在~/Library/Caches/Buzz(Mac OS)、~/.cache/Buzz(Unix)或C:Users<username>AppDataLocalBuzzBuzzcache(Windows)中。 Hugging 模型存储在~/.cache/huggingface/hub中。 https://github.com/chidiwilliams/buzz
gpt-crawler

gpt-crawler

用于从URL生成知识文件,以创建您自己的自定义GPT模型。 功能点: 1. **网站爬虫**:可从指定的URL爬取网站内容,为GPT模型提供学习和生成知识的素材。 2. **生成知识文件**:爬取的内容不仅被存储,还将被转化成知识文件,这些文件可以用来培训你自己的GPT模型。 3. **自定义GPT模型**:利用生成的知识文件,用户可以定制自己的GPT模型,以便生成特定类型的文本。 4. **MIT许可证**:gpt-crawler是在MIT许可下发布的,这意味着您可以自由地使用,复制,修改,合并,发布,分发,再许可,或者销售这个软件。