ChatGLM2-Voice-Cloning

6小时前发布 1 0 0

声音克隆和对话交互。它允许用户与喜欢的角色进行沉浸式对话,通过使用ChatGLM2模型和SadTalker模型来生成对话内容,并结合声音克隆技术实现角色的真实声音

语言:
zh
收录时间:
2026-08-31
ChatGLM2-Voice-CloningChatGLM2-Voice-Cloning

ChatGLM2-Voice-Cloning主要用于进行声音克隆和对话交互。它允许用户与喜欢的角色进行沉浸式对话,通过使用ChatGLM2模型和SadTalker模型来生成对话内容,并结合声音克隆技术实现角色的真实声音。

数据统计

相关导航

FaceChain

FaceChain

FaceChain是一个可以将自己的照片上传并生成数字孪生的应用程序。它使用了多个模型,包括面部检测模型、图像旋转模型、人体解析模型、肤色修饰模型等。在训练阶段,用户可以上传清晰的面部区域图像,输出Face LoRA模型。在推断阶段,基于面部LoRA模型和样式LoRA模型生成个人肖像图像,然后进一步改善肖像图像的面部细节。你可以通过FaceChain的Python脚本或熟悉的Gradio界面训练你的数字孪生模型并生成照片,也可以直接通过ModelScope Studio体验FaceChain。该项目由阿里达摩院开发。
Summari

Summari

Summari是一款专注于为出版商提供文本总结API的软件,其提供贴心、精准的文本总结服务,以确保准确性和快速阅读格式。Summari团队非常敏捷,能够快速支持客户的自定义需求。通过Summari,读者可以使用更少的精力和跳转获得更多信息。另外,人工智能在各个领域的应用也在不断地增加,包括抄袭检测、工作场所决策、乳腺癌检测等。同时,人工智能还成功预测了最佳影片奖。
Chidori

Chidori

Chidori 是一种用于构建人工智能代理的反应式运行时。它为构建具有反应性、可观察性和鲁棒性的人工智能代理提供了一个框架。它支持使用 Node.js、Python 和 Rust 构建代理。 它目前处于 alpha 阶段,尚未准备好投入生产使用。我们将继续根据反馈意见做出重大修改。 – 从头开始构建代理 – 运行时由 Rust 编写,开箱即支持 Python 和 Node.js – 构建可实际运行的代理 – LLM 缓存可最大限度地降低开发成本 – 针对长时间运行的人工智能工作流进行了优化 – 嵌入式代码解释器 – 支持时间旅行调试