HivisionIDPhoto

6小时前发布 1 0 0

HivisionIDPhoto 是一款基于 AI 的轻量级证件照制作工具,能智能识别和抠图,快速生成符合多种规格的证件照。支持自定义背景色和尺寸,未来还将推出美颜和智能换正装功能。用户可通过 Docker 部署,轻松搭建本地服务。GitHub 上提供源代码和在线体验。

语言:
zh
收录时间:
2026-08-31
HivisionIDPhotoHivisionIDPhoto

HivisionIDPhoto 是一款基于 AI 的轻量级证件照制作工具,能智能识别和抠图,快速生成符合多种规格的证件照。支持自定义背景色和尺寸,未来还将推出美颜和智能换正装功能。用户可… HivisionIDPhoto 旨在开发一种实用、系统性的证件照智能制作算法。 它利用一套完善的AI模型工作流程,实现对多种用户拍照场景的识别、抠图与证件照生成。 HivisionIDPhoto 可以做到: github:https://github.com/Zeyi-Lin/HivisionIDPhotos 最近更新: 在线体验: 、 、 2024.09.14: Gradio Demo增加 自定义DPI 功能,增加日语和韩语支持,增加 调整亮度、对比度、锐度 功能 2024.09.12: Gradio Demo增加 美白 功能 | API接口增加 加水印 、 设置照片KB值大小 、 证件照裁切 2024.09.11: Gradio Demo增加 透明图显示与下载 功能 2024.09.10: 增加新的 人脸检测模型 Retinaface-resnet50,以稍弱于mtcnn的速度换取更高的检测精度,推荐使用 2024.09.09: 增加新的 抠图模型 BiRefNet-v1-lite | Gradio增加 高级参数设置 和 水印 选项卡 2024.09.08: 增加新的 抠图模型 RMBG-1.4 | ComfyUI工作流 – HivisionIDPhotos-ComfyUI 贡献 by AIFSH 2024.09.07: 增加 人脸检测API选项 Face++ ,实现更高精度的人脸检测 2024.09.06: 增加新的抠图模型 modnet_photographic_portrait_matting.onnx

数据统计

相关导航

HierVST

HierVST

HierVST 是一种分层自适应零样本语音风格转换模型,它具备以下功能特点: 零样本语音风格转换:HierVST 可以在没有目标说话者语音数据的情况下,将一个新的说话者的语音风格转换为目标风格。这意味着即使没有目标说话者的语音样本,HierVST 也可以生成具有目标风格的语音。 分层自适应结构:HierVST 使用分层自适应生成器,逐步生成音高表示和波形音频,从而实现逐步转换语音的能力。这种结构让模型能够适应新的语音风格,并逐步进行转换。 自监督表示学习:HierVST 仅使用语音数据集进行训练,而无需使用文本转录。它采用了层次变分推断和自监督表示学习的方法,提高了模型在音频表示上的性能。 性能优于其他模型:在零样本语音风格转换场景中,HierVST 的实验结果表明其性能优于其他 VST 模型,如 AutoVC、VoiceMixer、DiffVC、Speech Resynthesis 和 YourTTS。
GPT-Pilot

GPT-Pilot

GPT-Pilot不仅仅是一个简单的AI工具,而是一个能够从头到尾执行整个开发流程的全能助手。从零开始,它能够独立编写代码、配置开发环境、管理任务,甚至解决复杂的开发问题。 在编码环节,GPT-Pilot具备强大的自动化编码能力。无论是前端、后端还是数据库代码,它都能快速生成,大大提高了开发效率。 在开发过程中,GPT-Pilot与开发者的交流是一大亮点。你可以告诉它想要创建的应用类型,它会通过对话方式澄清需求,并确保开发方向与预期一致。此外,它还能自动设置和调整开发环境,处理各种任务和配置,甚至自动安装所需的库和工具。 更令人惊叹的是,GPT-Pilot不仅能编写代码,还能根据开发者描述创建明确的产品和技术要求。在整个开发过程中,它都会分阶段完成项目,并及时寻求反馈,以确保项目进展顺利。 当然,开发过程中难免会遇到问题。GPT-Pilot同样具备强大的调试和问题解决能力。当遇到难题时,它会主动与开发者交流,共同寻找解决方案。 为了更好地服务于开发者,GPT-Pilot还推出了VS Code扩展。这使得它不仅仅是一个简单的自动完成或帮助工具,而是一个能够真正与开发者合作、共同完成开发任