LLaVA

LLaVA

LLaVA是一个大型多模态模型,旨在实现通用视觉和语言理解。它端到端训练,可以理解文本和图像,并在聊天中灵活运用这些信息。LLaVA在多模态指令跟随数据集上与GPT-4表现相似,相对分数达到85.1%。在Science QA上,其准确率达到92.53%。LLaVA模型将预训练的视觉编码器(CLIP ViT-L/14)与大型语言模型(Vicuna)通过简单投影矩阵连接。训练分为两个阶段:阶段1只更新投影矩阵,基于CC3M子集进行特征对齐预训练;阶段2更新投影矩阵和大型语言模型进行端到端微调,适应日常用户导向应用和科学问答场景。
10
Shutter Encoder

Shutter Encoder

Shutter Encoder是一款视频、音频和图像转换软件,基于FFmpeg和其他优秀工具设计,旨在尽可能方便和高效。它被视频编辑人员设计,目标是尽可能方便和高效。Shutter Encoder支持几乎所有你听过的编解码器,以及许多你没听过的编解码器。 Shutter Encoder提供了一系列功能,包括: 你可以在Shutter Encoder的官方网站https://www.shutterencoder.com/en/上下载该软件。根据你的操作系统选择相应的版本进行下载,比如Windows系统的INSTALL VERSION和PORTABLE VERSION,它们的区别在于一个需要安装,一个解压后就可以使用。 在使用过程中,如果发现软件启动时进度条卡住不动,可以检查路径是否含有中文字符。此外,为了获得最佳性能,建议开启底部的GPU解码,如果使用的是Nvidia显卡,可以选择cuda进行解码。
10
PASD

PASD

一个功能强大的开源图像处理工具,它能够实现真实感图像的超分辨率和个性化的风格化。该工具不仅可以将低分辨率的图像转换为高分辨率版本,而且还能保持或增强图像的真实感。它具备多种处理任务的能力,包括但不限于图像超分辨率、旧照片修复、个性化风格化(例如将照片转换为动漫风格)以及图像上色等。举个例子,你可以使用PASD来恢复家族旧照片的细节,或者将普通照片转换成具有独特艺术风格的作品。
10
Rope AI换脸

Rope AI换脸

换脸工具Rope已经发布了Ruby版本,该版本在性能上有了显著的提升。用户如有需求,可以尝试更新体验。此次更新的具体内容包括: 1. 性能提升:新版本的Rope性能几乎是之前版本的二倍,运行更加流畅。 2. 更快的GFPGAN:在图像处理方面进行了优化,使得GFPGAN的运行速度更快。 3. 可调整遮挡遮罩尺寸:用户现在可以根据需要调整遮挡遮罩的大小,以满足不同的需求。 4. 实验性功能添加:新版本还增加了实验性功能,允许用户调整面部交换区域的放置和面部比例,以实现更精细的面部交换效果。
10
screenshot-to-code

screenshot-to-code

将屏幕截图转换为清洁的HTML / Tailwind / JS代码。 这是一个使用MIT许可证进行许可的项目,因此,它是免费并且开源的。 功能点如下: 1. 屏幕截图转代码:用户通过输入截图,系统将自动将图像转换为HTML,Tailwind,或JS代码。 2. 开源活动:作为GitHub上的公开项目,任何对此项目感兴趣的开发者都可以查看源代码,对其进行修改,或进行贡献。 3. 自动化工作流程:项目包含一系列自动化的功能,可以帮助用户更有效地转换屏幕截图。 这是一个非常实用的工具,对开发者来说,尤其是前端开发者,它可以极大地提高他们的工作效率。
10
图应AI

图应AI

图应AI(Tuing AI)是国内首批AI+IMaaS架构的商拍优化平台,专注于通过AI技术生成指定需求的优质商拍图像。垂直服务于服装商拍领域。提供一站式商拍优化解决方案。 图应AI经过大量数据专业训练,具备高智能化能力。无需场景实拍,可以根据素材,进行融合处理,在保留指定特征的基础上嵌入模型表征,自动生成真实场景或指定需求的商拍内容。 官网地址:https://feilianyun.cn/
10