Umi-OCR

6小时前发布 1 0 0

一款完全离线的OCR图片转文字识别软件,支持命令行、HTTP接口等多种调用方式,支持截图OCR / 批量OCR / 二维码 / 数学公式识别(测试中)

语言:
zh
收录时间:
2026-08-31

一款功能强大的离线OCR软件,具备导入图片、多国语言支持、合并段落、竖排文字识别和水印区域排除等特点,能够帮助用户快速、准确地将图片中的文字转换为可编辑的文本。

数据统计

相关导航

GPT4Tools

GPT4Tools

GPT4Tools是一个可以控制多个视觉基础模型的集中式系统。它基于Vicuna(LLaMA),并71K自建指令数据。通过分析语言内容,GPT4Tools能够自动决定、控制和利用不同的视觉基础模型,允许用户在对话过程中与图像进行交互。通过这种方法,GPT4Tools提供了一个无缝高效的解决方案,以满足对话中各种与图像相关的需求。与以前的工作不同,我们支持用户通过自学指令和LoRA教授自己的LLM使用具有简单细化的工具。
AnythingLLM

AnythingLLM

一个具有高度定制化和隐私控制的聊天型人工智能,适用于各种规模的企业。它提供细粒度的多用户权限控制,可访问聊天记录等功能。同时,该系统兼容多种数据类型,如PDF、Word文档等,可进行与企业相关的各种数据操作。另外,AnythingLLM支持自定义模型,包括GPT-4、自定义模型以及像Llama、Mistral等开源模型。除此之外,用户还可以进行外部数据导入,并具备灵活的第三方控制和开源支持等特点。 功能点总结: 1. 高度定制化:适用于各种企业规模 2. 隐私控制:保护数据隐私,确保数据不离开用户实例 3. 多用户权限控制与安全:细粒度权限设置,符合合规要求 4. 数据兼容性:支持多种文档类型,如PDF、Word文档等 5. 自定义模型支持:不局限于单一提供商,可以使用企业模型或开源模型 6. 外部数据导入:用户可以上传PDF、Word文档等,拓展聊天机器人的知识库 7. 第三方控制与开源支持:自由选择第三方供应商,支持开源软件,提供透明性和定制化 8. 完整API支持和外观定制:提供全面的开发者API,外观可定制化 希望这能对您有所帮助。如果您有其他问题或需要进一步的解释,请告诉我。