docext 是用于从文档提取非结构化信息的本地化开源工具,无需 OCR,利用视觉语言模型(VLM)来识别和提取文档中的字段数据和表格信息,既准确又能保证数据安全隐私
Lama Cleaner 是基于 SOTA 深度学习模型的图像修复工具,完全支持本地部署,支持 CPU & GPU
WiseFlow是一个开源的敏捷信息提取工具,能够从网站、微信公众号、社交媒体等来源精炼信息,并自动分类标签上传到数据库。
由密码学专家团队打造的开源隐私计算平台,支持安全多方计算、联邦学习、隐私求交、隐私查询等。
一款功能强大的AI语音识别工具 github地址:https://github.com/openai/whisper.git 导入日期:20251009 更新日期:20260828
EasyPR是一个中文的开源车牌识别系统,其目标是成为一个简单、高效、准确的车牌识别引擎。相比于其他的车牌识别系统,EasyPR有如下特点:* 它基于openCV这个开源库。这意味着你可以获取全部源代码,并且移植到java等平台。* 它能够识别中文。例如车牌为苏EUK722的图片,它可以准确地输出std:string类型的"苏EUK722"的结果。* 它的识别率较高。图片清晰情况下,车牌检测与字符识别可以达到80%以上的精度。
Mirror of https://github.com/dirkvdb/ffmpegthumbnailer.git
fork from https://github.com/FunAudioLLM/SenseVoice SenseVoice是由阿里云通义实验室开发的一款多语言音频基础模型,专注于高精度多语言语音识别、情感辨识和音频事件检测。SenseVoice 是具有音频理解能力的音频基础模型,包括语音识别(ASR)、语种识别(LID)、语音情感识别(SER)和声学事件分类(AEC)或声学事件检测(AED)。
Stirling-PDF 是使用 Docker 的强大的、本地托管的、基于 Web 的 PDF 操作工具。它能够对PDF文件进行各种操作,包括分割、合并、转换、重组、添加图像、旋转、压缩等。这个本地托管的 Web 应用程序已发展为包含一组全面的功能,基本可以满足的所有 PDF 要求。
良心级开源人脸标定算法,人脸美颜,美妆,配合式活体检测,人脸校准的预处理步骤. Android代码基于深度学习,我们设计了高效的网络模型,该模型鲁棒性较好,支持多人脸跟踪.目前深度学习算法在人脸标定方向取得了良好的效果,该项目旨在提供一种较为简单易用的实现方式.
基于Retinaface车牌检测,全新模型仅1.8MB.
HyperLRP是一个开源的、基于深度学习高性能中文车牌识别库,由北京智云视图科技有限公司开发,支持PHP、C/C++、Python语言,Windows/Mac/Linux/Android/IOS 平台。
Kubeode一键部署k8s,助你快速落地 Kubernetes。特性:k8s集群二进制包一键化多master-HA基于内核负载高可用,支持centos7.9-10+kubernetes v1.23.5~1.31集群一键离线安装,一键批量增删node节点,一键集成k8s持久化方案Heketi+GlusterFS+nfs+helm3+动态存储+dns+ipvs+prometheus +grafan