AI 开源项目雷达
帮你从 GitHub 上快速发现、理解和复用高质量 AI 开源项目。
榜单
合集
Skills 库
分类
AI 搜索
左右滑动查看全部
↔
English
←
返回 AI 工作站
AI 搜索
搜项目、查事实、做对比,也能把复杂需求整理成可执行方案
AI 搜索
从一个真实需求开始
点击只会填入搜索框,你可以继续修改
项目
RAG 开源项目
按相关性与成熟度排序
Skills
代码安全审查
查找可复用能力
事实
Dify 的 License
只回答已核验信息
对比
Dify vs RAGFlow
企业知识库如何选
替代
Dify 的替代项目
发现同类选择
方案
搭建内部知识库
组合项目、Skills 与步骤
高频资源合集
更多筛选
0
办公效率与文档处理
浏览当前公开快照中“办公效率与文档处理”相关的 AI 开源项目,并查看许可证、部署、适用场景、限制和核验来源。
teableio/teable
— Teable 是一个基于 PostgreSQL 的数据库协作平台,支持通过自然语言描述让 AI 智能体在隔离沙盒中构建定制应用并发布,旨在将业务数据转化为贴合实际流程的 AI 工作流和定制应用。
pot-app/pot-desktop
— pot-desktop 是一个跨平台桌面应用,聚合了多种外部和本地服务,提供划词翻译、输入翻译、截图 OCR、截图翻译及语音合成等功能。它通过可扩展的 .potext 插件系统实现功能增强,适合需要在 PC 端进行多源文本翻译和文字识别的用户。
JaidedAI/EasyOCR
— easyocr 是一个支持 80 多种语言和主要书写体系的即用型 OCR 库,接受多种图像输入形式并返回包含边界框、文本和置信度的结构化结果。
PaddlePaddle/PaddleOCR
— PaddleOCR 是一个文档解析库,旨在将非结构化的图像和 PDF 文档转换为结构化的 Markdown 或 JSON 数据,以支撑大语言模型应用。该项目提供了 0.9B 参数的轻量级视觉语言模型以及结构化解析能力。
opendatalab/MinerU
— mineru 是一款文档解析工具,可将 PDF、图片及 Office 文档转换为 Markdown 与 JSON 格式,服务于检索增强生成等下游处理流程。该项目支持复杂版面识别、公式与表格提取,并提供多种解析后端以适应不同硬件配置。
tesseract-ocr/tesseract
— tesseract-ocr/tesseract 是一款开源 OCR 引擎,提供基于神经网络(LSTM)的行识别和传统字符模式识别两种引擎,并支持 100 多种语言的文本识别。
paperless-ngx/paperless-ngx
— paperless-ngx 是一个由社区支持的文档管理系统,通过 OCR、组织和索引,将纸质或数字文档转化为可搜索的在线档案。它面向希望自行托管并集中管理文档的用户。
hugohe3/ppt-master
— ppt-master 是一个利用 AI agent 从源文档生成可编辑 PowerPoint(.pptx)文件的代理工作流项目,其输出包含真实的幻灯片母版、原生形状、基于数据的图表和切换效果。它通过将生成的 SVG 输出转换为 DrawingML,解决了 AI 生成的演示文稿通常被扁平化为图像或仅填充模板而无法编辑原生元素的问题。
opendataloader-project/opendataloader-pdf
— opendataloader-project/opendataloader-pdf 是面向 PDF 结构化解析与无障碍处理的本地可运行库,提供确定性解析、可选 AI 混合模式,以及将无标签 PDF 转换为带标签 PDF 的能力。
lukas-blecher/LaTeX-OCR
— latex-ocr 是一个基于学习的系统,可将数学公式图像转换为 LaTeX 代码,并提供 CLI、GUI 和 Python 库调用等使用方式。
yusufkaraaslan/Skill_Seekers
— skill_seekers 将文档站点、GitHub 仓库、PDF 等多种来源的内容转换为结构化的 Claude AI 技能,并提供冲突检测。支持向 19 种 AI 编程代理自动安装生成的技能,并提供包含 40 个工具的 MCP 服务器。
×