AI 开源项目雷达
帮你从 GitHub 上快速发现、理解和复用高质量 AI 开源项目。
榜单
合集
Skills 库
分类
AI 搜索
左右滑动查看全部
↔
English
←
返回 AI 工作站
AI 搜索
搜项目、查事实、做对比,也能把复杂需求整理成可执行方案
AI 搜索
从一个真实需求开始
点击只会填入搜索框,你可以继续修改
项目
RAG 开源项目
按相关性与成熟度排序
Skills
代码安全审查
查找可复用能力
事实
Dify 的 License
只回答已核验信息
对比
Dify vs RAGFlow
企业知识库如何选
替代
Dify 的替代项目
发现同类选择
方案
搭建内部知识库
组合项目、Skills 与步骤
按分类找 AI 开源项目
更多筛选
0
图片处理
浏览当前公开快照中“图片处理”相关的 AI 开源项目,并查看许可证、部署、适用场景、限制和核验来源。
AUTOMATIC1111/stable-diffusion-webui
— stable-diffusion-webui 是一个基于 Gradio 的 Stable Diffusion Web 界面,提供文生图、图生图、模型训练等功能。该项目提供安装脚本并支持在 4GB 显存的显卡上运行,适合需要在本地运行和管理图像生成的用户。
Comfy-Org/ComfyUI
— 结论:comfy-org/comfyui 适合希望通过节点图精细组织生成式工作流、同时保留本地离线与外部服务选择空间的创作者。它覆盖图像、视频、三维模型和音频生成,但采用自定义节点或面向共享生产环境部署前,需要核查版本兼容性与证书配置。
huggingface/diffusers
— diffusers 是一个面向预训练扩散模型(覆盖图像、音频、视频)的模块化工具箱,提供推理流水线、可互换噪声调度器和可组合的预训练模型组件,基于 PyTorch 构建。它强调可用性优先于性能、可定制优先于抽象封装,适合需要在代码层面灵活控制生成与训练流程的开发者和研究人员。
opencv/opencv
— opencv 是一个覆盖计算机视觉、图像处理和深度学习领域的开源函数库,定位为计算机视觉开发的基础设施。该项目以库形式提供算法集合,供开发者在本地集成使用。
nexu-io/open-design
— open-design 是一个开源、本地优先的设计生成工具,让用户利用已有的编码代理 CLI 和自带密钥的端点生成设计产物,作为 Claude Design 闭源服务的替代方案。
deepfakes/faceswap
— faceswap 是一款面向学习和实验目的的开源深度学习换脸工具,支持从图像和视频中提取人脸、训练模型并完成换脸转换。用户无需具备高级 AI 专业背景即可通过命令行或图形界面使用。
ageitgey/face_recognition
— face_recognition 提供了基于 Python 库和命令行的人脸检测、特征点定位与识别能力,其底层依托 dlib 深度学习模型,在 Labeled Faces in the Wild 基准上准确率达 99.38%。
TencentARC/GFPGAN
— tencentarc/gfpgan 面向真实世界场景中的盲人脸恢复,使用预训练人脸 GAN 所封装的人脸先验进行修复。项目可在本地运行,提供训练代码,并提供不要求 CUDA 扩展的 Clean 版本。
lllyasviel/ControlNet
— ControlNet 是一种神经网络结构,通过为文本到图像扩散模型添加额外的空间条件来实现控制,同时不会破坏已有的生产级基础模型。
invoke-ai/InvokeAI
— InvokeAI 为专业创作者和爱好者提供本地托管的 Web 界面,支持使用生成式 AI 模型进行视觉媒体的生成与迭代。项目包含统一的画布工具和基于节点的工作流管理功能。
Anil-matcha/Open-Generative-AI
— open-generative-ai 是一个可自托管的生成式 AI 工作室,支持通过 200 多个模型生成图像、视频和口型同步内容,且不设内容过滤机制。该工具提供云端 API 调用与桌面端本地推理两种运行路径,适用于无需代码基础的媒体生成场景。
junyanz/pytorch-CycleGAN-and-pix2pix
— 提供 CycleGAN 与 pix2pix 的 PyTorch 实现,支持非配对和配对图像到图像翻译模型的训练、测试与预训练模型推理。其结果与原始 Torch 实现相当或更好,适合图像翻译研究、实验与定制开发。
microsoft/unilm
— microsoft/unilm 提供一组预训练基础模型、架构与工具,覆盖 NLP、视觉、语音及文档 AI 等多种任务。其中 LayoutLM 是面向文档 AI 的多模态(文本 + 版面/格式 + 图像)基础模型,可用于扫描文档、PDF 等场景。
apple/ml-stable-diffusion
— ml-stable-diffusion 提供将 PyTorch Stable Diffusion 模型转换为 Core ML 格式的 Python 工具,以及用于在 Apple Silicon 设备上进行端侧图像生成的 Swift 包。
camenduru/stable-diffusion-webui-colab
— stable-diffusion-webui-colab 适合希望通过 Google Colab 使用 Stable Diffusion WebUI、又不准备搭建本地环境的图像与视频创作者。它的核心价值是提供已配置模型、扩展和相关资源的笔记本集合,但不适合作为离线或本地自托管方案。
zai-org/CogVideo
— cogvideo 是一个开源的文本到视频与图像到视频扩散模型项目,提供推理优化与社区微调支持。该项目支持通过提示词或输入背景图像来生成视频内容。
junyanz/CycleGAN
— CycleGAN 是一种用于在没有配对输入输出样本的情况下学习图像到图像转换的算法实现,支持使用预训练模型生成图像或在自有数据集上训练新模型。
modelscope/DiffSynth-Studio
— DiffSynth-Studio 是一个开源扩散模型引擎,重新设计了主流扩散模型的推理与训练流程。它支持在消费级 GPU 上进行内存高效管理和灵活的模型训练。
×