AI 开源项目雷达
帮你从 GitHub 上快速发现、理解和复用高质量 AI 开源项目。
榜单
合集
Skills 库
分类
AI 搜索
左右滑动查看全部
↔
←
返回 AI 工作站
AI 搜索
搜项目、查事实、做对比,也能把复杂需求整理成可执行方案
AI 搜索
从一个真实需求开始
点击只会填入搜索框,你可以继续修改
项目
RAG 开源项目
按相关性与成熟度排序
Skills
代码安全审查
查找可复用能力
事实
Dify 的 License
只回答已核验信息
对比
Dify vs RAGFlow
企业知识库如何选
替代
Dify 的替代项目
发现同类选择
方案
搭建内部知识库
组合项目、Skills 与步骤
高频资源合集
更多筛选
0
图片生成与智能修图
浏览当前公开快照中“图片生成与智能修图”相关的 AI 开源项目,并查看许可证、部署、适用场景、限制和核验来源。
HBAI-Ltd/Toonflow-app
— toonflow-app 是一款开源桌面应用,提供从小说或剧本文本到角色生成分镜再到视频生成的短剧制作流水线。该项目依赖外部 AI 模型服务接口来执行核心的生成任务,通过多智能体协作和无限画布工作台组织创作流程。
AUTOMATIC1111/stable-diffusion-webui
— stable-diffusion-webui 是一个基于 Gradio 的 Stable Diffusion Web 界面,提供文生图、图生图、模型训练等功能。该项目提供安装脚本并支持在 4GB 显存的显卡上运行,适合需要在本地运行和管理图像生成的用户。
invoke-ai/InvokeAI
— InvokeAI 为专业创作者和爱好者提供本地托管的 Web 界面,支持使用生成式 AI 模型进行视觉媒体的生成与迭代。项目包含统一的画布工具和基于节点的工作流管理功能。
Comfy-Org/ComfyUI
— 结论:comfy-org/comfyui 适合希望通过节点图精细组织生成式工作流、同时保留本地离线与外部服务选择空间的创作者。它覆盖图像、视频、三维模型和音频生成,但采用自定义节点或面向共享生产环境部署前,需要核查版本兼容性与证书配置。
unslothai/unsloth
— unsloth 是一个支持通过 Web UI 和代码库在本地运行与训练文本、音频、嵌入及视觉模型的应用,旨在以更快的速度和更低的显存占用完成大模型任务。它同时提供数据集自动构建、模型导出和训练过程监控等支持性能力。
calesthio/OpenMontage
— openmontage 是一套端到端视频制作系统,通过外部 AI 编程助手自动化从构思到成片的流程化制作,支持真实素材或生成式视频组装,并带有质量校验环节。它不绑定特定供应商,将研究、提案、脚本、场景规划、资产生成、剪辑和合成编排为结构化阶段。
mudler/LocalAI
— localai 是一个开源 AI 引擎,可在用户自有基础设施上运行涵盖文本、音频、图像和视频的多模态模型,且不强制要求 GPU。它提供与 OpenAI、Anthropic 和 ElevenLabs API 兼容的接口,便于已有应用对接。
khoj-ai/khoj
— 结论:khoj 适合希望通过自托管或托管服务检索个人文档、查询互联网并与本地或在线大模型对话的用户。它还覆盖自定义智能体、研究自动化以及浏览器、桌面和移动端等访问方式,但选型前需另行确认 GPU、最低硬件和遥测要求。
ATH-MaaS/Pixelle-Video
— ath-maas/pixelle-video 面向希望从主题或脚本生成短视频、且不需要细粒度手工剪辑的创作者。它覆盖脚本、图像或视频素材、配音、背景音乐与成片合成,并允许通过不同服务或工作流替换部分生成组件。
junyanz/pytorch-CycleGAN-and-pix2pix
— 提供 CycleGAN 与 pix2pix 的 PyTorch 实现,支持非配对和配对图像到图像翻译模型的训练、测试与预训练模型推理。其结果与原始 Torch 实现相当或更好,适合图像翻译研究、实验与定制开发。
huggingface/peft
— peft 是一个用于在大型预训练模型上执行参数高效微调(如 LoRA)的 Python 库,仅训练少量额外参数即可降低计算与存储开销,并在性能上接近全量微调。
pydantic/pydantic-ai
— pydantic-ai 是一个 Python Agent 框架,通过 Pydantic 验证提供类型安全和结构化输出,并支持多种外部大语言模型。该项目由 Pydantic 团队开发,旨在提供模型无关、类型安全的代理程序构建方式。
helloianneo/ian-xiaohei-illustrations
— helloianneo/ian-xiaohei-illustrations 适合希望把中文文章中的关键认知点转成“小黑”手绘风配图,并接受依赖 Codex 与图像生成模型的内容创作者。它不适合需要矢量源文件、演示文稿成品、复杂信息图或商业品牌主视觉的团队。
×