AI 开源项目雷达
帮你从 GitHub 上快速发现、理解和复用高质量 AI 开源项目。
榜单
合集
Skills 库
分类
AI 搜索
左右滑动查看全部
↔
←
返回 AI 工作站
AI 搜索
搜项目、查事实、做对比,也能把复杂需求整理成可执行方案
AI 搜索
从一个真实需求开始
点击只会填入搜索框,你可以继续修改
项目
RAG 开源项目
按相关性与成熟度排序
Skills
代码安全审查
查找可复用能力
事实
Dify 的 License
只回答已核验信息
对比
Dify vs RAGFlow
企业知识库如何选
替代
Dify 的替代项目
发现同类选择
方案
搭建内部知识库
组合项目、Skills 与步骤
按分类找 AI 开源项目
更多筛选
0
视频技术
浏览当前公开快照中“视频技术”相关的 AI 开源项目,并查看许可证、部署、适用场景、限制和核验来源。
Comfy-Org/ComfyUI
— 结论:comfy-org/comfyui 适合希望通过节点图精细组织生成式工作流、同时保留本地离线与外部服务选择空间的创作者。它覆盖图像、视频、三维模型和音频生成,但采用自定义节点或面向共享生产环境部署前,需要核查版本兼容性与证书配置。
calesthio/OpenMontage
— openmontage 是一套端到端视频制作系统,通过外部 AI 编程助手自动化从构思到成片的流程化制作,支持真实素材或生成式视频组装,并带有质量校验环节。它不绑定特定供应商,将研究、提案、脚本、场景规划、资产生成、剪辑和合成编排为结构化阶段。
huggingface/diffusers
— diffusers 是一个面向预训练扩散模型(覆盖图像、音频、视频)的模块化工具箱,提供推理流水线、可互换噪声调度器和可组合的预训练模型组件,基于 PyTorch 构建。它强调可用性优先于性能、可定制优先于抽象封装,适合需要在代码层面灵活控制生成与训练流程的开发者和研究人员。
opencv/opencv
— opencv 是一个覆盖计算机视觉、图像处理和深度学习领域的开源函数库,定位为计算机视觉开发的基础设施。该项目以库形式提供算法集合,供开发者在本地集成使用。
Anil-matcha/Open-Generative-AI
— open-generative-ai 是一个可自托管的生成式 AI 工作室,支持通过 200 多个模型生成图像、视频和口型同步内容,且不设内容过滤机制。该工具提供云端 API 调用与桌面端本地推理两种运行路径,适用于无需代码基础的媒体生成场景。
ultralytics/ultralytics
— ultralytics 提供覆盖检测、分割、分类、姿态估计和目标追踪的实时计算机视觉模型开发与部署能力,通过统一的 CLI 和 Python API 交付 YOLO 模型。模型会在首次使用时自动下载,适合需要快速上手和迭代的视觉任务场景。
bradautomates/claude-video
— claude-video 以自包含技能单元形式,让 AI 助手通过下载视频、提取帧和转录音频来获取视频内容。该技能支持在多个代理宿主中运行,依赖 ffmpeg 和 yt-dlp 处理视频,并可通过可选的 Groq 或 OpenAI API 进行音频转录。
roboflow/supervision
— supervision 为计算机视觉应用提供可复用的数据加载、检测、可视化等构建块,支持通过连接器接入多种主流分类、检测或分割模型。它帮助开发者减少重复代码编写,使其能将精力集中在应用逻辑上。
HBAI-Ltd/Toonflow-app
— toonflow-app 是一款开源桌面应用,提供从小说或剧本文本到角色生成分镜再到视频生成的短剧制作流水线。该项目依赖外部 AI 模型服务接口来执行核心的生成任务,通过多智能体协作和无限画布工作台组织创作流程。
dramaclaw/dramaclaw
— dramaclaw/dramaclaw 是一条可自建的短剧制作流水线,将小说或稿件自动转化为完成度较高的短剧视频,并在流程中维护人物身份一致性。
ultralytics/yolov5
— ultralytics/yolov5 是一个基于 PyTorch 的视觉 AI 模型,支持目标检测、实例分割和图像分类任务,可用于快速训练、推理和部署。
deepfakes/faceswap
— faceswap 是一款面向学习和实验目的的开源深度学习换脸工具,支持从图像和视频中提取人脸、训练模型并完成换脸转换。用户无需具备高级 AI 专业背景即可通过命令行或图形界面使用。
palmier-io/palmier-pro
— palmier-pro 是一款使用 Swift 从零构建的开源 macOS 视频编辑器,定位为 Premiere Pro 的开源替代方案。它允许用户与 AI 智能体在时间轴内协同生成和编辑视频。
duixcom/Duix-Avatar
— duix-avatar 是一款本地离线运行的 AI 数字人克隆与视频合成软件,用户无需联网即可在本地生成数字人视频。
zhouxiaoka/autoclip
— autoclip 是一款基于 AI 的自动视频剪辑工具,能够从 YouTube、B站视频或本地文件中提取高光片段并生成智能合集,为视频二次创作提供端到端的自动化流程。
Lightricks/LTX-2
— lightricks/ltx-2 是首个基于 DiT 架构且开放获取的高保真音视频基础模型,适合需要在自托管环境中生成同步音视频的开发者与 AI 工程团队。它同时提供 Python 推理与 LoRA 训练工具,帮助团队构建从文本/图像生成到定制微调的完整链路。
Huanshere/VideoLingo
— videolingo 是一条自动化视频翻译与配音流水线,能够生成单行字幕并合成配音视频。它通过 NLP 和 AI 技术处理视频的转录、翻译、对齐和配音环节。
waooAI/waoowaoo
— waoowaoo 是一款 AI 视频制作工具,能够将小说文本转化为分镜、角色、场景和完整的视频。该项目支持通过 Docker Compose 进行本地部署,并提供中文与英文界面。
Emily2040/seedance-2.0
— emily2040/seedance-2.0 是一个面向 Seedance 2.0 视频生成的模块化 agent-skill 包,用于把创意方向转化为结构化提示词和制作流程。它支持从创意访谈、技术参考到 IP 安全改写的编排。
jianchang512/pyvideotrans
— pyvideotrans 将语音识别、字幕翻译、多角色配音和音视频合成串联为一条完整流水线,同时支持本地离线部署和多种主流在线 API。Windows 用户可直接使用预打包程序免配置运行。
WEIFENG2333/VideoCaptioner
— videocaptioner 是一款桌面端视频字幕处理工具,将语音转写、字幕优化、翻译和视频合成整合在一套流水线中。它提供免费的 ASR 与翻译选项(无需配置即可使用),同时也支持接入大语言模型(LLM)提升处理效果。
HKUDS/ViMax
— vimax 是一个智能体视频创作框架,可从简单概念或显式剧本出发,自主处理编剧、分镜、角色创建及最终视频生成的端到端流程。
spmallick/learnopencv
— spmallick/learnopencv 是一个为计算机视觉、深度学习和 AI 概念提供实践性、可复用代码示例的开源代码集合,代码与配套的教育性博客文章紧密结合。
linyqh/NarratoAI
— linyqh/narratoai 是一个将视频解说文案撰写、视频剪辑、配音和字幕生成整合为单一流程的自动化工具。它利用大语言模型生成解说脚本,并支持 TTS 语音合成与字幕转录,最终可导出至剪映进行后续编辑。
×