AI 开源项目雷达
帮你从 GitHub 上快速发现、理解和复用高质量 AI 开源项目。
榜单
合集
Skills 库
分类
AI 搜索
左右滑动查看全部
↔
English
←
返回 AI 工作站
AI 搜索
搜项目、查事实、做对比,也能把复杂需求整理成可执行方案
AI 搜索
从一个真实需求开始
点击只会填入搜索框,你可以继续修改
项目
RAG 开源项目
按相关性与成熟度排序
Skills
代码安全审查
查找可复用能力
事实
Dify 的 License
只回答已核验信息
对比
Dify vs RAGFlow
企业知识库如何选
替代
Dify 的替代项目
发现同类选择
方案
搭建内部知识库
组合项目、Skills 与步骤
高频资源合集
更多筛选
0
多语言翻译与字幕制作
浏览当前公开快照中“多语言翻译与字幕制作”相关的 AI 开源项目,并查看许可证、部署、适用场景、限制和核验来源。
pot-app/pot-desktop
— pot-desktop 是一个跨平台桌面应用,聚合了多种外部和本地服务,提供划词翻译、输入翻译、截图 OCR、截图翻译及语音合成等功能。它通过可扩展的 .potext 插件系统实现功能增强,适合需要在 PC 端进行多源文本翻译和文字识别的用户。
harry0703/MoneyPrinterTurbo
— moneyprinterturbo 面向希望从主题或关键词生成短视频的创作者,可串联脚本、素材匹配、配音、字幕与视频合成。它更适合能够自行部署并配置模型及语音服务凭据的团队,而不是需要全托管服务的非技术用户。
PDFMathTranslate/PDFMathTranslate
— pdfmathtranslate 是一款用于翻译科学 PDF 文档并保留原始版面布局的工具。它能够在翻译过程中保留公式、图表、目录和注释,并支持生成双语对照文档。
NVIDIA-NeMo/Speech
— nvidia-nemo/speech 是面向研究人员和 PyTorch 开发者的语音 AI 框架,用于构建、定制和部署语音识别(ASR)、语音合成(TTS)及语音大模型。目前项目正处于转型期,重心转向音频、语音和多模态大模型。
WEIFENG2333/VideoCaptioner
— videocaptioner 是一款桌面端视频字幕处理工具,将语音转写、字幕优化、翻译和视频合成整合在一套流水线中。它提供免费的 ASR 与翻译选项(无需配置即可使用),同时也支持接入大语言模型(LLM)提升处理效果。
PaddlePaddle/PaddleSpeech
— paddlespeech 是一个覆盖语音识别、语音合成、声音克隆、语音翻译和音频分类等任务的开源语音与音频处理工具包。它提供可通过命令行和服务端组件使用的训练、推理、测试与部署能力。
×