AI 开源项目雷达
帮你从 GitHub 上快速发现、理解和复用高质量 AI 开源项目。
榜单
合集
Skills 库
分类
AI 搜索
左右滑动查看全部
↔
English
←
返回 AI 工作站
AI 搜索
搜项目、查事实、做对比,也能把复杂需求整理成可执行方案
AI 搜索
从一个真实需求开始
点击只会填入搜索框,你可以继续修改
项目
RAG 开源项目
按相关性与成熟度排序
Skills
代码安全审查
查找可复用能力
事实
Dify 的 License
只回答已核验信息
对比
Dify vs RAGFlow
企业知识库如何选
替代
Dify 的替代项目
发现同类选择
方案
搭建内部知识库
组合项目、Skills 与步骤
按分类找 AI 开源项目
更多筛选
0
搜索调研
浏览当前公开快照中“搜索调研”相关的 AI 开源项目,并查看许可证、部署、适用场景、限制和核验来源。
firecrawl/firecrawl
— firecrawl 是一款面向 AI 系统的 Web 数据搜索与抓取 API,可将网页内容转换为 Markdown、结构化 JSON 或截图。它接管了代理轮换、速率限制和 JS 渲染等底层细节,为 LLM 应用提供可用的数据源。
unclecode/crawl4ai
— crawl4ai 将网页内容转化为经过清洗的 Markdown 和结构化数据,适用于 RAG 和数据管道。该项目无需强制使用 API 密钥,提供包括 Python 库和 Docker 在内的多种部署方式,并具备浏览器控制与反爬虫规避能力。
qdrant/qdrant
— qdrant 是用 Rust 编写的向量相似度搜索引擎,支持稠密向量、稀疏向量、多向量搜索与 JSON 负载过滤,并提供分片与副本的横向扩展能力。内置量化可将 RAM 占用降低多达 97%,用户可在搜索速度与精度之间进行调节。
milvus-io/milvus
— milvus 是一款云原生向量数据库,支持在十亿级向量规模下进行可扩展的向量近似最近邻(ANN)搜索,并支持实时流式更新。
TauricResearch/TradingAgents
— tradingagents 是一个多智能体 LLM 框架,通过部署专门的分析、研究、交易和风险管理智能体来模拟真实交易公司的运作,以协助评估市场状况并告知交易决策。该项目专为研究目的设计,其输出并非保证收益的财务或投资建议。
deepset-ai/haystack
— haystack 是一个 Python 框架,用于构建生产就绪的 LLM 应用程序,通过模块化管道编排检索、路由和生成过程。该框架允许开发者对信息进行检索、过滤和组合后提供给模型,并支持在系统间切换不同的模型或基础设施组件。
weaviate/weaviate
— weaviate 是一款云原生向量数据库,将向量相似度搜索、关键字过滤与生成式 RAG 能力整合在单一查询中,旨在解决 AI 应用在规模化场景下需要独立部署检索、向量存储与生成系统的难题。
bytedance/deer-flow
— deer-flow 是一个开源的智能体框架,用于编排子智能体、记忆和沙盒来处理需要数分钟到数小时的复杂任务。该项目支持通过本地、Docker 或 Kubernetes 模式执行代码,并可通过 IM 渠道和 MCP 服务器扩展能力。
assafelovic/gpt-researcher
— gpt-researcher 是一个自主深度研究代理,通过并行聚合超过 20 个网络或本地数据源,生成带有引用的详细研究报告。它采用规划与执行智能体协作完成研究任务,适用于需要客观、时效性信息整理的场景。
Panniantong/Agent-Reach
— agent-reach 是一个为 AI 代理提供互联网平台读取与搜索能力的工具,通过为各平台选择和维护稳定的访问方式,应对 API 付费墙与反爬虫措施带来的阻碍。它通过有序的后端路由机制,在某个访问方式失效时自动切换。
sansan0/TrendRadar
— sansan0/trendradar 是一个轻量级、可快速部署的舆情监控工具,通过聚合多平台热点与 RSS 订阅源,结合关键词与 AI 智能过滤,实现多渠道新闻追踪与推送。项目依赖外部 API 获取数据并支持通过自然语言描述筛选资讯。
meilisearch/meilisearch
— meilisearch 是一款搜索引掣 API,提供结合语义与全文检索的混合搜索、拼写容错以及预置配置。项目自述称其搜索即输入场景下的响应时间低于 50 毫秒。
mvanhorn/last30days-skill
— 一个面向 AI 代理的研究技能,通过并行搜索多个社交媒体与媒体平台,并依据真实人类互动信号对结果进行评分和综合,最终生成结构化简报。
stanford-oval/storm
— storm 是一个通过检索与多视角问答来自动化研究流程的系统,能够从零开始生成带引用的长篇文章。它支持人机协作的知识整理模式,并提供模块化的引擎定制接口。
666ghj/BettaFish
— bettafish 是一个多智能体舆情分析助手,可通过单条自然语言指令自动监控并分析跨平台社交媒体数据。它从零实现多智能体协作机制,不依赖现有智能体框架。
Imbad0202/academic-research-skills
— academic-research-skills 是一套面向学术研究的 Claude Code 技能集,提供从文献检索、引用格式化到数据验证的人在回路流水线。该项目通过不可跳过的完整性验证门,规避全自动 AI 研究流程中常见的引用幻觉和方法论编造问题。
LAION-AI/Open-Assistant
— Open Assistant 是一个已完结的聊天助手项目,支持在对话中理解用户任务并动态检索信息。该项目适合作为技术参考,但不再处于活跃维护阶段,不适合直接用于生产环境。
ItzCrazyKns/Vane
— itzcrazykns/vane 是一个注重隐私的 AI 搜索引擎,可在用户自有硬件上运行,并通过 SearxNG 和本地或云端大语言模型生成带引用来源的答案。
K-Dense-AI/scientific-agent-skills
— scientific-agent-skills 为 AI 代理提供 158 个即用型科学研究技能和 100 余个科学数据库访问能力,覆盖生物、化学、医学、药物发现等领域,基于开放的 Agent Skills 标准构建。
onyx-dot-app/onyx
— onyx 是一个可自托管的大语言模型应用层与聊天界面,为私有部署环境提供 RAG、联网搜索和深度研究等能力。该项目提供 50 种以上索引连接器以及可按需选择的轻量部署模式。
hsliuping/TradingAgents-CN
— hsliuping/tradingagents-cn 是一个中文本地化的多智能体 LLM 股票分析学习与研究平台,支持 A股、港股和美股研究,但不提供真实交易指令。
eugeneyan/applied-ml
— eugeneyan/applied-ml 是一份面向生产实践的机器学习资料索引,汇集论文和工程技术博客,并按领域及机器学习生命周期阶段组织。它适合用真实案例快速定位某类 ML 问题的实现经验与结果线索,而非提供可直接运行的 ML 框架。
karpathy/llm-council
— karpathy/llm-council 是一个本地运行的 Web 应用,通过 OpenRouter 向多个 LLM 发送同一问题,再由各模型匿名互相评审和排名,最终由指定的 Chairman LLM 综合出单一回答。
amusi/CVPR2026-Papers-with-Code
— 专为 CVPR 2026 计算机视觉会议打造的论文与开源代码分类追踪清单。它以纯 Markdown 目录的形式,帮助研究人员和开发者发现并获取视觉前沿算法的代码仓库线索。
Alibaba-NLP/DeepResearch
— deepresearch 是一个面向深度信息检索的开源智能体大语言模型,基于 30.5B 参数的 MoE 架构构建,旨在跨网络自动化执行长周期的深度研究任务。该模型在多个智能体搜索基准测试中取得了领先的性能表现。
dzhng/deep-research
— deep-research 是一个深度研究代理的开源实现,通过组合搜索引擎、网页抓取和大语言模型,对任意主题进行迭代式研究并输出 Markdown 报告。其代码量不到 500 行,主打实现简洁、易于理解和二次开发。
KKKKhazix/khazix-skills
— kkkkhazix/khazix-skills 是一组可直接加载到 40 多种 AI 代理中的结构化指令集,用于目标设定、磁盘清理、文档对齐、研究和写作等任务。
keon/awesome-nlp
— keon/awesome-nlp 是一份专注于自然语言处理(NLP)领域的精选资源目录,按任务和语言组织了教程、库、数据集和研究资料。该项目严格聚焦于 NLP 任务与技术,明确排除了通用聊天机器人、智能体框架和 RAG 应用入门套件等范围外的内容。
arc53/DocsGPT
— docsgpt 是一个支持私有部署的开源平台,用于在企业自有数据上构建智能代理与执行深度检索。它支持多种文档格式与主流大语言模型,并在回答中标注来源引用,适用于有隐私控制要求的知识检索场景。
ai-shifu/ChatALL
— chatall 是一款桌面客户端工具,支持将同一条提示词同时发送给多个第三方 AI 机器人,帮助用户对比不同模型的输出结果。适合需要评估不同 AI 效果的普通用户、研究人员和开发者。
nashsu/llm_wiki
— llm_wiki 是一款桌面应用,利用 LLM 从用户的文档中增量构建并维护一个持久化、相互链接的知识 wiki。它与传统 RAG 的区别在于将知识编译为有组织的持久结构,而非每次从零开始检索和回答。
MODSetter/SurfSense
— surfsense 是一个开源竞争情报平台,通过实时抓取连接器、MCP 服务器和知识库,为 AI 智能体提供互联网实时市场数据并生成带引用的简报与预警。该项目目前尚未达到生产就绪状态,适用于深度研究与智能体自动化场景的初步探索。
xbtlin/ai-berkshire
— ai-berkshire 是一套投资研究技能集合,通过四位价值投资大师方法论的多智能体对抗分析,生成带明确结论的投资研究报告。它直接解决向 AI 提问获取投资分析时结果缺乏决策纪律、结构化与可操作性不足的问题。
hindupuravinash/the-gan-zoo
— 汇总研究者创意命名的各类生成对抗网络(GAN)及其论文链接的列表项目,帮助跟踪不断增长的 GAN 研究。
jina-ai/clip-as-service
— clip-as-service 是一个用于提供 CLIP 模型图像和文本嵌入的微服务,具有低延迟和高可扩展性,可平滑集成到神经搜索生态系统中。
XiaomiMiMo/MiMo-Code
— mimo-code 是一款终端原生的 AI 编码助手,能够读写代码、执行命令、管理 Git,并通过持久化记忆系统和多代理协作来持续改进自身。
langchain-ai/open_deep_research
— langchain-ai/open_deep_research 是一个可配置的开源深度研究智能体,通过协调大语言模型、搜索接口和模型上下文协议服务器生成研究报告。它支持更换模型与搜索工具,并提供本地网页界面、托管平台部署、评测配置和开放智能体平台部署路径。
×