AI 搜索 开源项目
浏览当前公开快照中经过筛选的 AI 搜索 AI 开源项目,并进入项目详情查看适用场景、部署条件、限制与核验证据。
当前展示 16 个可索引项目。
every-app/open-seo
open-seo 是一个可自托管的 SEO 工具,提供关键词研究和排名追踪等核心功能。它按量付费调用第三方数据 API,并通过 MCP 服务器将 SEO 数据连接给 AI 代理。
firecrawl/firecrawl
firecrawl 是一款面向 AI 系统的 Web 数据搜索与抓取 API,可将网页内容转换为 Markdown、结构化 JSON 或截图。它接管了代理轮换、速率限制和 JS 渲染等底层细节,为 LLM 应用提供可用的数据源。
qdrant/qdrant
qdrant 是用 Rust 编写的向量相似度搜索引擎,支持稠密向量、稀疏向量、多向量搜索与 JSON 负载过滤,并提供分片与副本的横向扩展能力。内置量化可将 RAM 占用降低多达 97%,用户可在搜索速度与精度之间进行调节。
milvus-io/milvus
milvus 是一款云原生向量数据库,支持在十亿级向量规模下进行可扩展的向量近似最近邻(ANN)搜索,并支持实时流式更新。
weaviate/weaviate
weaviate 是一款云原生向量数据库,将向量相似度搜索、关键字过滤与生成式 RAG 能力整合在单一查询中,旨在解决 AI 应用在规模化场景下需要独立部署检索、向量存储与生成系统的难题。
assafelovic/gpt-researcher
gpt-researcher 是一个自主深度研究代理,通过并行聚合超过 20 个网络或本地数据源,生成带有引用的详细研究报告。它采用规划与执行智能体协作完成研究任务,适用于需要客观、时效性信息整理的场景。
Panniantong/Agent-Reach
agent-reach 是一个为 AI 代理提供互联网平台读取与搜索能力的工具,通过为各平台选择和维护稳定的访问方式,应对 API 付费墙与反爬虫措施带来的阻碍。它通过有序的后端路由机制,在某个访问方式失效时自动切换。
meilisearch/meilisearch
meilisearch 是一款搜索引掣 API,提供结合语义与全文检索的混合搜索、拼写容错以及预置配置。项目自述称其搜索即输入场景下的响应时间低于 50 毫秒。
mvanhorn/last30days-skill
一个面向 AI 代理的研究技能,通过并行搜索多个社交媒体与媒体平台,并依据真实人类互动信号对结果进行评分和综合,最终生成结构化简报。
LAION-AI/Open-Assistant
Open Assistant 是一个已完结的聊天助手项目,支持在对话中理解用户任务并动态检索信息。该项目适合作为技术参考,但不再处于活跃维护阶段,不适合直接用于生产环境。
DeusData/codebase-memory-mcp
deusdata/codebase-memory-mcp 适合需要让 AI 编码代理在本地理解大型或多服务代码库的团队:它把源码索引为持久化知识图谱,并通过 MCP 或命令行提供结构、关系与语义查询。若需求是独立的自然语言问答系统,或不希望安装程序修改代理配置,则不宜直接采用。
ItzCrazyKns/Vane
itzcrazykns/vane 是一个注重隐私的 AI 搜索引擎,可在用户自有硬件上运行,并通过 SearxNG 和本地或云端大语言模型生成带引用来源的答案。
ScrapeGraphAI/Scrapegraph-ai
scrapegraph-ai 是一个使用 LLM 和有向图逻辑构建抓取管线的 Python 库,用户通过自然语言提示即可从网页和本地文档中提取数据。它支持多种 API 和本地 LLM,适用于需要降低多站点解析代码维护成本的 Python 开发场景。
screenpipe/screenpipe
screenpipe 将本地屏幕和音频录制转化为可搜索的 AI 记忆与自动化系统,数据默认在本地存储。它通过事件驱动捕获、音频转写、自然语言搜索及 Pipes 插件系统,帮助用户在严格保护隐私的前提下记录和调用电脑活动数据。
apache/doris
apache/doris 是一个基于 MPP 架构的统一分析数据库,提供 SQL 分析、湖仓查询加速、流式数据摄入以及跨结构化数据、文本和向量的混合搜索。
langchain-ai/open_deep_research
langchain-ai/open_deep_research 是一个可配置的开源深度研究智能体,通过协调大语言模型、搜索接口和模型上下文协议服务器生成研究报告。它支持更换模型与搜索工具,并提供本地网页界面、托管平台部署、评测配置和开放智能体平台部署路径。