AI Agent 开源项目
浏览当前公开快照中经过筛选的 AI Agent AI 开源项目,并进入项目详情查看适用场景、部署条件、限制与核验证据。
当前展示 40 个可索引项目。
koala73/worldmonitor
worldmonitor 适合需要在同一界面查看全球新闻、地缘政治、金融与基础设施信号,并结合地图和人工智能简报开展态势研判的团队。若需求只是抓取网页、检索内部资料或连接数据库,应优先评估更聚焦的工具。
usestrix/strix
strix 提供自主 AI 渗透测试代理,能够动态运行代码并使用真实的 PoC 验证漏洞,从而减少传统静态分析产生的误报。该项目支持通过本地代码库或 Web URL 进行自动化安全测试。
ollama/ollama
ollama/ollama 提供了一种在本地运行开源大语言模型的简便方式,支持通过 CLI、REST API 和编程语言库进行交互。
stablyai/orca
orca 是一个 AI 开发环境,用于在不同 git worktree 中并行运行 CLI 编码代理(如 Codex、Claude Code)。它提供了一个桌面和移动端应用,用于统一追踪和引导这些代理。
openai/codex-plugin-cc
codex-plugin-cc 是一个 Claude Code 插件,让开发者在不离开当前工作流的前提下将只读代码审查、对抗性设计挑战和后台任务委派给 Codex。它复用已有的本地 Codex CLI 和配置来执行任务。
HKUDS/Vibe-Trading
vibe-trading 是一个将自然语言提问接入市场数据加载、策略生成、回测引擎与研究报告的量化研究工作台。它覆盖 A/HK/US 股票、加密货币、期货和外汇市场,提供自改进代理和多代理团队来辅助投资与风险分析。
alibaba/page-agent
page-agent 是一个在网页内部运行的 JavaScript GUI 代理,通过文本形式的 DOM 处理实现网页自然语言交互控制。该方案无需浏览器扩展、后端重写或无头浏览器即可在页面内直接部署。
langgenius/dify
dify 是一个将可视化 AI 工作流编排、RAG 数据管道、Agent 构建与模型管理融为一体的开源后端即服务平台。它通过提供直观的可视化界面与底层 API,帮助开发团队在无需编写大量基础代码的情况下,从原型过渡到生产级的 LLM 应用。
langchain-ai/langchain
langchain 是一个用于简化大语言模型应用开发的 Python 框架,通过提供标准接口帮助开发者将模型、向量数据库等互操作组件和第三方集成链接起来。它使开发者能够灵活地在不同抽象层级上构建和编排 AI 应用。
bradautomates/claude-video
claude-video 以自包含技能单元形式,让 AI 助手通过下载视频、提取帧和转录音频来获取视频内容。该技能支持在多个代理宿主中运行,依赖 ffmpeg 和 yt-dlp 处理视频,并可通过可选的 Groq 或 OpenAI API 进行音频转录。
infiniflow/ragflow
ragflow 是一款面向企业的 RAG 引擎,核心特点是基于深度文档理解技术处理复杂格式的非结构化数据。它提供包含高质量文档分块和可溯源引用的 RAG 工作流,并支持配置外部 LLM 和嵌入模型。
openclaw/openclaw
openclaw 是一个本地优先的单用户个人 AI 助手,将 WhatsApp、Telegram、Slack 和 Discord 等多个通讯渠道聚合为统一的多渠道收件箱,让用户在自己的设备上管理和响应消息。
obra/superpowers
obra/superpowers 是面向 AI 编程代理的技能与开发方法框架,重点把设计澄清、测试驱动开发和子代理协作串成可执行流程。若团队的主要痛点是代理直接改代码而缺少计划、测试与复核,它是优先评估的流程层选项。
affaan-m/ECC
ecc 是一套面向多种 AI 编程代理工具的本地工作流增强系统,重点提供可复用技能、跨工具钩子、安全扫描与持续优化能力。它更适合希望统一和治理现有代理开发流程的团队,而不是寻找独立编码模型或完整 IDE 的用户。
NousResearch/hermes-agent
hermes-agent 是一款具备自我改进能力的持久化 AI 代理,能够从交互经验中自主创建并优化技能。它支持跨会话记忆和多平台消息交付,可运行在低成本 VPS 或无服务器架构上。
n8n-io/n8n
n8n 是一个源码可见的工作流与 AI Agent 自动化平台,通过可视化画布、自定义代码和 1500+ 集成连接企业现有系统。支持自托管与多模型灵活切换,适合需要流程编排且对数据边界有控制要求的团队。
anomalyco/opencode
opencode 是一款开源 AI 编码智能体,内置全权限构建智能体和只读规划智能体,能够探索代码库、规划变更并执行开发任务。它支持通过主流包管理器一行命令安装,并提供跨平台的桌面客户端。
Significant-Gravitas/AutoGPT
autogpt 是面向持续智能体与复杂工作流自动化的低代码平台,覆盖可视化构建、持续运行、预构建智能体复用、开发工具包和基准测试。它适合愿意承担一定自托管成本、希望从设计走向长期运行的开发者与团队,但不适合要求立即使用成熟托管云服务的场景。
anthropics/skills
anthropics/skills 提供了一组可复用的 Agent Skills(技能)、模板和规范,用于启发并帮助用户为 Claude 创建完成特定任务的自定义技能。这些技能本质上是以文件夹形式组织的指令集,需要依赖兼容的 Claude 平台才能执行。
firecrawl/firecrawl
firecrawl 是一款面向 AI 系统的 Web 数据搜索与抓取 API,可将网页内容转换为 Markdown、结构化 JSON 或截图。它接管了代理轮换、速率限制和 JS 渲染等底层细节,为 LLM 应用提供可用的数据源。
langflow-ai/langflow
langflow 适合需要用可视化方式快速设计、测试并交付智能体工作流的开发者与团队,成品可直接发布为 API 或 MCP 服务,也可导出为供 Python 应用使用的 JSON。其优势是原型迭代与集成交付路径较完整,但深度组件定制仍需要 Python 能力。
anthropics/claude-code
claude-code 是一款驻留在终端中的代理式编码工具,能理解你的代码库并通过自然语言指令帮助加快开发流程。它将复杂代码解释、常规任务执行和 Git 操作整合到命令行中,减少上下文切换的开销。
msitarzewski/agency-agents
msitarzewski/agency-agents 适合希望直接复用专业角色型智能体,而不是从通用提示模板开始搭建的开发者与团队。其核心优势是按工程、设计和安全等分工组织交付导向的智能体,并可安装到多种智能体编程工具中。
Shubhamsaboo/awesome-llm-apps
awesome-llm-apps 收录了 100 多个经过测试的端到端开源 AI 代理和 RAG 应用合集,涵盖了从基础单文件代理到多代理协作系统、语音和 RAG 流水线等多种架构模式。它适合开发者用来学习和快速启动各类 AI 应用原型。
garrytan/gstack
garrytan/gstack 是面向独立开发者和小团队的开源软件开发流程工具,通过 23 个专业化斜杠命令角色组织从思考、规划到交付和复盘的开发周期。它需要配合兼容的 AI 编码代理使用。
farion1231/cc-switch
cc-switch 是一款跨平台桌面应用,提供可视化界面统一管理多种 AI 编码工具的供应商配置、MCP 服务器与技能。它通过集中化管理多工具配置,解决了手动编辑分散配置文件的效率瓶颈。
continuedev/continue
continuedev/continue 是一个开源 AI 编码代理,提供 CLI 工具和 VS Code 扩展,支持在多种开发环境中辅助编写代码。请特别注意,该项目仓库目前已处于只读且不再维护的状态,且 JetBrains 插件已标记为弃用。
run-llama/llama_index
run-llama/llama_index 是一个面向 LLM 应用的数据框架,用于接入既有数据、组织数据,并在数据之上提供检索与查询接口。它适合需要用私有数据增强 LLM 应用或构建智能体应用的代码型团队。
unclecode/crawl4ai
crawl4ai 将网页内容转化为经过清洗的 Markdown 和结构化数据,适用于 RAG 和数据管道。该项目无需强制使用 API 密钥,提供包括 Python 库和 Docker 在内的多种部署方式,并具备浏览器控制与反爬虫规避能力。
modelcontextprotocol/servers
servers 是 MCP(Model Context Protocol)的参考实现集合,由 MCP 指导小组管理,提供多个展示协议特性和 SDK 用法的示例服务器。其定位是教育和参考用途,而非可直接用于生产环境的解决方案。
browser-use/browser-use
browser-use/browser-use 是面向开发者的浏览器智能体 Python 库,可根据自然语言任务执行打开页面、点击、输入和填写表单,并输出已完成的浏览器操作或结构化数据。适合需要以代码扩展网页自动化流程的团队,但采用前应评估外部大模型 API、Chrome 内存占用以及验证码和浏览器指纹问题。
google-gemini/gemini-cli
google-gemini/gemini-cli 是一款面向终端开发者的 Gemini 智能代理,支持通过自然语言完成代码理解、编辑、调试及脚本自动化。它具备免费层访问且扩展能力较强,但模型能力依赖外部 Google Gemini API,若要求完全离线运行则不应优先选择。
Mintplex-Labs/anything-llm
anything-llm 提供了一套集成文档对话与 AI 代理能力的桌面或服务器端应用,支持本地隐私部署与多用户权限管理。用户无需编写代码即可通过图形界面将 PDF 等文件导入工作区进行问答交互。
openai/codex
openai/codex 是一个在本地终端中运行的轻量级编程代理。它通过结合 ChatGPT 账号或 API 集成,在用户的计算机上提供编码辅助。
crewAIInc/crewAI
crewaiinc/crewAI 是一个用于编排多智能体协作和生产级自动化工作流的 Python 框架。该项目结合了自主协作的 Crews 和事件驱动的 Flows,旨在在自主性与精确控制之间取得平衡。
TauricResearch/TradingAgents
tradingagents 是一个多智能体 LLM 框架,通过部署专门的分析、研究、交易和风险管理智能体来模拟真实交易公司的运作,以协助评估市场状况并告知交易决策。该项目专为研究目的设计,其输出并非保证收益的财务或投资建议。
FlowiseAI/Flowise
flowise 是一款低代码/无代码可视化构建工具,通过拖拽组件的方式帮助不具备编码能力的用户搭建并部署 AI 智能体和多智能体系统。用户只需通过单条 npm 命令即可在本地启动并使用其网页界面。
karpathy/autoresearch
autoresearch 是一个自主研究循环工具,由 AI agent 自动修改训练代码、执行短时实验并评估结果,用于迭代改进小型 LLM。它将实验标准化为 5 分钟固定训练预算,在单 GPU 上运行 nanochat 训练设置。
deepset-ai/haystack
haystack 是一个 Python 框架,用于构建生产就绪的 LLM 应用程序,通过模块化管道编排检索、路由和生成过程。该框架允许开发者对信息进行检索、过滤和组合后提供给模型,并支持在系统间切换不同的模型或基础设施组件。
DietrichGebert/ponytail
ponytail 是一个面向 AI 编码助手的规则集,通过要求 Agent 遵循惰性求值阶梯(复用现有代码、标准库或原生功能)来减少编写不必要的新代码,从而降低代码冗余。它在缩减代码量的同时,声明会保留验证、安全和无障碍等既有安全防护。