模型开发 开源项目
浏览当前公开快照中经过筛选的 模型开发 AI 开源项目,并进入项目详情查看适用场景、部署条件、限制与核验证据。
当前展示 40 个可索引项目。
huggingface/transformers
transformers 是覆盖文本、视觉、音频、视频和多模态的统一模型定义库。它通过提供低门槛的统一 API、支持共享已训练权重以减少算力消耗,并允许在 PyTorch/JAX/TF2.0 框架间迁移模型来提供服务。
pytorch/pytorch
pytorch 是一个面向深度学习研究与 GPU 加速张量计算的 Python 库,通过基于磁带的自动微分系统构建动态神经网络,兼顾灵活性与速度。
huggingface/diffusers
diffusers 是一个面向预训练扩散模型(覆盖图像、音频、视频)的模块化工具箱,提供推理流水线、可互换噪声调度器和可组合的预训练模型组件,基于 PyTorch 构建。它强调可用性优先于性能、可定制优先于抽象封装,适合需要在代码层面灵活控制生成与训练流程的开发者和研究人员。
karpathy/autoresearch
autoresearch 是一个自主研究循环工具,由 AI agent 自动修改训练代码、执行短时实验并评估结果,用于迭代改进小型 LLM。它将实验标准化为 5 分钟固定训练预算,在单 GPU 上运行 nanochat 训练设置。
mlabonne/llm-course
llm-course 是一份免费的结构化教程,涵盖从 LLM 基础理论到应用部署的完整学习路径,分为 LLM Fundamentals、LLM Scientist 和 LLM Engineer 三个模块,并配有可交互的 Colab 笔记本。
d2l-ai/d2l-zh
d2l-zh 是一本开源的深度学习交互式教程,将数学公式、批判性思维与可运行的工程代码整合于同一资源中。它旨在帮助读者理解从理论到实践所需的知识,从而向应用科学家的方向发展。
josephmisiti/awesome-machine-learning
awesome-machine-learning 是一份按编程语言分类整理的机器学习框架、库和软件的精选目录列表。该仓库本身只提供链接,不包含可运行的代码。
hiyouga/LlamaFactory
llamafactory 为 100 多种大语言模型和视觉语言模型提供统一微调框架,支持通过零代码 CLI 和 Web UI 完成训练,涵盖从持续预训练到 DPO/PPO 等多种算法与量化调优方案。
unslothai/unsloth
unsloth 是一个支持通过 Web UI 和代码库在本地运行与训练文本、音频、嵌入及视觉模型的应用,旨在以更快的速度和更低的显存占用完成大模型任务。它同时提供数据集自动构建、模型导出和训练过程监控等支持性能力。
keras-team/keras
keras 是一个高级深度学习框架,支持在 JAX、TensorFlow、PyTorch 和 OpenVINO 后端上构建、训练和推理模型,旨在提供易调试的开发体验并规避框架锁定。
jingyaogong/minimind
minimind 是一个面向个人学习者的开源教育项目,提供从零开始用 PyTorch 训练 64M 参数大型语言模型的全流程代码与配套数据集。项目覆盖预训练到强化学习对齐的完整环节,旨在降低理解 LLM 的门槛。
JuliaLang/julia
julialang/julia 是一门动态编程语言,设计目标是将易用性与数值及科学计算所需的高性能结合。它面向技术计算场景,提供命令行交互式提示符与可执行程序构建方式。
GokuMohandas/Made-With-ML
made-with-ml 是一门教授如何将机器学习与软件工程实践相结合的课程及配套代码,旨在帮助开发者学习构建可靠的生产级机器学习系统。课程在编写代码前先建立对机器学习概念的原理性理解,并提供了涵盖数据处理、训练、实验追踪和模型服务的具体示例。
roboflow/supervision
supervision 为计算机视觉应用提供可复用的数据加载、检测、可视化等构建块,支持通过连接器接入多种主流分类、检测或分割模型。它帮助开发者减少重复代码编写,使其能将精力集中在应用逻辑上。
Lordog/dive-into-llms
dive-into-llms 是一个基于大学课程衍生的免费大语言模型(LLM)编程教程系列,提供涵盖微调、提示工程、知识编辑到 AI Agent 等主题的讲义与可执行代码。
aymericdamien/TensorFlow-Examples
tensorflow-examples 是一套面向初学者的 TensorFlow v1 与 v2 示例和教程集合,覆盖基础模型、神经网络、数据管理与硬件加速等主题。该项目通过提供清晰、简洁的源代码和 Jupyter Notebook,帮助学习者快速了解并实践 TensorFlow 的各项 API。
ray-project/ray
ray 是一个统一的 Python 与 AI 应用分布式框架,旨在将计算密集型机器学习负载从单机开发环境扩展到集群。它提供无状态任务、有状态 Actor 和不可变对象的分布式抽象。
deepspeedai/DeepSpeed
deepspeed 面向需要扩展大模型训练与推理的 PyTorch 开发者,通过 ZeRO、ZeRO-Infinity、3D 并行和 Ulysses 序列并行等系统优化降低分布式计算的工程复杂度。它适合具备代码、编译工具链和环境排障能力的团队,不是面向非技术用户的开箱即用应用。
hpcaitech/ColossalAI
colossalai 提供一组并行组件,开发者可以像在笔记本电脑上编写模型一样编写分布式深度学习模型,旨在克服大模型训练和推理的硬件与成本瓶颈。
shiyu-coder/Kronos
Kronos 是一个面向金融 K 线(蜡烛图)序列的预训练基础模型,采用分层分词器和自回归 Transformer 架构,旨在支持多种量化任务。该项目自述在超过 45 个全球交易所的数据上进行了预训练,并称自身为首个针对金融 K 线的开源基础模型。
lllyasviel/ControlNet
ControlNet 是一种神经网络结构,通过为文本到图像扩散模型添加额外的空间条件来实现控制,同时不会破坏已有的生产级基础模型。
yunjey/pytorch-tutorial
yunjey/pytorch-tutorial 提供简明的深度学习教程代码,覆盖从 PyTorch 基础到高级模型,大多数实现代码少于 30 行。适合用于学习而非生产环境部署。
sgl-project/sglang
sglang 是一个面向大语言模型和多模态模型的服务框架,通过 RadixAttention、零开销调度器和连续批处理等运行时特性,提供低延迟、高吞吐的推理能力,并具备多硬件平台兼容性。
d2l-ai/d2l-en
d2l-ai/d2l-en 是一本开源的交互式深度学习教材,以 Jupyter Notebook 为载体,整合了图表、数学公式和可运行的代码。该项目旨在通过统一的教学资源,帮助读者在概念、背景和代码层面学习深度学习。
HandsOnLLM/Hands-On-Large-Language-Models
hands-on-large-language-models 是《Hands-On Large Language Models》一书的配套代码库,提供涵盖大语言模型入门到高级主题的可运行 Jupyter 笔记本及近 300 幅原创教学插图。
liguodongiot/llm-action
llm-action 整理了面向大语言模型的训练与参数高效微调教程,部分示例配有代码链接,适合希望动手实践训练流程的开发者与研究人员。
AiHubCN/Awesome-Chinese-LLM
awesome-chinese-llm 是一个收录了 100 多个开源中文大语言模型资源的精选清单,涵盖基础模型、垂直领域微调模型、数据集与教程。它解决的是优质中文 LLM 资源分散难以发现的问题,其本身是一个导航列表,而非可直接运行的应用程序或模型。
recommenders-team/recommenders
recommenders 是一个用于推荐系统原型设计、实验与生产化的工具包,提供经典算法与深度学习算法的实现示例及可复用 Python 工件。需注意实验性模型未经充分测试且可能需要额外安装步骤。
huggingface/peft
peft 是一个用于在大型预训练模型上执行参数高效微调(如 LoRA)的 Python 库,仅训练少量额外参数即可降低计算与存储开销,并在性能上接近全量微调。
AI4Finance-Foundation/FinGPT
fingpt 面向金融文本处理与金融大语言模型定制,提供金融预测、多任务金融模型、低秩适配微调和检索增强框架。它适合具备 Python、模型运行环境和金融数据处理需求的研究与工程团队,不适合作为真实资金交易或投资建议工具。
kvcache-ai/ktransformers
ktransformers 是一个针对大语言模型(尤其是 MoE 模型)的推理与微调框架,通过 CPU-GPU 异构计算降低硬件门槛。它支持在本地环境中加速模型推理并集成微调工具链。
ymcui/Chinese-LLaMA-Alpaca
chinese-llama-alpaca 在原始 LLaMA 词表基础上扩充中文字符,提供开源的中文 LLaMA 与 Alpaca 模型 LoRA 权重、训练脚本和本地部署工具,用于改善中文语义理解与指令跟随能力。
lightgbm-org/LightGBM
lightgbm 是一个基于树学习算法的梯度提升框架,针对大规模数据训练场景提供较快的训练速度和较低的内存占用。
stas00/ml-engineering
为训练和调试大语言模型及多模态模型提供开源的方法论集合与可复制粘贴的命令指南。内容源自 BLOOM-176B 和 IDEFICS-80B 等大型开源模型的真实训练经验。
pytorch/vision
vision 为 PyTorch 提供计算机视觉任务所需的核心组件,包括公开数据集的下载与准备、常用图像变换以及预训练模型架构。
NVIDIA-NeMo/Speech
nvidia-nemo/speech 是面向研究人员和 PyTorch 开发者的语音 AI 框架,用于构建、定制和部署语音识别(ASR)、语音合成(TTS)及语音大模型。目前项目正处于转型期,重心转向音频、语音和多模态大模型。
camel-ai/camel
camel 是面向研究人员与人工智能工程师的多智能体系统框架,适合通过 Python 构建智能体协作、任务自动化、检索增强和合成数据流程。它要求编程,且基础快速上手路径需要 OpenAI 接口密钥,因此不适合作为无代码工具或托管服务。
argoproj/argo-workflows
argo-workflows 是一个开源的容器原生工作流引擎,运行于 Kubernetes 之上,用于编排并行任务并管理任务间的依赖关系。用户可以将机器学习或数据处理等计算密集型作业建模为多步骤工作流或 DAG,每个步骤以容器方式执行。
ddbourgin/numpy-ml
numpy-ml 是一个用 NumPy 实现的机器学习算法集合,优先保证代码的可读性和透明度,而非运行效率。它适合用作学习常见 ML 算法实现细节的参考,以及快速搭建原型时的起点。
treeverse/dvc
dvc 为机器学习项目提供类 Git 的数据与模型版本控制,同时支持轻量级 ML 流水线和本地实验跟踪,无需独立服务器即可运行。