🤖 AI开源项目全景图

覆盖主流AI开源生态,从大模型到应用落地,从热门赛道到待开发蓝海——一份面向开发者的全景导航

200+
收录开源项目
15
核心领域分类
7
空白待开发领域
🧠 大模型(Foundation Models)

通用大语言模型——从千亿参数巨兽到高效轻量模型,开源社区正在打破闭源垄断

🔮 DeepSeek-V3 ⭐ 92K

DeepSeek 第三代 MoE 架构大模型,671B 参数,激活仅 37B。在多项基准上超越 Llama 3.1 和 GPT-4o,训练成本仅为同类模型的 1/10。

MoE架构中文优化MIT协议
🧪 DeepSeek-R1 ⭐ 92K

深度求索推出的推理增强模型,通过强化学习训练,具备 Chain-of-Thought 深度推理能力。在数学和编程任务上表现出色。

推理增强强化学习数学/代码
🦙 Llama 4 ⭐ 50K

Meta 开源的最新一代大语言模型系列,包含 Scout(109B)和 Maverick(400B+)两款 MoE 模型,支持 1000 万 token 超长上下文。

Meta出品MoE架构超长上下文
🌐 Qwen3 ⭐ 35K

阿里云通义千问第三代模型,支持思考/非思考模式切换。0.6B~235B 全尺寸覆盖,在多语言和代码能力上表现优异。

阿里云思考模式全尺寸
🌬️ Mistral ⭐ 30K

法国 AI 初创公司推出的高效大模型系列,以 7B 参数量达到 13B 级别性能。擅长滑动窗口注意力和高效推理。

欧洲AI高效架构滑动窗口
💬 GLM-4 ⭐ 15K

智谱 AI 推出的 GLM 系列第四代模型,支持多模态、长上下文和工具调用。中文理解和对话能力出色。

清华系多模态中文对话
🏔️ InternLM3 ⭐ 10K

上海AI实验室推出的书生浦语大模型第三代,在数学推理、代码生成和指令遵循方面有显著提升。

上海AI Lab推理能力指令遵循
💎 Gemma 2 ⭐ 12K

Google DeepMind 推出的轻量级开源模型,2B/9B/27B 三种规格。基于 Gemini 技术,在同等规模中表现领先。

Google轻量高效Gemini技术
⚡ 推理部署(Inference & Serving)

让大模型跑起来——从本地一键部署到生产级高并发服务

🦙 Ollama ⭐ 181K

本地大模型一键运行工具,支持 llama3、mistral、qwen 等主流模型。像 Docker 一样拉取和管理模型,零配置体验。

一键部署本地运行跨平台
🔥 llama.cpp ⭐ 80K

纯 C/C++ 实现的 LLM 推理引擎,无需 Python 依赖。支持 GGUF 量化格式,在 CPU 上也能高效运行大模型。

C/C++GGUF量化CPU推理
🚀 vLLM ⭐ 65K

高吞吐量 LLM 推理和服务引擎,采用 PagedAttention 技术,显存利用率提升 2-4 倍。生产环境首选。

PagedAttention高吞吐生产级
🔗 LiteLLM ⭐ 25K

统一的 LLM API 网关,用 OpenAI 格式调用 100+ 个 LLM 提供商。支持负载均衡、限流和费用追踪。

API网关100+提供商统一接口
⚡ SGLang ⭐ 20K

高性能 LLM 推理框架,支持 RadixAttention 前缀缓存。在多轮对话和结构化输出场景中性能领先。

RadixAttention前缀缓存结构化输出
🏠 LocalAI ⭐ 30K

本地 AI API 服务,兼容 OpenAI API 格式。支持 LLM、图像生成、音频转录等多种 AI 能力,无需 GPU 也可运行。

OpenAI兼容多模态无GPU可用
📱 MLC LLM ⭐ 20K

跨平台 LLM 部署引擎,支持在手机、浏览器、嵌入式设备上运行大模型。基于 TVM 编译优化。

移动端浏览器TVM编译
🔧 TensorRT-LLM ⭐ 15K

NVIDIA 官方 LLM 推理优化库,基于 TensorRT 深度优化。在 NVIDIA GPU 上实现极致推理性能。

NVIDIA官方GPU优化极致性能
🔧 微调训练(Fine-tuning & Training)

让通用模型变成你的专属专家——从 LoRA 轻量微调到全参数训练

🏭 LLaMA-Factory ⭐ 72K

一站式大模型微调框架,支持 100+ 模型的 SFT/RLHF/DPO 训练。Web UI 可视化操作,零代码完成微调。

一站式Web UI100+模型
🚀 Unsloth ⭐ 67K

极速微调框架,训练速度提升 2-5 倍,显存节省 70%。支持 LoRA/QLoRA,手写 Triton 内核深度优化。

极速训练显存优化Triton内核
🎯 TRL ⭐ 19K

HuggingFace 官方的强化学习训练库,支持 SFT、RLHF、DPO、PPO 等对齐训练方法。

HuggingFaceRLHFDPO/PPO
🦅 ms-swift ⭐ 18K

魔搭社区推出的轻量级训练框架,支持 300+ LLM 和 50+ MLLM 的微调。PEFT 方法全覆盖。

魔搭社区PEFT300+模型
🤗 Transformers ⭐ 145K

HuggingFace 核心库,提供数千种预训练模型的统一 API。NLP、CV、音频、多模态全覆盖,AI 基础设施级项目。

HuggingFace基础设施全模态
🔥 PyTorch ⭐ 88K

Meta 主导的深度学习框架,动态计算图 + Pythonic 设计。学术界和工业界的事实标准,几乎所有 AI 项目的基础。

深度学习框架事实标准Meta主导
🤖 Agent(智能体框架)

让大模型自主规划、使用工具、协作完成复杂任务——AI 应用的终极形态

🦜 LangChain ⭐ 146K

LLM 应用开发框架的事实标准。提供链式调用、工具集成、记忆管理等核心抽象,生态最完整。

事实标准链式调用生态最全
🕸️ LangGraph ⭐ 15K

LangChain 团队推出的有状态多 Agent 编排框架。基于图结构定义复杂工作流,支持循环和条件分支。

图编排有状态多Agent
🎭 AutoGen ⭐ 40K

微软推出的多 Agent 对话框架,支持 Agent 之间自主对话协作。可自定义 Agent 角色和对话流程。

微软多Agent对话角色自定义
👥 CrewAI ⭐ 28K

面向多 Agent 协作的编排框架,模拟团队分工。每个 Agent 有专属角色、目标和工具,协同完成复杂任务。

团队协作角色分工任务编排
🔌 Composio ⭐ 20K

Agent 工具集成平台,提供 200+ 应用的即插即用连接器。让 AI Agent 轻松操作 Gmail、Slack、GitHub 等外部服务。

200+集成即插即用工具平台
📚 RAG(检索增强生成)

让大模型拥有你的知识——连接私有数据,消除幻觉,精准回答

📜 RAGFlow ⭐ 83K

端到端 RAG 引擎,深度文档解析能力突出。支持 PDF/Word/PPT 等复杂格式的智能切片和检索。

端到端文档解析深度切片
🦙 LlamaIndex ⭐ 50K

数据框架 for LLM 应用。提供数据连接、索引构建和查询接口,支持 160+ 数据源接入。

数据框架160+数据源索引构建
💬 Langchain-Chatchat ⭐ 38K

基于 LangChain 的本地知识库问答方案。开箱即用,支持多种文档格式,中文场景优化。

本地部署中文优化开箱即用
🌈 Chroma ⭐ 28K

AI 原生开源向量数据库,嵌入式部署零配置。API 简洁优雅,适合快速原型和中小型生产环境。

向量数据库嵌入式零配置
⚡ Qdrant ⭐ 22K

高性能向量搜索引擎,Rust 编写。支持过滤、Payload 存储和分布式部署,生产级可靠性。

Rust编写高性能分布式
🔍 Milvus ⭐ 32K

云原生分布式向量数据库,支持万亿级向量检索。LF AI 基金会毕业项目,企业级首选。

云原生万亿级企业级
🌾 Haystack ⭐ 26K

模块化 NLP/RAG 框架,支持灵活的 Pipeline 编排。可自由组合检索器、阅读器和生成器组件。

模块化Pipeline编排灵活组合
💻 AI编程(AI Coding)

AI 驱动的编程革命——从代码补全到自主开发,程序员的新搭档

⚡ Cline ⭐ 68K

VS Code 中的自主编程 Agent。能读写文件、执行命令、浏览网页,像一个结对编程的 AI 搭档。

VS Code自主编程结对编程
🙌 OpenHands ⭐ 50K

AI 软件开发 Agent 平台(原 Devin 开源替代)。能自主编写代码、调试、执行测试,完成端到端开发任务。

Devin替代端到端开发自主调试
🤝 Aider ⭐ 30K

终端中的 AI 结对编程工具。直接在 Git 仓库中与 AI 对话修改代码,自动 commit,支持多种 LLM。

终端工具Git集成自动Commit
▶️ Continue ⭐ 25K

开源 AI 代码助手,支持 VS Code 和 JetBrains。代码补全、聊天、编辑一体化,可接入本地模型。

IDE插件代码补全本地模型
🔬 SWE-agent ⭐ 16K

普林斯顿大学推出的自动修复 GitHub Issue 的 Agent。在 SWE-bench 基准上表现优异,学术研究标杆。

学术研究自动修复SWE-bench
🧠 MiniMind ⭐ 25K

从零手把手训练一个微型 LLM 的教程项目。2 小时即可训练 26M 参数的 GPT,LLM 入门最佳实践。

教程项目从零训练LLM入门
🎨 图像生成与处理

AI 画师军团——从 Stable Diffusion 生态到目标检测,视觉创造力全面爆发

🎨 ComfyUI ⭐ 80K

节点式 Stable Diffusion 工作流引擎。可视化编排复杂图像生成流程,支持 ControlNet/IPAdapter 等插件生态。

节点式工作流插件丰富
🖼️ Stable Diffusion ⭐ 70K

开创性的文生图扩散模型。开源引爆 AI 绘画革命,催生了庞大的社区生态和无数衍生项目。

扩散模型文生图开创性
🎯 Fooocus ⭐ 45K

简化版 Stable Diffusion 前端,专注于易用性。一键安装,自动优化提示词,小白也能生成高质量图片。

零门槛一键安装自动优化
🎛️ ControlNet ⭐ 30K

为扩散模型添加精确空间控制。支持边缘图、深度图、姿态图等多种条件输入,AI 绘画精确控制的里程碑。

空间控制条件生成里程碑
⚡ FLUX ⭐ 20K

Black Forest Labs 推出的新一代文生图模型,图像质量和文字渲染能力大幅提升。SD 核心团队出走后的力作。

新一代高质量文字渲染
👁️ YOLOv8 ⭐ 35K

Ultralytics 推出的最新 YOLO 系列,支持检测、分割、分类、姿态估计。实时目标检测的行业标准。

目标检测实时推理多任务
🎬 视频生成与处理

AI 视频生成进入爆发期——从文本到视频,创作门槛急剧降低

🌊 Wan2.1 ⭐ 25K

阿里通义万相视频生成模型,支持文生视频和图生视频。开源版本质量媲美商业方案,中文生态友好。

阿里出品文生视频高质量
💡 LTX-Video ⭐ 10K

Lightricks 推出的高效视频生成模型,推理速度快。支持文本到视频和图像到视频的流畅生成。

高效推理文生视频图生视频
🎞️ Open-Sora ⭐ 25K

Colossal-AI 团队的开源 Sora 复现方案。致力于民主化视频生成技术,支持长视频和高分辨率。

Sora复现开源长视频
💰 MoneyPrinterTurbo ⭐ 25K

一键生成短视频的 AI 工具。自动编写文案、匹配素材、添加配音和字幕,批量生成可发布的短视频。

一键生成短视频自动配音
🎵 音频与语音

让 AI 开口说话、听懂世界——语音识别、合成和音乐生成

👂 Whisper ⭐ 75K

OpenAI 开源的通用语音识别模型,支持 99 种语言。鲁棒性强,几乎能处理任何音频质量的转录任务。

OpenAI99种语言鲁棒性强
⚡ faster-whisper ⭐ 15K

Whisper 的 CTranslate2 加速版本,推理速度提升 4 倍。保持相同精度,大幅降低部署成本。

4倍加速CTranslate2低成本
🗣️ Coqui TTS ⭐ 35K

深度学习文本转语音工具包,支持多说话人和语音克隆。提供 XTTS 等高质量模型。

语音合成语音克隆多说话人
🎙️ CosyVoice ⭐ 15K

阿里通义实验室的语音合成模型,支持中英日韩粤多语言。零样本语音克隆效果出色。

阿里出品多语言零样本克隆
🐕 Bark ⭐ 35K

Suno AI 推出的文本转语音模型,能生成高度逼真的人声。支持笑声、叹息等非语言声音和背景音效。

逼真人声非语言声音Suno出品
🎵 Suno API ⭐ 20K

Suno 音乐生成 API 的非官方封装。通过文本描述即可生成完整歌曲,包含旋律、歌词和编曲。

音乐生成文本生曲API封装
👁️ 多模态模型

突破文本边界——能看图、理解视频、处理多种信息的 AI 模型

🌐 Qwen2.5-VL ⭐ 15K

通义千问视觉语言模型,支持图像理解、视频分析和 Agent 操作。能理解复杂图表和长视频内容。

视觉语言视频分析Agent操作
🏔️ InternVL ⭐ 10K

上海AI实验室的多模态大模型,视觉理解能力领先。支持图文对话、文档解析、图表分析等任务。

视觉理解文档解析图表分析
🔮 CogVLM2 ⭐ 10K

智谱AI的视觉语言模型第二代,在视觉问答和图像描述上表现优异。支持高分辨率图像输入。

智谱AI高分辨率视觉问答
🦙 LLaVA ⭐ 20K

大型语言和视觉助手,开创性地将视觉编码器与 LLM 连接。多模态研究的重要基线模型。

开创性视觉助手基线模型
🏗️ AI 基础设施与应用平台

搭建 AI 应用的底座——从工作流编排到一站式对话平台

🔗 n8n ⭐ 204K

开源工作流自动化平台,支持 400+ 集成。可视化编排复杂业务流程,AI 节点让工作流拥有智能。

工作流400+集成可视化
🌊 Dify ⭐ 80K

开源 LLM 应用开发平台,提供 Agent 工作流、RAG 管道、模型管理和可观测性。从原型到生产的完整方案。

应用平台Agent工作流RAG管道
💬 NextChat ⭐ 80K

轻量级 ChatGPT/LLM 对话客户端(原 ChatGPT-Next-Web)。一键部署,支持多模型切换和 PWA。

一键部署多模型PWA支持
🧠 Lobe Chat ⭐ 60K

现代化的开源 AI 对话框架,支持插件系统、知识库和多模态。UI 设计精美,开发者体验优秀。

精美UI插件系统知识库
🌐 browser-use ⭐ 65K

让 AI Agent 操作浏览器的 Python 库。LLM 驱动的网页自动化,能完成填表、点击、导航等复杂交互。

浏览器自动化Agent驱动网页交互
📦 AnythingLLM ⭐ 35K

一站式 LLM 私有化部署桌面应用。支持文档上传、向量化、对话,内置多种 LLM 和嵌入模型。

桌面应用私有化部署开箱即用
🎛️ Gradio ⭐ 38K

快速构建 ML 演示应用的 Python 库。几行代码创建 Web 界面,HuggingFace Spaces 的默认框架。

快速原型HuggingFaceWeb界面
📖 Jina Reader ⭐ 20K

将任意 URL 转换为 LLM 友好的文本格式。网页内容提取利器,RAG 管道的重要组件。

网页提取LLM友好RAG组件
🔌 MCP(模型上下文协议)

连接 AI 与外部世界的新标准——Anthropic 推出的 Model Context Protocol 生态

📋 awesome-mcp-servers ⭐ 95K

MCP 服务器的精选列表,收录数百个社区开发的 MCP 实现。涵盖数据库、文件系统、API 等各类工具集成。

精选列表社区驱动数百实现
🏛️ MCP 官方 Servers ⭐ 15K

Anthropic 官方维护的 MCP 服务器参考实现。包含文件系统、GitHub、数据库等核心连接器。

Anthropic官方参考实现核心连接器
📊 评估与可观测性

衡量 AI 应用的质量——从 LLM 输出评估到全链路可观测

🔭 Langfuse ⭐ 34K

开源 LLM 可观测性和评估平台。追踪每次调用的延迟、成本和质量,支持 Prompt 管理和 A/B 测试。

可观测性成本追踪A/B测试
🧪 DeepEval ⭐ 10K

LLM 输出评估框架,提供幻觉检测、相关性评分、毒性检测等评估指标。像 pytest 一样写测试。

幻觉检测评估框架pytest风格
📐 RAGAS ⭐ 8K

RAG 系统评估框架,自动评估检索质量和生成质量。无需标注数据即可衡量 RAG 管道表现。

RAG评估无需标注自动化
🔍 空白领域分析

7 个被开源社区忽视但潜力巨大的垂直领域——机会正在等待先行者

⚖️ 法律 AI

法律文本高度专业化,各国法律体系差异大。数据隐私和合规要求严格,案例标注成本极高。法律后果的严重性要求 AI 输出几乎零容错。

合同审查自动化、法律文书生成、案例检索与分析、合规风险评估。中国法律 AI 市场几乎空白,中文法律大模型潜力巨大。

🌾 农业 AI

农业生产环境复杂多变,数据采集困难(田间、大棚等场景)。作物病害、土壤分析等需要专业知识,开源数据集稀缺。硬件部署在偏远地区面临网络和算力挑战。

病虫害图像识别、智能灌溉决策、产量预测模型、农产品质量检测。中国作为农业大国,智慧农业需求迫切。

🏛️ 政务 AI

政务数据涉及国家安全,开放程度极低。审批流程复杂且各地区差异大,AI 需要理解大量政策法规。系统对接要求高,需与现有政务系统深度集成。

智能政务问答、政策文件解析、审批流程自动化、舆情分析。数字政府建设浪潮下,政务 AI 有万亿级市场空间。

🏥 医疗 AI

医疗数据极度敏感,隐私保护要求严格。AI 辅助诊断的法律责任界定不清。需要医学专业知识验证,标注成本高。FDA/NMPA 等监管审批周期长。

医学影像辅助诊断、电子病历结构化、药物研发分子生成、健康管理助手。中国医疗资源不均衡,AI 辅助有巨大社会价值。

🎓 教育 AI

教育内容需要严格准确性,AI 幻觉可能导致知识错误。个性化教学需要深度理解学生认知状态。不同年龄段、学科的教学方法差异大。

自适应学习系统、AI 家教辅导、作业自动批改、知识点图谱构建。中国 K12 和职业教育市场庞大,个性化教育需求旺盛。

🏭 工业 AI

工业场景要求极高的可靠性和实时性。设备数据格式多样,协议不统一。故障样本稀少(正常运行远多于故障),模型训练数据不平衡。

预测性维护、质量检测视觉系统、工艺参数优化、供应链智能调度。中国制造业转型升级,工业 AI 是核心驱动力。

🔬 科研 AI

科学研究要求极高的准确性和可解释性。跨学科知识整合困难,专业壁垒高。实验数据获取成本高,可复现性验证复杂。

文献智能综述、实验设计优化、蛋白质结构预测、材料性质模拟。AI for Science 是诺贝尔奖级别的前沿方向。

📊 领域项目密度对比

各领域开源项目的成熟度一目了然——颜色越深代表生态越繁荣

领域 代表项目数 总 Stars 生态密度 成熟度
🏗️ 基础设施 8 ~522K
★★★★★
🤖 Agent 框架 5 ~249K
★★★★★
🧠 大模型 8 ~386K
★★★★☆
⚡ 推理部署 8 ~446K
★★★★☆
🔧 微调训练 6 ~409K
★★★★☆
📚 RAG 7 ~276K
★★★★☆
🎨 图像 6 ~280K
★★★★☆
💻 AI编程 6 ~214K
★★★☆☆
🎵 音频 6 ~195K
★★★☆☆
🔌 MCP 2 ~110K
★★★☆☆
👁️ 多模态 4 ~55K
★★☆☆☆
🎬 视频 4 ~85K
★★☆☆☆
📊 评估 3 ~52K
★★☆☆☆
⚖️ 法律 AI — —
☆☆☆☆☆
🌾 农业 AI — —
☆☆☆☆☆
🏛️ 政务 AI — —
☆☆☆☆☆
🏥 医疗 AI — —
☆☆☆☆☆
🎓 教育 AI — —
☆☆☆☆☆
🏭 工业 AI — —
☆☆☆☆☆
🔬 科研 AI — —
☆☆☆☆☆