覆盖主流AI开源生态,从大模型到应用落地,从热门赛道到待开发蓝海——一份面向开发者的全景导航
通用大语言模型——从千亿参数巨兽到高效轻量模型,开源社区正在打破闭源垄断
DeepSeek 第三代 MoE 架构大模型,671B 参数,激活仅 37B。在多项基准上超越 Llama 3.1 和 GPT-4o,训练成本仅为同类模型的 1/10。
深度求索推出的推理增强模型,通过强化学习训练,具备 Chain-of-Thought 深度推理能力。在数学和编程任务上表现出色。
Meta 开源的最新一代大语言模型系列,包含 Scout(109B)和 Maverick(400B+)两款 MoE 模型,支持 1000 万 token 超长上下文。
阿里云通义千问第三代模型,支持思考/非思考模式切换。0.6B~235B 全尺寸覆盖,在多语言和代码能力上表现优异。
法国 AI 初创公司推出的高效大模型系列,以 7B 参数量达到 13B 级别性能。擅长滑动窗口注意力和高效推理。
智谱 AI 推出的 GLM 系列第四代模型,支持多模态、长上下文和工具调用。中文理解和对话能力出色。
上海AI实验室推出的书生浦语大模型第三代,在数学推理、代码生成和指令遵循方面有显著提升。
Google DeepMind 推出的轻量级开源模型,2B/9B/27B 三种规格。基于 Gemini 技术,在同等规模中表现领先。
让大模型跑起来——从本地一键部署到生产级高并发服务
本地大模型一键运行工具,支持 llama3、mistral、qwen 等主流模型。像 Docker 一样拉取和管理模型,零配置体验。
纯 C/C++ 实现的 LLM 推理引擎,无需 Python 依赖。支持 GGUF 量化格式,在 CPU 上也能高效运行大模型。
高吞吐量 LLM 推理和服务引擎,采用 PagedAttention 技术,显存利用率提升 2-4 倍。生产环境首选。
统一的 LLM API 网关,用 OpenAI 格式调用 100+ 个 LLM 提供商。支持负载均衡、限流和费用追踪。
高性能 LLM 推理框架,支持 RadixAttention 前缀缓存。在多轮对话和结构化输出场景中性能领先。
本地 AI API 服务,兼容 OpenAI API 格式。支持 LLM、图像生成、音频转录等多种 AI 能力,无需 GPU 也可运行。
跨平台 LLM 部署引擎,支持在手机、浏览器、嵌入式设备上运行大模型。基于 TVM 编译优化。
NVIDIA 官方 LLM 推理优化库,基于 TensorRT 深度优化。在 NVIDIA GPU 上实现极致推理性能。
让通用模型变成你的专属专家——从 LoRA 轻量微调到全参数训练
一站式大模型微调框架,支持 100+ 模型的 SFT/RLHF/DPO 训练。Web UI 可视化操作,零代码完成微调。
极速微调框架,训练速度提升 2-5 倍,显存节省 70%。支持 LoRA/QLoRA,手写 Triton 内核深度优化。
HuggingFace 官方的强化学习训练库,支持 SFT、RLHF、DPO、PPO 等对齐训练方法。
魔搭社区推出的轻量级训练框架,支持 300+ LLM 和 50+ MLLM 的微调。PEFT 方法全覆盖。
HuggingFace 核心库,提供数千种预训练模型的统一 API。NLP、CV、音频、多模态全覆盖,AI 基础设施级项目。
Meta 主导的深度学习框架,动态计算图 + Pythonic 设计。学术界和工业界的事实标准,几乎所有 AI 项目的基础。
让大模型自主规划、使用工具、协作完成复杂任务——AI 应用的终极形态
LLM 应用开发框架的事实标准。提供链式调用、工具集成、记忆管理等核心抽象,生态最完整。
LangChain 团队推出的有状态多 Agent 编排框架。基于图结构定义复杂工作流,支持循环和条件分支。
微软推出的多 Agent 对话框架,支持 Agent 之间自主对话协作。可自定义 Agent 角色和对话流程。
面向多 Agent 协作的编排框架,模拟团队分工。每个 Agent 有专属角色、目标和工具,协同完成复杂任务。
Agent 工具集成平台,提供 200+ 应用的即插即用连接器。让 AI Agent 轻松操作 Gmail、Slack、GitHub 等外部服务。
让大模型拥有你的知识——连接私有数据,消除幻觉,精准回答
端到端 RAG 引擎,深度文档解析能力突出。支持 PDF/Word/PPT 等复杂格式的智能切片和检索。
数据框架 for LLM 应用。提供数据连接、索引构建和查询接口,支持 160+ 数据源接入。
基于 LangChain 的本地知识库问答方案。开箱即用,支持多种文档格式,中文场景优化。
AI 原生开源向量数据库,嵌入式部署零配置。API 简洁优雅,适合快速原型和中小型生产环境。
高性能向量搜索引擎,Rust 编写。支持过滤、Payload 存储和分布式部署,生产级可靠性。
云原生分布式向量数据库,支持万亿级向量检索。LF AI 基金会毕业项目,企业级首选。
模块化 NLP/RAG 框架,支持灵活的 Pipeline 编排。可自由组合检索器、阅读器和生成器组件。
AI 驱动的编程革命——从代码补全到自主开发,程序员的新搭档
VS Code 中的自主编程 Agent。能读写文件、执行命令、浏览网页,像一个结对编程的 AI 搭档。
AI 软件开发 Agent 平台(原 Devin 开源替代)。能自主编写代码、调试、执行测试,完成端到端开发任务。
终端中的 AI 结对编程工具。直接在 Git 仓库中与 AI 对话修改代码,自动 commit,支持多种 LLM。
开源 AI 代码助手,支持 VS Code 和 JetBrains。代码补全、聊天、编辑一体化,可接入本地模型。
普林斯顿大学推出的自动修复 GitHub Issue 的 Agent。在 SWE-bench 基准上表现优异,学术研究标杆。
从零手把手训练一个微型 LLM 的教程项目。2 小时即可训练 26M 参数的 GPT,LLM 入门最佳实践。
AI 画师军团——从 Stable Diffusion 生态到目标检测,视觉创造力全面爆发
节点式 Stable Diffusion 工作流引擎。可视化编排复杂图像生成流程,支持 ControlNet/IPAdapter 等插件生态。
开创性的文生图扩散模型。开源引爆 AI 绘画革命,催生了庞大的社区生态和无数衍生项目。
简化版 Stable Diffusion 前端,专注于易用性。一键安装,自动优化提示词,小白也能生成高质量图片。
为扩散模型添加精确空间控制。支持边缘图、深度图、姿态图等多种条件输入,AI 绘画精确控制的里程碑。
Black Forest Labs 推出的新一代文生图模型,图像质量和文字渲染能力大幅提升。SD 核心团队出走后的力作。
Ultralytics 推出的最新 YOLO 系列,支持检测、分割、分类、姿态估计。实时目标检测的行业标准。
AI 视频生成进入爆发期——从文本到视频,创作门槛急剧降低
阿里通义万相视频生成模型,支持文生视频和图生视频。开源版本质量媲美商业方案,中文生态友好。
Lightricks 推出的高效视频生成模型,推理速度快。支持文本到视频和图像到视频的流畅生成。
Colossal-AI 团队的开源 Sora 复现方案。致力于民主化视频生成技术,支持长视频和高分辨率。
一键生成短视频的 AI 工具。自动编写文案、匹配素材、添加配音和字幕,批量生成可发布的短视频。
让 AI 开口说话、听懂世界——语音识别、合成和音乐生成
OpenAI 开源的通用语音识别模型,支持 99 种语言。鲁棒性强,几乎能处理任何音频质量的转录任务。
Whisper 的 CTranslate2 加速版本,推理速度提升 4 倍。保持相同精度,大幅降低部署成本。
深度学习文本转语音工具包,支持多说话人和语音克隆。提供 XTTS 等高质量模型。
阿里通义实验室的语音合成模型,支持中英日韩粤多语言。零样本语音克隆效果出色。
Suno AI 推出的文本转语音模型,能生成高度逼真的人声。支持笑声、叹息等非语言声音和背景音效。
Suno 音乐生成 API 的非官方封装。通过文本描述即可生成完整歌曲,包含旋律、歌词和编曲。
突破文本边界——能看图、理解视频、处理多种信息的 AI 模型
通义千问视觉语言模型,支持图像理解、视频分析和 Agent 操作。能理解复杂图表和长视频内容。
上海AI实验室的多模态大模型,视觉理解能力领先。支持图文对话、文档解析、图表分析等任务。
智谱AI的视觉语言模型第二代,在视觉问答和图像描述上表现优异。支持高分辨率图像输入。
大型语言和视觉助手,开创性地将视觉编码器与 LLM 连接。多模态研究的重要基线模型。
搭建 AI 应用的底座——从工作流编排到一站式对话平台
开源工作流自动化平台,支持 400+ 集成。可视化编排复杂业务流程,AI 节点让工作流拥有智能。
开源 LLM 应用开发平台,提供 Agent 工作流、RAG 管道、模型管理和可观测性。从原型到生产的完整方案。
轻量级 ChatGPT/LLM 对话客户端(原 ChatGPT-Next-Web)。一键部署,支持多模型切换和 PWA。
现代化的开源 AI 对话框架,支持插件系统、知识库和多模态。UI 设计精美,开发者体验优秀。
让 AI Agent 操作浏览器的 Python 库。LLM 驱动的网页自动化,能完成填表、点击、导航等复杂交互。
一站式 LLM 私有化部署桌面应用。支持文档上传、向量化、对话,内置多种 LLM 和嵌入模型。
快速构建 ML 演示应用的 Python 库。几行代码创建 Web 界面,HuggingFace Spaces 的默认框架。
将任意 URL 转换为 LLM 友好的文本格式。网页内容提取利器,RAG 管道的重要组件。
连接 AI 与外部世界的新标准——Anthropic 推出的 Model Context Protocol 生态
MCP 服务器的精选列表,收录数百个社区开发的 MCP 实现。涵盖数据库、文件系统、API 等各类工具集成。
Anthropic 官方维护的 MCP 服务器参考实现。包含文件系统、GitHub、数据库等核心连接器。
衡量 AI 应用的质量——从 LLM 输出评估到全链路可观测
7 个被开源社区忽视但潜力巨大的垂直领域——机会正在等待先行者
法律文本高度专业化,各国法律体系差异大。数据隐私和合规要求严格,案例标注成本极高。法律后果的严重性要求 AI 输出几乎零容错。
合同审查自动化、法律文书生成、案例检索与分析、合规风险评估。中国法律 AI 市场几乎空白,中文法律大模型潜力巨大。
农业生产环境复杂多变,数据采集困难(田间、大棚等场景)。作物病害、土壤分析等需要专业知识,开源数据集稀缺。硬件部署在偏远地区面临网络和算力挑战。
病虫害图像识别、智能灌溉决策、产量预测模型、农产品质量检测。中国作为农业大国,智慧农业需求迫切。
政务数据涉及国家安全,开放程度极低。审批流程复杂且各地区差异大,AI 需要理解大量政策法规。系统对接要求高,需与现有政务系统深度集成。
智能政务问答、政策文件解析、审批流程自动化、舆情分析。数字政府建设浪潮下,政务 AI 有万亿级市场空间。
医疗数据极度敏感,隐私保护要求严格。AI 辅助诊断的法律责任界定不清。需要医学专业知识验证,标注成本高。FDA/NMPA 等监管审批周期长。
医学影像辅助诊断、电子病历结构化、药物研发分子生成、健康管理助手。中国医疗资源不均衡,AI 辅助有巨大社会价值。
教育内容需要严格准确性,AI 幻觉可能导致知识错误。个性化教学需要深度理解学生认知状态。不同年龄段、学科的教学方法差异大。
自适应学习系统、AI 家教辅导、作业自动批改、知识点图谱构建。中国 K12 和职业教育市场庞大,个性化教育需求旺盛。
工业场景要求极高的可靠性和实时性。设备数据格式多样,协议不统一。故障样本稀少(正常运行远多于故障),模型训练数据不平衡。
预测性维护、质量检测视觉系统、工艺参数优化、供应链智能调度。中国制造业转型升级,工业 AI 是核心驱动力。
科学研究要求极高的准确性和可解释性。跨学科知识整合困难,专业壁垒高。实验数据获取成本高,可复现性验证复杂。
文献智能综述、实验设计优化、蛋白质结构预测、材料性质模拟。AI for Science 是诺贝尔奖级别的前沿方向。
各领域开源项目的成熟度一目了然——颜色越深代表生态越繁荣
| 领域 | 代表项目数 | 总 Stars | 生态密度 | 成熟度 |
|---|---|---|---|---|
| 🏗️ 基础设施 | 8 | ~522K | ★★★★★ | |
| 🤖 Agent 框架 | 5 | ~249K | ★★★★★ | |
| 🧠 大模型 | 8 | ~386K | ★★★★☆ | |
| ⚡ 推理部署 | 8 | ~446K | ★★★★☆ | |
| 🔧 微调训练 | 6 | ~409K | ★★★★☆ | |
| 📚 RAG | 7 | ~276K | ★★★★☆ | |
| 🎨 图像 | 6 | ~280K | ★★★★☆ | |
| 💻 AI编程 | 6 | ~214K | ★★★☆☆ | |
| 🎵 音频 | 6 | ~195K | ★★★☆☆ | |
| 🔌 MCP | 2 | ~110K | ★★★☆☆ | |
| 👁️ 多模态 | 4 | ~55K | ★★☆☆☆ | |
| 🎬 视频 | 4 | ~85K | ★★☆☆☆ | |
| 📊 评估 | 3 | ~52K | ★★☆☆☆ | |
| ⚖️ 法律 AI | — | — | ☆☆☆☆☆ | |
| 🌾 农业 AI | — | — | ☆☆☆☆☆ | |
| 🏛️ 政务 AI | — | — | ☆☆☆☆☆ | |
| 🏥 医疗 AI | — | — | ☆☆☆☆☆ | |
| 🎓 教育 AI | — | — | ☆☆☆☆☆ | |
| 🏭 工业 AI | — | — | ☆☆☆☆☆ | |
| 🔬 科研 AI | — | — | ☆☆☆☆☆ |