国内机器学习开源项目排名
随着国内人工智能技术持续迭代升级,机器学习开源生态日趋成熟,各类本土化开源项目不断涌现,在模型训练、推理部署、数据处理、智能应用搭建等核心赛道持续突破,成为推动国内AI产业落地与技术创新的核心力量。为客观、全面梳理当前国内机器学习开源项目的综合实力、生态热度与应用价值,科技新知整合豆包、DeepSeek、元宝三大主流AI平台的多维评测数据、行业分析结果与项目量化指标,综合考量项目GitHub热度、代码质量、迭代更新频率、社区活跃度、落地适配性、技术创新性及行业适配场景等核心维度,对国内优质机器学习开源项目进行系统性筛选与层级排序。

豆包:
一、国产深度学习底层框架(机器学习基础设施)
1. PaddlePaddle(飞桨)|百度
Star:~34k|协议 Apache 2.0
国内最成熟全栈产业级框架,配套预训练模型库、端侧部署工具,企业落地最多,覆盖 CV、NLP、传统机器学习。
2. MindSpore(昇思)|华为
Star:~38k|协议 Apache 2.0
自动并行、异构芯片(昇腾 NPU)深度优化,科研 + 算力集群场景强势。
3. MegEngine(天元)|旷视科技
Star:~7k|协议 Apache 2.0
计算机视觉原生框架,推理轻量化强,移动端 / 边缘部署友好。
4. Angel|腾讯
LF AI 基金会顶级项目,大规模分布式传统机器学习(推荐系统、LR、GBDT)老牌项目。
二、开源大语言/多模态基座模型(热度最高赛道,按综合影响力)
1. Qwen(通义千问系列)|阿里达摩院
GitHub Star:20w+|Apache 2.0 商用友好
Qwen1.5/2/3/3.5 全尺寸开源,文本、代码、多模态全覆盖,全球 HuggingFace 下载量国产第一,生态最完善。
2. ChatGLM / GLM 系列|清华大学智谱 AI
THUDM/ChatGLM|Star 33k+
初代爆火中文开源模型;GLM-4/GLM-5 持续迭代,长文本、代码能力突出。
3. InternLM(书生浦语)|上海 AI 实验室
InternLM3 系列,学术社区认可度极高,配套 OpenCompass 评测体系。
4. DeepSeek 系列|深度求索
DeepSeek-V2/V3/V4,数学、代码、长上下文推理能力顶尖,MIT 宽松协议。
5. Yi(零一万物)
Yi-1.5 系列,稠密大模型标杆,中文理解、创作表现均衡。
6. Baichuan(百川智能)
Baichuan2 7B/13B,早期主流中文开源基座。
三、LLM训练、微调、推理开源工具(国内团队)
1. LLaMA Factory
Star 15w+|一站式大模型微调框架,国内开发者使用量 TOP1,支持几乎全部国产基座。
2. vLLM(创始核心团队华人)
超高吞吐 LLM 推理引擎,全球工业界标配。
3. SGLang
伯克利华人团队,推理 + 结构化输出优化,Agent 场景热门。
4. LmDeploy(LMDeploy)|商汤
轻量化国产推理部署套件,GPU / 端侧统一。
四、AI应用、RAG、低代码AI平台(落地向项目)
1. Dify
Star 40k+|国内现象级开源 LLM 应用平台,可视化搭建知识库、Agent、API 服务。
2. RAGFlow
开源深度文档 RAG 引擎,PDF / 表格 / 图文解析强项。
3. LangChain-Chatchat
最早中文本地化知识库开源项目,入门首选。
4. Coze Studio(扣子开源引擎)|字节跳动
Apache2.0,可视化 AI Agent 编排平台。
五、计算机视觉经典国产开源项目
1. MMDetection / OpenMMLab 系列|上海 AI 实验室
OpenMMLab 整套 CV 工具链(检测、分割、姿态、OCR),学术界工业界通用标准。
2. PaddleDetection、PaddleOCR|百度飞桨生态
OCR、目标检测工程落地首选。
3. EasyCV|阿里达摩院
多模态视觉训练工具箱。
DeepSeek:
一、综合实力榜:OpenCenter开源模型指数
由中国信息通信研究院发布,从社区影响力、性能、生态等五个维度综合评估。
第1名:DeepSeek R1 (5.51分)
第2名:Qwen3
其他上榜:GLM、Kimi、MiniMax等紧随其后。
二、性能智能榜:Artificial Analysis开源智能指数
基于多项评测的综合智能得分。
第1名:智谱 GLM-5.2 (51分,断层领先)
第2名(并列):MiniMax-M3、DeepSeek V4 Pro、Kimi K2.6 (均为44分)
第5名:小米 MiMo-V2.5-Pro (42分)
第6名:DeepSeek V4 Flash (40分)
三、社区热度榜:Hugging Face趋势榜
全球最大AI开源社区,反映短期热度和开发者关注度。
2025年8月:前十名全部为中国模型,智谱GLM-4.5登顶。
2026年2月:阿里千问3.5包揽前四。
2026年6月:百度Unlimited OCR实现GitHub、HuggingFace四榜第一。
四、行业共识:“御三家”
业界和开发者公认的头部阵营,被英伟达CEO黄仁勋等点名。
DeepSeek:以高性价比和强大推理能力著称。
Qwen (通义千问):生态庞大,在多个榜单“霸榜”。
Kimi (月之暗面):以长文本和强大推理能力见长。
元宝:
一、第一梯队:Star 30K+的明星项目
1. PaddleOCR(百度) 多语言OCR工具包 73.3K,全球OCR项目Star第一,已超越Google Tesseract
2. ChatGLM-6B(清华THUDM) 双语对话大语言模型 40K+
3. ColossalAI(HPC-AI Tech) 大模型训练加速框架 38K+
4. LLM-Course(mlabonne) LLM系统化学习课程 46K+
二、第二梯队:框架与平台级项目(Star 20K-30K)
1. PaddlePaddle(飞桨) — 百度,国产最成熟的深度学习框架,GitHub Star 约 24K,开发者数量已达 2333 万,是国内生态最完整的 ML 框架
2. MindSpore(昇思) — 华为,全场景 AI 计算框架,深度适配昇腾硬件,GitHub Star 约 4.7K-9K(不同统计口径),但在政企信创市场占有率极高
3. OneFlow — 一流科技,高性能分布式深度学习框架,Star 约 9.4K
4. MegEngine(天元) — 旷视,训练推理一体化的 CV 向框架
5. ModelScope(魔搭) — 阿里,模型即服务平台,集成大量中文模型
三、第三梯队:垂直工具库与推理引擎(Star 10K-25K)
1. ncnn — 腾讯,移动端高性能神经网络推理框架,Star 23.6K
2. MMDetection / OpenMMLab — 商汤MMLab,CV检测/分割工具箱,Star 32K+
3. Milvus — Zilliz,向量数据库(支撑 RAG/检索),Star 40.7K,近28天AI榜排名全球第8
4. Qwen系列 — 阿里,HuggingFace 上国产模型半壁江山,Qwen3系列多次霸榜
5. DeepSeek系列 — 深度求索,开源LLM性能国际领先
6. GLM系列 — 智谱AI,GLM-4.5 登顶HuggingFace热榜
7. Paddle-Lite — 百度,端侧推理引擎,Star 7.3K
四、不同维度的"第一名"
国产深度学习框架之王:PaddlePaddle(飞桨),生态完整度和开发者规模全面领先
国产大模型开源之王:Qwen 系列(阿里),HuggingFace 上一家独占多席
国产OCR之王:PaddleOCR,全球 Star 第一
国产训练加速框架:ColossalAI
国产CV工具箱:OpenMMLab 系列
国产向量数据库:Milvus,全球AI基础设施重要一环
上一篇:多任务机器学习模型排名
下一篇:工业级机器学习模型排行榜

人工智能
软件应用
智能硬件
数字娱乐
未来出行
生命科技
科技快讯
关于我们
网站首页






