AI 开源库

AI 开源库

收录 AI 相关的开源仓库,按「大类 → 小类」两级分类组织,持续更新。

最近更新:2026-09-22

RAG

框架

  • RAGFlowhttps://github.com/infiniflow/ragflow

    基于深度文档理解的开源 RAG 引擎,提供模板化分块、多路召回、引用溯源与可编排的智能体工作流,支持对接主流大模型。

  • GraphRAGhttps://github.com/microsoft/graphrag

    微软开源的知识图谱增强 RAG 框架,用 LLM 从语料中抽取实体与关系构建图谱,再分层生成社区摘要,擅长回答需要跨文档全局理解的「大局观」问题。

文档解析

  • pdfplumberhttps://github.com/jsvine/pdfplumber

    纯 Python 的 PDF 解析库,可精细提取文本、表格、坐标与注释,表格结构还原尤其出色,是文档处理与数据抽取的常用底座。

  • MinerUhttps://github.com/opendatalab/MinerU

    上海人工智能实验室 OpenDataLab 开源的文档解析工具,将 PDF、网页、电子书转为 Markdown,对公式、表格与复杂版面的还原效果出色,常用于大模型语料预处理。

检索引擎

提示工程

学习指南

提示词库

提示压缩

智能体工程

学习指南

记忆管理

  • Zephttps://github.com/getzep/zep

    Zep 官方仓库:托管式智能体记忆平台 Zep Cloud 的 SDK、框架集成(LangGraph、CrewAI 等)与数据导入示例集合,平台本身闭源。

  • Graphitihttps://github.com/getzep/graphiti

    Zep 团队开源的时序知识图谱框架,为智能体提供记忆层:事实带有效期、过时自动失效而非删除,支持增量更新与混合检索。

LLM 评估

评估框架

可观测与追踪

应用开发框架

应用框架

模型服务

推理引擎

  • vLLMhttps://github.com/vllm-project/vllm

    UC Berkeley 起源的高性能 LLM 推理与服务引擎,凭 PagedAttention 显存管理与连续批处理取得业界领先吞吐,支持 200 余种主流模型架构。

  • SGLanghttps://github.com/sgl-project/sglang

    LMSYS 托管的高性能推理服务框架,以 RadixAttention 前缀缓存与零开销调度器实现高吞吐低延迟,从单卡到大规模集群均可部署。

API 网关