1. 前置了解

1.1 什么是智能体(Agents)?

智能体是由大模型驱动的知识助手,能够调用工具完成调研、数据提取等各类任务。

智能体能力跨度很广:

  • 简单形态为问答机器人;
  • 高阶智能体可自主感知信息、做出决策并执行动作以完成复杂目标。

LlamaIndex 提供完整的智能体开发框架,支持将 RAG 流水线作为众多工具之一,辅助智能体完成任务。


1.2 什么是工作流(Workflows)?

工作流是由多步骤组成的处理流程,可组合一个或多个智能体、数据连接器与外部工具协同完成任务。

它属于事件驱动型程序,能够整合多份 RAG 数据源与多个智能体,搭建复杂应用;支持反思自省、错误修正等高阶大模型应用能力。开发者可以将这套智能体工作流直接部署为生产可用的微服务。


1.3 什么是上下文增强(Context Augmentation)?

大模型搭建起人类与数据之间的自然语言交互桥梁。大模型基于海量公开数据预训练,但并未学习你的私有业务数据。这些数据可能涉及隐私、面向特定业务场景,存放于接口后端、SQL数据库、PDF 文档、幻灯片之中。

上下文增强,就是把私有数据提供给大模型,辅助其解决对应业务问题。

LlamaIndex 提供全套工具,支撑各类上下文增强场景,从原型验证平稳过渡到生产环境。开发者可以完成数据导入、解析、索引构建、数据处理,快速搭建融合数据访问与大模型提示词的复杂查询流程。

上下文增强最经典的实现方案就是检索增强生成(RAG),在推理阶段将相关上下文注入大模型。


2. LlamaIndex(原 Run Llama, Inc.)公司介绍

GitHub 组织地址

公司正式名称:LlamaIndex, Inc.,初创阶段企业名称为 Run Llama,因此 GitHub 组织命名为 run-llama。总部位于美国加利福尼亚旧金山。

2.1 基础概况

1、 创立背景

项目最早 202211 月开源,最初命名 GPT Index;创始人 Jerry LiuCEO)、Simon SuoCTO)。二人曾任职 Uber AI 实验室,发现大模型难以可靠读取企业私有文档,于是开发这套面向私有数据的 LLM 应用开发框架。2023 年初项目更名为 LlamaIndex,并成立商业化公司。

重要区分:项目与 MetaLLaMA 大模型没有隶属关系,只是名称相近。

2、 融资情况

  • 种子轮:850 万美元;
  • A 轮:1900 万美元;

累计融资超 2750 万美元,投资方包括 GreylockSalesforce VenturesGoogle VenturesDatabricks、毕马威等。

3、商业模式:开源生态 + 商业云服务双轮驱动

  • 开源引流:核心框架 LlamaIndexLiteParseLlamaAgents 采用开源协议,面向全球开发者免费使用,构建庞大开发者社区;
  • 商业变现LlamaCloud / LlamaParse 企业级 SaaS 平台,提供高性能文档解析、托管 RAG 服务,面向政企付费客户。

2.2 核心产品矩阵

在这里插入图片描述

🔹 开源产品

  1. LlamaIndex(Python/TS)
    业界主流开源框架,用于构建 RAG检索增强生成、AI 智能体(Agent)、工作流应用。提供完整链路:数据接入、文档索引、混合检索、查询引擎、多智能体编排,兼容几乎所有大模型、向量数据库。
  2. LlamaAgents
    新一代异步事件驱动智能体运行框架,构建并交付以文档为核心的智能体
  3. LiteParse
    Rust 编写、完全开源本地文档解析引擎,支持私有化部署,无需上传文件至云端,解析PDFOffice、图片文档。

🔹 商业产品 LlamaParse(LlamaCloud)

主打 SOTA Agentic OCR(智能体式文档识别),企业级非结构化数据自动化平台,也是你前文文档介绍的核心产品:

  1. Parse(文档解析):高精度识别复杂版式、嵌套表格、图表、手写文字、内嵌图片;
  2. Extract(信息提取):上下文感知结构化抽取,附带置信度与原文引用;
  3. Index(索引构建):智能分块+向量嵌入,产出高质量数据直接对接 RAG

2.3 客户与典型场景

标杆企业客户Salesforce、凯雷集团(Carlyle)、乐天集团(Rakuten)等全球金融、科技企业。

主流落地场景:

  • 金融:财报、尽调文档、合同智能解析;
  • 制造业/医疗:技术手册、病历检索;
  • 通用企业:发票处理、知识库问答、客服智能助手;
  • 通用技术:搭建文档智能体、多智能体协同系统。

3. LlamaIndex:面向上下文增强型大模型应用的开发框架

3.1 核心组件

LlamaIndex 不会限制大模型的使用方式。你可以将大模型用于文本续写、对话机器人、智能体等场景,框架只是简化整个开发流程。

内置核心组件如下:

  • 数据连接器:从原始数据源、原生格式导入数据,支持接口、PDFSQL 等大量数据源;
  • 数据索引:将数据转化为中间结构化形式,便于大模型高效读取与调用;
  • 引擎:提供自然语言方式访问私有数据:
    • 查询引擎:问答场景核心交互入口,典型实现就是 RAG流程;
    • 对话引擎:支持多轮来回交互的会话接口;
  • 智能体:搭载各类工具的大模型知识工作者,工具涵盖简易函数、第三方API 集成等;
  • 可观测性与评估组件:支撑完整实验、效果评估、线上监控,形成持续优化闭环;
  • 工作流:将上述所有组件整合为事件驱动系统,相比传统图编排方案拥有更高灵活性。

3.2 应用场景

LlamaIndex 与上下文增强技术常见落地场景:

  1. 问答系统
  2. 对话机器人
  3. 文档理解与结构化数据提取
  4. 具备信息检索、自主执行能力的自治智能体
  5. 融合文本、图像等多模态数据的应用
  6. 基于私有数据微调模型,提升任务效果

3.3 👨‍👩‍👧‍👦 谁适合使用 LlamaIndex?

LlamaIndex 兼顾入门开发者与资深工程师。

  • 高层 API:新手仅需 5 行代码,即可完成数据导入与问答查询;
  • 底层 API:面向复杂业务,高级开发者能够自定义、扩展任意模块:数据连接器、索引、检索器、查询引擎、重排序模块等,高度灵活适配业务需求。

3.4 快速上手

LlamaIndex 同时提供 Python(本文档)与 TypeScript 版本。如果你不清楚如何入门,可以先阅读文档指引,根据自身技术水平选择合适章节。

配置环境变量 OPENAI_API_KEY,填入你的 OpenAI Key,安装 Python库:

pip install llama-index

将文档放入 data 文件夹,使用经典 5 行代码实现文档问答:

from llama_index.core import VectorStoreIndex, SimpleDirectoryReader

# 从指定目录"data"读取所有文档文件,自动解析文件内容,返回文档对象列表
documents = SimpleDirectoryReader("data").load_data()

# 将读取到的文档向量化,构建向量存储索引(底层会调用嵌入模型生成向量)
index = VectorStoreIndex.from_documents(documents)

# 基于向量索引创建查询引擎,用于实现文档检索+大模型问答
query_engine = index.as_query_engine()

# 传入问题,执行检索:先召回相关文档片段,再交给大模型生成答案
response = query_engine.query("在这里输入和文档相关的问题")

# 打印输出大模型返回的问答结果
print(response)

如果运行遇到问题,可以查看完整入门教程,支持 OpenAI 等远程模型,也兼容本地部署模型。


3.5 商业服务:LlamaCloud

企业开发者可以了解 LlamaCloud。这是一套端到端托管服务,提供文档解析、信息提取、索引构建与检索全套能力,快速为AI智能体提供生产级数据能力。

新用户注册每月可领取 10000 免费额度,支持订阅套餐;如有企业定制需求可以联系官方。平台同时提供 SaaS云端版本与私有化部署方案。

核心能力:

  1. 文档解析(LlamaParse):业界顶尖文档解析方案,依托视觉大模型,完美处理复杂文档(嵌套表格、内嵌图表、图片等);
  2. 数据提取(LlamaExtract):依据人工定义或自动推导的 Schema,从任意文档抽取结构化数据;
  3. 索引与检索:搭建端到端文档检索流水线,对接 Sharepoint、谷歌云盘、对象存储等数据源与向量数据库,自动完成文档处理与数据同步。

3.6 社区支持

3.6.1 社区地址

遇到问题、想要提出功能建议?欢迎加入 LlamaIndex 社区:
X(Twitter)DiscordLinkedIn


3.6.2 资源地址

Python 版本

TypeScript/Javascript 版本(LlamaIndex.TS)


3.6.3 参与贡献

项目开源,欢迎所有人提交代码贡献!查阅贡献指南,了解如何扩展核心库、新增大模型、向量库、智能体工具等第三方集成。


3.7 LlamaIndex 生态体系

LlamaIndex 拥有丰富周边项目:

  • llama_deploy:将智能体工作流部署为生产微服务
  • LlamaHub:持续扩充的自定义数据连接器资源库
  • SEC Insights:基于 LlamaIndex 构建的金融研究应用
  • create-llama:命令行脚手架,一键生成 LlamaIndex 项目模板

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐