以 LlamaParse 云平台做解析/抽取/索引,配合开源框架或独立使用,构建文档智能体
框架负责本地编排,云平台提供企业级 OCR、抽取与索引能力,两者可组合也可拆开用
✓ 支持130+文档格式✓ 框架与平台解耦可独立使用 ✕ 云平台需注册并获取API key
方案简介
LlamaParse 是 LlamaIndex 团队的企业级「文档智能体平台」,聚焦文档智能体与智能 OCR。它包含四个能力模块:Parse(解析)、LlamaAgents(部署的文档智能体)、Extract(结构化抽取)和 Index(摄取与 RAG)。平台与开源 LlamaIndex 框架形成一套完整配方:框架负责在本地编排 LLM 与数据,LlamaParse 云端负责高质量文档解析、抽取与托管索引。该平台既可以与 LlamaIndex 框架搭配使用,也可以独立使用。适合需要处理复杂文档(PDF 等 130+ 格式)、构建端到端文档智能体流水线的企业开发者。
亮点与能力
- Parse:智能 OCR 与文档解析,支持 130+ 种格式
- Extract:从文档中进行结构化数据抽取
- Index:摄取、索引与 RAG 流水线
- Split:将大文档拆分为子类别
- Agents:用 Workflows 与 Agent Builder 构建端到端文档智能体
- 可与 LlamaIndex 框架组合使用,也可完全独立使用
- 提供官方文档与云控制台注册入口
组成与分工
- LlamaParse (Parse):智能 OCR 与文档解析引擎,处理 130+ 格式
- Extract:结构化抽取模块,从文档中产出结构化数据
- Index:摄取、索引与 RAG 流水线模块
- Split:大文档拆分为子类目的模块
- LlamaAgents:部署的文档智能体,配合 Workflows 与 Agent Builder
- LlamaIndex 框架:开源编排框架,可与平台组合调用上述能力
前置要求
- 注册 LlamaParse 云平台账号并获取 API key:
Sign up for LlamaParse — Create an account and get your API key.
- 若与框架组合使用,需安装 LlamaIndex Python 包(见 LlamaParse 官方文档)
实施步骤
1. 注册并获取密钥
前往 cloud.llamaindex.ai 创建账号,获取 API key。
2. 选择使用模式
- 独立使用:直接调用 LlamaParse 各模块(Parse/Extract/Index/Split)的文档接口
- 组合使用:在 LlamaIndex 框架中调用 LlamaParse 的解析与索引能力
3. 按需查阅官方文档
各模块均有对应文档:Parse(llamaparse)、Extract(llamaextract)、Index(llamacloud)、Split(split/getting_started)、Agents(llamaagents/overview)。
使用与配置要点
- 解析复杂文档用 Parse,需结构化输出用 Extract,构建检索问答用 Index,长文档分类用 Split
- 构建端到端文档智能体时使用 LlamaAgents 的 Workflows 与 Agent Builder
- 验证方式:按各模块官方文档的入门指南(getting started)跑通第一个示例
注意事项与常见问题
- LlamaParse 为企业平台,属云服务,使用前必须注册账号并获取 API key
- README 提示平台各产品链接与文档相互独立,Parse/Extract/Index/Split/Agents 分别有各自的文档入口,注意区分
优缺点
- ✓ 支持130+文档格式
- ✓ 框架与平台解耦可独立使用
- ✕ 云平台需注册并获取API key
出处
本方案挖掘自开源项目 run-llama/llama_index,方案内容与实施命令均来自其 README 原文。
方案出处
run-llama/llama_index:LlamaIndex is the leading document agent and OCR platform 52056 star LlamaIndex is the leading document agent and OCR platform
本方案由真实开源项目挖掘整理,实施命令均来自其 README 原文,安装使用请遵循项目开源协议。