ragcooking
BibliotecaConjuntos (frameworks)LlamaIndex

LlamaIndex

conjunto de bloquesopen source🗣 Python nativorequiere embedding externo

De los datos a la respuesta: readers, node parsers, retrievers y query engines

Historia: quién, evolución y momento

Promovido por LlamaIndex (empresa homónima fundada por Jerry Liu en 2022; nació como GPT Index). Fue EL framework de datos de la primera ola LLM; desde 2024 pivota hacia agentes y workflows (LlamaDeploy) mientras LangChain copa el hype agéntico. Estado: estable y muy respetado en su nicho — la cresta la tuvo en 2023, pero sigue siendo la referencia del lado datos del RAG.

Capacidades

Más de cien lectores de fuentes y formatos; múltiples tipos de índice (vectorial, árbol, grafo, resumen); node parsers de todo tipo; query engines con citas; retrievers componibles (densa, sparse, auto-merging); routers y agentes; workflows con eventos; observabilidad integrada.

Variantes: elige cuántas fases te cubre

Pipeline completo
IngestaLlamaIndex · readers — Más de 100 lectores de formatos y fuentes
ChunkingLlamaIndex · node parsers — Splitters por sentencia, código, markdown o jerárquicos
RecuperaciónLlamaIndex · retrievers — Densa, sparse, híbrida y auto-merging
GeneraciónLlamaIndex · query engine — Síntesis con citas a los nodos fuente
Solo recuperación + generación
RecuperaciónLlamaIndex · retrievers — Sobre un índice que tú ya construyes
GeneraciónLlamaIndex · query engine — Síntesis con citas
Lo completa por arriba y por abajo

Al soltarlo en el lienzo, además activa y rellena con las piezas por defecto del mercado:Corpus, Embedding, Almacenamiento.

Fases que puede cubrir

Ingesta Chunking Recuperación Generación

Pros y contras

ProsContras
  • Ideal para datos
  • Muchos conectores
  • API cambiable entre versiones
Cocinar con LlamaIndex Volver a la biblioteca