Tengo una idea para un proyecto: una pequeña aplicación web donde pueda subir mis propios documentos (PDFs, principalmente) y hacerles preguntas. He visto que esto se llama RAG (Retrieval-Augmented Generation).
El ecosistema parece enorme y un poco abrumador. Veo herramientas como LangChain, LlamaIndex, bases de datos vectoriales como Chroma o FAISS, etc. Quiero ejecutar todo en local con un LLM tipo Llama 3 o Mistral.
Para alguien que empieza, ¿cuál sería el camino más sencillo para montar un prototipo funcional? ¿Debería usar un framework como LangChain o intentarlo desde cero para aprender mejor?