RAG en Producción · Lección 01
¿Qué etapas componen típicamente un pipeline RAG completo en producción, más allá del par simplificado de 'recuperar y generar'?
Ingesta y preprocesamiento de documentos, generación de embeddings, indexación vectorial, recuperación en tiempo de consulta, construcción del prompt, y generación de la respuesta final con el LLM
Un pipeline RAG en producción consiste únicamente en enviar la pregunta del usuario directamente al LLM sin ningún paso adicional
Solo requiere tener un LLM funcionando, sin ninguna base de datos ni proceso de indexación adicional
Elimina por completo la necesidad de tener cualquier tipo de preprocesamiento de los documentos fuente
RAG en Producción · Lección 01
Completa el código
La etapa que ocurre antes de recibir cualquier consulta del usuario se llama fase de
Revisa: se llama fase de indexación (offline, antes de cualquier consulta).
RAG en Producción · Lección 01
¿Por qué separar el pipeline en una fase offline de indexación y una fase online de consulta permite que la recuperación de una pregunta específica sea rápida, sin tener que procesar todos los documentos en ese momento?
Pista: todo el trabajo costoso de procesar, generar embeddings e indexar los documentos ocurre de antemano en la fase offline; cuando llega una consulta real del usuario, el sistema solo necesita buscar en ese índice ya preparado, sin repetir ese procesamiento pesado en cada consulta individual.
✓
¡Lección completada!
Anatomía de un pipeline RAG en producción
0
XP ganado
3
Vidas restantes