LLMOPS PARA UN SISTEMA DE GENERACIÓN AUMENTADA POR RECUPERACIÓN EN LA NUBE
| dc.contributor.author | Morán Lorente, Álvaro | |
| dc.date.accessioned | 2026-08-04T01:00:15Z | |
| dc.date.issued | 2026-07-23 | |
| dc.description | Trabajo Fin de Grado leído en la Universidad Rey Juan Carlos en el curso académico 2025/2026. Directores/as: Natalia Madrueño Sierro, Óscar Soto Sánchez | |
| dc.description.abstract | Los modelos de lenguaje de gran tamaño (LLM) han impulsado de forma notable la inteligencia artificial generativa, pero presentan limitaciones relevantes cuando se utilizan de forma aislada: su conocimiento interno puede quedar desactualizado, no acceden por sí mismos a información privada o específica de dominio y pueden generar respuestas no fundamentadas. Para mitigar estas carencias, este Trabajo de Fin de Grado aborda el diseño y construcción de un sistema de Generación Aumentada por Recuperación (RAG), capaz de responder preguntas utilizando documentos externos como fuente de contexto. El caso de uso se formula como un sistema de preguntas y respuestas sobre documentos procedentes de Wikipedia, evaluado de forma controlada mediante un conjunto de datos que proporciona preguntas, el contexto necesario para responderlas correctamente y las respuestas de referencia de alta calidad. Como elemento clave para asegurar la fiabilidad del sistema frente a posibles alucinaciones, la evaluación incorpora métricas de abstención orientadas a analizar el comportamiento del modelo ante preguntas que no pueden responderse con el corpus disponible. El desarrollo técnico se aborda bajo un ciclo continuo de LLMOps, partiendo de un prototipo local y evolucionando hacia una infraestructura en Amazon Web Services (AWS). La integración de herramientas de orquestación, versionado y seguimiento experimental garantiza una gestión gobernable y trazable, permitiendo la comparación objetiva entre configuraciones. En este entorno en la nube, se evalúan alternativas de búsqueda como OpenSearch Serverless y S3 Vectors, demostrando que esta última aproximación semántica gestionada ofrece un rendimiento superior con menor complejidad de implementación, siendo la opción seleccionada. | |
| dc.identifier.uri | https://hdl.handle.net/10115/489977 | |
| dc.language.iso | spa | |
| dc.publisher | Universidad Rey Juan Carlos | |
| dc.rights.accessRights | info:eu-repo/semantics/restrictedAccess | |
| dc.subject | LLMOps | |
| dc.subject | Modelos de lenguaje de gran tamaño | |
| dc.subject | Amazon Web Services | |
| dc.subject | Retrieval-Augmented Generation | |
| dc.title | LLMOPS PARA UN SISTEMA DE GENERACIÓN AUMENTADA POR RECUPERACIÓN EN LA NUBE | |
| dc.type | info:eu-repo/semantics/studentThesis |
Files
License bundle
1 - 1 of 1
Loading...
- Name:
- license.txt
- Size:
- 2.97 KB
- Format:
- Item-specific license agreed upon to submission
- Description:
