Mostrar el registro sencillo del ítem

dc.contributor.advisorCarrasco Poblete, Edwin
dc.contributor.authorYupanqui Huaman, Roger
dc.date.accessioned2026-07-30T15:01:10Z
dc.date.available2026-07-30T15:01:10Z
dc.date.issued2026
dc.identifier.other253T20260356
dc.identifier.urihttps://hdl.handle.net/20.500.12918/12938
dc.description.abstractLos large language model (LLM) vienen demostrando un desempeño muy sobresaliente en tareas del procesamiento del lenguaje natural (NLP). Sin embargo, su rendimiento en tareas de preguntas y respuestas en dominios cerrados necesita un análisis más profundo. El manual deportivo de ajedrez representa un dominio cerrado y estructurado lo que hace pertinente la evaluación de los LLMs en este escenario. Este estudio plantea la evaluación de los LLMs considerando las arquitecturas encoder, encoder-decoder y decoder aplicando sobre ellos las métricas Strict Accuracy, Lenient Accuracy, Similitud Semántica y que fueron complementadas con evaluación humana que es indispensable en este tipo de tareas. Para ello se elabora un dataset basado en le manual deportivo de ajedrez considerando el contexto, la pregunta y la respuesta asociada a la misma. Los resultados muestran que los LLMs tienen un buen desempeño en responder preguntas donde la información se halla directamente en el contexto. Por otro lado, se observan limitaciones en las preguntas que necesitan un razonamiento adicional o la aplicación de varias reglas al mismo tiempo. Se concluye que los LLMs son de gran utilidad en tareas de preguntas y respuestas, su aplicación en dominios cerrados requiere de evaluaciones específicas, además que la elaboración de un dataset es un proceso complejo y necesario para una buena evaluación de los modelos.es_PE
dc.formatapplication/pdfen_US
dc.language.isospaes_PE
dc.publisherUniversidad Nacional de San Antonio Abad del Cuscoes_PE
dc.rightsinfo:eu-repo/semantics/openAccessen_US
dc.rights.urihttps://creativecommons.org/licenses/by-nc-nd/4.0/*
dc.subjectLarge Language Modelses_PE
dc.subjectEncoderes_PE
dc.subjectDecoderes_PE
dc.subjectStrict Accuracyes_PE
dc.subjectLenient Accuracy.es_PE
dc.titleEvaluación de large language model en la generación de respuestas para preguntas sobre las leyes deportivas de ajedrezes_PE
dc.typeinfo:eu-repo/semantics/bachelorThesis
thesis.degree.nameIngeniero Informático y de Sistemas
thesis.degree.grantorUniversidad Nacional de San Antonio Abad del Cusco. Facultad de Ingeniería Eléctrica, Electrónica, Informática y Mecánica
thesis.degree.disciplineIngeniería Informática y de Sistemas
dc.subject.ocdehttps://purl.org/pe-repo/ocde/ford#2.02.04
renati.author.dni44764030
renati.advisor.orcidhttps://orcid.org/0000-0003-4437-3960
renati.advisor.dni24001157
renati.typehttps://purl.org/pe-repo/renati/type#tesis
renati.levelhttps://purl.org/pe-repo/renati/level#tituloProfesional
renati.discipline612296
renati.jurorCarbajal Luna, Julio Cesar
renati.jurorVera Olivera, Harley
renati.jurorCutipa Arapa, Efraina Gladys
renati.jurorPillco Quispe, Jose Mauro
dc.publisher.countryPE


Ficheros en el ítem

Thumbnail

Este ítem aparece en la(s) siguiente(s) colección(ones)

Mostrar el registro sencillo del ítem

info:eu-repo/semantics/openAccess
Excepto si se señala otra cosa, la licencia del ítem se describe como info:eu-repo/semantics/openAccess