english Icono del idioma   español Icono del idioma  

Por favor, use este identificador para citar o enlazar este ítem: https://hdl.handle.net/20.500.12008/56219 Cómo citar
Registro completo de metadatos
Campo DC Valor Lengua/Idioma
dc.contributor.advisorMoncecchi, Guillermo-
dc.contributor.advisorWonsever, Dina-
dc.contributor.authorGarat, Diego-
dc.date.accessioned2026-07-24T19:53:17Z-
dc.date.available2026-07-24T19:53:17Z-
dc.date.issued2026-
dc.identifier.citationGarat, D. Bajo el dominio de la ley : desidentificación y extracción de eventos en la Base de Jurisprudencia Nacional del Uruguay [en línea] Tesis de doctorado. Montevideo : Udelar. FI. INCO : PEDECIBA. Área Informática, 2026.es
dc.identifier.issn1688-2776-
dc.identifier.urihttps://hdl.handle.net/20.500.12008/56219-
dc.description.abstractEl procesamiento de lenguaje natural (PLN) en el dominio jurídico es un área de investigación clave, debido a que gran parte de la información se encuentra en leyes, sentencias y reglamentos, con desafíos derivados de su complejidad lingüística, semántica y discursiva. El objetivo de esta investigación es mejorar la calidad y accesibilidad de la información en la Base de Jurisprudencia Nacional (BJN), una colección de más de 100 000 sentencias del Poder Judicial de Uruguay. Como primer objetivo, se aborda la desidentificación automática de sentencias. Esta se centra en nombres propios y se basa en un modelo de reconocimiento de entidades nombradas combinado con agrupamiento aglomerativo para la resolución de correferencias, entrenado y evaluado sobre el corpus B*N, creado a partir de sentencias de la BJN con este fin. Los resultados se integran en un prototipo funcional para desidentificación asistida por humanos. Como segundo objetivo, se estudia la extracción de eventos relevantes. Esta se basa en la Teoría de Marcos Semánticos de Fillmore y en el aprendizaje en contexto con grandes modelos de lenguaje. Con ejemplos de FrameNet en inglés se obtienen resultados competitivos respecto de enfoques previos, mientras que la combinación con el corpus ViolenciaR en español, derivado de sentencias de la BJN y anotado manualmente, permite observar el impacto del uso de recursos multilingües y de la complejidad del dominio jurídico sobre el rendimiento del sistema. Este trabajo introduce recursos lingüísticos inéditos y metodologías innovadoras, constituyendo una contribución significativa al desarrollo del PLN en el dominio jurídico, particularmente en la BJN.es
dc.description.abstractNatural Language Processing (NLP) in the legal domain is a key research area, as much of the information is contained in laws, court rulings, and regulations, which pose challenges due to their linguistic, semantic, and discursive complexity. The aim of this research is to improve the quality and accessibility of information in the National Jurisprudence Database (BJN), a collection of over 100 000 court rulings from the Judiciary of Uruguay. As a first objective, the automatic de-identification of court rulings is addressed. This focuses on proper names and is based on a named entity recognition model combined with agglomerative clustering for coreference resolution, trained and evaluated on the B*N corpus, created from rulings in the BJN for this purpose. The results are integrated into a functional prototype for human-assisted de-identification. As a second objective, the extraction of relevant events is studied. This is grounded in Fillmore’s Frame Semantic Theory and in-context learning with large language models. Using FrameNet examples in English yields results competitive with prior approaches, while combining them with the manually annotated ViolenciaR corpus in Spanish, derived from BJN rulings, allows observation of the impact of multilingual resources and legal-domain complexity on system performance. This work introduces new linguistic resources and innovative methodologies, constituting a significant contribution to the development of NLP in the legal domain, particularly with respect to the BJN.es
dc.description.sponsorshipParte fue financiado por ANII y el Ministerio de Industria, Energía y Minería a través del Fondo Sectorial de Investigación a partir de Datos.es
dc.format.extent244 p.es
dc.format.mimetypeapplication/pdfes
dc.language.isoeses
dc.publisherUdelar. FI.es
dc.rightsLas obras depositadas en el Repositorio se rigen por la Ordenanza de los Derechos de la Propiedad Intelectual de la Universidad de la República.(Res. Nº 91 de C.D.C. de 8/III/1994 – D.O. 7/IV/1994) y por la Ordenanza del Repositorio Abierto de la Universidad de la República (Res. Nº 16 de C.D.C. de 07/10/2014)es
dc.subjectBase de Jurisprudencia Nacional de Uruguayes
dc.subjectDesidentificaciónes
dc.subjectExtracción de eventoses
dc.subjectAnálisis de marcos semánticoses
dc.subjectAprendizaje en contextoes
dc.subjectFrameNetes
dc.titleBajo el dominio de la ley : desidentificación y extracción de eventos en la Base de Jurisprudencia Nacional del Uruguayes
dc.typeTesis de doctoradoes
dc.contributor.filiacionGarat Diego, Universidad de la República (Uruguay). Facultad de Ingeniería-
thesis.degree.grantorUniversidad de la República (Uruguay). Facultad de Ingeniería.es
thesis.degree.nameDoctor en Informáticaes
dc.rights.licenceLicencia Creative Commons Atribución - No Comercial (CC - By-NC 4.0)es
Aparece en las colecciones: Tesis de posgrado - Instituto de Computación

Ficheros en este ítem:
Fichero Descripción Tamaño Formato   
Gar26.pdfTesis de doctorado2,11 MBAdobe PDFVisualizar/Abrir


Este ítem está sujeto a una licencia Creative Commons Licencia Creative Commons Creative Commons