Asistente conversacional para la exploración de un archivo público

Los archivos públicos custodian grandes volúmenes de información descrita mediante modelos tradicionales basados en bases de datos relacionales y normas archivísticas. Sin embargo, la evolución hacia modelos semánticos ofrece nuevas posibilidades para la representación y reutilización de la información archivística. Este TFG tiene como objetivo estudiar y desarrollar un proceso de transformación de descripciones archivísticas existentes a un modelo basado en la ontología RiC-O (Records in Contexts Ontology), estándar promovido por el Consejo Internacional de Archivos para la representación semántica del contexto documental. Para ello se trabajará con conjuntos reales de descripciones archivísticas procedentes de una institución pública, analizando cómo trasladar elementos propios de la archivística (funciones, productores, documentos, lugares, normas …) al paradigma de grafos de conocimiento.

Sobre esta base semántica, el proyecto explorará el desarrollo de un asistente conversacional capaz de interactuar con el conocimiento archivístico mediante lenguaje natural. El sistema permitirá que usuarios no especializados formulen preguntas sobre fondos documentales, productores, funciones o relaciones entre documentos sin necesidad de conocer la estructura interna del modelo de datos. El trabajo combinará tecnologías de Web Semántica, consultas sobre grafos de conocimiento e Inteligencia Artificial generativa para evaluar la viabilidad de una nueva generación de herramientas de acceso a la información archivística.