AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucional

Autores
Pinilla Gómez, Adriana Constanza
Año de publicación
2017
Idioma
español castellano
Tipo de recurso
tesis de maestría
Estado
versión aceptada
Colaborador/a o director/a de tesis
Gutiérrez, María de los Milagros
Ballejos, Luciana Cristina
Descripción
El principal aporte de esta tesis es el diseño e implementación de AMELOIR (Automatic Metadata Extracción Learning Object Institutional Repository), un nuevo algoritmo para la extracción automática de metadatos en repositorios institucionales utilizando técnicas de procesamiento de lenguaje natural e inteligencia artificial. AMELOIR fue incorporado en la plataforma DSpace alterando el proceso de almacenamiento, de tal manera que al ser cargado un archivo para almacenar, se invoca al extractor para que obtenga automáticamente los metadatos. Éstos se presentan al usuario en la etapa de verificación de metadatos, para que sean validados y completados en caso de que sea necesario.
Con el desarrollo de nuevos algoritmos y sistemas de extracción automática de metadatos como el propuesto en esta tesis, se reducen en gran medida los inconvenientes que presenta el autoarchivo con respecto al uso de los metadatos que no contienen información, o bien, cuando la información que poseen es incorrecta o de baja calidad. Dichos inconvenientes se presentan en gran parte por desconocimiento de valor y significado de los metadatos por parte de quien archiva el objeto de aprendizaje en el repositorio, por no contar con una herramienta adecuada de extracción automática, por la falta de selección por parte de los desarrolladores de repositorios de un conjunto adecuado de metadatos (obligatorios y opcionales) para describir los objetos de aprendizaje, así como por la diversidad de normas y el soporte de motores de búsqueda.
Además, en el algoritmo que se va a proponer se afrontan los siguientes desafíos con respecto a la extracción automática de metadatos de objetos de aprendizaje en repositorios institucionales de acceso abierto:
- Se aplican herramientas de procesamiento de lenguaje natural y expresiones regulares para la extracción de metadatos.
- Se reduce, hasta donde sea posible, la intervención del usuario en el proceso de extracción de metadatos, para disminuir el grado de imprecisión, incompletitud, inconsistencias y discrepancias de la información almacenada en el repositorio.
- Se contempla el procesamiento de archivos en formato Word y PDF.
- Se hace uso integrado de estándares de metadatos Dublin Core e IEE LOM, como una forma de aprovechar los grandes esfuerzos que se han hecho hasta el momento para brindar la posibilidad de estandarizar y unificar la información que se extrae y almacena de los objetos de aprendizaje, haciendo posible la compatibilidad e interoperabilidad entre diferentes repositorios institucionales.
Al ser AMELOIR un algoritmo de extracción de metadatos aplicable a cualquier repositorios institucionales implementado en DSpace, el software más utilizado a nivel global en lo que a RI de universidades y centros de investigación respecta, es posible adaptar dicho algoritmo para ser utilizado en cualquier otro repositorio que cumpla con estas características, haciendo factible su inserción en mercados externos.
El atractivo del algoritmo está en permitir el enriquecimiento de las descripciones de los recursos educativos y de esta manera, optimizar las funcionalidades de búsqueda implementadas en cada uno de los repositorios.
Adicionalmente, se estarían sustituyendo herramientas que trabajen de manera independiente al repositorio institucional o con un menor nivel de detalle, y que a su vez podrían ser privativas o generar algún costo de licenciamiento.
A partir del desarrollo y adaptación de AMELOIR, se hace factible sustituir la importación de material educativo pago, tanto físico como virtual, debido a que se incentiva la reutilización del material producido en la misma institución y la colaboración entre, por ejemplo, universidades y grupos de investigación de distintos países. De esta forma, se enriquecen las funcionalidades disponibles del repositorio institucional utilizado, logrando contar con un producto de gran valor tecnológico, a la vez que se reutiliza y agrega valor promoviendo el conocimiento generado internamente.
Por otra parte, con la implementación de este algoritmo se contribuye de manera significativa al desarrollo del repositorio institucional del CIDISI (Centro de Investigación y Desarrollo de Ingeniería en Sistemas de Información, Universidad Tecnológica Nacional, Facultad Regional Santa Fe), el cual está en su etapa inicial de implementación, y a través de éste último se da impulso a proyectos futuros a partir de la distribución, visibilidad y reutilización del conocimiento logrado en investigaciones previas.
Fil: Pinilla Gómez, Adriana Constanza. Universidad Tecnológica Nacional. Facultad Regional Santa Fe; Argentina.
Peer Reviewed
Se presenta esta tesis en cumplimiento de los requisitos exigidos por la Universidad Tecnológica Nacional para la obtención del grado académico de magister en Ingeniería en sistemas de Información
Materia
Repositorio institucional
Metadatos
Extractor automático
Objetos de aprendizaje
Nivel de accesibilidad
acceso abierto
Condiciones de uso
2017-12-05T22:55:06Z
Repositorio
Repositorio Institucional Abierto (UTN)
Institución
Universidad Tecnológica Nacional
OAI Identificador
oai:ria.utn.edu.ar:20.500.12272/2513

id RIAUTN_2c4cb88f7244fce57fe3e20e9ebe7c8c
oai_identifier_str oai:ria.utn.edu.ar:20.500.12272/2513
network_acronym_str RIAUTN
repository_id_str a
network_name_str Repositorio Institucional Abierto (UTN)
spelling AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucionalPinilla Gómez, Adriana ConstanzaRepositorio institucionalMetadatosExtractor automáticoObjetos de aprendizajeEl principal aporte de esta tesis es el diseño e implementación de AMELOIR (Automatic Metadata Extracción Learning Object Institutional Repository), un nuevo algoritmo para la extracción automática de metadatos en repositorios institucionales utilizando técnicas de procesamiento de lenguaje natural e inteligencia artificial. AMELOIR fue incorporado en la plataforma DSpace alterando el proceso de almacenamiento, de tal manera que al ser cargado un archivo para almacenar, se invoca al extractor para que obtenga automáticamente los metadatos. Éstos se presentan al usuario en la etapa de verificación de metadatos, para que sean validados y completados en caso de que sea necesario.Con el desarrollo de nuevos algoritmos y sistemas de extracción automática de metadatos como el propuesto en esta tesis, se reducen en gran medida los inconvenientes que presenta el autoarchivo con respecto al uso de los metadatos que no contienen información, o bien, cuando la información que poseen es incorrecta o de baja calidad. Dichos inconvenientes se presentan en gran parte por desconocimiento de valor y significado de los metadatos por parte de quien archiva el objeto de aprendizaje en el repositorio, por no contar con una herramienta adecuada de extracción automática, por la falta de selección por parte de los desarrolladores de repositorios de un conjunto adecuado de metadatos (obligatorios y opcionales) para describir los objetos de aprendizaje, así como por la diversidad de normas y el soporte de motores de búsqueda.Además, en el algoritmo que se va a proponer se afrontan los siguientes desafíos con respecto a la extracción automática de metadatos de objetos de aprendizaje en repositorios institucionales de acceso abierto:- Se aplican herramientas de procesamiento de lenguaje natural y expresiones regulares para la extracción de metadatos.- Se reduce, hasta donde sea posible, la intervención del usuario en el proceso de extracción de metadatos, para disminuir el grado de imprecisión, incompletitud, inconsistencias y discrepancias de la información almacenada en el repositorio.- Se contempla el procesamiento de archivos en formato Word y PDF.- Se hace uso integrado de estándares de metadatos Dublin Core e IEE LOM, como una forma de aprovechar los grandes esfuerzos que se han hecho hasta el momento para brindar la posibilidad de estandarizar y unificar la información que se extrae y almacena de los objetos de aprendizaje, haciendo posible la compatibilidad e interoperabilidad entre diferentes repositorios institucionales.Al ser AMELOIR un algoritmo de extracción de metadatos aplicable a cualquier repositorios institucionales implementado en DSpace, el software más utilizado a nivel global en lo que a RI de universidades y centros de investigación respecta, es posible adaptar dicho algoritmo para ser utilizado en cualquier otro repositorio que cumpla con estas características, haciendo factible su inserción en mercados externos.El atractivo del algoritmo está en permitir el enriquecimiento de las descripciones de los recursos educativos y de esta manera, optimizar las funcionalidades de búsqueda implementadas en cada uno de los repositorios.Adicionalmente, se estarían sustituyendo herramientas que trabajen de manera independiente al repositorio institucional o con un menor nivel de detalle, y que a su vez podrían ser privativas o generar algún costo de licenciamiento.A partir del desarrollo y adaptación de AMELOIR, se hace factible sustituir la importación de material educativo pago, tanto físico como virtual, debido a que se incentiva la reutilización del material producido en la misma institución y la colaboración entre, por ejemplo, universidades y grupos de investigación de distintos países. De esta forma, se enriquecen las funcionalidades disponibles del repositorio institucional utilizado, logrando contar con un producto de gran valor tecnológico, a la vez que se reutiliza y agrega valor promoviendo el conocimiento generado internamente.Por otra parte, con la implementación de este algoritmo se contribuye de manera significativa al desarrollo del repositorio institucional del CIDISI (Centro de Investigación y Desarrollo de Ingeniería en Sistemas de Información, Universidad Tecnológica Nacional, Facultad Regional Santa Fe), el cual está en su etapa inicial de implementación, y a través de éste último se da impulso a proyectos futuros a partir de la distribución, visibilidad y reutilización del conocimiento logrado en investigaciones previas.Fil: Pinilla Gómez, Adriana Constanza. Universidad Tecnológica Nacional. Facultad Regional Santa Fe; Argentina.Peer ReviewedSe presenta esta tesis en cumplimiento de los requisitos exigidos por la Universidad Tecnológica Nacional para la obtención del grado académico de magister en Ingeniería en sistemas de InformaciónGutiérrez, María de los MilagrosBallejos, Luciana Cristina2017-12-05T22:55:06Z2017-12-05T22:55:06Z2017-08info:eu-repo/semantics/masterThesisinfo:eu-repo/semantics/acceptedVersionhttp://purl.org/coar/resource_type/c_bdccinfo:ar-repo/semantics/tesisDeMaestriaapplication/pdfapplication/pdfPinilla Gómez, A. C. (2017). AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucional (Tesis de Maestría). Universidad Tecnológica Nacional, Facultad Regional Santa Fe, Argentina.http://hdl.handle.net/20.500.12272/2513spainfo:eu-repo/semantics/openAccess2017-12-05T22:55:06Zhttp://creativecommons.org/licenses/by-nc-sa/4.0/La autoraAtribución-NoComercial-CompartirIgual 4.0 InternacionalLicencia Creative Commonsreponame:Repositorio Institucional Abierto (UTN)instname:Universidad Tecnológica Nacional2026-09-24T12:43:54Zoai:ria.utn.edu.ar:20.500.12272/2513instacron:UTNInstitucionalhttp://ria.utn.edu.ar/Universidad públicaNo correspondehttp://ria.utn.edu.ar/oaigestionria@rec.utn.edu.ar; fsuarez@rec.utn.edu.arArgentinaNo correspondeNo correspondeNo correspondeopendoar:a2026-09-24 12:43:55.703Repositorio Institucional Abierto (UTN) - Universidad Tecnológica Nacionalfalse
dc.title.none.fl_str_mv AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucional
title AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucional
spellingShingle AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucional
Pinilla Gómez, Adriana Constanza
Repositorio institucional
Metadatos
Extractor automático
Objetos de aprendizaje
title_short AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucional
title_full AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucional
title_fullStr AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucional
title_full_unstemmed AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucional
title_sort AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucional
dc.creator.none.fl_str_mv Pinilla Gómez, Adriana Constanza
author Pinilla Gómez, Adriana Constanza
author_facet Pinilla Gómez, Adriana Constanza
author_role author
dc.contributor.none.fl_str_mv Gutiérrez, María de los Milagros
Ballejos, Luciana Cristina
dc.subject.none.fl_str_mv Repositorio institucional
Metadatos
Extractor automático
Objetos de aprendizaje
topic Repositorio institucional
Metadatos
Extractor automático
Objetos de aprendizaje
dc.description.none.fl_txt_mv El principal aporte de esta tesis es el diseño e implementación de AMELOIR (Automatic Metadata Extracción Learning Object Institutional Repository), un nuevo algoritmo para la extracción automática de metadatos en repositorios institucionales utilizando técnicas de procesamiento de lenguaje natural e inteligencia artificial. AMELOIR fue incorporado en la plataforma DSpace alterando el proceso de almacenamiento, de tal manera que al ser cargado un archivo para almacenar, se invoca al extractor para que obtenga automáticamente los metadatos. Éstos se presentan al usuario en la etapa de verificación de metadatos, para que sean validados y completados en caso de que sea necesario.
Con el desarrollo de nuevos algoritmos y sistemas de extracción automática de metadatos como el propuesto en esta tesis, se reducen en gran medida los inconvenientes que presenta el autoarchivo con respecto al uso de los metadatos que no contienen información, o bien, cuando la información que poseen es incorrecta o de baja calidad. Dichos inconvenientes se presentan en gran parte por desconocimiento de valor y significado de los metadatos por parte de quien archiva el objeto de aprendizaje en el repositorio, por no contar con una herramienta adecuada de extracción automática, por la falta de selección por parte de los desarrolladores de repositorios de un conjunto adecuado de metadatos (obligatorios y opcionales) para describir los objetos de aprendizaje, así como por la diversidad de normas y el soporte de motores de búsqueda.
Además, en el algoritmo que se va a proponer se afrontan los siguientes desafíos con respecto a la extracción automática de metadatos de objetos de aprendizaje en repositorios institucionales de acceso abierto:
- Se aplican herramientas de procesamiento de lenguaje natural y expresiones regulares para la extracción de metadatos.
- Se reduce, hasta donde sea posible, la intervención del usuario en el proceso de extracción de metadatos, para disminuir el grado de imprecisión, incompletitud, inconsistencias y discrepancias de la información almacenada en el repositorio.
- Se contempla el procesamiento de archivos en formato Word y PDF.
- Se hace uso integrado de estándares de metadatos Dublin Core e IEE LOM, como una forma de aprovechar los grandes esfuerzos que se han hecho hasta el momento para brindar la posibilidad de estandarizar y unificar la información que se extrae y almacena de los objetos de aprendizaje, haciendo posible la compatibilidad e interoperabilidad entre diferentes repositorios institucionales.
Al ser AMELOIR un algoritmo de extracción de metadatos aplicable a cualquier repositorios institucionales implementado en DSpace, el software más utilizado a nivel global en lo que a RI de universidades y centros de investigación respecta, es posible adaptar dicho algoritmo para ser utilizado en cualquier otro repositorio que cumpla con estas características, haciendo factible su inserción en mercados externos.
El atractivo del algoritmo está en permitir el enriquecimiento de las descripciones de los recursos educativos y de esta manera, optimizar las funcionalidades de búsqueda implementadas en cada uno de los repositorios.
Adicionalmente, se estarían sustituyendo herramientas que trabajen de manera independiente al repositorio institucional o con un menor nivel de detalle, y que a su vez podrían ser privativas o generar algún costo de licenciamiento.
A partir del desarrollo y adaptación de AMELOIR, se hace factible sustituir la importación de material educativo pago, tanto físico como virtual, debido a que se incentiva la reutilización del material producido en la misma institución y la colaboración entre, por ejemplo, universidades y grupos de investigación de distintos países. De esta forma, se enriquecen las funcionalidades disponibles del repositorio institucional utilizado, logrando contar con un producto de gran valor tecnológico, a la vez que se reutiliza y agrega valor promoviendo el conocimiento generado internamente.
Por otra parte, con la implementación de este algoritmo se contribuye de manera significativa al desarrollo del repositorio institucional del CIDISI (Centro de Investigación y Desarrollo de Ingeniería en Sistemas de Información, Universidad Tecnológica Nacional, Facultad Regional Santa Fe), el cual está en su etapa inicial de implementación, y a través de éste último se da impulso a proyectos futuros a partir de la distribución, visibilidad y reutilización del conocimiento logrado en investigaciones previas.
Fil: Pinilla Gómez, Adriana Constanza. Universidad Tecnológica Nacional. Facultad Regional Santa Fe; Argentina.
Peer Reviewed
Se presenta esta tesis en cumplimiento de los requisitos exigidos por la Universidad Tecnológica Nacional para la obtención del grado académico de magister en Ingeniería en sistemas de Información
description El principal aporte de esta tesis es el diseño e implementación de AMELOIR (Automatic Metadata Extracción Learning Object Institutional Repository), un nuevo algoritmo para la extracción automática de metadatos en repositorios institucionales utilizando técnicas de procesamiento de lenguaje natural e inteligencia artificial. AMELOIR fue incorporado en la plataforma DSpace alterando el proceso de almacenamiento, de tal manera que al ser cargado un archivo para almacenar, se invoca al extractor para que obtenga automáticamente los metadatos. Éstos se presentan al usuario en la etapa de verificación de metadatos, para que sean validados y completados en caso de que sea necesario.
publishDate 2017
dc.date.none.fl_str_mv 2017-12-05T22:55:06Z
2017-12-05T22:55:06Z
2017-08
dc.type.none.fl_str_mv info:eu-repo/semantics/masterThesis
info:eu-repo/semantics/acceptedVersion
http://purl.org/coar/resource_type/c_bdcc
info:ar-repo/semantics/tesisDeMaestria
format masterThesis
status_str acceptedVersion
dc.identifier.none.fl_str_mv Pinilla Gómez, A. C. (2017). AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucional (Tesis de Maestría). Universidad Tecnológica Nacional, Facultad Regional Santa Fe, Argentina.
http://hdl.handle.net/20.500.12272/2513
identifier_str_mv Pinilla Gómez, A. C. (2017). AMELOIR : algoritmo para la extracción automática de metadatos a partir de objetos de aprendizaje en un repositorio institucional (Tesis de Maestría). Universidad Tecnológica Nacional, Facultad Regional Santa Fe, Argentina.
url http://hdl.handle.net/20.500.12272/2513
dc.language.none.fl_str_mv spa
language spa
dc.rights.none.fl_str_mv info:eu-repo/semantics/openAccess
2017-12-05T22:55:06Z
http://creativecommons.org/licenses/by-nc-sa/4.0/
La autora
Atribución-NoComercial-CompartirIgual 4.0 Internacional
Licencia Creative Commons
eu_rights_str_mv openAccess
rights_invalid_str_mv 2017-12-05T22:55:06Z
http://creativecommons.org/licenses/by-nc-sa/4.0/
La autora
Atribución-NoComercial-CompartirIgual 4.0 Internacional
Licencia Creative Commons
dc.format.none.fl_str_mv application/pdf
application/pdf
dc.source.none.fl_str_mv reponame:Repositorio Institucional Abierto (UTN)
instname:Universidad Tecnológica Nacional
reponame_str Repositorio Institucional Abierto (UTN)
collection Repositorio Institucional Abierto (UTN)
instname_str Universidad Tecnológica Nacional
repository.name.fl_str_mv Repositorio Institucional Abierto (UTN) - Universidad Tecnológica Nacional
repository.mail.fl_str_mv gestionria@rec.utn.edu.ar; fsuarez@rec.utn.edu.ar
_version_ 1877230866904645632
score 13.24418