Recursos de humanidades digitales
de la UNED (herramientas, corpus y MOOC)
- LINHD
ArText es el primer redactor asistido para el español que ayuda a escribir textos de ámbitos especializados y textos en lenguaje claro. Se desarrolló en el ámbito del proyecto https://equipo.sistema-artext.com/
PoeMAS es una base de datos que se ha ido desarrollando a lo largo de tres proyectos del plan nacional de investigación y que contiene poemas que han sido musicalizados y canciones que hacen referencia a poemas de alguna manera.
Documentación:
Laín Corona, G., & Martínez Cantón, C. I. (2022). Introducción: “Estas que me dictó rimas sonoras”. Aproximación a las relaciones entre música y poesía . Pasavento. Revista De Estudios Hispánicos, 10(2), 331–337. https://doi.org/10.37536/preh.2022.10.2.2007
FILITERATURA: base de datos de literatura hispanofilipina y de literatura sobre Filipinas en español
Filiteratura es una base de datos de literatura filipina en español y literatura en español publicada en Filipinas o sobre Filipinas que se creó gracias a una subvención de los fondos de investigación de la Universidad de Amberes (Bélgica). Además, incluye una selección de traducciones del Noli me tangere , El filibusterismo y algunos otros libros escritos inicialmente en español a diferentes idiomas. Esta base de datos estaba alojada en la Universidad de Amberes y recientemente se borró de allí. Esta es el nuevo punto de acceso a la misma.
Documentación:
Ortuño Casanova, R. (2021). FILITERATURA: Base de datos relacional en Heurist de literatura en español en Filipinas y sobre Filipinas. Signa: Revista de la Asociación Española de Semiótica, 30, 109–138. https://doi.org/10.5944/signa.vol30.2021.29300
Las humanidades digitales han cambiado la forma de investigar la literatura en lengua española, pero su impacto no ha llegado a la enseñanza. En este libro en acceso abierto, que se desarrolla dentro del proyecto europeo DIGIPHILIT, se aborda, mediante un recorrido sistemático y detallado, con ejemplos y ejercicios prácticos, diferentes metodologías digitales que nos llevan desde la búsqueda de textos en lengua española en repositorios, su almacenaje, su preparación para el análisis y su análisis con diferentes técnicas. Se busca facilitar la integración de las metodologías digitales en las aulas universitarias y su posterior aplicación en el estudio de la literatura escrita en lengua española. El fin último es la revisión de cánones e historias de la literatura estancadas y que nuevas generaciones de investigadores e investigadoras se asomen a otra forma de concebir las disciplinas, propongan nuevas aperturas del canon, pongan a disposición del público general obras olvidadas y las integren en sus estudios cuantitativos aprovechando los trabajos de digitalización previos y emprendiendo otros nuevos para ampliar los límites de la investigación literaria.
Script para automatizar la conversión de obras de teatro filipino en formato de texto plano (.txt) a XML-TEI compatible con el esquema DraCor mediante el modelo de lenguaje gemma-4-26b-a4b-it
Álvarez, Andrea, Cristina Jiménez y Rocío Ortuño Casanova. Teatro filipino en español: corpus, marcado TEI-DraCor y evaluación de métodos automáticos. Repositorio GitHub, 2026. [https://github.com/DigiPhiLit/teatro-filipino]
Base de datos relacional de escritoras.
Documentación:
Baranda Leturio, N., Marín Pina, M. C., Martos Pérez, M. D., Centenera Centenera, P., & García Sánchez-Migallón, P. (2019). BIESES. Escritoras de la Edad Moderna, desde la bibliografía a las redes. En M. L. Sánchez Hernández (editor), Mujeres en la Corte de los Austrias: una red social, cultural, religiosa y politica (pp. 55-82). Polifemo.
Marín Pina, M. C., & Baranda Leturio, N. (2006). Bibliografía de escritoras españolas (Edad Media-siglo XVIII): Una base de datos. En A. J. Close (Ed.), Edad de oro cantabrigense: Actas del VII Congreso de la Asociación Internacional de Hispanistas del Siglo de Oro (pp. 425–435). Iberoamericana; Vervuert. https://cvc.cervantes.es/literatura/aiso/pdf/07/aiso_7_061.pdf
Herramienta de análisis de poesía basada en el modelo de lenguaje BERT desarrollado en el proyecto POST-DATA.
Documentación:
Ros Muñoz, S., González-Blanco García, E., de la Rosa, J., & Pérez, Á. (2023). Alberti: a Multilingual Domain Specific Language Model for Poetry Analysis. Procesamiento del lenguaje natural, 71, 215-225. https://arxiv.org/pdf/2307.01387.pdf
El Corpus de los Atlas Lingüísticos (CORPAT) es una herramienta informática cuyo objetivo es la sistematización y organización de los datos de los atlas lingüísticos. Proporciona datos para el estudio de la variación lingüística desde el eje diatópico que complementan la información que aportan los corpus textuales y las obras lexicográficas.
Documentación:
Julià Luna, C. (2023). Desarrollo de un corpus de atlas lingüísticos. En A. Grajales Ramírez, J. M. Molina Mejía y P. Valdivia Martín (Eds.), Digital humanities, corpus and language technology / Humanidades digitales, corpus y tecnología del lenguaje: A look from diverse case studies / Una mirada desde diversos casos de estudio (pp. 123–142). Universidad de Antioquia y University of Groningen Press. https://doi.org/10.21827/64db66aa60828
(en el repositorio de la UNED https://e-spacio.uned.es/entities/publication/2d7d6a37-2431-4f5c-9830-98c5555ab798 )
La librería de Python RanTamPlan desarrollada por el LINHD para el proyecto ReMetCa con el objetivo de medir automáticamente versos y que es utilizada en la Biblioteca Virtual Miguel de Cervantes https://data.cervantesvirtual.com/versos
Documentación:
Pablo Ruiz, Clara I. Martínez Cantón. ¿Cómo puedo extraer información métrica de un corpus en verso? Herramientas de análisis métrico y rimático. La experiencia de DISCO. Clara Martínez; Rocío Ortuño; Antonio Huertas. Las humanidades digitales en la enseñanza de las literaturas hispánicas. Aplicaciones prácticas, Peter Lang, pp.329–359, 2023, ⟨10.3726/b21145⟩. ⟨hal-04747963⟩ https://hal.science/hal-04747963
El DISCO: Diachronic Spanish Sonnet Corpus creado desde el Departamento de Literatura Española y Teoría de la Literatura, que incluye herramientas de medición automática de los versos y comparación de formas de sonetos.
Descripción del corpus:
Pablo Ruiz, Helena Bermúdez Sabel, Clara I. Martínez Cantón, Elena González-Blanco, Borja Navarro-Colorado. The Diachronic Spanish Sonnet Corpus (DISCO): TEI and Linked Open Data Encoding, Data Distribution and Metrical Findings. Digital Humanities 2018, Jun 2018, Mexico, Mexico. pp.486-489, ⟨10.5281/zenodo.1012567⟩. ⟨hal-02420507⟩ https://hal.science/hal-02420507
El buscador de Bieses pone a disposición de los investigadores y usuarios distintos modos de búsquedas sobre los paratextos etiquetados de las obras de las autoras objeto de estudio. Desde las distintas opciones se pueden recuperar fragmentos de paratextos así como el acceso a la obra completa.
Documentación:
Martos Pérez, M. D. (2019). Categorías interpretativas, marcado textual y codificación en XML-TEI para el estudio de los paratextos de escritoras españolas en la Edad Moderna (BIESES). Janus. Estudios sobre el Siglo de Oro, 8, 242–264. https://doi.org/10.17979/janus.2019.0.08.10372
Corpus de metacomentarios de texto (comentarios de texto comentados), y glosario de figuras retóricas online resultado del proyecto de innovación docente para enseñar a analizar textos literarios Littera.
ANJA: herramienta para la detección de encabalgamientos en poesía. Confeccionada por Clara I. Martínez Cantón y Pablo Ruiz Fabo.
Documentación:
Martínez Cantón, Clara Isabel, Pablo Ruiz Fabo, Elena Gonzalez-Blanco, Elena, y Thierry Poibeau. 2021. «Automatic Enjambment Detection as a New Source of Evidence in Spanish Versification». En Plotting Poetry: On Mechanically Enhanced Reading, editado por Anne-Sophie Bories, Gerald Purnelle, y Hugues Marchal, 93-112. Liège: Presses Universitaires de Liège.]
El proyecto DigiPhiLit creó un MOOC sobre literatura filipina en español y humanidades digitales accesible en:
https://urjcx.urjc.es/courses/literatura-hispanofilipina/
Los materiales (presentaciones interactivas y vídeos) están también en:
https://digiphilit.com/formacion/
El último tema está dedicado a hacer una introducción a las humanidades digitales y se titula «Metodologías digitales para el análisis de la literatura»:
MOOC para profesores de colegios bilingües publicado por el proyecto BIMO.
Documentación:
Colibaba, A., Gheorghiu, I., Antonita, C., Juncu, I., Mironeanu, O., Dinu, C. E., & Ursa, O. The BiMo Project and the Benefits of Bilingual and CLIL Programmes. In 14 th International Conference Innovation in Language Learning Hybrid Edition (p. 119).
El profesor Álvaro Piquero participa de la digitalización del repositorio de romances de la Fundación Ramón Menéndez Pidal, un repositorio tanto oral como escrito que recoge un archivo que empezaron a compilar Menéndez Pidal y María Goyri.
Documentación:
Sánchez, S. B., & Piquero, Á. (2020). El Archivo Digital del Romancero: una herramienta para investigadores. Viejos son, pero no cansan, 301. https://d1wqtxts1xzle7.cloudfront.net/66082920/Viejos_son_pero_no_cansan._Novos_estudos_sobre_o_romanceiro-libre.pdf
Base de datos relacional cuyo objeto es el patrimonio incunable de ediciones impresas en España de obras de autores clásicos latinos. El repertorio se ha elaborado en el marco del proyecto FFI2011-23685. El corpus de referencia está constituido por las ediciones incunables realizadas en talleres hispánicos desde la década de 1470 hasta 1500, incluyendo los impresos en latín así como las traducciones. Datos procedentes de Biblioteca de Ediciones de Clásicos Latinos en el Renacimiento. Enlace al corpus.