-
CLARA-MeD corpus
Una colección de 24 298 pares de textos profesionales y simplificados (>96 millones de tokens): 1) Prospectos de medicamentos y resúmenes de las características del producto (10 211 pares de textos, >82 millones de palabras); 2) Resúmenes de...
Instituto: Instituto de Lengua, Literatura y Antropología (ILLA), CSIC
-
Botánica y Literatura en la antigua Mesopotamia-Fuentes Primarias
Los datos utilizados y generados durante la ejecución del proyecto PID2021125678NB-I00 son de doble naturaleza, ambos relacionados con la disciplina del estudio de las lenguas y culturas del Próximo Oriente antiguo. Se trata por un lado de tablillas...
Instituto: Instituto de Lenguas y Culturas del Mediterráneo y Oriente Próximo (ILC), CSIC
-
Corpus para la identificación de palabras complejas en textos médicos en espa...
[Descripción de los métodos utilizados para la recopilación/generación de datos] Las estadísticas y los métodos del corpus se explican en el siguiente artículo: Federico Ortega-Riba, Leonardo Campillos-Llanos, Doaa Samy (2025) «Lexical Simplification...
Instituto: Instituto de Lengua, Literatura y Antropología (ILLA), CSIC
