Introduction
Recording principles
1. Introducción
El proyecto DEMel se ha fijado el objetivo de digitalizar todo el archivo de datos del DEM y hacerlo accesible gratuitamente en la web. Durante el registro de datos, la información más importante de las fichas del Fichero DEM nuclear se ha introducido en una base de datos con este fin. Los Ficheros DEM auxiliares, aparte de los Vocabularios I, no se han incluido en la base de datos, por lo que pueden consultarse en el Fichero digitalizado. El archivo de datos refleja el estado del proyecto DEM en el año 2007, momento en que se interrumpió por motivos financieros. Dado que el proyecto DEMel es puramente un proyecto de digitalización, no ha sido posible llevar a cabo una revisión exhaustiva del contenido del material. Las inexactitudes, que pudieran encontrarse, no han podido ser corregidas, dado el gran número de fichas: alrededor de 700 000. Las dificultades en el registro de datos también se debieron a la heterogeneidad del material, que no siempre se preparó según el mismo patrón a lo largo de varias décadas.
A continuación se describe la metodología del registro de datos; es un resumen del manual con directrices de registro, que se actualizó continuamente durante el proyecto DEMel, y explica a los usuarios, mediante ejemplos, qué datos se han registrado, según qué principios se ha hecho y qué información adicional contienen las fichas. Siguiendo la estructura de la base de datos, la descripción se divide en cuatro secciones: Lemas, Documentaciones, Bibliografía y Textos. Dada la heterogeneidad del material, su condición de herramienta de trabajo para la redacción de artículos de diccionario y el carácter de DEMel como proyecto de pura digitalización (con una duración limitada), los datos registrados deben consultarse con precaución. En caso de duda, puede ser conveniente consultar el pasaje de texto pertinente en la fuente correspondiente, además de la entrada en la base de datos. En el caso de unas 200 fuentes, el pasaje de texto está enlazado directamente; en cuanto al resto, la información que figura en las fichas permite, por lo general, localizar las documentaciones sin dificultad.
2. Lemas
2.1. Lemario
La base de datos contiene todos los lemas y las documentaciones, que se crearon para el Fichero DEM nuclear durante la duración del proyecto DEM. El resultado son más de 32 000 lemas. En ocasiones, también se incluyen lemas cuyo material documental correspondiente queda fuera del marco temporal considerado por el DEM (del siglo X hasta principios del XV) o que proceden de textos en otras lenguas. Dado que la tarea del proyecto consistía en digitalizar todo el archivo de datos del DEM, también se han registrado estos lemas. Cuando en la ficha de lema se ha encontrado una advertencia, en el registro de lemas se ha añadido en Notas la información “no forma parte del DEM” o “no forma parte del español medieval”, como puede verse en la imagen:
Los nombres propios como topónimos, antropónimos, etc. también se han creado como lemas si formaban parte del Fichero DEM nuclear. Otros nombres propios se encuentran en el fichero digitalizado en el apartado 2.3. Topónimos y nombres propios.
El lemario también contiene alrededor de 6 000 lemas de remisión. Se trata en su mayoría de variantes gráficas en las que se hace referencia a la forma nominal del lema correspondiente. La decisión de si un objeto creado en la base de datos es un lema o un lema de remisión se ha tomado a partir de las documentaciones enlazadas a este objeto: un objeto ha sido declarado lema de remisión en la base de datos cuando, en la ficha de lema en el Fichero DEM nuclear, se indicaba una remisión a otro lema y además
- no contaba con una documentación,
- solo contaba con documentaciones del tipo "remisión" o
- solo tenía fichas con documentaciones secundarias en las que se mostraba una remisión.
2.2. Lematización
La lematización en el proyecto DEMel está basada en el lemario del DEM y en la ordenación existente del Fichero DEM nuclear. Sin embargo, dado que el material inédito del DEM no fue revisado y comprobado debido al final del proyecto, esta clasificación y separación de lemas ha sido a veces incoherente, ya que los casos difíciles no se pudieron aclarar de forma concluyente. En el marco del proyecto DEMel, no ha sido posible depurar las inexactitudes en materia de lematización en todos los casos. Esto concierne sobre todo a la separación o fusión de variantes gráficas, así como a la diferenciación de lemas según las categorías gramaticales. En ocasiones, los adjetivos y los sustantivos han tenido que fusionarse porque las documentaciones no estaban separadas entre sí de forma coherente y las categorías gramaticales no siempre podían determinarse claramente a partir de la ficha (entre otras causas, debido a la ausencia de contextos). Por ejemplo, el adjetivo extranjero, a y el sustantivo masculino extranjero han sido agrupados bajo el lema extranjero, a. Tampoco fue posible separar claramente los nombres propios y los sustantivos en algunos casos, como el lema villa. Los participios causaron dificultades particulares. Generalmente, el DEM incluyó los participios adjetivados como lemas independientes. Sin embargo, no era posible separar sistemáticamente las documentaciones de los participios de uso adjetival y de uso verbal. Además, la clasificación existente de las documentaciones era, en algunos casos, provisional. Por esta razón, puede ocurrir que los participios adjetivados se hayan clasificado también en el verbo y viceversa. Todas las documentaciones con lematización poco clara han sido asignadas al objeto de lema #dudoso.
2.3. Escritura de los lemas
La escritura de los lemas se ha tomado de las fichas de lema. Por regla general, se basa en el español actual, como en el DEM. Pueden aparecer los siguientes caracteres especiales:
| Caracteres especiales | Explicación | Ejemplo |
|---|---|---|
| Corchetes [] | Según el DEM, los corchetes [] denotan una variante gráfica del lema que no pudo documentarse en el español medieval. | [alhorrería] |
| Signo de interrogación ? | Un signo de interrogación al final de un lema pone en duda la existencia del lema en el español medieval. | xulan ? |
| Cifras | Como es habitual, los homónimos se distinguen entre sí por los números. | y 1 |
| Barra / | Una barra separa dos variantes gráficas de un lema. | alfidida / alfita |
Particularidades de la escritura de los lemas:
- Los nombres propios se escriben en mayúsculas en la base de datos, por ejemplo, Ávila, a menos que el lema se utilice como nombre propio y como sustantivo, como alcántara.
- En el caso del uso pronominal de un verbo, este se indica en el lema (infinitivo) añadiendo (se), como por ejemplo, en ir(se).
2.4. Categorías gramaticales
En la medida de lo posible, se han asignado a los lemas una o varias categoría(s) gramatical(es). La información sobre la categoría gramatical de un lema se obtiene principalmente del lemario del DEM o de las fichas de lema. Durante el registro de datos, cuando se ha encontrado en las fichas información manuscrita sobre otras categorías gramaticales, esta ha quedado registrada en el lema. Las asignaciones de categorías gramaticales no se pudieron comprobar con más detalle. En algunos lemas, la categoría gramatical no se indica o no está clara. En estos casos, hay que tener en cuenta que el material digitalizado refleja el estado de la investigación hasta que el DEM se interrumpió en 2007, por lo que algunos de estos casos pueden haberse aclarado ya en investigaciones más recientes. En la base de datos se distingue - en general, de acuerdo con las convenciones del DEM (cf. vol. 1, p. XLVf.) - entre las siguientes categorías gramaticales:
| adj. | adjetivo | prep. | preposición |
| adv. | adverbio | pron. | pronombre |
| art. | artículo | f. | sustantivo femenino |
| ger. | gerundio | f. pl. | sustantivo femenino plural |
| interj. | interjección | m. | sustantivo masculino |
| conj. | conjunción | m. pl. | sustantivo masculino plural |
| antrop. | antropónimo | s. | sustantivo (género no aclarado) |
| top. | topónimo | v. | verbo |
| n. p. (otros) | otros nombres propios (incl. no aclarados) | v. (prnl.) | verbo pronominal |
| part. | participio | [no espec.] | categoría gramatical no especificada |
Nota sobre las categorías gramaticales:
- Los numerales se han clasificado como adjetivos según la tradición gramatical española, por ejemplo, catorze adj.
- Los sustantivos que son tanto femeninos como masculinos se han clasificado como "f." y "m.", por ejemplo, alumno, a m./f.
- La categoría gramatical "s." solo se ha utilizado cuando no se ha podido determinar el género de un sustantivo, por ejemplo, alicoçien s.
- La categoría gramatical "n. p. (otros)" solo se ha asignado cuando un nombre propio no es ni un topónimo ni un antropónimo o si hay un caso dudoso, por ejemplo, Abnadina n. p. (otros).
- La categoría gramatical "v. (prnl.)" se ha asignado cuando había indicios de uso pronominal o reflexivo en el lema o en las fichas - normalmente indicado mediante infinitivo + (se). A los verbos de uso exclusivamente pronominal solo se les ha asignado la categoría gramatical "v. (prnl.)", por ejemplo, zabullirse v. (prnl.). Para los verbos con los dos valores, se ha utilizado la categoría gramatical "v. " y "v. (prnl.)", por ejemplo, aborrecer(se) v./v. (prnl.).
- No se ha asignado ninguna categoría gramatical a los lemas de remisión. Solo se ha registrado la remisión.
A la hora de lematizar o clasificar las documentaciones, en ocasiones ha sido necesario combinar lemas de diferentes categorías gramaticales. Por lo tanto, un lema puede combinar diferentes categorías gramaticales. Por ejemplo, en el caso de los verbos sustantivados, también se ha asignado al verbo la categoría gramatical "m", como por ejemplo en usar(se).
2.5. Remisión
Bajo "Remisión", se han indicado tanto las remisiones de un lema a otro lema morfológica o funcionalmente similar que aparecen en las fichas de lema, como, en el caso de las variantes gráficas, las remisiones a la forma nominal del lema.
2.6. Notas
En la base de datos, la información sobre el origen y el uso de los lemas se ha incorporado en el apartado "Notas" de la entrada, así como los comentarios con respecto al periodo en el que se documentaron las palabras en cuestión, siempre que aparecía en la ficha respectiva. Por falta de tiempo, no se ha podido hacer una comprobación de esta información. En la base de datos se han utilizado las siguientes abreviaturas relacionadas con el origen y el uso de los lemas:
| Abreviatura utilizada en la base de datos | Significado | Abreviatura utilizada en la base de datos | Significado |
|---|---|---|---|
| ant. | antiguo | lat. | latín |
| ár. | árabe | lat. med. | latín medieval |
| arag. | aragonés | lat. vulg. | latín vulgar |
| cast. | castellano | medic. | medicina |
| cat. | catalán | mozár. | mozárabe |
| fr. | francés | nav. | navarro |
| gall. | gallego | occit. | occitano |
| gent. | gentilicio | port. | portugués |
| gr. | griego | prov. | provenzal |
| hebr. | hebreo | vasc. | euskera |
| ingl. | inglés | xenismo | extranjerismo |
| judeoesp. | judeoespañol |
Además, las siguientes indicaciones pueden aparecer en la base de datos:
| Nota utilizada en la base de datos | Significado |
|---|---|
| no forma parte del DEM | El lema no pertenece al DEM. |
| no forma parte del español medieval | El lema no pertenece al español medieval. |
3. Documentaciones
El archivo de datos del DEM ha sido completamente digitalizado para que sea de libre acceso en la web (incluidas las documentaciones que no pertenecen al español medieval). Se distingue entre documentaciones primarias, documentaciones secundarias y documentaciones del tipo "remisión".
3.1. Documentaciones primarias
Las documentaciones primarias pueden constar de las siguientes partes:
|
![]() |
La información más importante de las documentaciones primarias se ha registrado: el lema, la forma documentada, la sigla, la datación y las unidades pluriverbales (1-5). Además, en aproximadamente el 60 % de las documentaciones primarias se han generado la ubicación y el contexto a partir de los textos completos procesados en el proyecto (6-7). En su caso, posibles significados, las remisiones y toda la información adicional se encuentran en las fichas (8-10).
3.1.1. Lema
Presentación del lema
| Presentación del lema | Ejemplo | Forma nominal del lema |
|---|---|---|
| El lema suele estar subrayado en la parte superior izquierda de la ficha. | ![]() |
madero |
| En algunos casos, hay una variante gráfica en la parte superior izquierda de las fichas en lugar de la forma nominal del lema. | ![]() |
lámpara |
| Si el lema forma parte de una unidad pluriverbal, suele estar doblemente subrayado, mientras que en el resto de la unidad pluriverbal el subrayado es simple. | ![]() |
almirante |
| Especialmente en el caso de las fichas de la base de datos DEM, el lema no suele aparecer en las fichas. | ![]() |
vaca |
| En algunas fichas, la forma documentada se ha escrito en la esquina superior izquierda en lugar del lema. En estos casos, el lema no aparece indicado explícitamente. | ![]() |
ver |
Asignación del lema
A cada documentación se le ha asignado un lema del Lemario. La lematización provisional de la documentación solo se ha comprobado en casos excepcionales. En la asignación del lema existen las siguientes particularidades:
| Particularidades de la asignación del lema | Ejemplo | Lema asignado |
|---|---|---|
| Si en una ficha se habían marcado formas documentadas de varios lemas, se han creado varias documentaciones, cada una con un lema y la forma documentada correspondiente. | ![]() |
Documentación 1:
Documentación 2:
|
| Si la lematización de una documentación no estaba clara, se ha asignado a la documentación el objeto de lema #dudoso. | ![]() |
#dudoso |
3.1.2. Forma documentada
Presentación de la forma documentada
| Presentación de la forma documentada | Ejemplo | Forma documentada |
|---|---|---|
| Forma subrayada | ![]() |
maas |
| Forma coloreada | ![]() |
maayo |
| Forma con subrayado precedente | ![]() |
alguno |
| Forma sin resaltar | ![]() |
macado |
| La marcación no siempre se corresponde únicamente con la forma documentada. A veces aparecen más palabras subrayadas. | ![]() |
venie |
Escritura de la forma documentada
Durante el registro de datos, las formas documentadas se han introducido en la base de datos como aparecían en las fichas. Solo en casos concretos, por ejemplo, si la forma documentada era ilegible, se han comprobado las formas. Durante el proceso de registro se han tenido en cuenta las siguientes particularidades:
| Particularidades del registro de las formas documentadas | Ejemplo | Forma documentada |
|---|---|---|
| Las abreviaturas se han mantenido (y no han sido resueltas). | ![]() |
b. |
| Las formas aglutinadas se han introducido completamente en la base de datos. | ![]() |
oubritar |
| Las omisiones entre las distintas partes de las formas documentadas se han marcado con tres puntos. | ![]() |
qual … quier |
| Se han mantenido las letras mayúsculas y minúsculas. | ![]() |
MUGERES |
| Los verbos auxiliares no se han introducido en la base de datos. | ![]() |
vsado |
| En el caso de las unidades pluriverbales, solo se ha registrado la forma documentada del lema asignado. | ![]() |
ido |
| Las correcciones en las formas documentadas han sido adoptadas. | ![]() |
batalla |
| La grafía <ſ> ha sido sustituida por <s>. | ![]() |
carreras |
| Se han adoptado caracteres especiales como corchetes o guiones. | ![]() |
clareçie<n>do |
| Se han descodificado los caracteres especiales codificados con # y números. | ![]() |
[a]los |
Documentaciones sin formas documentadas
En algunas fichas falta el contexto. En estos casos, en general no se ha registrado ninguna forma documentada. Solo en el caso de algunas de estas documentaciones, la forma documentada se ha introducido en la base de datos durante la anotación de las documentaciones. En la sección Documentaciones, las demás documentaciones pueden identificarse con "[sin]" en la columna de formas. Esto afecta a los siguientes tipos de fichas:
| Tipo con explicación | Ejemplo |
|---|---|
| Ficha sin contexto y sin forma documentada | ![]() |
|
Ficha sin contexto que introduce una variante gráfica mediante "graf.", "grafía" o "var.": Una comprobación aleatoria de los pasajes ha mostrado que las formas introducidas por "graf.", "grafía" o "var." suelen corresponder a la forma documentada concreta en la palabra raíz, pero no en lo que respecta a la flexión.
|
![]() |
|
Ficha sin contexto, pero con la variante gráfica en lugar de la forma nominal del lema: Una comprobación aleatoria ha mostrado que las variantes gráficas anotadas en la esquina superior izquierda de la ficha en lugar de la forma nominal del lema suelen corresponder en raíz a la forma concreta utilizada, pero no en su flexión.
|
![]() |
|
Documentación primaria de "DocsMozárToledo": Dado que los documentos de "DocsMozárToledo" estaban redactados en su mayoría en escritura árabe y solo se disponía de una traducción al castellano actual en escritura latina, no se ha registrado ninguna forma documentada.
|
![]() |
|
Documentación del tipo "remisión" con remisión a la forma nominal del mismo lema: En algunas documentaciones del tipo "remisión", una variante gráfica hacía referencia a la forma nominal del lema al que pertenecía la documentación. Como esa remisión no habría tenido sentido, se ha registrado una documentación primaria sin forma documentada. (La documentación de ejemplo pertenece al lema clavazón. Por lo tanto, una remisión a clavazón no habría tenido sentido).
|
![]() |
Fichas con varias formas documentadas
| Fichas con varias formas documentadas | Ejemplo | Forma documentada |
|---|---|---|
|
Si una misma forma documentada de la misma fuente se había anotado varias veces en una ficha, solo se ha registrado una vez. (Si las formas documentadas proceden de distintas fuentes, se han registrado varias documentaciones. Si la documentación se procesó durante la anotación de las documentaciones, se han creado posteriormente documentaciones adicionales.)
|
![]() |
almud |
| Si en una ficha aparecen diferentes formas documentadas, se hace un registro por cada forma documentada. | ![]() |
Documentación 1:
Documentación 2:
|
3.1.3. Sigla
Presentación de la sigla
| Presentación de la sigla | Ejemplo | Sigla en la bibliografía |
|---|---|---|
| La sigla se indica en la ficha de forma manuscrita o mediante la impresión de un sello, normalmente en la esquina superior derecha. | ![]() |
FBaeza |
| En el caso de las fichas de la base de datos DEM, la sigla aparece junto con la datación al principio. | ![]() |
Alf XI LMontería (ADMYTE 0) |
| La escritura de la sigla en la ficha no siempre corresponde a la escritura de la sigla en la bibliografía. | ![]() |
ColForm |
| Para algunas fichas, se utilizó inicialmente una variante de sigla diferente y posteriormente se añadió la forma estandarizada de la sigla. | ![]() |
Alf X PCrónGen I |
| En algunas colecciones de documentos, además de la sigla, se menciona el documento específico del que procede el extracto de texto. | ![]() |
FsMun |
| Para las fichas extraídas de los Textos lingüísticos navarros, se ha utilizado el encabezamiento del texto respectivo en lugar de la sigla. | ![]() |
TLingNavarros |
| La sigla "FCuenca - Iznat" se ha utilizado para las fichas del Fuero de Cuenca o del Fuero de Iznatoraf. Según el subrayado, se trata o de la sigla "FCuenca" o "FHeznatoraf". | ![]() |
FHeznatoraf |
| Las fichas manuscritas con la sigla "ColDiplOviedo" provienen de "CartSVicenteOviedo". | ![]() |
CartSVicenteOviedo |
Asignación de la sigla
A cada documentación se le ha asignado una sigla de la Bibliografía. Solo en casos excepcionales se ha comprobado si las siglas que figuraban en las fichas eran correctas. A la hora de asignar la sigla se han tenido en cuenta las siguientes particularidades:
| Particularidades al asignar la sigla | Ejemplo | Sigla asignada |
|---|---|---|
| Si se han indicado diferentes siglas en una ficha, se registra una documentación por sigla. | ![]() |
Documentación 1:
Documentación 2:
|
| Si se ha indicado una variante de la sigla en una ficha, se ha asignado a la documentación la grafía estandarizada de la sigla. | ![]() |
Alf X LeyesNuevas |
| No se ha incluido información complementaria sobre la sigla. | ![]() |
FsMun |
3.1.4. Datación
Presentación de la datación
| Presentación de la datación | Ejemplo | Datación correcta |
|---|---|---|
| La fecha suele estar indicada en la esquina superior derecha, justo encima de la sigla. | ![]() |
c 1400 |
| En algunas siglas, la fecha se añadía detrás de esta, mediante la impresión de un sello. | 1280 | |
| En el caso de las fichas de la base de datos DEM, la datación está al principio. | ![]() |
1342-50 |
| En el caso de las colecciones de documentos que contienen fuentes de un periodo de tiempo más amplio, las documentaciones suelen tener una datación precisa. |
Documentación:
Sigla:
|
|
| Algunas fuentes fueron corregidas durante los trabajos del DEM. Algunas fichas siguen teniendo la antigua datación. | ![]() |
1200-1250 |
Registro de la datación
Al registrar la datación de las documentaciones en la segunda fase del proyecto, se distinguió entre dos casos diferentes:
- La documentación procede de una fuente en la que todas las documentaciones tienen la misma datación. Para estas documentaciones no hizo falta registrar la datación a mano, ya que se podía generar automáticamente a partir de la fuente primaria.
- La documentación procede de una colección de documentos que contiene fuentes de un periodo más amplio (por ejemplo, "TLingNavarros" siglos XI-XV). En el caso de estas documentaciones, la datación concreta del respectivo documento o fuente individual suele anotarse en las fichas correspondientes.
Para el registro de las dataciones se comprobó en primer lugar qué fuentes primarias pertenecían a la segunda categoría. Se identificaron 272 fuentes. A continuación, se registró la datación de las documentaciones correspondientes. Para que las dataciones fuesen consultables, las denominaciones como circa, ante, post, etc. han tenido que convertirse en intervalos numéricos:
| Designación | Desde | Hasta |
|---|---|---|
| siglo | comienzo del siglo (xx00) | fin de siglo (xx99) |
| s XIV | 1300 | 1399 |
| principios de siglo | comienzo del siglo (xx00) | 10 años después del inicio (xx10) |
| princ. s XIV | 1300 | 1310 |
| mediados de siglo | 10 años antes de la mitad del siglo (xx40) | 10 años después de mitad del siglo (xx60) |
| med. s XIV | 1340 | 1360 |
| primera mitad del siglo | comienzo del siglo (xx00) | mitad de siglo (xx50) |
| 1ª mit. s XIV | 1300 | 1350 |
| segunda mitad del siglo | mitad de siglo (xx50) | fin de siglo (xx99) |
| 2ª mit. s XIV | 1350 | 1399 |
| finales de siglo | 10 años antes del fin de siglo (xx89) | fin de siglo (xx99) |
| fines s XIV | 1389 | 1399 |
| aproximadamente | 15 años antes de xxxx | 15 años después de xxxx |
| c 1300 | 1285 | 1315 |
| anterior a | 15 años antes de xxxx | xxx |
| a 1300 | 1285 | 1300 |
| posterior a | xxx | 15 años después de xxxx |
| p 1300 | 1285 | 1315 |
| posterior a- anterior a | xxx | xxx |
| p 1275 – a 1300 | 1275 | 1300 |
3.1.5. Unidad pluriverbal
Presentación de la unidad pluriverbal
| Presentación de la unidad pluriverbal | Ejemplo | Unidad pluriverbal |
|---|---|---|
| Si el lema forma parte de una unidad pluriverbal, suele estar doblemente subrayado, mientras que en el resto de la unidad pluriverbal el subrayado es simple. | ![]() |
ir su carrera |
| A veces, la unidad pluriverbal se ha subrayado solo una vez. | ![]() |
caer en |
| A veces, solo se ha subrayado el lema y no el resto de la unidad pluriverbal. | ![]() |
aducir delante el juez |
| En las unidades pluriverbales puede haber abreviaturas. | ![]() |
acordar en u.c. |
| Los comodines suelen introducirse con "+". | ![]() |
haber de + inf. |
| Los paréntesis también pueden marcar comodines. | ![]() |
cerrar a algn. las puertas de (un país) |
| En las fichas, la escritura de la unidad pluriverbal no siempre se basa en el español actual. | ![]() |
fablar razones con alg. |
| Suelen usarse tres puntos para las omisiones en las unidades pluriverbales. | ![]() |
de … en afuera |
Registro de las unidades pluriverbales
En la segunda fase del proyecto, se registraron las unidades pluriverbales de las fichas. Durante el proceso de registro se tuvieron en cuenta las siguientes particularidades:
| Particularidades en el registro de las unidades pluriverbales | Ejemplo | Unidad pluriverbal registrada |
|---|---|---|
| El lema dentro de la unidad pluriverbal se ha marcado con corchetes curvos. En la aplicación web DEMel, estas etiquetas se sustituyen por un doble subrayado. | ![]() |
{ir} su carrera |
| Las abreviaturas se han normalizado, por ejemplo sustituyendo a.c. y u.c. por algo. | ![]() |
{acordar} en algo |
| Los comodines se han marcado con corchetes. Se ha omitido el signo más. | ![]() |
{haber} de [inf.] |
| La escritura de las unidades pluriverbales se ha basado en el español actual. | ![]() |
{hablar} razones con alg. |
| Las omisiones se han señalado con tres puntos, como en las fichas. | ![]() |
de … en {afuera} |
| Solo se ha registrado una unidad pluriverbal si figuraba como tal en la parte superior izquierda de la ficha. No se ha comprobado si había más. | ![]() |
Los principales comodines utilizados en las unidades pluriverbales son:
| Comodín utilizado en la base de datos | Significado | Comodín utilizado en la base de datos | Significado |
|---|---|---|---|
| [adj.] | adjetivo | [mes] | mes |
| [determ.] | artículo | [poses.] | pronombre posesivo |
| [fecha] | fecha | [prep.] | preposición |
| [ger.] | gerundio | [sust.] | sustantivo |
| [inf.] | infinitivo | [x] | cantidad |
| [part.] | participio | [top.] | topónimo |
3.1.6. Ubicación
Las fichas también proporcionan información sobre la ubicación exacta de la documentación dentro de la fuente. La ubicación no se ha registrado de las fichas. Sin embargo, en aproximadamente el 60 % de las documentaciones primarias, la ubicación se ha generado a partir de los textos completos procesados en el proyecto.
Las abreviaturas comunes son:
| apénd. | apéndice | p. | página | r | recto |
| cap. | capítulo | pról. | prólogo | v | verso |
3.1.7. Contexto
La forma documentada ha sido anotada con su contexto durante los trabajos en el DEM. El contexto no se ha registrado de las fichas. Sin embargo, en aproximadamente el 60 % de las documentaciones primarias, el contexto se ha generado a partir de los textos completos procesados en el proyecto.
3.1.8. Significado
Debajo del contexto, suele haber una indicación provisional del significado del lema en este contexto, normalmente en español, ocasionalmente también en alemán. El significado suele introducirse con el signo igual y entre comillas. Los significados provisionales no se han registrado.
3.1.9. Remisión
Ocasionalmente, hay remisiones a otros lemas en las fichas. Estas remisiones no se han registrado. Por regla general, las remisiones se introducen por:
- véase
- v.
- véase también
- v. t.
- siehe
- s.
- siehe auch
- cf.
- vid.
- →
3.1.10. Información adicional
En ocasiones, las fichas contienen más información, como la relativa a la etimología, la categoría gramatical, el uso del lema en ese contexto o el periodo que abarca la documentación en cuestión. Esta información no se ha registrado.
Las siguientes abreviaturas relativas a la categoría gramatical del lema se encuentran en algunas fichas:
| Abreviaturas utilizadas en las fichas | Significado | Abreviaturas utilizadas en las fichas | Significado |
|---|---|---|---|
| adj. | adjetivo | pron.indef. | pronombre indefinido |
| adv. | adverbio | pron.pers. | pronombre personal |
| art. | artículo | pp. | participio |
| art.indef. | artículo indefinido | prn. | pronombre |
| conj. | conjunción | prnl. | pronominal |
| excl. | interjección | r. | reflexivo |
| f. | sustantivo femenino | refl. | reflexivo |
| indef. | pronombre indefinido | s. | sustantivo |
| interj. | interjección | s.f. | sustantivo femenino |
| intr. | intransitivo | s.m. | sustantivo masculino |
| m. | sustantivo masculino | Subst. | sustantivo |
| N.P. | antropónimo | sust. | sustantivo |
| num. | numeral | top. | topónimo |
| Präp. | preposición | tr. | transitivo |
| prep. | preposición | v. | verbo |
| pers.pron. | pronombre personal | v.r. | verbo reflexivo |
| pron. | pronombre |
En las fichas se han utilizado las siguientes abreviaturas relativas a la etimología, al uso del lema en este contexto, etc:
| Abreviaturas utilizadas en las fichas | Significado | Abreviaturas utilizadas en las fichas | Significado |
|---|---|---|---|
| ant. | anticuado | lat. | latín |
| ár. | árabe | lat. med. | latín medieval |
| arag. | aragonés | lat. vulg. | latín vulgar |
| aum. | aumentativo | med. | medicina |
| cast. | castellano | medic. | medicina |
| cat. | catalán | moz. | mozárabe |
| dim. | diminutivo | mozár. | mozárabe |
| fr. | francés | nav. | navarro |
| gall. | gallego | occit. | occitano |
| gent. | gentilicio | Okzit. | occitano |
| gr. | griego | port. | portugués |
| hebr. | hebreo | prov. | provenzal |
| ingl. | inglés | sent. relig. | en sentido religioso |
| judeoesp. | judeoespañol | Sp. | español |
| Kat. | catalán | vasc. | euskera |
Además, se pueden encontrar las siguientes notas en las fichas:
La documentación no forma parte del DEM:
- kein Beleg
- kein Beleg DEM
- kein zitierbarer Beleg
- niA [= nicht im Artikel]
- nicht im DEM
- nicht zitieren
- wird nicht zitiert
- zitieren wir nicht
- no lo citamos
- no se cita
La datación de la documentación no está clara:
- Datierung unsicher
- Datierung der Hs. unsicher
- datación incierta
- sin fecha
La documentación es posterior al español medieval:
- zu spät
3.2. Documentaciones secundarias
Las documentaciones secundarias son documentaciones procedentes de fuentes secundarias científicas, como glosarios, vocabularios, concordancias o artículos especializados. Las fichas contienen fragmentos de estas obras secundarias y, por tanto, representan una documentación indirecta de las formas gráficas del español medieval. La estructuración de las fichas varía mucho en función de la estructura y la finalidad de la obra secundaria analizada. Normalmente, las documentaciones secundarias constan de las siguientes partes:
|
![]() |
Solo se han registrado el lema y la sigla (1-2). La datación (3) se ha generado automáticamente a partir de la sigla. La información de los extractos de las obras secundarias, las unidades pluriverbales, las remisiones y toda la información adicional se tomará de las fichas (4-7), si procede.
3.2.1. Lema
Presentación del lema
| Presentación del lema | Ejemplo | Forma nominal del lema |
|---|---|---|
| El lema suele estar subrayado en la parte superior izquierda de la ficha. | ![]() |
contrallar |
| En algunos casos, hay una variante gráfica en la parte superior izquierda de las fichas en lugar de la forma nominal del lema. | ![]() |
sinagoga |
| En algunas fichas, el lema está marcado dentro del extracto de la obra secundaria. | ![]() |
contrallar |
| La escritura del lema marcado no siempre corresponde a la forma nominal del lema en el DEMel. | ![]() |
lanza |
| En algunas fichas (por ejemplo, fichas de la base de datos DEM) falta el lema. | ![]() |
batallar |
| Si el lema forma parte de una unidad pluriverbal, suele estar doblemente subrayado y en el resto de la unidad pluriverbal el subrayado es simple. | ![]() |
cada |
| En algunas fichas aparecen varios lemas. | ![]() |
Lema 1:
Lema 2:
|
Asignación del lema
A cada documentación se le ha asignado un lema del Lemario. La lematización provisional de la documentación solo se ha comprobado en casos excepcionales. En la asignación del lema han intervenido las siguientes particularidades:
| Particularidades de la asignación del lema | Ejemplo | Lema asignado |
|---|---|---|
| Si en una ficha aparecen varios lemas, se han creado varias documentaciones con un lema cada uno. | ![]() |
Documentación 1:
Documentación 2:
|
| Si la lematización de una documentación no estaba clara, se le ha asignado a la documentación el objeto de lema #dudoso. | ![]() |
#dudoso |
3.2.2. Sigla
Presentación de la sigla
| Presentación de la sigla | Ejemplo | Sigla en la bibliografía |
|---|---|---|
| La sigla suele indicarse en la ficha de forma manuscrita o mediante la impresión de un sello en la esquina superior derecha. | ![]() |
EnperadorOtas(Baird) Glos. |
| En las fichas, la sigla aparece a menudo junto con una signatura interna que empieza por Bs-, S- o Us-. | ![]() |
JManuel Glos. |
| En el caso de las fichas de la base de datos DEM, la sigla aparece junto con la fecha al principio. | ![]() |
Heredia Actor Conc. |
| En las fichas, algunas siglas carecen de las abreviaturas comunes de las siglas de las fuentes secundarias, como Glos., Voc,. Conc., etc. | ![]() |
GConqUltramar(S) Glos. |
| En algunas fichas, las siglas carecen de una referencia a la edición específica. | ![]() |
MaríaEgipciaca(Andrés Cast.) Voc. |
| La variante de la sigla en la ficha no siempre corresponde a la forma de escritura de la sigla en la bibliografía. | ![]() |
JManuel Voc. |
| Para algunas fichas, se utilizó inicialmente una variante de la sigla y posteriormente se añadió la forma estandarizada de la sigla. | ![]() |
JManuel Voc. |
| En algunas colecciones de documentos, el documento específico al que se refiere la documentación secundaria se menciona además de la sigla. | ![]() |
TLingMedioevo Glos. |
| En el caso de las fichas de una concordancia sobre un autor concreto, se utilizan abreviaturas para referirse a las distintas obras. | ![]() |
JManuel Conc. |
| En algunas fichas falta la sigla. | ![]() |
Enfermedades AvesCaza Ind. |
| En las fichas que muestran extractos de estudios léxicos, la sigla, que a menudo no es estándar, suele figurar en la parte inferior. | ![]() |
Macrì, Dizionario Corominas |
| En las fichas que muestran extractos de estudios léxicos, a menudo hay una signatura interna de la revista correspondiente en la esquina superior derecha en lugar de la sigla. | ![]() |
Dworkin, Phonotactic Constraints |
Asignación de la sigla
A cada documentación se le ha asignado una sigla de la bibliografía. Solo en casos excepcionales se ha comprobado si las siglas que figuraban en las fichas eran correctas. A la hora de asignar la sigla se han tenido en cuenta las siguientes particularidades:
| Particularidades al asignar la sigla | Ejemplo | Sigla asignada |
|---|---|---|
| Si se anotaron diferentes siglas en una ficha, se ha creado una documentación por sigla. | ![]() |
Documentación 1:
Documentación 2:
|
| Aunque la variante de sigla utilizada en la ficha correspondiera a una fuente primaria, la sigla se ha asignado a la fuente secundaria correspondiente. | ![]() |
GConqUltramar(S) Glos. |
| Si se indicaba una variante de la sigla en una ficha, se ha asignado a la documentación la grafía estandarizada de la sigla. | ![]() |
JManuel Voc. |
| No se ha incluido información complementaria a la sigla. | ![]() |
TLingMedioevo Glos. |
| Si faltaba la sigla en una ficha, se ha determinado la sigla si era posible. En caso contrario, se le ha asignado la sigla #sinSigla. | ![]() |
Enfermedades AvesCaza Ind. |
3.2.3. Datación
La datación de las documentaciones secundarias se genera automáticamente a partir de las fuentes. Esto significa que para algunas documentaciones secundarias solo se da un lapso de tiempo muy aproximado para la datación (por ejemplo, para "DocsAltoAragón Voc." 1258-1495) o no se da ninguna datación (por ejemplo, para muchos estudios léxicos). Una datación más precisa puede constar en las fichas correspondientes, pero no se ha registrado.
| Datación en fichas con documentaciones secundarias | Ejemplo | Dataciones en la bibliografía |
|---|---|---|
| La fecha suele estar indicada en la parte superior derecha de la sigla. | ![]() |
c 1295 |
| En algunas siglas, la fecha se añadía detrás mediante la impresión de un sello. | ![]() |
c 1215-20 |
| En el caso de las fichas de la base de datos DEM, la datación está al principio. | ![]() |
2a mit.s XIV |
| En el caso de las obras secundarias que contienen textos fuente de un periodo más largo, se suele disponer de una datación más precisa en las fichas. | ![]() |
1258-1495 |
| En algunas fichas, se anotó la fecha respectiva de cada documentación primaria dentro de la documentación secundaria. | ![]() |
1282-1348 |
| En algunas fichas, la datación de la sigla no coincide exactamente con la datación en la bibliografía. | ![]() |
s XI-XV |
| Algunas fuentes, por ejemplo los estudios léxicos o los diccionarios como el DHLE, no están fechadas en la bibliografía. En algunos casos está anotada una fecha en las fichas correspondientes. | ![]() |
sin datación |
3.2.4. Extracto de obras secundarias
Tipos de fichas con documentaciones secundarias
La información que figura en las fichas difiere en función de la estructura y el objetivo de la obra secundaria evaluada. Esta información no se ha registrado. Básicamente, se puede distinguir entre los siguientes tipos:
| Tipo | Ejemplo | Abreviatura de la sigla |
|---|---|---|
|
Nota a pie de página:
|
![]() |
Notas |
|
Glosario:
|
![]() |
Glos. |
|
Glosario:
|
![]() |
Glos. |
|
Índice:
|
Ind. | |
|
Concordancia:
|
![]() |
Conc. |
|
Concordancia:
|
![]() |
Conc. |
|
Concordancia:
|
![]() |
Conc. |
|
Concordancia:
|
![]() |
Conc. |
|
Concordancia:
|
![]() |
Conc. |
|
Estudio léxico:
|
![]() |
|
|
Texto primario de una obra secundaria:
|
![]() |
|
|
Vocabulario:
|
![]() |
Voc. |
|
Vocabulario:
|
![]() |
Voc. |
|
Diccionario:
|
![]() |
Lex. |
Notas sobre los tipos:
- La distinción entre glosario, índice y vocabulario se realiza según la designación en la obra secundaria respectiva.
- Las documentaciones manuscritas de los vocabularios y glosarios se copiaron a menudo dos veces.
- El extracto de la obra secundaria falta en algunas fichas.
Distinción entre documentaciones secundarias y remisiones
| ¿Documentación secundaria o remisión? | Ejemplo | Registro |
|---|---|---|
| En algunas fichas, el extracto de la obra secundaria constituye una remisión. | Se ha creado una documentación secundaria si la remisión formaba parte de la obra secundaria. | |
|
En algunas fichas, una variante gráfica hace referencia a la forma nominal del lema al que pertenecía la documentación. Tal remisión no habría tenido sentido.
|
![]() |
En lugar de una remisión, se ha creado una documentación secundaria si la sigla hace referencia a una fuente secundaria. |
3.2.5. Unidad pluriverbal
En algunas fichas, el lema aparece en la esquina superior izquierda dentro de una unidad pluriverbal. En estos casos, el lema suele estar subrayado dos veces y el resto de la unidad pluriverbal es simple. Las unidades pluriverbales no se han registrado en las documentaciones secundarias.
3.2.6. Remisión
Ocasionalmente, hay remisiones a otros lemas en las fichas. Estas remisiones no se han registrado. Por regla general, las remisiones se introducen por:
- véase
- v.
- véase también
- v. t.
- siehe
- s.
- siehe auch
- cf.
- vid.
- →
3.2.7. Información adicional
En ocasiones, las fichas contienen más información, como la relativa a la etimología, la categoría gramatical, el uso del lema en ese contexto o el periodo que abarca la documentación en cuestión. Esta información no se ha registrado.
Las siguientes abreviaturas relativas a la categoría gramatical del lema se encuentran en algunas fichas:
| Abreviaturas utilizadas en las fichas | Significado | Abreviaturas utilizadas en las fichas | Significado |
|---|---|---|---|
| adj. | adjetivo | pron.indef. | pronombre indefinido |
| adv. | adverbio | pron.pers. | pronombre personal |
| art. | artículo | pp. | participio |
| art.indef. | artículo indefinido | prn. | pronombre |
| conj. | conjunción | prnl. | pronominal |
| excl. | interjección | r. | reflexivo |
| f. | sustantivo femenino | refl. | reflexivo |
| indef. | pronombre indefinido | s. | sustantivo |
| interj. | interjección | s.f. | sustantivo femenino |
| intr. | intransitivo | s.m. | sustantivo masculino |
| m. | sustantivo masculino | Subst. | sustantivo |
| N.P. | antropónimo | sust. | sustantivo |
| num. | numeral | top. | topónimo |
| Präp. | preposición | tr. | transitivo |
| prep. | preposición | v. | verbo |
| pers.pron. | pronombre personal | v.r. | verbo reflexivo |
| pron. | pronombre |
En las fichas se han utilizado las siguientes abreviaturas relativas a la etimología, al uso del lema en este contexto, etc:
| Abreviaturas utilizadas en las fichas | Significado | Abreviaturas utilizadas en las fichas | Significado |
|---|---|---|---|
| ant. | anticuado | lat. | latín |
| ár. | árabe | lat. med. | latín medieval |
| arag. | aragonés | lat. vulg. | latín vulgar |
| aum. | aumentativo | med. | medicina |
| cast. | castellano | medic. | medicina |
| cat. | catalán | moz. | mozárabe |
| dim. | diminutivo | mozár. | mozárabe |
| fr. | francés | nav. | navarro |
| gall. | gallego | occit. | occitano |
| gent. | gentilicio | Okzit. | occitano |
| gr. | griego | port. | portugués |
| hebr. | hebreo | prov. | provenzal |
| ingl. | inglés | sent. relig. | en sentido religioso |
| judeoesp. | judeoespañol | Sp. | español |
| Kat. | catalán | vasc. | euskera |
Además, se pueden encontrar las siguientes notas en las fichas:
La documentación no forma parte del DEM:
- kein Beleg
- kein Beleg DEM
- kein zitierbarer Beleg
- niA [= nicht im Artikel]
- nicht im DEM
- nicht zitieren
- wird nicht zitiert
- zitieren wir nicht
- no lo citamos
- no se cita
La datación de la documentación no está clara:
- Datierung unsicher
- Datierung der Hs. unsicher
- datación incierta
- sin fecha
La documentación es posterior al español medieval:
- zu spät
3.3. Remisión
Las documentaciones de tipo "remisión" remiten a otro lema. En la mayoría de los casos, se utilizan para referirse de un lema de una unidad pluriverbal a otro de los lemas de la unidad pluriverbal, ya que la documentación primaria o secundaria correspondiente suele encontrarse allí en el conjunto de documentaciones.
![]() |
![]() |
Las remisiones pueden constar de las siguientes partes:
![]() |
La información más importante de las remisiones se ha registrado: el lema (1), la remisión (2), la sigla (3) y las unidades pluriverbales (5). Si la documentación proviene de una fuente primaria, también se ha registrado la datación (4). En el caso de las fuentes secundarias, se genera automáticamente a partir de la sigla. Si es necesario, la ubicación y la información adicional se pueden tomar de la ficha (6-7).
3.3.1. Lema
Presentación del lema
| Presentación del lema | Ejemplo | Forma nominal del lema |
|---|---|---|
| El lema suele estar en la esquina superior izquierda de la ficha y está subrayado. | ![]() |
alcoz |
| En algunos casos, hay una variante gráfica en la parte superior izquierda de las fichas en lugar de la forma nominal del lema. | ![]() |
traslado |
| Si el lema forma parte de una unidad pluriverbal, suele estar doblemente subrayado y en el resto de la unidad pluriverbal, el subrayado es simple. | ![]() |
mujer |
Asignación del lema
A cada documentación se le ha asignado un lema del Lemario. La lematización provisional de la documentación solo se ha comprobado en casos excepcionales. Si en una ficha aparecían varios lemas, se han creado varias documentaciones con un lema cada una.
3.3.2. Remisión
Presentación de las remisiones
| Abreviatura que introduce una remisión | Ejemplo | Palabra de remisión |
|---|---|---|
| → | ![]() |
ahora |
| cf. | ![]() |
descender |
| siehe (véase) | ![]() |
alcaduz |
| siehe auch (véase también) | ![]() |
damuntdicho |
| s. v. | ![]() |
olla |
| v. | ![]() |
anchura |
| véase | ![]() |
almatica |
| véase también | ![]() |
ableza |
| vid. | ![]() |
a |
| v. t. | ![]() |
añadir |
Registro de la remisión
Conforme a la remisión en la ficha, se ha elegido un lema del Lemario como palabra de remisión para cada documentación. Solo en algunos casos se ha hecho una comprobación, si, en el caso de las unidades pluriverbales, la documentación en cuestión puede encontrarse realmente en el conjunto de documentaciones de la palabra de remisión. En el registro de datos se han tenido en cuenta las siguientes particularidades:
| Particularidades al registrar la palabra de remisión | Ejemplo | Remisión registrada |
|---|---|---|
| Si la remisión forma parte de una unidad pluriverbal, solo se ha registrado el lema subrayado como palabra de remisión. | ![]() |
acometer(se) |
| Si la remisión forma parte de una unidad pluriverbal en la que toda la unidad pluriverbal está subrayada, solo se ha registrado como palabra de remisión el lema doblemente subrayado. | ![]() |
poner(se) |
| Si en una ficha aparecen varias palabras de remisión, se ha creado una documentación para cada palabra de remisión. | ![]() |
1.Beleg:
2.Beleg:
|
| Si el lema de una unidad pluriverbal también está subrayado como palabra de remisión, se ha registrado otro lema de la unidad pluriverbal como palabra de remisión. | ![]() |
espíritu |
| En algunas fichas, una variante gráfica remite a la forma nominal del lema al que pertenece la documentación. Tal remisión no habría tenido sentido. | ![]() |
En lugar de una remisión, se ha creado una documentación primaria o secundaria. |
| Si la remisión forma parte de un extracto de una fuente secundaria, se ha creado una documentación secundaria en lugar de una remisión. Solo se ha creado una documentación de tipo "remisión" en el caso de remisiones manuscritas. | ![]() |
Se ha creado una documentación secundaria en lugar de una remisión. |
3.3.3. Sigla
Presentación de la sigla
| Presentación de la sigla | Ejemplo | Sigla en la bibliografía |
|---|---|---|
| La sigla se indica en la ficha de forma manuscrita o mediante la impresión de un sello, normalmente en la esquina superior derecha. | ![]() |
DocsLingCast |
| La forma de escribir la sigla en la ficha no siempre corresponde a la escritura de la sigla en la bibliografía. | ![]() |
ColForm |
| En el caso de algunas fichas, se utilizó inicialmente una variante de sigla y posteriormente se añadió la escritura estandarizada. | ![]() |
ColForm |
| En algunas colecciones de documentos, además de la escritura estandarizada de la sigla, se menciona el documento del que procede el extracto del texto. | ![]() |
FsMun |
| La sigla "FCuenca - Iznat" se utilizaba para las fichas del Fuero de Cuenca o del Fuero de Iznatoraf. Según el subrayado, se trata de la sigla FCuenca o FHeznatoraf. | ![]() |
FHeznatoraf |
| En algunas fichas no hay sigla. | ![]() |
Asignación de la sigla
A cada documentación se le ha asignado una sigla de la Bibliografía. Solo en casos excepcionales se ha comprobado si las siglas que figuraban en las fichas eran correctas. A la hora de asignar la sigla se han tenido en cuenta las siguientes particularidades:
| Directrices para la asignación de la sigla | Ejemplo | Sigla asignada |
|---|---|---|
| Si se han indicado diferentes siglas en una ficha, se ha creado una documentación por sigla. | ![]() |
Documentación 1:
Documentación 2:
|
| Si se ha indicado una variante de la sigla en una ficha, se ha asignado a la documentación la grafía estandarizada de la sigla. | ![]() |
ColForm |
| No se ha incluido información complementaria sobre la sigla. | ![]() |
FsMun |
| A las fichas en los que no había ninguna sigla se les ha asignado la sigla #sinSigla. | ![]() |
#sinSigla |
Mientras que solo las fuentes primarias son elegibles como siglas para las documentaciones primarias y solo las fuentes secundarias para las documentaciones secundarias, las remisiones pueden provenir de ambos tipos de fuente. Esto ha causado dificultades especialmente con las fuentes secundarias que han sido abreviadas en las fichas con una variante de sigla sin una abreviatura característica, como Glos., Voc. etc.. En estos casos, a menudo era imposible determinar sin comprobación si la remisión se refería a la fuente primaria o secundaria correspondiente.
![]() |
![]() |
3.3.4. Datación
Presentación de la datación
| Presentación de la datación | Ejemplo | Datación correcta |
|---|---|---|
| La fecha suele estar indicada en la esquina superior derecha, justo encima de la sigla. | ![]() |
c 1400 |
| En algunas siglas, la fecha se ha añadido detrás mediante la impresión de un sello. | ![]() |
1280 |
| En el caso de las colecciones de documentos que contienen fuentes de un periodo de tiempo más amplio, las documentaciones suelen tener una datación precisa. | ![]() |
Documentación:
Sigla:
|
| Algunas fuentes fueron corregidas durante los trabajos del DEM. Algunas fichas siguen teniendo la antigua datación. | ![]() |
1200-1250 |
Registro de la datación
Al registrar la datación de las documentaciones en la segunda fase del proyecto, se distinguió entre tres casos diferentes:
- La documentación procede de una fuente primaria en la que todas las documentaciones tienen la misma datación. Para estas documentaciones no hizo falta registrar la datación a mano, ya que se podía generar automáticamente a partir de la fuente primaria.
- La documentación procede de una colección de documentos que contiene fuentes de un periodo más amplio (por ejemplo, "TLingNavarros" siglos XI-XV). En el caso de estas documentaciones, la datación concreta del respectivo documento o fuente individual suele anotarse en las fichas correspondientes.
- La documentación procede de una fuente secundaria. Para estas documentaciones no se ha registrado la datación, por lo que todavía se genera automáticamente a partir de la fuente.
Para el registro de las dataciones se comprobó en primer lugar qué fuentes primarias pertenecían a la segunda categoría. Se identificaron 272 fuentes. A continuación, se registró la datación de las documentaciones correspondientes. Para que las dataciones fuesen consultables, las denominaciones como circa, ante, post, etc. han tenido que convertirse en intervalos numéricos:
| Designación | Desde | Hasta |
|---|---|---|
| siglo | comienzo del siglo (xx00) | fin de siglo (xx99) |
| s XIV | 1300 | 1399 |
| principios de siglo | comienzo del siglo (xx00) | 10 años después del inicio (xx10) |
| princ. s XIV | 1300 | 1310 |
| mediados de siglo | 10 años antes de la mitad del siglo (xx40) | 10 años después de mitad del siglo (xx60) |
| med. s XIV | 1340 | 1360 |
| primera mitad del siglo | comienzo del siglo (xx00) | mitad de siglo (xx50) |
| 1ª mit. s XIV | 1300 | 1350 |
| segunda mitad del siglo | mitad de siglo (xx50) | fin de siglo (xx99) |
| 2ª mit. s XIV | 1350 | 1399 |
| finales de siglo | 10 años antes del fin de siglo (xx89) | fin de siglo (xx99) |
| fines s XIV | 1389 | 1399 |
| aproximadamente | 15 años antes de xxxx | 15 años después de xxxx |
| c 1300 | 1285 | 1315 |
| anterior a | 15 años antes de xxxx | xxx |
| a 1300 | 1285 | 1300 |
| posterior a | xxx | 15 años después de xxxx |
| p 1300 | 1285 | 1315 |
| posterior a- anterior a | xxx | xxx |
| p 1275 – a 1300 | 1275 | 1300 |
3.3.5. Unidad pluriverbal
Presentación de la unidad pluriverbal
| Presentación de la unidad pluriverbal | Ejemplo | Unidad pluriverbal |
|---|---|---|
| Si el lema forma parte de una unidad pluriverbal, suele estar doblemente subrayado, mientras que en el resto de la unidad pluriverbal el subrayado es simple. | ![]() |
yugo de bueyes |
| A veces, solo se ha subrayado el lema y no el resto de la unidad pluriverbal. | ![]() |
carta partida por abc |
| En las unidades pluriverbales puede haber abreviaturas. | ![]() |
alzar u.c. en los hombros |
| Los comodines suelen introducirse con "+". | ![]() |
haber consigo de + inf. |
| Los paréntesis también pueden marcar comodines. | ![]() |
cerca de (un lugar) |
| En las fichas, la escritura de la unidad pluriverbal no siempre se basa en el español actual. | ![]() |
aver acuerdo con |
| Suelen usarse tres puntos para las omisiones en las unidades pluriverbales. | ![]() |
de … años a acá |
Registro de las unidades pluriverbales
En la segunda fase del proyecto, se registraron las unidades pluriverbales de las fichas. Durante el proceso de registro se tuvieron en cuenta las siguientes particularidades:
| Particularidades en el registro de las unidades pluriverbales | Ejemplo | Unidad pluriverbal registrada |
|---|---|---|
| El lema dentro de la unidad pluriverbal se ha marcado con corchetes curvos. En la aplicación web DEMel, estas etiquetas se sustituyen por un doble subrayado. | ![]() |
yugo de {bueyes} |
| La escritura de las unidades pluriverbales se ha basado en el español actual. | ![]() |
{haber} acuerdo con |
| Las abreviaturas se han normalizado, por ejemplo sustituyendo a.c. y u.c. por algo. | ![]() |
alzar algo en los {hombros} |
| Los comodines se han marcado con corchetes. Se ha omitido el signo más. | ![]() |
haber {consigo} de [inf.] |
| Las omisiones se han señalado con tres puntos, como en las fichas. | ![]() |
{de} … años a acá |
Los principales comodines utilizados en las unidades pluriverbales son:
| Comodín utilizado en la base de datos | Significado | Comodín utilizado en la base de datos | Significado |
|---|---|---|---|
| [adj.] | adjetivo | [mes] | mes |
| [determ.] | artículo | [poses.] | pronombre posesivo |
| [fecha] | fecha | [prep.] | preposición |
| [ger.] | gerundio | [sust.] | sustantivo |
| [inf.] | infinitivo | [x] | cantidad |
| [part.] | participio | [top.] | topónimo |
3.3.6. Ubicación
Las fichas también proporcionan información sobre la ubicación exacta de la documentación dentro de la fuente. La ubicación no se ha registrado.
Las abreviaturas comunes en las ubicaciones son:
| apénd. | apéndice | p. | página | r | recto |
| cap. | capítulo | pról. | prólogo | v | verso |
3.3.7. Información adicional
En ocasiones, las fichas contienen más información, como la relativa a la etimología, la categoría gramatical, el uso del lema en ese contexto o el periodo que abarca la documentación en cuestión. Esta información no se ha registrado.
Las siguientes abreviaturas relativas a la categoría gramatical del lema se encuentran en algunas fichas:
| Abreviaturas utilizadas en las fichas | Significado | Abreviaturas utilizadas en las fichas | Significado |
|---|---|---|---|
| adj. | adjetivo | pron.indef. | pronombre indefinido |
| adv. | adverbio | pron.pers. | pronombre personal |
| art. | artículo | pp. | participio |
| art.indef. | artículo indefinido | prn. | pronombre |
| conj. | conjunción | prnl. | pronominal |
| excl. | interjección | r. | reflexivo |
| f. | sustantivo femenino | refl. | reflexivo |
| indef. | pronombre indefinido | s. | sustantivo |
| interj. | interjección | s.f. | sustantivo femenino |
| intr. | intransitivo | s.m. | sustantivo masculino |
| m. | sustantivo masculino | Subst. | sustantivo |
| N.P. | antropónimo | sust. | sustantivo |
| num. | numeral | top. | topónimo |
| Präp. | preposición | tr. | transitivo |
| prep. | preposición | v. | verbo |
| pers.pron. | pronombre personal | v.r. | verbo reflexivo |
| pron. | pronombre |
En las fichas se han utilizado las siguientes abreviaturas relativas a la etimología, al uso del lema en este contexto, etc:
| Abreviaturas utilizadas en las fichas | Significado | Abreviaturas utilizadas en las fichas | Significado |
|---|---|---|---|
| ant. | anticuado | lat. | latín |
| ár. | árabe | lat. med. | latín medieval |
| arag. | aragonés | lat. vulg. | latín vulgar |
| aum. | aumentativo | med. | medicina |
| cast. | castellano | medic. | medicina |
| cat. | catalán | moz. | mozárabe |
| dim. | diminutivo | mozár. | mozárabe |
| fr. | francés | nav. | navarro |
| gall. | gallego | occit. | occitano |
| gent. | gentilicio | Okzit. | occitano |
| gr. | griego | port. | portugués |
| hebr. | hebreo | prov. | provenzal |
| ingl. | inglés | sent. relig. | en sentido religioso |
| judeoesp. | judeoespañol | Sp. | español |
| Kat. | catalán | vasc. | euskera |
Además, se pueden encontrar las siguientes notas en las fichas:
La documentación no forma parte del DEM:
- kein Beleg
- kein Beleg DEM
- kein zitierbarer Beleg
- niA [= nicht im Artikel]
- nicht im DEM
- nicht zitieren
- wird nicht zitiert
- zitieren wir nicht
- no lo citamos
- no se cita
La datación de la documentación no está clara:
- Datierung unsicher
- Datierung der Hs. unsicher
- datación incierta
- sin fecha
La documentación es posterior al español medieval:
- zu spät
3.4. Particularidades de las documentaciones
3.4.1. Documentaciones de varias imágenes
Algunas documentaciones constan de varias imágenes. Esto se aplica especialmente a las fichas que tienen información escrita en el dorso. Estos han sido marcados con una "R" de "Rückseite" (dorso) en la esquina superior derecha. También se ven afectadas las documentaciones secundarias cuyo extracto de la obra secundaria comprende dos o más imágenes. Si una documentación se compone de varias imágenes, se le han asignado todas las imágenes durante el registro de datos.
![]() |
![]() |
3.4.2. Combinación de diferentes tipos de documentaciones
Dentro de los extractos de vocabularios, glosarios, índices y diccionarios que aparecen en las fichas como fuentes secundarias, se suele hacer referencia a uno o varios pasajes del texto de fuentes primarias. A veces, durante el trabajo en el proyecto DEM, en las fichas se añadía la documentación primaria con la forma documentada correspondiente directamente debajo del extracto de la obra secundaria. Normalmente, esto solo se aplica a las documentaciones en las que la fuente secundaria y la fuente primaria proceden de la misma obra o edición. En estos casos, se ha creado una documentación secundaria y, por forma documentada, una documentación primaria durante el registro de datos, a menos que la misma documentación primaria ya se hubiera registrado en otro lugar.
3.4.3. Formas mixtas de tipos de documentaciones
Para algunas fichas, no se puede determinar claramente el tipo de documentación. Esto se aplica sobre todo a la distinción entre documentaciones primarias y secundarias, si se ha utilizado una concordancia durante la creación del DEM. En muchos casos, la ubicación se copió de una concordancia, por lo que habría que hablar de una documentación secundaria. Sin embargo, si el pasaje de texto correspondiente se añadió a algunas o todas las ubicaciones, se cumplen los requisitos de una documentación primaria o, en el caso de diferentes formas documentadas, de varias documentaciones primarias. A diferencia de las combinaciones de documentaciones primarias y secundarias, que se dan sobre todo en el caso de extractos de vocabularios, glosarios, índices y diccionarios, la documentación secundaria en este caso solo aporta información sobre la ubicación que también podrían formar parte de la(s) documentación(es) primaria(s). Por lo tanto, en estos casos, solo se ha creado una documentación primaria durante el registro de datos cuando los pasajes de texto comprendían más de dos palabras, es decir, si la forma documentada se presentaba en su contexto.
3.4.4. Documentaciones múltiples
Durante el trabajo en el proyecto DEM, algunas documentaciones se copiaron varias veces, de modo que aparecen dos veces o incluso más en Fichero DEM nuclear. Por regla general, las documentaciones correspondientes se suceden ordenadamente en la clasificación del Fichero. Si durante el registro de datos se observaba que una documentación se había copiado varias veces, solo se ha registrado una vez.
Se trata sobre todo de las documentaciones de las siguientes fuentes secundarias:
- AT Voc.
- Cid Voc.
- FAlarcón Glos.
- FBaeza Voc.
- FEstella Voc.
- FJuzgo(Fernández Llera) Voc.
- FMadrid Glos.
- FTeruel Voc.
- Heredia GCrón Voc.
- HistTroyana(Pidal) Glos.
- HistoriaTroyana Lex.
- JManuel Voc.
- MaríaEgipciaca(Andrés Cast.) Voc.
- NT Mateo Voc.
- NT Voc.
- Berceo Poesías(Janer) Voc.
![]() |
![]() |
En el caso de las fuentes primarias, el fenómeno se produce principalmente entre los lemas ya publicados. Sin embargo, normalmente las siguientes fuentes primarias se han copiado dos veces para todo el Fichero DEM nuclear:
- DocSJuanBurgos
- DocsLeoneses(Staaff)
![]() |
![]() |
4. Bibliografía
La bibliografía del DEMel se basa en la bibliografía del DEM publicada en los volúmenes primero, segundo y tercero. Sin embargo, como bibliografía provisional, no alista todas las fuentes que se utilizaron en el Fichero DEM nuclear. Por lo tanto, se ha creado una nueva entrada en la bibliografía del DEMel por cada fuente adicional que aparecía en las fichas.
4.1. Tipos de fuentes
Todas las fuentes han sido clasificadas en cuatro tipos de fuente:
- Fuente primaria
- Fuente secundaria
- Revista
- Otros
Existen las siguientes particularidades:
- Algunas ediciones se han incluido en la bibliografía bajo dos entradas bibliográficas -una como fuente primaria y otra como fuente secundaria- porque contienen un vocabulario, un glosario o un índice además del texto primario.
- Las obras que son principalmente un tratado científico y solo citan ocasionalmente textos primarios se han incluido en la bibliografía como fuentes secundarias.
- La categoría "Otros" incluye las siguientes siglas: #desconocida, asignada cuando la sigla en una ficha no estaba clara, y #sinSigla, asignada cuando no aparecía en una ficha y no se podía determinar la sigla correcta.
- Las siglas empleadas en el DEM para revistas no se han utilizado en el registro de datos, ya que se han empleado exclusivamente para descodificar las abreviaturas de las revistas utilizadas en las entradas de la bibliografía.
4.2. Siglas
4.2.1. Formación de siglas
Se han utilizado las siglas de la bibliografía del DEM. Dado que las demás fuentes a menudo no contaban con una escritura estandarizada de la sigla, se ha formado una para cada una de ellas siguiendo el ejemplo de las siglas ya existentes. La notación de las fichas se ha incluido en la base de datos como una variante de sigla para facilitar la asignación correcta durante el registro. En la formación de las siglas se han tenido en cuenta las siguientes reglas:
| Reglas para la formación de siglas | Ejemplo: sigla | Ejemplo: edición |
|---|---|---|
| Las siglas de las obras literarias nombran primero al autor y luego el título de la obra. Tanto el autor como el título de la obra pueden ser abreviados. | Berceo Loores | Gonzalo de Berceo. Los Loores de Nuestra Señora, in: Gonzalo de Berceo, Obras completas III, El Duelo de la Virgen, Los Himnos, Los Loores de Nuestra Señora, Los Signos del Juicio Final. Estudio y edición crítica por Brian Dutton, London 1975 (Colección Támesis, Serie A - Monografías, XVIII). |
| Las siglas de textos legales suelen nombrar primero el tipo de texto en forma abreviada y luego el lugar o región correspondiente. | FCuenca | Fuero de Cuenca (Formas primitiva y sistemática: Texto latino, texto castellano y adaptación del Fuero de Iznatoraf). Edición crítica, con introducción, notas y apéndice por Don Rafael de Ureña y Smenjaud, Madrid 1935. |
| Por lo general, las diferentes ediciones se han agrupado bajo una misma fuente. Si se ha creado una entrada bibliográfica separada para una edición, la referencia a la edición (normalmente el apellido del editor) se ha colocado entre paréntesis después de la sigla en el caso de las fuentes primarias. | FernánGonzález(Geary) | Historia del Conde Fernán González. A facsimile and paleographic edition with commentary and concordance by John S. Geary, Madison 1987 (The Hispanic Seminary of Medieval Studies, Ltd., Spanish Series, 35). |
| Las siglas de las fuentes secundarias, aparte de los estudios léxicos y los diccionarios, suelen llevar al final una abreviatura que indica el tipo de texto, como "Glos. " para "Glosario" o "Voc. " para "Vocabulario". La distinción entre glosario, índice y vocabulario se ha realizado según la designación en la obra secundaria respectiva. | FBaeza Voc. | El Fuero de Baeza. Edición, estudio y vocabulario (avec résumé en français), Proefschrift [...] door Jean Marie Victor Roudil, Gravenhage 1962, Vocabulario: 249-415. |
| Las siglas de los estudios léxicos se han formado de la siguiente manera, de acuerdo con las normas del DEM: "Autor, primer término significativo del título". | Meier, Heilige Kühe | Harri Meier, Drei heilige Kühe, in: RF 98, 1986, 245-257. |
| Cuando se han citado documentaciones de otros diccionarios, como el DHLE, se ha tomado la sigla correspondiente y se ha mencionado la fuente entre paréntesis después de la sigla. | OrdenanzasMurcia(DHLE) | Ordenanzas de la mvy noble y mvy leal civdad de Mvrcia, Murcia 1695. |
De acuerdo con las convenciones del DEM, aparecen en las siglas las siguientes abreviaturas:
| Significado | Significado | ||
|---|---|---|---|
| Alf | Alfonso | F(s) | Fuero(s) |
| Apend. | Apéndice | FS | Festschrift (homenaje) |
| AT | Antiguo Testamento | Glos | Glosario |
| Canc | Cancionero | Hist | Historia |
| Cat | Catedral | Ind | Índice, Index |
| Cart | Cartulario | J | Juan |
| ColDipl | Colección Diplomática | L(s) | Libro(s) |
| Conc | Concordancia, Concordance | Lex | Léxico |
| Conc | Concilio | M | Maestre |
| Conq | Conquista | Mun | Municipal |
| Crón | Crónica | NT | Nuevo Testamento |
| Dicc | Diccionario | Ordenam | Ordenamiento |
| Dict | Dictionnaire, Dictionary | Priv | Privilegio |
| Doc | Documentación | Reg | Registro |
| Docs | Documentos | S | San |
| Ep | Epístola | TLing | Textos lingüísticos |
| Ev | Evangelio | Voc | Vocabulario |
4.2.2. Variantes de sigla
Dado que la escritura de las siglas en las fichas no siempre se corresponde con la escritura de la sigla en la bibliografía, se han incluido en la base de datos algunas variantes de la sigla, además de la escritura estandarizada. Esto debería facilitar la asignación de la sigla correcta durante el registro de documentaciones. Las variantes de sigla que se han incluido en la base de datos no suelen corresponder a las convenciones del DEM, ya que en parte las siglas aún no habían sido estandarizadas cuando se crearon las fichas.
![]() |
![]() |
En el caso de las fuentes secundarias, las variantes de sigla utilizadas en las fichas suelen carecer de la abreviatura que indica su tipo de fuente. Por ejemplo, en lugar de "JManuel Voc.", se utilizaba a menudo la sigla "Felix Juan". Para dejar claro a qué tipo de fuente pertenecen las variantes de sigla, se ha añadido entre paréntesis la abreviatura correspondiente. Por ello, la variante de sigla "Félix Juan" se ha incluido en la bibliografía como "Félix Juan (Voc.)".
![]() |
![]() |
4.3. Datación
Se ha asignado una datación a cada fuente. En los casos en los que estaban disponibles, las fechas se han tomado sin verificar de la bibliografía del DEM. Por el contrario, cuando las fuentes no aparecían o no estaban fechadas en la bibliografía, se ha intentado determinar la datación. En el caso de las colecciones de documentos sin datación explícita en la bibliografía, se ha buscado el documento más antiguo y el más reciente y de ahí se ha derivado el periodo de tiempo de la datación. Suele ser un lapso de tiempo muy aproximado (por ejemplo, para "TLingNavarros" siglos XI-XV). En el caso de las ediciones de textos individuales, se ha utilizado la información sobre la datación que figuraba en las introducciones de los editores, cuando estaba disponible. En el caso de las revistas, los estudios léxicos, los diccionarios, etc., la datación no se basa en el año de publicación, sino que se refiere al periodo estudiado o a la datación de la obra estudiada. Si no se ha podido determinar la datación, a estas fuentes se les ha asignado "sin datación".
Para que la datación de las fuentes fuese consultable, las denominaciones como circa, ante, post, etc. han tenido que convertirse en intervalos numéricos:
| Designación | Desde | Hasta |
|---|---|---|
| siglo | comienzo del siglo (xx00) | fin de siglo (xx99) |
| s XIV | 1300 | 1399 |
| principios de siglo | comienzo del siglo (xx00) | 10 años después del inicio (xx10) |
| princ. s XIV | 1300 | 1310 |
| mediados de siglo | 10 años antes de la mitad del siglo (xx40) | 10 años después de mitad del siglo (xx60) |
| med. s XIV | 1340 | 1360 |
| primera mitad del siglo | comienzo del siglo (xx00) | mitad de siglo (xx50) |
| 1ª mit. s XIV | 1300 | 1350 |
| segunda mitad del siglo | mitad de siglo (xx50) | fin de siglo (xx99) |
| 2ª mit. s XIV | 1350 | 1399 |
| finales de siglo | 10 años antes del fin de siglo (xx89) | fin de siglo (xx99) |
| fines s XIV | 1389 | 1399 |
| aproximadamente | 15 años antes de xxxx | 15 años después de xxxx |
| c 1300 | 1285 | 1315 |
| anterior a | 15 años antes de xxxx | xxx |
| a 1300 | 1285 | 1300 |
| posterior a | xxx | 15 años después de xxxx |
| p 1300 | 1285 | 1315 |
| posterior a- anterior a | xxx | xxx |
| p 1275 – a 1300 | 1275 | 1300 |
4.4. Ediciones
Según el DEM, se ha asignado a cada fuente una o más ediciones. Se han tenido en cuenta las siguientes particularidades:
- Si las fuentes formaban parte de la bibliografía provisional del DEM, la información bibliográfica correspondiente a las ediciones se ha incluido a la bibliografía del DEMel sin verificar.
- Para las nuevas fuentes, se ha anotado la edición respectiva.
- Si aparecía otra edición en la ficha, ha sido añadida a la fuente correspondiente.
- Dado que las fichas a menudo no distinguen claramente entre las diferentes ediciones y no se ha podido determinar la edición correcta para cada documentación, han tenido que agruparse algunas entradas de la bibliografía en las que el DEM hacía referencia a diferentes ediciones con diferentes siglas.
En la segunda fase del proyecto se registraron más datos de las ediciones:
- Se buscaron sistemáticamente reproducciones de las ediciones en la web. Se registró el proveedor de cada una de estas reproducciones, así como posibles notas sobre la copia digital. Además, se indicó si el acceso era libre o restringido.
- Se buscaron las ediciones en el portal de datos de la Biblioteca Nacional de España y se registró el ID para poder hacer referencia a la entrada correspondiente.
- En el caso de los artículos de revistas, también se registró el DEMel-ID de esta revista para enlazar la entrada bibliográfica correspondiente.
4.5. Más datos de las fuentes primarias
Para ampliar las opciones de filtrado en la bibliografía, en la segunda fase del proyecto se introdujo en la base de datos más información sobre las fuentes primarias: Tipo de texto, lengua, género y subgénero, así como autor o traductor. A la hora de definir las categorías y registrar los datos, se siguieron en la medida de lo posible el Old Spanish Textual Archive (OSTA) del Hispanic Seminary of Medieval Studies (HSMS) y la Bibliografía Española de Textos Antiguos (BETA). Los correspondientes IDs de obra (HSMS-ID y BETA) se registraron como "IDs externos" para las fuentes primarias. No se registraron más datos para las fuentes secundarias y las revistas. Durante el registro de datos, se tuvieron en cuenta las siguientes particularidades para las distintas categorías:
Autor, traductor
Como autores y traductores se registraron las personas implicadas en las fuentes primarias medievales (y no los editores de las ediciones modernas). Entre las personas implicadas figuran tanto los autores o traductores de las fuentes medievales como, en ocasiones, los encargados de las obras. Por ello, a algunas fuentes se les asignó más de una persona. Para todas las personas se registraron, en la medida de lo posible, los registros de autoridades correspondientes de los siguientes ficheros de autoridades:
- Virtual International Authority File (VIAF)
- Biblioteca Nacional de España (BNE)
- Gemeinsame Normdatei (GND) de la Biblioteca Nacional de Alemania
- Wikidata
La escritura de los nombres se basó generalmente en la escritura sugerida por la BNE. Se escribió primero el nombre y después el apellido. En el caso de los reyes, se anotó también el título para facilitar la distinción entre los diferentes reyes.
Tipos de textos
Los tipos de texto se dividen en prosa y verso. A los prosimetra y a las colecciones de textos que contienen textos en prosa y en verso se les asignaron ambos tipos de texto. Si no se pudo determinar el tipo de texto de una fuente, se seleccionó "no especificado".
Lenguas
Además de OSTA y BETA, también se utilizó el prólogo de la edición correspondiente para seleccionar las lenguas. Si el editor no especificaba la lengua utilizada, se seleccionó "no especificado". Se podían asignar varias lenguas a una misma fuente, lo que sucedía especialmente en el caso de las colecciones de documentos.
Género / Subgénero
En la medida de lo posible, a cada fuente primaria se le asignó un género y un subgénero. No fue posible seleccionar varios géneros o subgéneros para una fuente. Si no se podía determinar el género o subgénero, se seleccionaba "no especificado" para la categoría correspondiente.
| Tipos de texto | Lenguas | Géneros | Subgéneros |
|---|---|---|---|
|
|
|
|
5. Textos y contextos
El objetivo central de la tercera fase del proyecto consistió en registrar de forma legible por máquina en la base de datos los contextos anotados a mano en las fichas. La transcripción manual fue descartada desde un principio, pues habría resultado tanto laboriosa como propensa a errores. En su lugar, se compiló un corpus de textos del español medieval que permite generar automáticamente los contextos y las ubicaciones de las documentaciones primarias. El corpus abarca una gran parte de las fuentes primarias utilizadas en el DEM. A continuación se describe cómo se compiló, cómo se anotaron en él las documentaciones y cómo se generaron los contextos y las ubicaciones.
5.1. Compilación del corpus
Para el corpus de textos se recurrió a fuentes primarias que ya estaban disponibles en formato electrónico en diversas formas. Al contrario de lo previsto inicialmente, no se utilizaron los ficheros de la base de datos de textos del DEM, desarrollada desde 1992 en el centro de investigación de Heidelberg. Un examen exhaustivo reveló que dichos textos presentaban con frecuencia una estructura inconsistente, estaban incompletos o contenían errores tipográficos. Por ello, se utilizaron textos completos digitales disponibles a través de proveedores externos. En los casos en que aún no se disponía de textos completos, se crearon, en la medida de lo posible, textos completos propios mediante el reconocimiento óptico de caracteres (OCR) a partir de archivos de imagen. A la hora de seleccionar las fuentes adecuadas, se dio prioridad a la relación coste-beneficio: las fuentes debían presentar una alta densidad de documentaciones y el diseño de la edición debía tener una estructura sencilla. Para el reconocimiento de texto se utilizó inicialmente OCR4all. Para ello, se generaron datos de entrenamiento a partir de modelos disponibles y se corrigieron manualmente, con el fin de entrenar posteriormente un modelo específico para el español medieval, el cual se ajustó ligeramente para cada edición. Esto permitió obtener textos de alta calidad. Únicamente los caracteres especiales, como los corchetes y las comillas angulares, requirieron un procesamiento manual posterior. Sin embargo, OCR4all presentaba deficiencias en el reconocimiento de la maquetación, especialmente en lo que respecta al orden de lectura, y no permitía entrenar modelos propios de maquetación. Dado que estas limitaciones afectaban sistemáticamente a la calidad del corpus, se tomó la decisión de cambiar a Transkribus para el procesamiento de los textos restantes. Los modelos públicos de Transkribus proporcionaron resultados satisfactorios, por lo que no fue necesario ningún entrenamiento adicional. Solo hubo que volver a corregir manualmente los paréntesis.
El corpus final comprende 200 obras:
- 109 textos completos generados mediante OCR
- 44 textos completos de la Digital Library of Old Spanish Texts del Hispanic Seminary of Medieval Studies (HSMS)
- 40 textos completos del Archivo Digital de Manuscritos y Textos Españoles (ADMYTE)
- 7 textos completos de la Biblioteca Virtual Miguel de Cervantes en formato HTML
Por cada fuente se incluyó como máximo una edición en el corpus de textos, seleccionando únicamente aquellas ediciones que también habían servido de base textual en el DEM. Las ediciones del HSMS se publicaron en Zenodo en abril de 2026 bajo una licencia CC BY NC SA 4.0. En el proyecto, sin embargo, se utilizaron aún las versiones publicadas en https://www.hispanicseminary.org. Todas las demás ediciones empleadas son anteriores a 25 años y, por tanto, ya no están sujetas al derecho de protección de las ediciones científicas, por lo que se pueden ofrecer como textos completos en el marco del proyecto.
5.2. Procesamiento de los textos
Dado que los textos completos procedían de fuentes heterogéneas y se presentaban en distintos formatos, fue necesario procesar y convertirlos a un formato uniforme antes de proceder a la anotación de las documentaciones. El objetivo consistía en extraer, mediante script o manualmente, el texto continuo medieval de cada fuente, convertirlo al formato XML conforme a las directrices de la Text Encoding Initiative (TEI) y, en la medida de lo posible, marcar las principales estructuras textuales.
5.2.1. De HSMS y ADMYTE a XML/TEI
Los textos completos del HSMS y de ADMYTE se basan en las convenciones de transcripción del HSMS, descritas en el Manual of Manuscript Transcription for the Dictionary of the Old Spanish Language de David Mackenzie y Ray Harris-Northall y disponibles en versión abreviada en Zenodo. La conversión de los textos completos a XML/TEI se realizó en gran medida de forma automática mediante script. Las intervenciones manuales solo fueron necesarias en casos excepcionales, por ejemplo cuando el número de etiquetas de apertura no coincidía con el de cierres "}".
No se pretendió establecer un mapeo completo de todas las etiquetas HSMS a sus equivalentes XML, sino obtener un texto continuo depurado sin elementos adicionales como títulos de columna, reclamos y pies de ilustración, y con las marcas paleográficas (letras voladas, corchetes para añadidos, etc.) resueltas. En concreto, se realizaron los siguientes cambios en el paso de HSMS y ADMYTE a XML/TEI:
Etiquetas eliminadas con su contenido:
Los elementos que no pertenecían al texto continuo fueron suprimidos por completo: {ILL.}, {IN.}, {HD.}, {MIN.}, {DIAG.}, {BLANK.}, {CW.}, {SG.}, {RMK.}, {SYMB.}
Etiquetas de lengua eliminadas (contenido conservado):
Los pasajes en otras lenguas se conservaron pero se eliminaron sus etiquetas: {ARB.}, {BAS.}, {CAT.}, {ENG.}, {FRN.}, {GAL.}, {GER.}, {GRK.}, {HEB.}, {ITL.}, {LAT.}, {PRT.}, {PRV.}
Etiquetas conservadas (con equivalente TEI):
| Etiqueta HSMS | Elemento TEI |
|---|---|
{RUB.} |
<hi rend="rubric"> |
{GL.} |
<gloss> |
{AD.} |
<add> |
[fol.] |
<pb/> |
Caracteres especiales eliminados:
[ ], < >, << >>, ^, #2, \, *, $, |, [+], %
Combinaciones de caracteres ASCII resueltas (ejemplos):
| Original | Resultado |
|---|---|
| c' | ç |
| n~ | ñ |
| s' | σ |
Además, se eliminaron los paréntesis redondos junto con su contenido, ya que marcan supresiones editoriales. Los paréntesis dobles se convirtieron en simples, pues en el original representan paréntesis en el texto. Los fragmentos textuales, separados por +, %2 o %3 de acuerdo con la estructura del manuscrito, se reunificaron.
El resultado son textos continuos de las fuentes medievales depurados de caracteres especiales. Dado que las convenciones de transcripción del HSMS se centran principalmente en una reproducción paleográficamente precisa y no contemplan el marcado de unidades estructurales como capítulos o párrafos, los textos procesados tampoco contienen ninguna otra estructuración, salvo un <div> y un <p> envolventes. En el marco del proyecto no fue posible realizar un marcado manual posterior.
5.2.2. De OCR a XML/TEI
El proyecto DEM se caracterizó por una gran diversidad de fuentes, lo que afectó directamente a los textos que debían procesarse en el proyecto: colecciones de documentos, textos legales, poemas, un drama y otros géneros debían recopilarse de manera uniforme. Esta heterogeneidad dificultó considerablemente la creación de un corpus de textos coherente basado en TEI. A esto se sumaba que las ediciones utilizadas como base también diferían mucho entre sí en cuanto a formato y convenciones; así, por ejemplo, el significado de los corchetes podía variar de una edición a otra. Dado que no se disponía de tiempo para leer detenidamente todos los prólogos ni todas las ediciones especificaban claramente sus convenciones editoriales, en tales casos hubo que actuar de forma pragmática.
El objetivo principal del procesamiento manual de los textos OCR y de las ediciones de la Biblioteca Virtual Miguel de Cervantes fue —al igual que con los textos del HSMS y de ADMYTE— obtener el texto continuo medieval. Por ello no se tuvieron en cuenta las introducciones de los editores, los glosarios, las traducciones, los comentarios ni los índices. Además se aplicaron las siguientes reglas:
Elementos de texto no incluidos
- Notas a pie de página y aparatos críticos
- Encabezados que, a juzgar, no formaban parte del original medieval y estaban escritos en español moderno
- Texto en escritura árabe y hebrea
- Metadatos al inicio de los documentos (datación, resumen, descripción del original)
- Datos de foliación así como el símbolo "/" utilizado en las ediciones para marcar los límites de folio (con la excepción de los textos t0134 y t0052, ya que las fuentes correspondientes b0589 y b1396 se citan en el DEM según su foliación)
Procesamiento de signos y convenciones editoriales
- Los paréntesis redondos y los corchetes se conservaron, incluido su contenido; los comentarios editoriales como "[sic]" se eliminaron.
- Las omisiones se representaron como en la fuente, por ejemplo con "…".
Normalizaciones a nivel de carácter
- s en lugar de ſ
- Las letras voladas se bajaron a la línea.
- Las cursivas no se reprodujeron.
Estructura del texto y maquetación
- Las estructuras de texto más importantes (capítulos, estrofas, párrafos, saltos de página, etc.) se marcaron con TEI.
- Los saltos de columna y de línea no se tuvieron en cuenta al marcar las estructuras de texto.
Las excepciones a estas reglas se indican en el elemento <encodingDesc> del <teiHeader> del documento correspondiente. A continuación se describen en detalle los demás elementos TEI utilizados.
5.2.3. Descripción de la sintaxis TEI
El corpus consta de 200 archivos XML (uno por texto), codificados conforme a las directrices actuales (P5) de la Text Encoding Initiative (TEI). Se emplea una selección reducida de elementos TEI adaptada a las necesidades del proyecto que se define en un documento ODD y un esquema RELAX NG generado a partir de él.
Encabezado
El encabezado TEI (<teiHeader>) se divide en los siguientes elementos:
- El elemento
<fileDesc>(descripción bibliográfica del archivo) contiene los subelementos<titleStmt>(título y responsabilidades),<editionStmt>(datos sobre la edición),<extent>(extensión),<publicationStmt>(datos de publicación) y<sourceDesc>(descripción del original). Dentro de<sourceDesc>, los datos bibliográficos de la edición que sirvió de base para el texto se registran con<bibl type="analog-source">. Los datos se extraen de la base de datos del DEMel. En<bibl type="original-source">se remite al texto medieval subyacente y se indica su datación con<date>. - El elemento
<profileDesc>recoge la clasificación del contenido del texto mediante<textClass>,<keywords>y<term>. El atributo@correspremite a la taxonomía del DEMel. - La información sobre la codificación se recoge en
<encodingDesc>, incluyendo<listPrefixDef>con<prefixDef>para definir los prefijos URI para la taxonomía y las documentaciones, así como<editorialDecl>para la documentación de las decisiones editoriales. - Los cambios en el archivo se documentan en
<revisionDesc>con<listChange>y<change>.
Texto continuo
Dentro de <text> no se distingue entre <body>, <front> y <back>, ya que en la mayoría de los casos se omitieron las partes de la edición relevantes para <front> y <back>, como las introducciones y los apéndices. Por ello, todo se incluye bajo <body>. Los textos más extensos o las colecciones de documentos se subdividen en capítulos o documentos mediante <div>. Si estaban numerados en la edición, la numeración se transfirió al atributo @n, empleando números arábigos o romanos según la fuente. A nivel de párrafo, <p> recoge el texto continuo. En textos bíblicos como t0033 se utiliza <ab> para los versículos bíblicos si la estructura de la edición original lo permitía. Para los versos se emplean <lg> (grupo de versos) y <l> (verso). En la única obra dramática, t0006, el diálogo de los personajes se marca con <sp> y el personaje que habla con <speaker>. Para marcar los títulos se utiliza <head>; para los saltos de página, el elemento vacío <pb/>, en el que el número de página se expresa con el atributo @n. Si una palabra estaba separada por un salto de página, se añadió el atributo @break="no" y se eliminó el guion precedente. Asimismo, se eliminaron sistemáticamente los espacios antes y después de <pb/>.
Las rúbricas de los textos del HSMS y ADMYTE se reprodujeron con <hi rend="rubric">. No se prescindió de su marcado, ya que en los originales suelen indicar títulos y aportan así al menos cierta estructura al texto. Las adiciones se etiquetan con <add> y las glosas con <gloss>.
El elemento <seg> permite marcar cualquier segmento de texto. En el corpus se utiliza exclusivamente para anotar las documentaciones primarias. Para ello, se indica el ID de la documentación mediante el atributo @corresp. A través del prefijo "obj", definido en <prefixDef>, se puede acceder a la entrada TEI Lex-0 correspondiente. A continuación se describen detalladamente las reglas según las cuales se llevó a cabo el marcado de las documentaciones en los textos.
5.3. Anotación de las documentaciones
El objetivo de la anotación de las documentaciones era marcar las documentaciones primarias registradas en la base de datos en el pasaje del texto anotado en la ficha correspondiente. De este modo se posibilita la posterior generación automática del contexto de la documentación. Esta anotación solo fue posible para las documentaciones primarias procedentes de 200 fuentes para las que se pudo crear un texto completo en formato XML/TEI, tal y como se ha descrito anteriormente. Esta cifra corresponde a aproximadamente el 60 % de todas las documentaciones primarias de la base de datos. A continuación se explican las directrices para el marcado.
5.3.1. Directrices
Solo se marcó el pasaje de texto anotado en la ficha, no todas las ocurrencias de la forma documentada. La anotación de las documentaciones se realizó en parte de forma automática mediante el uso de reconocimiento óptico de texto en las fichas. Eso permitió clasificar las ocurrencias de la forma documentada en el texto completo de la fuente según su similitud con el texto reconocido en la imagen de la ficha. Si se identificaba un claro favorito, este se anotaba automáticamente. Para las demás documentaciones, las ocurrencias fueron asignadas de forma semiautomática por estudiantes colaboradores mediante una aplicación de registro.
Reglas para la anotación automática
Una documentación se anotó automáticamente cuando se cumplían varias condiciones. En primer lugar, el reconocimiento de texto (Tesseract o Transkribus) debía haber producido resultados suficientemente fiables, lo que se comprobó mediante el valor de confianza del OCR (cuando estaba disponible, umbral: 70) y la longitud del texto reconocido (mínimo 100 caracteres). Si se cumplían estas condiciones, se buscaba la forma documentada en el texto completo correspondiente. Si solo había una ocurrencia, la documentación se anotó siempre que la similitud entre el pasaje de texto encontrado en el texto completo y el texto reconocido en la ficha fuera suficientemente elevada (distancia de Levenshtein inferior a 80). En caso de varias ocurrencias, la documentación solo se anotó si el mejor resultado tenía una distancia inferior a 80 y se distinguía del segundo mejor en al menos 5 puntos. La fiabilidad de la anotación automática se documentó en tres niveles. Los casos más dudosos fueron revisados posteriormente por estudiantes colaboradores.
Anotación de las documentaciones en el texto completo
La anotación de las documentaciones con una forma documentada simple se realizó mediante el uso de un elemento <seg>. El ID de la documentación se indica con el atributo @corresp.
Tomen de las <seg corresp="obj:demel_d00509311">almendras</seg> buenas quantas quisieren e faganles eras e pongan los en ellas en el mes de setienbre.
Forma documentada con varias palabras consecutivas
Cuando la forma documentada constaba de varias palabras consecutivas, se anotaron conjuntamente con un solo elemento <seg>.
Guiado es el que <seg corresp="obj:demel_d00056152">se trabaja</seg> en este sieglo pora aver folgura en el otro.
Forma documentada con varias palabras no consecutivas
Cuando la forma documentada consistía en dos palabras no consecutivas, ambas partes se anotaron cada una con su propio elemento <seg>, sin incluir el texto intercalado. Los dos elementos correspondientes recibieron cada uno un @xml:id y se remiten entre sí mediante los atributos @prev y @next con lo que se indica su relación.
En tod esto Pollinices non <seg corresp="obj:demel_d00671792" xml:id="seg-d145e37959" next="#seg-d145e37962">se</seg> quiso <seg corresp="obj:demel_d00671792" xml:id="seg-d145e37962" prev="#seg-d145e37959">abaxar</seg> en su razon, […].
Varios pasajes de texto con la misma forma documentada en una ficha
Cuando la misma forma documentada de la misma fuente aparecía varias veces en una ficha, en la primera fase del proyecto solo se creó una documentación en la base de datos, ya que los registros habrían sido idénticos al carecer de contextos y ubicaciones. La anotación de las documentaciones y la posterior generación de los contextos permiten ahora crear registros diferenciables entre sí. Para cada pasaje de texto adicional se creó, por tanto, una nueva documentación en la base de datos. Para cada documentación se anotó exactamente un pasaje de texto, lo que garantizó que ninguna documentación fuera referenciada múltiples veces y que cada ID de documentación apareciera solo una vez en el archivo XML. (Las documentaciones cuya forma documentada consta de varias palabras no consecutivas constituyen una excepción: en este caso el ID de la documentación aparece dos veces en el archivo XML, aunque solo se genera un contexto.)
E tomó el señor de josep a josep e púsolo en la <seg corresp="obj:demel_d00326454">casa</seg> de la prisyón, onde los presos del rrey estauan presos; e estouo en la <seg corresp="obj:demel_d00723295">casa</seg> de la prisyón.
Varias documentaciones para un pasaje de texto
Cuando en varias fichas figuraba el mismo pasaje de texto, era posible anotar varios IDs, separados por espacios, en un mismo elemento <seg>. Cuando los registros correspondientes eran idénticos —a excepción de los IDs de documentación y de las imágenes asociadas—, las documentaciones se fusionaron en el proceso de revisión. Una documentación se marcó como eliminada. Su imagen correspondiente se vinculó entonces a la documentación restante. El ID de la documentación eliminada se suprimió del archivo XML. (La documentación eliminada sigue siendo accesible a través de su PURL, lo que garantiza su citabilidad permanente.)
[…] sabet çiertament que qui no <seg corresp="obj:demel_d00642964">abandona</seg> la dignidat por occasion de enuidia es bien consellado […]
![]() |
![]() |
Las documentaciones no se fusionaron cuando los registros de la base de datos diferían en al menos un atributo, por ejemplo en el lema.
Non es él mayor en esta casa que yo e non me vedó cosa, <seg corresp="obj:demel_d00077449 obj:demel_d00078125">saluo</seg> a ty, porque eres su muger […]
5.3.2. Particularidades derivadas del uso de distintas ediciones
En el DEM se recurrió a menudo a varias ediciones para una fuente, por ejemplo cuando estas se basaban en distintos manuscritos o cuando durante el desarrollo del proyecto había aparecido una edición más reciente. En el proyecto DEMel, en cambio, se preparó para la anotación de las documentaciones un máximo de una edición por fuente. En los casos en que el pasaje de texto en cuestión, procedente de una edición no utilizada, apareciera también en la edición utilizada, se anotaron las documentaciones. De ello pueden derivarse las siguientes particularidades:
Ubicación divergente
Dado que para la anotación de las documentaciones se utilizó en ocasiones una edición distinta, la ubicación indicada en la ficha puede diferir de la del texto procesado y de la de la base de datos.
Forma documentada divergente
Cuando solo la forma documentada difería entre las ediciones pero el contexto coincidía, la documentación se anotó igualmente. De este modo, la forma documentada marcada en el contexto generado puede diferir de la que aparece en la ficha y en la base de datos. Algo similar ocurrió cuando la edición utilizada contenía un aparato crítico y las variantes de texto allí registradas habían sido anotadas en las fichas y, por tanto, también en la base de datos.
Documentación sin anotar
En algunos casos, el pasaje de texto anotado en la ficha no aparecía en la edición procesada, o bien el fragmento de texto en cuestión difería fundamentalmente en ambas ediciones. En tales casos la documentación no fue anotada, razón por la que algunas documentaciones de una misma fuente cuentan con contexto y otras no. Una causa adicional puede ser que durante el procesamiento del texto se suprimieran determinadas partes de la fuente. Esto afecta especialmente a los textos basados en ediciones del HSMS, de los que se eliminaron, por ejemplo, los títulos de columna y los textos de las ilustraciones para obtener el texto continuo de la fuente.
5.4. Generación de los contextos y ubicaciones de las documentaciones
A partir de los IDs de las documentaciones en los archivos XML/TEI, se generaron los contextos y las ubicaciones mediante un programa en Java y se insertaron en la base de datos. Los contextos de las documentaciones constan de 60 caracteres antes y 60 caracteres después de la forma documentada. Las palabras que se habrían dividido en este límite se incluyeron íntegramente, aunque con ello se superara el límite de 60 caracteres. Las ubicaciones se generaron mediante expresiones XPath adaptadas a cada fuente, siguiendo las normas de citación establecidas en el DEM. Según la fuente, se cita por <div>, <pb>, <lg>, <ab>, <l> o por una combinación de estos elementos, es decir, por ejemplo por libro, capítulo, página, folio o estrofa.
<pb xml:id="pb-d22e171" n="3" />
<div>
<p>[…] muchas cosas de aquellas que io falle escritas de los
<seg corresp="obj:demel_d00459321">antiguos</seg> autores y en libros diversos esparsidas.
E en este […]</p>
</div>
concat('p ', ./preceding::tei:pb[1]/@n) que determina el número de la página anterior (<pb/>).
En las documentaciones cuya forma documentada consta de dos palabras no consecutivas y que, por tanto, se anotaron con dos elementos <seg> separados, el contexto se compone de 60 caracteres antes del primer <seg>, el texto completo entre ambos elementos y 60 caracteres después del segundo <seg>.
[…]declinassen en la porfidia arriana ⁊ por tal que esto <seg corresp="obj:demel_d00623033" xml:id="seg-d96e22643" next="#seg-d96e22646">se</seg> pudiesse mas ayna <seg corresp="obj:demel_d00623033" xml:id="seg-d96e22646" prev="#seg-d96e22643">acabar</seg> Euduxio por palauras ⁊ con moneda enclino a uuilsilla uispo delos godos […]
<seg>, el fragmento intercalado "pudiesse mas ayna" y 60 caracteres tras el segundo <seg>.
Los contextos de las documentaciones no sobrepasan los límites de elementos: si el elemento concluye dentro de los 60 caracteres, el contexto se interrumpe en ese punto.
<div>
[…]
<p>[…] et enuiamosuos carta et recado a las otras cosas que nos dixieron por uos.</p>
<p><seg corresp="obj:demel_d00298428">Dada</seg> en Cordoua, el rey la mando martes XXIX
dias de junio, era de mil et dozientos et nouaenta et ocho anos. Garçia Domingueç la fizo.</p>
</div>
<p>.
Constituyen una excepción los elementos <l>, <ab> y <hi>: cuando una documentación está anotada dentro de uno de estos elementos, el contexto puede incluir también el texto de los elementos hermanos, ya que entre ellos no suele haber ruptura de contenido.
<lg n="3">
<l>Esto pense ordenar</l>
<l>Para el niño <seg corresp="obj:demel_d00606706">administrar</seg>,</l>
<l>Por que es malo despulgar</l>
<l>El çamarro.</l>
</lg>
Los elementos <add>, <gloss> y <speaker> se ignoraron al generar los contextos, por lo que su contenido no se incluyó en el contexto.
[…] mj non puedes nada fazer E dize el sabio seneca <gloss>seneca</gloss> que los <seg corresp="obj:demel_d00451182">nuestros</seg> consejos yerran ⁊ non son estables Ca non ha en Nos tan […]
<gloss> no se tuvo en cuenta.
6. Cambios en la base de datos
Para consolidar la base de datos, se realizan cambios continuamente. Estos cambios suelen hacerse para corregir errores, algunos de los cuales ya estaban presentes en el archivo de papel. Otros se cometieron durante el registro. Entre ellos se encuentran sobre todo:
- objetos duplicados
- vínculos incorrectos entre objetos (por ejemplo, asignación incorrecta de un lema a una documentación)
- registro incorrecto de las propiedades de los objetos (por ejemplo, la categoría gramatical de un lema o la forma documentada de una documentación)
Estas imprecisiones se han corregido y se corregirán en la base de datos en la medida de lo posible. Los cambios correspondientes se documentan con ayuda de la función de comentarios. De este modo se garantiza la citabilidad sistemática de todos los objetos. Los comentarios correspondientes son del tipo "Comentario de revisión del equipo del DEMel". Dado que a través de los PURL se promete una recuperabilidad permanente de cada objeto en la base de datos, en el caso de los objetos duplicados se prescinde del borrado completo de la entrada. En su lugar, uno de los objetos duplicados se marca como "borrado" en la base de datos, lo que significa que ya no puede encontrarse en las búsquedas. Sin embargo, el PURL correspondiente todavía redirecciona a este objeto. Además, se explica el motivo de la "eliminación" mediante un comentario y se proporciona un enlace al objeto que aún existe. En el caso de las documentaciones duplicadas, la imagen de la documentación eliminada se vincula a la segunda documentación si contiene más información.
La anotación de las documentaciones en los textos procesados permitió detectar errores adicionales en el conjunto de datos que fueron corregidos a continuación. Esto afecta, entre otros casos, a diferencias entre la forma documentada o la fuente indicadas en la ficha y las registradas en la base de datos. Además, se añadió la forma documentada a posteriori a partir del texto procesado a documentaciones en las que no se había anotado ninguna forma documentada en la ficha. Todos los cambios se documentaron, como se ha descrito antes, con un comentario de revisión.


















































































































































