Acerca del corpus

Metodología MIPVU, principios FAIR, licencia, cómo citar y descargas.

F

Findable

LOCALIZABLE

Slug de corpus, DOIs, indexación en OLAC, esquema y Google Dataset Search y Schema.org.

A

Accessible

ACCESIBLE

API REST pública sobre HTTPS sin autenticación para lectura, metadatos Dublin Core.

I

Interoperable

INTEROPERABLE

JSON-LD, TEI-XML, RDF/Turtle, Vocabularios SKOS, Dublin Core, Universal Dependencies.

R

Reusable

REUTILIZABLE

Licencia CC-BY 4.0, proceso técnica detallada por registro, estándares MIPVU + TEI.

Metodología MIPVU

El Metaphor Identification Procedure Vrije Universiteit (MIPVU) es el protocolo estándar de anotación de metáforas lingüísticas, desarrollado en la Universidad Libre de Ámsterdam. El procedimiento identifica unidades léxicas metafóricas mediante la comparación entre su significado contextual y su significado básico según un diccionario de referencia (para el español, el DLE).

Esquema de anotación — 20 campos

Cada registro MIPVU incluye: ID, Orden (consecutivo secuencial único por documento fuente), Título 1/2/3, Página, Expresión metafórica, Contexto, Foco, Foco lematizado, Categoría gramatical del foco, Significado contextual, Significado básico, Metáfora conceptual (dominio X ES Y), Dominio fuente, Dominio meta, Correspondencias ontológicas, Correspondencias epistémicas, Tipología, Observaciones.

El campo Orden

Un aporte diferenciador de MetaCorpus Explorer es el tratamiento explícito del campo Orden como entero único por documento fuente. Este campo permite medir la proximidad textual entre expresiones metafóricas con granularidad superior al número de página, habilitando visualizaciones de densidad metafórica y navegación secuencial por la aparición en el texto, no por ID arbitrario.

Corpus actual — Informe Final de la Comisión de la Verdad de Colombia

Versión 1.0.0, publicado el 2026-01-01. Licencia CC BY 4.0.