# El tesauro documental

- Sitio: Ikusmira — enciclopedia en castellano de ciencias sociales y humanidades
- URL canónica: https://ikusmira.org/p/el-tesauro-documental/
- Categoría: Ciencias de la documentación
- Publicado: 2025-03-11
- Autoría: Josemari Sarasola Ledesma — Editor coordinador; Profesor titular de escuela universitaria, Universidad del País Vasco/Euskal Herriko Unibertsitatea
- Perfiles del autor: https://ekoizpen-zientifikoa.ehu.eus/investigadores/127490/detalle, https://dialnet.unirioja.es/servlet/autor?codigo=333202
- Política editorial (autoría, revisión, correcciones, financiación): https://ikusmira.org/politica-editorial/

Un **tesauro documental** es una lista de términos autorizados para describir y buscar documentos sobre una materia, en la que cada término aparece conectado con sus sinónimos, con los términos más amplios y más estrechos, y con los que guardan alguna relación. Sirve para que quien indexa un documento y quien lo busca usen la misma palabra para la misma idea. Si un artículo habla de «automóviles» y el lector busca «coches», un buen tesauro hace que se encuentren. Es uno de los tipos de [lenguaje documental](https://ikusmira.org/p/lenguaje-documental/), el más estructurado de los que usan palabras en lugar de números.

La palabra viene del griego *thesaurós*, tesoro, y durante siglos se usó para diccionarios grandes, como el *Thesaurus linguae latinae*. El sentido moderno arranca en 1852, cuando el médico inglés Peter Mark Roget publicó un *Thesaurus of English Words and Phrases*. A diferencia de un diccionario, que va de la palabra al significado, el de Roget iba de la idea a la palabra: agrupaba el vocabulario en unas mil categorías de conceptos para ayudar a los escritores a encontrar el término justo. Sigue reeditándose y en inglés *thesaurus* significa todavía, sin más, diccionario de sinónimos.



La documentación tomó la palabra prestada a finales de los años cincuenta. Los centros de información técnica y militar de Estados Unidos, desbordados por miles de informes, habían empezado a indexarlos con palabras clave sueltas en lugar de encabezamientos de materia. El sistema era rápido, pero cada indizador elegía sus palabras y las búsquedas fallaban por culpa de los sinónimos, los plurales y los términos demasiado generales o demasiado concretos. La solución fue controlar ese vocabulario y anotar las relaciones entre palabras. En 1960 apareció el tesauro de descriptores de la agencia de documentación del ejército estadounidense, y en 1967 el tesauro de términos de ingeniería y ciencia, el TEST, que fijó el modelo que se sigue usando.

Un tesauro distingue dos clases de términos. Los **descriptores** son los términos preferentes, los únicos que se pueden usar para indexar. Los **no descriptores** son sinónimos o variantes que remiten al descriptor, para que quien los busque sea redirigido. Entre ellos se establecen tres tipos de relación. La de **equivalencia** une un no descriptor con su descriptor. La **jerárquica** une un término con otro más amplio o más estrecho. La **asociativa** une términos que no son sinónimos ni están uno dentro del otro, pero que conviene tener presentes juntos.

Cada relación tiene su abreviatura, que en los tesauros en español suele ser esta: USE remite del no descriptor al descriptor, y UP (usado por) indica en el descriptor qué sinónimos sustituye. TG es el término genérico, el más amplio, y TE el término específico, el más estrecho. TR señala un término relacionado. Y NA, la nota de alcance, explica cómo debe usarse un término cuando su significado podría prestarse a dudas. Así aparecería una entrada:

```
Bibliotecas públicas
  NA  Bibliotecas abiertas a toda la población, financiadas con fondos públicos.
  UP  Bibliotecas populares
  TG  Bibliotecas
  TE  Bibliotecas municipales
  TE  Bibliobuses
  TR  Lectura pública
  TR  Préstamo interbibliotecario

Bibliotecas populares
  USE Bibliotecas públicas
```

```mermaid
%% Las tres relaciones de un tesauro alrededor de un descriptor
flowchart TB
  G["Bibliotecas<br>(TG)"] --> D["Bibliotecas públicas<br>(descriptor)"]
  D --> E1["Bibliotecas municipales<br>(TE)"]
  D --> E2["Bibliobuses<br>(TE)"]
  N["Bibliotecas populares<br>(no descriptor)"] -. "USE" .-> D
  D <-. "TR" .-> R["Lectura pública"]
```

Construir un tesauro exige decisiones que parecen menudas y no lo son. Hay que fijar si los términos van en singular o en plural (en español se prefiere el plural para lo que se puede contar, como «bibliotecas», y el singular para lo abstracto, como «lectura»), cómo se tratan las siglas, qué hacer con los términos compuestos y dónde cortar la jerarquía. Una relación jerárquica debe ser verdadera en todos los casos: todo bibliobús es una biblioteca pública, pero no toda biblioteca escolar lo es, así que no puede colgar de ella. Cuando la relación no es siempre verdadera, se marca como asociativa.

La norma internacional actual es la ISO 25964, publicada en dos partes en 2011 y 2013, que sustituyó a normas anteriores para tesauros monolingües y multilingües. En la web, la forma habitual de publicar un tesauro es el lenguaje SKOS, una recomendación del W3C de 2009 que traduce las relaciones clásicas a datos enlazados: un concepto tiene una etiqueta preferente, etiquetas alternativas y vínculos más amplios, más estrechos o relacionados. Así un tesauro puede enlazarse con otros y con catálogos de todo el mundo.

Algunos tesauros son herramientas de uso diario para millones de personas. El MeSH, el vocabulario médico de la Biblioteca Nacional de Medicina de Estados Unidos, indexa desde 1960 la literatura biomédica y es lo que hay detrás de cada búsqueda en PubMed. El Tesauro de la UNESCO cubre educación, cultura, ciencia y comunicación. EuroVoc, el de la Unión Europea, está disponible en las veinticuatro lenguas oficiales, de modo que un documento indexado en húngaro se puede recuperar con una búsqueda en portugués. En España, el Consejo Superior de Investigaciones Científicas mantuvo durante décadas tesauros especializados para sus bases de datos.

El auge de los buscadores de texto completo llevó a pensar que los tesauros sobraban: si el ordenador puede leer todo el documento, ¿para qué indexarlo? La experiencia ha matizado esa idea. El texto completo encuentra las palabras que aparecen, no los conceptos, y falla con los sinónimos, con los documentos en otros idiomas y con los temas que un texto trata sin nombrarlos. Por eso los sistemas de búsqueda serios siguen usando vocabularios controlados por debajo, a veces sin que el usuario lo note, y por eso el tesauro sigue siendo una pieza central del [análisis documental](https://ikusmira.org/p/analisis-documental/).

[Lenguaje documental](https://ikusmira.org/p/lenguaje-documental/) – [Análisis documental](https://ikusmira.org/p/analisis-documental/) – [Punto de acceso](https://ikusmira.org/p/punto-de-acceso-bibliotecas-catalogos-bibliograficos/) – [Búsqueda bibliográfica](https://ikusmira.org/p/busqueda-bibliografica/) – [Metadatos](https://ikusmira.org/p/metadatos/) – [Las cinco leyes de Ranganathan](https://ikusmira.org/p/las-cinco-leyes-de-ranganathan/)

## Fuentes

- Peter Mark Roget — *Thesaurus of English Words and Phrases, Classified and Arranged so as to Facilitate the Expression of Ideas and Assist in Literary Composition*, Longman, Brown, Green, and Longmans, Londres (1852)
- Jean Aitchison, Alan Gilchrist y David Bawden — *Thesaurus Construction and Use: A Practical Manual, 4.ª edición*, Aslib, Londres (2000)
- Blanca Gil Urdiciain — *Manual de lenguajes documentales, 2.ª edición*, Trea, Gijón (2004)
- Organización Internacional de Normalización — *ISO 25964-1:2011. Information and documentation. Thesauri and interoperability with other vocabularies. Part 1: Thesauri for information retrieval*, ISO, Ginebra (2011)
- Birger Hjørland — *Does the Traditional Thesaurus Have a Place in Modern Information Retrieval?*, Knowledge Organization 43 (3) (2016) — https://doi.org/10.5771/0943-7444-2016-3-145
- Alistair Miles y Sean Bechhofer (eds.) — *SKOS Simple Knowledge Organization System Reference*, W3C Recommendation (2009) — https://www.w3.org/TR/skos-reference/

---

Cómo citar: Sarasola, Josemari (2025). «El tesauro documental». Ikusmira. https://ikusmira.org/p/el-tesauro-documental/
Índice del sitio para modelos: https://ikusmira.org/llms.txt
