<?xml version="1.0" encoding="UTF-8" ?>
<othersabs xmlns="http://eprints.org/ep2/data/2.0"><item><othabstracts>Este artículo describe algunas de las actividades del grupo de investigación REINA en torno a la recuperación de información web. Estas actividades se han centrado en probar la capacidad de recuperación que puede esperarse de diversos elementos informativos presentes en las páginas web, además del texto que el usuario visualiza normalmente en su navegador. Nuestro objetivo ha sido probar estrategias pre-recuperación de mezclar o combinar esos campos o elementos de información. Combinar términos de diversa procedencia en un único índice puede conseguirse, en sistemas basados en el modelo del espacio vectorial, operando sobre la frecuencia del término en el documento, si se aplica un esquema de pesado basado en tfxidf. El campo BODY es, obviamente, el más potente desde el punto de vista de la recuperación; pero los ANCHORs de los backlinks que reciben las páginas indizadas añaden una mejora considerable a los resultados de la recuperación. El contenido de las etiquetas META, sin embargo, contribuyen poco a la mejora en la recuperación.</othabstracts><language>es</language></item></othersabs>
