Mostrando entradas con la etiqueta web. Mostrar todas las entradas
Mostrando entradas con la etiqueta web. Mostrar todas las entradas

viernes, 2 de mayo de 2014

Los buscadores semánticos

Twine fue un servicio Web de índole social, que permitía subir piezas de información, tales como textos, archivos, etcétera, y realizaba análisis para generar automáticamente una serie de etiquetas que definían el contenido. Estas etiquetas podían estar presentes en el texto analizado o inferirse derivando información asociada a ellas. Con una estructura semejante a la de una Wiki, Twine trató de establecer una “red de conocimiento” capaz de poner en contacto a personas, de acuerdo con el conocimiento extraído de sus contribuciones.

Aunque Twine pudo ser un buscador encargado de indexar semánticamente toda la Web, arrancó con un objetivo más sencillo: hacerse cargo de aquellas partes que la gente considera valiosas. Con la adquisición de Twine.com por la Empresa EVRI, el 11 de marzo del 2011, esta interesante aplicación fue retirada de la red. En su lugar surgió un “motor de descubrimiento de contenido móvil” al que se denominó EVRI.  http://www.evri.com.

EVRI es un buscador que se especializa en la devolución de resultados de las últimas noticias, temas seguidos regularmente, nuevos temas y recomendaciones de amigos. La plataforma central de la tecnología de EVRI se basa en el procesamiento del lenguaje natural y búsquedas semánticas, para proporcionar canales de contenido agregado en millones de temas.

Wolfram Alpha, desarrollado por la compañía Wolfram Research, es otra importante aplicación Web 3.0 que surgió el 15 mayo de 2009. Este buscador, al que se le llamó “Motor de Conocimiento Computacional”, es un servicio en línea que responde directamente las preguntas del usuario, en lugar de proporcionar una lista de los documentos o páginas Web que podrían contener la respuesta, como lo hace Google.

Wolfram Alpha se basa en la tecnología “Question Answering” o “QA”, para la recuperación de la información.  QA es un método que procesa el Lenguaje Natural de una forma más compleja que otros sistemas de recuperación de documentos, razón por la que se le observa como un paso por delante de la tecnología de los buscadores tradicionales para Internet. Asimismo se basa en uno de los anteriores programas creados por Wolfram Research: “Mathematica”, que incluye el procesamiento de álgebra, cálculo numérico y simbólico, visualizaciones y capacidades estadísticas. http://www.wolframalpha.com.

Diferencias entre los buscadores semánticos y los tradicionales

A fin de ilustrar las diferencias entre las tecnologías de los buscadores tradicionales y los semánticos, se presenta el siguiente ejemplo: suponga que usted desea localizar en Internet los datos del presidente de México.  A fin de trabajar de la misma manera con los buscadores, la búsqueda se realizará en inglés. La cadena a buscar será: “President of Mexico”.

Google, uno de los buscadores más conocidos y utilizados, es capaz de arrojar millones de resultados por cada palabra de búsqueda. Esta sobreabundancia de resultados responde al hecho de que las webs del momento son sintácticas, esto es, se sirven de las palabras, los términos, para ser localizadas por los buscadores.



En la figura 2 note que Google entregó una lista con todas las páginas que encontró con la información solicitada (230,000,000 de resultados en 0.12 segundos), sin duda muchas en un tiempo muy corto. No obstante, si analizamos los resultados obtenidos, nos damos cuenta que tendremos que revisar cada una de las ligas para extraer los datos que requerimos.

La misma búsqueda, pero ahora realizada con Wolfram Alpha, nos arroja resultados que son sin duda más apegados a las necesidades y deseos del usuario final



Esta es la promesa de los buscadores semánticos o Web 3.0: ajustar las búsquedas de información a las necesidades de los usuarios.

La misma búsqueda, pero ahora realizada con el buscador “EVRI”, sin duda arroja resultados actualizados e interesantes, pero con el enfoque comercial para el cual fue concebido: “mostar sólo las últimas novedades del presidente de México”



Como puede apreciarse, hay una diferencia significativa entre los resultados arrojados por cada uno de los buscadores.

Vale la pena mencionar también que Google ha estado trabajando en el desarrollo de un producto de búsqueda semántica. De hecho el pasado 3 de junio de 2009 fue lanzado Google Squared. Este buscador permitía extraer datos estructurados de toda la Web y presentaba sus resultados en un formato parecido al de una hoja de cálculo. Google Squared actualmente no está disponible en la red, pues se cerró después de una serie de pruebas a fin de mejorar las búsquedas. También en Julio de 2010, Google adquirió a la empresa Metaweb. Esta empresa es una compañía líder en el tema de Web semántica. Son quienes están detrás de Freebase, una inmensa base de datos, de la cual Google ya venía usando servicios para su sitio de noticias.

Otro buscador Web de importancia, que está tratando de introducir el uso de la tecnología semántica, es Bing de Microsoft, que fue puesto en línea el 3 de junio de 2009. Bing está basado en la tecnología semántica desarrollada por la empresa Powerset y que Microsoft compró en 2008 para el enriquecimiento de sus búsquedas.

Por otra parte, en lo que se refiere al tema de los buscadores semánticos, el pasado 2 de junio de 2011 Google, Yahoo y Bing, anunciaron la creación de un proyecto al que llamaron schema.org para acercar la Web semántica a cualquier página basada en la tecnología Rich Snippets (“Fragmentos Ricos”) de Google, que surgió en el 2009.

Entre las características y mejoras que ofrece schema.org, destacan las siguientes:


  • Posibilidad de etiquetar muchos tipos de información, como por ejemplo: restaurantes, productos, eventos, sonidos, recetas, etcétera.
  • Unificar la estructura de los datos. Hasta ahora podíamos trabajar con RDFa, microdatos o microformatos. A partir de ahora todo se centrará en microdatos; eso sí, el resto seguirán teniendo soporte, al menos por el momento.

Web 3.0, definición y ejemplos

Por todos es sabido que el concepto de evolución tecnológica ha cambiado desde la aparición de Internet. Se trata de un medio en constante cambio y mejora, del que no podemos alejarnos mucho sin caer en la obsolescencia.
Estimación de la evolución de la Red 1980-2030

Estimación de la evolución de la Red 1980-2030
Si empezamos por los tiempos de la popularización de Internet, nos encontramos con aquella primera World Wide Web, a la que ahora llamamos Web 1.0 y que mostraba poco más que un escaparate. La implementación del llamado Social Media y la posibilidad de compartir y crear desde cualquier lugar del mundo con tan solo disponer de una conexión a la Red, dieron lugar a la Web 2.0, democratizando la comunicación y haciéndola inmediata para sus usuarios.
Según los expertos, será en la década actual cuando despunte esa Web 3.0 de la que seguro que ya todos hemos oído hablar. La pregunta es, ¿sabemos de qué se trata?
Una posible definición de Web 3.0 sería la siguiente: Aquellas plataformas o herramientas online que no sólo permiten la conversación e interacción entre sus usuarios, sino que además son capaces de actuar de forma proactiva.
La Web 3.0 usa Internet para conectar información. Hace la Web más inteligente, teniendo en cuenta nuestros gustos, preferencias, hábitos e incluso el contexto. Páginas capaces de comunicarse con otras páginas mediante el lenguaje natural, dando lugar a esa llamada Web Semántica.
¿Inteligencia artificial? ¿Software capaz de comprender el lenguaje humano? La respuesta es sí, todo eso y seguramente mucho más. En definitiva y una vez más, la tecnología al servicio del bienestar y del acceso a la información.
Los primeros ejemplos de Web 3.0 que podemos encontrar actualmente están orientados a nuevas funcionalidades en buscadores. Estos son algunos de ellos:
Quintura: Buscador generalista que sugiere en forma de nube de tags términos relacionados que pueden ayudar a afinar tu búsqueda.
The WebBrain: Muestra mapas de ideas relacionados con los términos de tu búsqueda.
Retrievr: Buscador de imágenes en Flickr que permite buscar mediante un boceto o subiendo una imagen local.

¿Qué es la Web 3.0?

web3.0
La Web 3.0 es un término que no termina de tener un significado ya que varios expertos han intentado dar definiciones que no concuerdan o encajan la una con la otra pero que, en definitiva, va unida a veces con la Web Semántica.
En lo que a su aspecto semántico se refiere, la Web 3.0 es una extensián del World Wide Weben el que se puede expresar no sólo lenguaje natural, también se puede utilizar un lenguaje que se puede entender, interpretar utilizar por agentes software, permitiendo de este modo encontrar, compartir e integrar la información más fácilmente.
El termino se acuño en 2001 en un artículo científico escrito por American Boauthored Berners-Lee en el que se describía el término como lugar en el cual las máquinas pueden leer páginas Web con la misma facilidad con la que los humanos lo hacemos.
Otros de los términos que se han utilizado para definir la Web 3.0 hacen referencia a la transformación de la Web en una base de datos, un movimiento hacia la fabricación de contenido accesible para múltiples buscadores, la influencia de la Inteligencia Artificial, laWeb Semántica o la Web geoespacial.
La Web 3.0 y sus servicios se fundamentan en el colectivo de la Web Semántica, búsquedas de lenguaje natural, data-mining, aprendizaje automático y asistencia de agentes, todo ello conocido como técnicas de la Inteligencia Artificial o Inteligencia Web.
De acuerdo a algunos expertos, “la Web 3.0 está caracterizada y aprovisionada por la acertada unión de la Inteligencia Artificial y la Web”, mientras que algunos expertos han definido laWeb 3.0 como el siguiente paso en la progresión de las tuberís que conforman Internet.