Mostrando las entradas para la consulta semántica ordenadas por relevancia. Ordenar por fecha Mostrar todas las entradas
Mostrando las entradas para la consulta semántica ordenadas por relevancia. Ordenar por fecha Mostrar todas las entradas

lunes, 7 de septiembre de 2009

Introducción a la Web Semántica

El concepto de Web Semántica ya estaba implícito en la concepción de Internet, pero por omisión o prisas, no se materializó en sus inicios y recientemente se están empezando a poner las bases para recuperar esa idea. Filosóficamente, se trata de que haya un entendimiento más estrecho entre los humanos y la web de forma que:
  • Por un lado las aplicaciones entiendan mejor el lenguaje humano (por ejemplo, sepan distinguir entre "cerca" (próximo)" vs "cerca" (valla) o que "mañana por la mañana" entiendan que se trata del día siguiente al de hoy a primera hora o que "4 + 5" es una operación matemática )
  • Y por otro lado, las personas reciban una mejor información de la web, más precisa y puedan interactuar con ella para sus gestiones habituales, haciendo que los "agentes inteligentes" lo entiendan y ya se ocupen de interactuar entre ellos.
Por ejemplo, actualmente, los buscadores nos ofrecen datos relativos a palabras como patrones independientes (carentes de significado) :

Búsqueda hecha por palabras

Mientras que con la Web Semántica lo que se quiere es que entienda realmente nuestra petición:

Búsqueda hecha por conceptos relacionados

Como os podréis imaginar, para llegar a tener esta web semántica se deben hacer muchas cosas previamente, entre ellas una separación entre el formato y el contenido de las webs (hasta ahora el HTML sólo servía para el formato). Se necesita internamente crear nuevos metalenguajes estructurados (RDF, OWL, XML), nuevos selectores de información (GRDDL, SPARQL,...), se necesitan crear diccionarios de datos, de conceptos, de contextos asociados a las palabras, a las personas, a las relaciones entre las personas, a los documentos, etc. De esta forma las páginas web ya dejarán de ser estáticas y referenciadas para convertirse en sitios de conceptos relacionables.

La idea por tanto, es que la web semántica con sus "agentes inteligentes" sean capaces de extraer la información de páginas webs convenientemente preparadas, de las relaciones, de las personas, de los servicios web, de los contextos... creando una serie de ontologías que sirvan para ofrecer al usuario una información más veraz, precisa y útil.

martes, 8 de septiembre de 2009

Web Semántica. Gestión de Ontologías

Como ya hemos visto, la Web Semántica se basa en una recopilación de información de los recursos de Intenet (páginas webs (URI), conceptos, documentos, personas, relaciones,...) para ofrecer un servicio mucho más directivo y preciso.

Las ontologías son la forma de describir y representar exhaustivamente un área de conocimiento de un campo determinado como puede ser el de las finanzas, medicina, deporte, etc. Las ontologías incluyen definiciones de conceptos básicos en un campo determinado y la relación entre ellos.


Por tanto, podemos sugerir de forma global que la web semántica es el gran gestor de las ontologías. Técnicamente dicha gestión se basa en los metalenguajes que defino brevemente para que suenen:
  • XML: lenguaje de marcas y etiquetas para la sintaxis superficial de las webs para los documentos estructurados, pero sin dotarles de ninguna restricción sobre el significado. Para entendernos, los lenguajes HTML o XHTML serían particularizaciones de XML.
  • RDF: modelo de datos para los recursos que hay en Intentet (documentos, personas, fotos, eventos,...) y las relaciones que se puedan establecer entre ellos. Este lenguaje puede representarse mediante XML. Y de forma inversa, para extraer información RDF de un documento XML usaríamos GRDDL
  • SPARQL: es el lenguaje de consulta sobre RDF, que permite hacer búsquedas sobre los recursos de la Web Semántica utilizando distintas fuentes datos.
  • OWL: es un mecanismo para desarrollar temas o vocabularios específicos en los que asociar los recursos de Internet. Lo que hace OWL es proporcionar un lenguaje para definir ontologías estructuradas que pueden ser utilizadas a través de diferentes sistemas (usuarios, bases de datos, aplicaciones) que necesitan compartir información de un campo. Con OWL se describen las propiedades y clases de una ontología.
Pila de metalenguajes de la web semántica (2007)

Ejemplo sencillo de cómo va esto: Buscar un día para quedar entre todos mis amigos.

Si varias personas tienen un calendario de actividades en diversos medios (codificados en RDFa). Podemos extraer con GRDDL los distintos RDFs para tener un RDF stándar, común y entendible, para que con el buscador SPARQL nos sepa encontrar el día libre entre todos los RDFs-calendarios. ¿Visto?


martes, 1 de septiembre de 2009

FOAF

FOAF (Friend Of a Friend) es un proyecto comunitario y libre del W3C para que dentro de la incipiente "Web Semántica" se creen unos stándares de programación/definición para describir a las personas y a sus amigos. Está basado en etiquetas y ficheros RDF y XML.

¿Qué significa todo esto?

Al igual que en la vida real, una persona es identificada por un nombre y el D.N.I, en Internet, una persona está identificada por un nombre y una dirección de correo electrónico. Y esa es la base del FOAF: describir a una persona y a las personas que ella conoce.

Veamos un ejemplo sencillo de fichero foaf construido con sintaxis RDF dentro de un XML:

Fichero FOAF que describe a Leandro Mariano y su amistad con Jim Ley

Lo básico es el nombre (foaf:name), el email (foaf:mbox ó mbox_cha1sum (encriptado para evitar el SPAM)) y las personas a quien conoce, aunque se pueden añadir más atributos (página web, teléfono, documentos, grupos a los que petenece, etc).
Con este tipo de ficheros FOAF (que pueden ser leidos por máquinas) se pueden establecer fácilmente mapas de relaciones entre personas.

Las aplicaciones actuales que utilizan este vocabulario FOAF son variadas, pero siempre encaminadas a utilizar la información de la relación entre personas: