Inicio
Mostrando entradas con la etiqueta web semantica. Mostrar todas las entradas
Mostrando entradas con la etiqueta web semantica. Mostrar todas las entradas

viernes, 22 de mayo de 2009

Destripando Wolfram Alpha

Hace unos días se presentó Wolfram Alpha. Para el que todavía no lo sepa se trata de un "computational knowledge engine" que en castellano viene a ser "motor de computación de conocimiento". Esto quiere decir que es un buscador de información, una máquina que opera con muchísima información para poder ofrecer respuestas. Informan con cierto secretismo que utilizan "un nuevo tipo de computación basada en el conocimiento". El proyecto es muy ambicioso y tienen la bondadosa intención de...

"Our goal is to build on the achievements of science and other systematizations of knowledge to provide a single source that can be relied on by everyone for definitive answers to factual queries."

conseguir ser la gran fuente de información que sea capaz de mostrar los logros de la ciencia en base a las  preguntas de los usuarios.  "Recabar toda la información objetiva, método o algoritmo y hacerla computable".

Internamente está basado en Mathematica, software longevo (más de 20 años) de desarrollo matemático bastante conocido en el ámbito académico y cuando se realizó la release el servidor de clustering contaba con más de 10.000cores. Toda una start-up.

Desde el punto de vista de la web semántica suena muy interesante y hasta cierto punto llama la atención que en este mundillo no se haya comentado nada hasta hace unos días. Las reacciones no se han dejado esperar, hay quien ve una lucha entre el "mundo abierto" que promulga la Web Semántica y este tipo de soluciones basadas en modelos cerrados y alejados de los estándares, ontologías, descripciones de vocabularios. 

Tras someterle a una batería de pruebas [1], llegamos a varias conclusiones interesantes.
  • Wolfram Alpha responde preguntas con respuestas únicas y concretas. Primer distanciamiento con Google.
  • La respuesta contiene información en sí misma (respuestas concretas, gráficas, etc...) y no páginas con información relativa. Por lo tanto, Wolfram Alpha no es un buscador tradicional, del estilo Google o yahoo!. 
  • Entiende lenguaje natural. Este aspecto resulta muy llamativo, pero no han sido los primeros en llevar a cabo una idea así, de hecho recuerdo que iSOCO llevo a cabo una herramienta que entendía el languaje natural hace algunos años.  Aquí cabe una matización: qué entienda lenguaje natural no significa que sólo entienda lenguaje natural. Esta reflexión es muy importante desde el punto de vista de que no han cometido el error de exigir un cambio en el paradigma de búsqueda por todos estandarizado. Se ve claro con el ejemplo 1 y 2 de la batería de pruebas. 
  • La información viene supervisada por un "comité de sabios", esto nos valdría para decir que no es una aplicación 2.0.  En Wolfram Alpha la colaboración del usuario se límita a un feedback a modo de comentario sobre el resultado de la entrada. Han vendido esta obligada supervisión como una clave de su excelencia, exactamente la misma excelencia que busca la wikipedia con la solución contraria. ¡Qué curioso!
  • Ofrecen un API bastante interesante aunque todavía bastante primigenio. El API es unidireccional, sólo se envían datos. Ofrece dos grandes líneas de trabajo: la función Query que responde tus preguntas y la funciónValidateQuery que estudia la validez de tus preguntas. Afortunadamente comentan que pronto ofrecerán un API más potente, más de "bajo nivel". 
  • Está sólo en inglés. La salida ha sido en inglés y no he leído nada al respecto de internacionarlo, supongo que es demasiado pronto todavía, aunque tras ver la respuesta que da a la pregunta número 8 ya no me extraña nada en este mundo. No me quiero ni imaginar cómo van a hacer para internacionalizar el sistema de reconocimiento del lenguaje natural. Todo un reto increíble. 
  • No es semántico. Aunque muchas páginas digan que sí lo es. Basta el ejemplo 7 para demostrar esta afirmación. La web semántica se basa en que la información esté descentralizada y compartida en la nube, al alcance de todos. Wolfram alpha es simplemente lo contrario, la información tiene un ámbito cerrado.
    Si alguno tiene dudas, utilizando psicología inversa, podríamos afirmar que si fueran semántico, hubieran  habilitado en su api o en su versión de pago algún formato de intercambio semántico.  Se han limitado a PDF, hojas de cálculo, XML, 3D modeling, TeX... Está claro que intercambiar información en XML es una aproximación que posibilita acceder a esa información de manera semántica de forma quasi-inmediata, pero aun así, la respuesta es: Wolfram Alpha no es semántico. Toda una lástima, por cierto.
    Espero que la gente de LOD (Linking Open Data) se pongan manos a la obras a crear sinergias con el señor Wolfram.
    Voy a ver si hablo con un antiguo profesor, podría plantearse un buen proyecto final de carrera en esta dirección... ¿algún voluntario?
  • Ámbito académico y educacional. Exactamente lo que no tiene la Wikipedia. La rigurosidad de su política de actualización de información y la calidad de las respuestas dentro del ámbito científico hacen de él un producto excepcional, sin embargo, me gustaría saber qué frecuencia de actualización van a llevar, ahí va a ser difícil competir con la wikipedia. 
    Espero que los responsables en educación y la comunidad cientifica tomen definitivamente nota.


¿Cuándo veremos páginas que utilicen este conjunto de datos de manera útil para el usuario final?


[1] Batería 

1. Big City

http://www19.wolframalpha.com/input/?i=big+city

2. What is the biggest city?

http://www04.wolframalpha.com/input/?i=What+is+the+biggest+city%3F

3. A room of one's own (libro de Virginia Woolf)

http://www01.wolframalpha.com/input/?i=A+room+of+one's+own

4. Cuando libros ha escrito Michael Crichton?

http://www04.wolframalpha.com/input/?i=How+many+books+did+Michael+Crichton+write%3F

5. Michael Crichton

http://www04.wolframalpha.com/input/?i=Michael+Crichton

6. What is Nato?

http://www04.wolframalpha.com/input/?i=What+is+NATO%3F

7. What is RDF?

http://www19.wolframalpha.com/input/?i=what+is+rdf%3F

8.  Blowind in the wind

http://www96.wolframalpha.com/input/?i=How+many+roads+must+a+man+walk+down+before+you+can+call+him+a+man%3F


David Canós

martes, 10 de febrero de 2009

Google analiza Webs con Microformatos









Una vez leí una entrada de blog donde el autor se preguntaba: ¿qué está haciendo Google sobre la Web Semántica?.

El autor indicaba que Google no se estaba posicionando al respecto. No había un comunicado oficial diciendo cual era su postura frente al uso de esa tecnología, o si estaba desarrollando algo.

Pero en cambio resaltaba varias pistas que indicaban que algo si estaban haciendo: contratación de investigadores de la materia, participación en el W3C, y alguna más que no recuerdo.

Hoy he encontrado otra pista:

Lean "Contributors" en
http://microformats.org/wiki/product-brainstorming
-> Paul Lee, Google Product Search


La Web trata de la definición de un microformato para describir productos. Ahora mismo se utiliza el genérico hList (utilizado por kelkoo, flickr, yahoo local, yahoo tech, netinstruments.com por ejemplo)


Algunas ventajas de su uso:
- auto-discovery: las webs de comparación de productos lo tendrán más fácil para extraerlo. Cometerán menos el típico error de considerar como distintos, los mismos productos. Ejemplo: "MiMarca cascos ModelExclusivo", "MiMarca ModelExclusivo", "cascos ModelExclusivo".

Subcribirse a productos será muy sencillo para cualquiera.


- social-shooping: puntuar una lista de productos, o compartirla, o hacer con ella lo que quieras es muy sencillo.


Si te lo estás planteando, no dejes de mirar la opción de RDFa. Es muy fácil de usar y además es un estándar ;-).

miércoles, 26 de noviembre de 2008

10 Billones de Datos consumibles, reusables, para compartir





"Ya estan aquiiiiii", decía la niña de Poltergeist.

Ya están disponibles Datos de la Web de los Datos. La WEB 3.0.
Datos para coger y usar. Para ser buscados, encontrados, consumidos, intercambiados, enlazados...

SINDICE nos los pone en bandeja: libros, eventos, música, personas, lugares, ciencia, proyectos, .........


Utiliza su API en tu aplicación y abusa de los datos.


Otra lectura de la noticia:

- Dale significado a los datos de tu Web cuanto antes. La competencia lo hace y los buscadores los premian: "Yahoo! announced that the existing SearchMonkey apps for CitySearch and Zagat are now available by default to all users of Yahoo! Search."


Otro día os hablo de Search Monkey y otras facilidades para "dar Significado" a los datos de tu aplicación Web.

jueves, 13 de noviembre de 2008

Twine - Knowledge networking


Twine no es otro sistema de etiquetado social. Twine tiene como modelos de referencia la web semantica y la inteligencia colectiva. Los usuarios de Twine participan en redes sociales de interés en las cuales se intercambian informaciones de manera colaboorativa. Y detràs de todo, un motor semàntico basado en ontologias RDF que permite la generación automática de etiquetas, descripciones y sumarios para las páginas web marcadas según los intereses del usuario..
Merece echarle un vistazo

Declaración de parcialidad

Los autores de este blog nos declaramos potencialmente bastante parciales en nuestras valoraciones y juicos. Todos somos empleados de una compañia (isoco) que se posiciona en la Web 3.0 y eso con toda seguridad puede constituir sospechas razonables de parcialidad.