Inicio

martes, 23 de febrero de 2010

Me entiendes?

Los buscadores semánticos están consiguiendo entrar en el mercado. Ya hay mucha gente, potenciales pagadores, que entienden que las búsquedas en sus webs o intranets son un problema no resuelto y que necesitan ayuda.

La semántica es una de las mejores alternativas que manejan, ya que promete mejorar radicalmente el concepto de búsqueda y con ello resolver el problema. ¿Pero que es lo que hace exactamente un buscador semántico? Algunos proveedores prometen que la tecnología semántica 'entiende' lo que el usuario quiere y responde con datos concretos. Sinceramente, todavía no he visto en el MundoReal (tm) un programa que entienda lo que digo. Y no creo que sea del todo culpa mía.

Al final la semántica se suele reducir a la expansión de preguntas del usuario según algún modelo predefinido. Si el usuario es médico y ha buscado el término 'sangre' el sistema puede salir a buscar documentos con esas seis letras 's-a-n-g-r-e' y además recuperar documentos con 'plasma', 'blood' o 'hemoglobina' por que algún modelo dice que están relacionados con alguna relación.

No deja de ser un pequeño milagro. Pero después de unos cuantos intentos el usuario final cae en la cuenta que su problema de encontrar las cosas no se ha solucionado. Es peor, se ha complicado un poco más. Ahora en vez de obtener mil documentos poco relevantes en menos de un segundo, obtiene cuatro mil en más tiempo.

A falta de tecnología que nos entienda (aunque ya queda menos según el sr. Kurzweil), no nos queda otra que mejorar radicalmente la experiencia del usuario con pequeñas herramientas y trucos para facilitarle al máximo su búsqueda.

Hemos preparado un decálogo de herramientas, algunas con tecnología semántica, que hacen que la experiencia de usuario en las búsquedas tradicionales mejore y se haga más llevadero el tiempo de espera hasta la singularidad tecnológica.


Otro día hablaremos de los asistentes virtuales, avatares, monigotes, ninos, etc.

sábado, 20 de febrero de 2010

Cierre de 2009: balance y promesas para 2010

Como es ya costumbre ReadWriteWeb recopila la lista de empresas, productos y tendencias que han marcado el año que acabamos de despedir.

Google se lleva de nuevo el premio para la mejor gran empresa de 2009. Después de haber coleccionado reconocimientos en 2004 y 2006, este año la compañía de Mountain View se ha destacado gracias a la introducción en el mercado de la plataforma Android, Google Apps, Google Chrome , Google Maps y Google Voice, demostrando un modelo de negocio flexible y proponiendose como nuevo competidor en aquellos mercados (como la telefonía móvil) donde todavía no había llegado.


Entre las pequeñas empresas la triunfadora ha sido Aardvark: un motor de búsqueda social que combina inteligencia artificial, procesamiento de lenguaje natural y colaboración social. Es posible preguntar cualquier cosa a Aardvark, que intentará buscar la persona adecuada para proporcionar una respuesta. A diferencia de Yahoo Answers esta aplicación no mantiene un repositorio de "preguntas-respuestas" sino intenta buscar un experto en la tu propria red social.

Para el 2010, siempre según ReadWriteWeb, no hay que perder de vista Wolfram|Alpha, buscador lanzado en Mayo del año pasado y que ha decepcionado mas de un experto. La gran expectación venía de la diferencia con Google: Wolfram|Alpha proporciona respuestas y no enlaces.
En los últimos meses se ha ampliado su base de conocimiento para encarar con nuevas fuerzas el año que viene.

En 2010 y los próximos años serán calve aquellas aplicaciones que permitan usar, acceder e integrar los datos fructos del trabajo colaborativo de los internautas en el marco de la filosofía de la Web 2.0. Wolfram|Alpha es una seria candidata a ser la aplicación del año para 2010.

lunes, 19 de octubre de 2009

Día de Innovación Abierta. Evento en Madrid

El 5 de Noviembre, de 10h a 12:30h, en el Círculo de Bellas Artes de Madrid (Sala Valle-Inclán) se celebrará la presentación/cocktail de Open Innovation


Para ello Sr. Luís Lovaco, Responsable de Gestión del Conocimiento Corporativo de Repsol y Sr. Richard Benjamins Director de Modelado de Usuario de Telefónica I+D compartirán sus experiencias con Open Innovation y como esta nueva forma de gestionar el conocimiento, les ayuda a alcanzar una ventaja competitiva sobre las otras compañías, optimizar los procesos de producción y de esta manera mejorar sus beneficios.


Para el acceso al evento es necesario confirmar la asistencia:

marketing [at] isoco.com (Referencia: Blog webtrespuntocero)

Reblog this post [with Zemanta]

lunes, 12 de octubre de 2009

Google y Yahoo acercan posiciones en el marcado RDFa



Haciendo unos deberes que tengo pendientes con un colega de iSOCO, y por pura curiosidad, busco como marcar contenidos de una Web con RDFa y que sean legibles tanto para Google como para Yahoo, los dueños y señores en las búsquedas, Bing mediante.




Google sorprendió con su torpeza presentando un vocabulario para marcar semánticamente contenidos. Su vocabulario no sigue los estándares RDF (enlaces CURIE que no llevan a ningún sitio), no ofrece jerarquía de clases, es escaso en expresividad y además, no reutiliza odontologías existentes como la de vcard y reinventan la rueda siguiendo el modelo hcard de microformatos (sic). Este párrafo es casi una traducción del enlace que incluyo, donde a todo esto lo llaman arrogancia o torpeza.

Pero Google es Dios, y santaspascuas. Y un sólo consejo proveniente de ellos, por muy descuidado que sea, hace que miles de euros en publicidad/posicionamiento Web vayan destinados a algo que evidentemente no se mantendrá en el futuro, pero que HOY es lo que vale.

Yahoo se lo curró, y se lo sigue currando. No les duele en prendas adoptar otros vocabularios que son tan buenos o mejores que el suyo y facilitan su utilización. Como en otras ocasiones, hablo de GoodRelations.


No hay un modo simple para tener una Web con RDFa legible para Yahoo y para Google. Pero hay esperanzas de que a medio plazo, sea así:

+ Google anunció su vocabulario como una beta, algo provisional.

+ La gente de GoodRelations hace esfuerzos continuos por demostrar a Google que se puede trabajar con otros vocabularios.
Y cito: " The current main purpose of this page is to allow Google staff to check that the proposed recipes for such data are compliant with all current Google content policies,"

+ Y lo mejor: Google utiliza vocabulario RDFa de Yahoo Searchmonkey para marcar videos !


Este último punto nos dice que van a aprovechar el buen trabajo de Yahoo. Esto abre una puerta a repetirlo con otros vocabularios.


Y acabo. A día de hoy puedes mostrar detalles de los productos, como precio, ofertas, imagen, ratings, imagen, localización, blablabla, pero debes escoger un bando: Google o Yahoo, o complicarte publicando con referencias a dos vocabularios a la vez (yo me niego).

Mi recomendación es usar GoodRelations, que de momento, resalta resultados en Yahoo, con la esperanza de que Google lo adapte pronto, y por la certeza de que aunque sigas las instrucciones de Google, salir resaltado es tarea complicada. Yo no lo he conseguido y hace un mes que espero.

Disclaimer: Soy colaborador de Un regalo musical, y lo he aprovechado para jugar con el RDFa de Google.

miércoles, 30 de septiembre de 2009

Trabajar, Comunicar, Colaborar en el mundo de Google


Los de Google no saben estar quietecitos y lanzan hoy Google Wave. La mala noticia es que no es para todos, por lo menos de momento. Así que los más curiosos deberán esperar algo más de tiempo antes de probar en primera persona cual es la interpreatación de "trabajo colaborativo" según el gigante de Mountain View.

Google Wave es una plataforma para la creación y edición colaborativa de documentos, pero puede ser utilizado como una Wiki o un sitio en el cual organizar una quedada para tomar unas cañas. Es el sistema que (dicen) remplazará email y mensajería instantanea en las empresas (y ya son palabras mayores...).

Hoy unos cien mil afortunados han recibido una invitación para empezar a jugar con Google Wave y... no pueden invitar a sus amigos, tal y como pasó con Gmail (!) Lo que sí pueden hacer es nominar a 8 amigos que irán a la cola de los nuevos potenciales usuarios... Todos los demás deberán aceptar que hay más vida fuera de Google.

Se hace cada vez más dura la lucha entre el modelo de negocio de "software de pago en mi maquina" (la de Microsoft para entendernos) y la de "software gratuito en el servidor de otros" (la filosofía googliana).

Nosotros esperamos nuestra invitación.. y os contaremos
Reblog this post [with Zemanta]

lunes, 7 de septiembre de 2009

¿Pueden las máquinas analizar los sentimientos en la Web?

¿Puede un programa saber si lo que se dice en Internet acerca de algo tiene connotaciones positivas o negativas? ¿Pueden las máquinas saber de qué manera percibimos las cosas? Así lo creen algunos proyectos aparecidos recientemente en ReadWriteWeb, que se apuntan a la tendencia del sentiment analysis, con el cual se quiere averiguar la actitud que un escrito tiene hacia determinado tema.

evriPor un lado está Evri, que ofrece una API entre la que se encuentran métodos muy detallados para analizar los sentimientos que se tiene acerca de personajes, entidades, etc., con un nivel de detalle que incluye quién opina de tal manera o qué tipo de críticas se hacen. Usar esta API puede ser muy interesante para realizar "reputation tracking" y pulsar la imagen que se tiene acerca de una persona importante, o de una empresa o marca.

context senseEl enfoque de ContextSense, la nueva "tecnología de extracción de sentimientos" de la compañía Wingify, es ligeramente distinto: Permite analizar los sentimientos globales que en un determinado texto o página se producen, cuantificando numéricamente si son positivos o negativos. Entre sus utilidades, la de permitir a anunciantes rechazar aparecer asociados a artículos en los que desprendan "malas vibraciones".

Si bien las limitaciones de estas soluciones son todavía importantes, muestran una interesante dirección en esta área, y habrá que seguir con detalle los avances que se produzcan al respecto.

Real-time sentiment analysis?

Aplicando el potencial de este tipo de análisis a una herramienta como twitter, podemos conseguir una combinación explosiva, averiguando en tiempo real la percepción que se tiene acerca de lo que queramos. De hecho, esto es lo que han pensado varios proyectos que, aplicando diferentes técnicas, permiten seleccionar un término y comprobar en tiempo real si se habla bien acerca de ese tema o no. Ejemplos son Twendz, Twitratr y Tweetfeel:





Analizando, por ejemplo, lo que se dice de la peli recién estrenada, podemos hacernos una idea inmediata de si a la gente le ha gustado. El ejemplo no es casual: Alguna película como Brüno ya ha sufrido el "efecto twitter", viendo cómo el día después del estreno la afluencia de público caía en picado (hecho al que contribuyó, dicen, la velocidad a la que circularon los comentarios negativos acerca de ella en twitter), mientras que otras como Inglourious Basterds o District 9 han visto la afluencia incrementada tras los comentarios positivos en el día del estreno.

Estaría bien relacionar el estudio de la percepción de los usuarios sobre la película con los datos de taquilla. Quizás así se pueda ir ajustando el análisis de sentimiento, haciendo que las máquinas nos comprendan cada día un poco mejor. :-)

miércoles, 22 de julio de 2009

1.0, 2.0 y 3.0 en 4 minutos

Aquí va un video de la holandesa EPN donde en 4 minutos se muestra la evolución desde la Web "prehistorica" a la Web del futuro.
Enjoy.




y si os ha gustado.. este otro de STI es incluso mejor :) lo encontrais aqui

martes, 14 de julio de 2009

TELCOS: De canutos tontos a canutos listos


La madurez de internet como mercado y la aparición de soluciones de comuniaciones integtradas (Unified Communication) presenta un peligro para las operadoras de telecomunicaciones relegandolas a 'meras' proveedoras de conectividad. Este síndrome, también llamado dumb pipe, las lleva a la necesidad de generación de nuevos productos y servicios de valor añadido y extremadamente personalizados fomentando un cambio de organización de las operadoras hacia modelos más flexibles e innovadores. Según un estudio de IBM sobre las intenciones de los CEOs de las operadoras, la innovación que buscan en estos momentos debe ser casi disruptiva para tomar posiciones avanzadas en este mercado. De acuerdo con el trabajo, este proceso radical de innovación deberá incluir no solamente estructuras tradicionales de I+D+i corporativas, si no que deberá implicar a las compañías en todo su entorno, incluyendo empleados, socios, proveedores y sobre todo a los clientes.

Una de las tendencias de más éxito es la implantación del paradigma de innovación abierta (Open Innovation) que permite establecer modelos de colaboración en todo el ecosistema corporativo. Una de las virtudes de este paradigma es la inclusión de todos los actores relevantes en la creación u optimización de nuevos productos o servicios. Los futuros usuarios tienen voz y voto durante todo el proceso y pueden influir en cualquier fase de la creación.

Las implementaciones de soluciones de colaboración como Open Innovation acarrean necesidades de tecnologías que manejen de manera intensiva información y conocimiento para mecanizar en la manera todo el proceso de innovación. Es necesaria una tecnología que catalice de manera adecuada las contribuciones de cada miembro del ecosistema.

La manera más natural de innovación es la recombinación de elementos para formar soluciones novedosas. Algunas iniciativas de soluciones de comunicaciones unificadas apuntan en esta dirección. Poder combinar servicios de voz, con correo electrónico, agenda o localización abre un amplio espectro de nuevas aplicaciones a corto y medio plazo. Plataformas como Google Voice o Ribbit permiten que expertos tecnólogos creen aplicaciones avanzadas en tiempos reducidos.

En este caso también es necesario disponer de tecnologías que permitan una integración de aplicaciones poco costosa y rápida. La creación de mashups dentro de una corta ventana de oportunidad descarta las tecnologías tradicionales de integración empresarial. La reciente liberación de ezWeb apunta en esta dirección.

El extremo que podría unir las dos tendencias anteriores es la delegación total al usuario final la creación de aplicaciones a su medida con los recursos disponibles. A modo de bricolaje inteligente el usuario podría configurarse su propia solución de comunicación unificada en poco tiempo y sin coste adicional.

En este caso el reto tecnológico está en una más que satisfactoria experiencia de usuario mediante interfaces inteligente que permitan que usuarios no expertos desarrollen aplicaciones a medida (tipo Yahoo Pipes o SOA4ALL cuando vea la luz).

Es cuestión de tiempo que las comunicaciónes suban a las nubes y los teléfonos se pasen a los museos.

vía La Cofa

viernes, 29 de mayo de 2009

Microsoft dice "Bing"

Hablamos hace unas semanas de Kumo, el nuevo buscador semántico de Microsoft. Al parecer el nombre no ha acabado de convencer y la aplicación se presentará el 3 de Junio como "Bing" (en Europa con funcionalidades limitadas).

Microsoft ha publicado horas los detalles y algunas fotos del motor, y un vídeo explicativo. El motor se basa en un nuevo principio: ofrecer información de utilidad inmediata para las necesidades prácticas: según los términos introducidos por el usuario Bing "entiende" el contexto de búsqueda y proporciona información relacionada. Por ejemplo? Introducimos el nombre de una localidad turística Bing nos pide si queremos ver fotos u obtener información sobre hoteles. Además, en contraste con la gráfica escueta de Google, Bing tiene varias secciones (Salud, Turismo, Deporte..) en las cuales el usuario puede navegar a la búsqueda de la información que necesita.
La batalla de los buscadores se mueve hacía las búsquedas inteligentes. No nos queda que esperar al día del lanzamiento y ver como reaccionan los internáutas más expertos y el gran público.
Reblog this post [with Zemanta]

viernes, 22 de mayo de 2009

Destripando Wolfram Alpha

Hace unos días se presentó Wolfram Alpha. Para el que todavía no lo sepa se trata de un "computational knowledge engine" que en castellano viene a ser "motor de computación de conocimiento". Esto quiere decir que es un buscador de información, una máquina que opera con muchísima información para poder ofrecer respuestas. Informan con cierto secretismo que utilizan "un nuevo tipo de computación basada en el conocimiento". El proyecto es muy ambicioso y tienen la bondadosa intención de...

"Our goal is to build on the achievements of science and other systematizations of knowledge to provide a single source that can be relied on by everyone for definitive answers to factual queries."

conseguir ser la gran fuente de información que sea capaz de mostrar los logros de la ciencia en base a las  preguntas de los usuarios.  "Recabar toda la información objetiva, método o algoritmo y hacerla computable".

Internamente está basado en Mathematica, software longevo (más de 20 años) de desarrollo matemático bastante conocido en el ámbito académico y cuando se realizó la release el servidor de clustering contaba con más de 10.000cores. Toda una start-up.

Desde el punto de vista de la web semántica suena muy interesante y hasta cierto punto llama la atención que en este mundillo no se haya comentado nada hasta hace unos días. Las reacciones no se han dejado esperar, hay quien ve una lucha entre el "mundo abierto" que promulga la Web Semántica y este tipo de soluciones basadas en modelos cerrados y alejados de los estándares, ontologías, descripciones de vocabularios. 

Tras someterle a una batería de pruebas [1], llegamos a varias conclusiones interesantes.
  • Wolfram Alpha responde preguntas con respuestas únicas y concretas. Primer distanciamiento con Google.
  • La respuesta contiene información en sí misma (respuestas concretas, gráficas, etc...) y no páginas con información relativa. Por lo tanto, Wolfram Alpha no es un buscador tradicional, del estilo Google o yahoo!. 
  • Entiende lenguaje natural. Este aspecto resulta muy llamativo, pero no han sido los primeros en llevar a cabo una idea así, de hecho recuerdo que iSOCO llevo a cabo una herramienta que entendía el languaje natural hace algunos años.  Aquí cabe una matización: qué entienda lenguaje natural no significa que sólo entienda lenguaje natural. Esta reflexión es muy importante desde el punto de vista de que no han cometido el error de exigir un cambio en el paradigma de búsqueda por todos estandarizado. Se ve claro con el ejemplo 1 y 2 de la batería de pruebas. 
  • La información viene supervisada por un "comité de sabios", esto nos valdría para decir que no es una aplicación 2.0.  En Wolfram Alpha la colaboración del usuario se límita a un feedback a modo de comentario sobre el resultado de la entrada. Han vendido esta obligada supervisión como una clave de su excelencia, exactamente la misma excelencia que busca la wikipedia con la solución contraria. ¡Qué curioso!
  • Ofrecen un API bastante interesante aunque todavía bastante primigenio. El API es unidireccional, sólo se envían datos. Ofrece dos grandes líneas de trabajo: la función Query que responde tus preguntas y la funciónValidateQuery que estudia la validez de tus preguntas. Afortunadamente comentan que pronto ofrecerán un API más potente, más de "bajo nivel". 
  • Está sólo en inglés. La salida ha sido en inglés y no he leído nada al respecto de internacionarlo, supongo que es demasiado pronto todavía, aunque tras ver la respuesta que da a la pregunta número 8 ya no me extraña nada en este mundo. No me quiero ni imaginar cómo van a hacer para internacionalizar el sistema de reconocimiento del lenguaje natural. Todo un reto increíble. 
  • No es semántico. Aunque muchas páginas digan que sí lo es. Basta el ejemplo 7 para demostrar esta afirmación. La web semántica se basa en que la información esté descentralizada y compartida en la nube, al alcance de todos. Wolfram alpha es simplemente lo contrario, la información tiene un ámbito cerrado.
    Si alguno tiene dudas, utilizando psicología inversa, podríamos afirmar que si fueran semántico, hubieran  habilitado en su api o en su versión de pago algún formato de intercambio semántico.  Se han limitado a PDF, hojas de cálculo, XML, 3D modeling, TeX... Está claro que intercambiar información en XML es una aproximación que posibilita acceder a esa información de manera semántica de forma quasi-inmediata, pero aun así, la respuesta es: Wolfram Alpha no es semántico. Toda una lástima, por cierto.
    Espero que la gente de LOD (Linking Open Data) se pongan manos a la obras a crear sinergias con el señor Wolfram.
    Voy a ver si hablo con un antiguo profesor, podría plantearse un buen proyecto final de carrera en esta dirección... ¿algún voluntario?
  • Ámbito académico y educacional. Exactamente lo que no tiene la Wikipedia. La rigurosidad de su política de actualización de información y la calidad de las respuestas dentro del ámbito científico hacen de él un producto excepcional, sin embargo, me gustaría saber qué frecuencia de actualización van a llevar, ahí va a ser difícil competir con la wikipedia. 
    Espero que los responsables en educación y la comunidad cientifica tomen definitivamente nota.


¿Cuándo veremos páginas que utilicen este conjunto de datos de manera útil para el usuario final?


[1] Batería 

1. Big City

http://www19.wolframalpha.com/input/?i=big+city

2. What is the biggest city?

http://www04.wolframalpha.com/input/?i=What+is+the+biggest+city%3F

3. A room of one's own (libro de Virginia Woolf)

http://www01.wolframalpha.com/input/?i=A+room+of+one's+own

4. Cuando libros ha escrito Michael Crichton?

http://www04.wolframalpha.com/input/?i=How+many+books+did+Michael+Crichton+write%3F

5. Michael Crichton

http://www04.wolframalpha.com/input/?i=Michael+Crichton

6. What is Nato?

http://www04.wolframalpha.com/input/?i=What+is+NATO%3F

7. What is RDF?

http://www19.wolframalpha.com/input/?i=what+is+rdf%3F

8.  Blowind in the wind

http://www96.wolframalpha.com/input/?i=How+many+roads+must+a+man+walk+down+before+you+can+call+him+a+man%3F


David Canós

martes, 12 de mayo de 2009

Wolfram Alpha

Cuando un equipo quiere ganar en campeonato de fórmula uno pero otros tienen coches más fiables y más experiencia que tú, te queda la opción de hacer mucho ruido para que otros cometan un error o al menos se pongan nerviosos. Puedes anunciar que tu coche tiene algo muy innovador que te hará correr el doble que otros. En el mercado IT, especialmente en el de los buscadores pasa un poco parecido. Es un mercado está madurando en los últimos años, fruto de compras por parte de Autonomy, Microsoft o Google, ya se están dibujando algunos ganadores. Aunque existe todavía una pequeña ventana de tiempo que permitirá estar entre los mejores, pero es a cambio de aportar algo muy innovador y convincente. Y eso muchos lo intentan, pero solo pocos lo van a conseguir.

Después del intento del buscador de Wikipedia y PowerSet, ahora es el turno de Wolfram Alpha que se ha dedicado a mover ficha en dos direcciones. Primero en mejorar la experiencia de usuario entendiendo preguntas en lenguaje natural y segundo asegurando la calidad del contenido donde todo está verificado por expertos. Dos ejes donde los grandes, como Google, tienen sus flaquezas.
En cuanto al primer punto, Wolfram no son ni los primeros ni los últimos en anunciar un sistema que entiende el lenguaje natural. El problema que todos han visto es sobre tipo de lenguaje entiende una maquina. Es muy difícil decir: "si hablas de esta forma, la maquina te entenderá", y eso nos lleva al método de prueba y error y finalmente a la frustración. Tal vez en el futuro exista una Real Academia de la Lengua de las Máquinas, que nos digan cómo hablar con las tostadoras.

En segundo eje es un propósito noble: asegurar la calidad de la información, a modo de enciclopedia. En plena era Web 2.0 y estándares semánticos no parece un método escalable, pero seguro que la calidad es del más alto nivel.

Estos dos puntos están muy ligados, de manera cuanto más amplio es el contenido posible, ya sea científico o la wikipedia al completo, más difícil se le hace entender para un ordenador. La tendencia actual de algunas empresas innovadoras en el campo de gestión inteligente de contenidos apunta hacia la creación de agentes especializados que entiendan nuestros deseos en campos muy concretos y nos representen en la nueva Web, la Web 3.0.

Declaración de parcialidad

Los autores de este blog nos declaramos potencialmente bastante parciales en nuestras valoraciones y juicos. Todos somos empleados de una compañia (isoco) que se posiciona en la Web 3.0 y eso con toda seguridad puede constituir sospechas razonables de parcialidad.