Showing posts with label Google. Show all posts
Showing posts with label Google. Show all posts

Monday, January 03, 2022

Privacidad y grandes datos


Mi cuenta de Google Mail me manda, cada mes, un reporte de dónde he estado en los últimos 30 días. Para ello usa los datos geográficos de mi teléfono, pues en muchos casos, para usar los servicios de Google en el celular, tenemos que dar de alta nuestro número telefónico móvil. En alguna medida asusta saber la cantidad de información que tiene Google sobre cada uno de nosotros. Pero no son los únicos. Facebook y Amazon tienen algún pacto de compartirse información de sus clientes y para probarlo, entren a Amazon y busquen algún libro en particular. Cuando terminen dicha búsqueda, entren a Facebook y "sorprendentemente" veremos anuncios de los libros que hemos buscado. No, no es coincidencia. Claramente estas empresas se comparten datos.

Pero quizás no deberíamos sorprendernos demasiado. Por ejemplo desde que nació GMail, se anunció que Google "leería" los correos con un robot, buscando en realidad palabras claves para eventualmente, ponerle anuncios al usuario sobre temas que le interesan. Vamos, no es que Google lea nuestros correos, sino que los escanea buscando temas que puedan ser de interés comercial. Así, si yo tengo comunicación vía GMail con otros jugadores de ajedrez, es probable que de pronto Google me muestre anuncios asociados al tema del ajedrez (compra de ajedreces, libros del tema, etc.).

Y la pregunta que surge es ¿qué tan peligroso es esto para nuestra privacidad? La verdad es que no tenemos de qué preocuparnos porque en términos generales, lo que buscan estas enpresas que acumulan y adquieren datos de sus clientes, es en términos estadísticos sus intereses para venderles cosas. Vamos, a Google no le interesa quién eres en lo personal. No le interesa tu nombre. Lo que quiere es simplemente ubicarte a través de sus servicios para eventualmente buscar venderte bienes y servicios. Por ello, la seguridad y privacidad personal no es en realidad un tema aunque no falte quien diga que hay empresas que de esta manera espían a sus usuarios y esta información bien podría pasar a los departamentos de inteligencia de los diferentes gobiernos. Dicho de otra manera, si alguien en las redes sociales protesta contínuamente contra su gobierno, bien podría -esta información- ser usada en contra de los usuarios por sus manifestaciones políticas. Pero este escenario es probable que ocurra, si ocurre, en regímenes totalitarios.

El "big data" no tiene como función el andar vigilando a los usuarios particulares. Lo que les interesa es la cuestión estadística. Ahora bien, hay muchas maneras de evitar que Google sepa más de cada uno de nosotros. Vayan a sus cuentas de Google y entren a la parte de configuraciín y privacidad y modifiquen los parámetros para evitar que la empresa siga recolectando sus datos. Esto puede hacerse aquí.

Monday, August 27, 2018

Gigachess: bases de datos y búsquedas regulares



El software que he escrito para parte del desarrollo de mi tesis de doctorado no es lo rápido que quisiera y en ocasiones me he puesto a pensar si es el  enfoque correcto. La idea va así: de mi base de partidas de ajedrez, estoy tomando 1 millón de ellas y las estoy procesando de forma que cada una contenga dos campos: el encabezado de la partida: quién contra quién jugó y en qué torneo (incluyendo fecha). Los demás datos como rating no me interesan realmente. El segundo campo contiene una imagen de cada posición que se dio en cada partida. La posición la represento como una línea de caracteres Forsyth, que es un formato en modo texto para representar posiciones de ajedrez. Por ejemplo, la posición:



se representa como: "4t1r1/p1p2pp1/1d1p3p/1P3P2/1P6 /2c1D3/PA4PP/4T1R1/". La posición en modo texto se representa leyendo el tablero de izquierda a derecha y de arriba a abajo. Las piezas blancas se representan con sus iniciales en mayúsculas y las negras con minúsculas. Así, "4t1r1" significa que en la octava fila (la primera del negro), hay 4 casillas vacías, una torre negra, otra casilla vacía, un rey negro y una casilla vacía más. Las diagonales "/" simplemente sirven para denotar que pasamos a la siguiente fila, pero pueden omitirse. Si se omiten tengo exactamente 64 letras o números máximo. Obviamente puedo poner "4t1r1" como "1111t1r1", pero poniendo la cifra de casillas vacías me ahorro espacios.

Imaginemos que tenemos ya una base de datos armada así y que quiero buscar si en alguna posición se tuvo un caballo  blanco en f6 y un rey negro en g8. Mi busqueda buscaría esta posición: "6r1/8/5C2/8/8/8/8/8". Evidentemente ignoro (o debería ignorar) si hay otras piezas en donde yo estoy diciendo que hay casillas vacías. Debo -pienso- definir si es vacía o no con alg{un símbolo en la búsqueda. Se me ocurre entonces que si busco que exista un caballo blanco en f6 y cualquier pieza en g8, debería poder buscar algo así: "6?1/*/5C??/...", donde el símbolo "?" es un comodín que sustituye al símbolo "?" por cualquier pieza o casilla vacía en el tablero. Esto, de hecho, no es un invento mío, sino que se ha definido hace muchos años en cómputo. Hablamos de las búsquedas regulares, las cuales buscan "patrones" en cadenas de caracteres. Es un sistema que es muy versátil y pienso que podría ser muy útil en lo que estoy trabajando.

Mi problema básicamente es que si proceso un millón de partidas tendré aproximadamente 80 millones de posiciones. ¿Cómo puedo buscar sobre una base de datos con expresiones regulares que sea muy rápido? La idea de generar todas las posiciones que es las búsquedas sean muy rápidas. Por ejemplo, Chessbase permite buscar posiciones, pero el sistema lee cada partida y hace la búsqueda sobre la base de datos de referencia que se le dé y esto puede llevarle minutos. No es mucho, lo sé, pero pienso que mi enfoque podría hacer que con búsquedas de expresiones regulares, en mucho menos tiempo que Chessbase, debería saber en qué partida ocurrió una posición determinada.

Hay que decir que tampoco etoy pidiendo algo imposible, porque por ejemplo, si se le piude a Google que busque "regular search", entrega el siguiente resultado:

Cerca de 1,260,000,000 resultados (0.45 segundos) 

Es decir, en su gigantesca base de datos halla 1,260 millones de resultados en menos de medio segundo. Sí, sé que Google usa cómputo distribuido y que tiene montones de algoritmos refinados para sus complejas bases de datos, por lo que me queda claro que lo que quiero hacer tampoco pretende ser algo del otro mundo.

Hay un sistema RegEx, que permite hacer más fácil el asunto de definir las búsquedas de expresiones regulares y hay muchas aplicaciones que permiten crear estas búsquedas casi visualmente.


Entiendo que Oracle permite hacer búsquedas de expresiones regulares en sus bases de datos, pero no tengo más información y no tengo idea de cómo hacerlo en esa plataforma de base de datos. ¿Alguna idea de mis cuatro lectores?

Thursday, December 07, 2017

AlphaZero es el nuevo súper gran maestro, ¿es eso muy grave?



Hace un par de días se dio la noticia de que AlphaZero y su algoritmo de aprendizaje reforzado, había sido aplicado al juego del ajedrez y en sólo cuatro horas, el sistema había aprendido a a jugar un ajedrez de súper gran maestro a partir del único conocimiento de cómo se movían las piezas. Los investigadores de DeepMind, que es una empresa de Google, pusieron a jugar a su invento contra uno de los mejores programas de ajedrez, StockFish, el cual es además de código abierto. Jugaron 100 partidas y AlphaZero venció 28-0 con 72 empates. Es decir, la máquina de Google no perdió una sola partida. Verdaderamente asombroso.

Y esto, por supuesto, como seres humanos, nos hace pensar si este nuevo algoritmo de redes neuronales es capaz de sintetizar en 4 horas 500 años de lo que sabemos de ajedrez y sin siquiera alimentárselo.  Si pensamos en los esfuerzos que se han hecho desde los años sesentas del siglo pasado en el campo de ajedrez por computadora, podemos observar un desarrollo sistemático y muy lento para llegar a tener motores de ajedrez como Komodo, Houdini o StockFish. Y lo que hizo AlphaZero parece ser el parte aguas el cual puede modificar de por vida la manera en como vemos el ajedrez.

Pero yo creo que el avance científico no tiene siquiera que estar peleado con el propio ajedrez. Ahora dispondremos de una herramienta mucho más poderosa que la anterior. Cabe por ejemplo señalar, que ya los programas como Houdini o Komodo, le ganan al 99.95% de los jugadores en todo el mundo y que desde el año 2000 aproximadamente, debido a los avances de cómputo, ya ni siquiera se hacen esos espectaculares encuentro de grandes maestros contra las computadoras. La razón es simple: ya nos ganó la técnica. Ya no podemos competir a la frialdad de los cálculos y valoraciones de árboles de variantes gigantescos. Vamos, el juego no estará resuelto oficialmente, pero ya lo está en la práctica.

Y entonces, AlphaZero es como una motocicleta en una carrera de 100 metros planos de seres humanos. Simplemente no podemos competir contra ella y listo. Pero eso no acabó con las carreras de los seres humanos y la razón es simple: sí, tenemos artefactos y dispositivos que juegan muy bien y mucho mejor que nosotros, los seres humanos, pero que en el fondo tienen otra naturaleza diferente al de la raza humana. Yo simplemente no me preocuparía tanto.

Creo que el alcance de AlphaZero será importante y modificará algunos aspectos de cómo vemos el ajedrez pero de ahí a decir que ya hay que guardar nuestras piezas y peones para siempre, me parece que no debe ser así. AlphaZero habla finalmente de algo importante: sabemos muy poco de ajedrez y ahora tenemos una herramienta formidable. Usémosla. Aprendamos de ella y sigamos dando jaques.
¿Por qué no?

¿El fin del ajedrez?




En 1997 Garry Kasparov perdía un match a seis partidas contra una máquina preparada sólo para jugar al ajedrez. IBM había puesto mucho dinero y su plan era demostrar que una máquina ya tenía la suficiente capacidad para derrotar al mejor jugador del mundo en este difícil arte del ajedrez. Pero 20 años después nos enteramos que DeepMind había puesto un programa llamado AlphaGo, a jugar contra el mejor jugador del juego chino Go, y que le había derrotado sin duda ninguna. Hoy DeepMind nos da la noticia que su programa, aplicado al ajedrez, logró en sólo cuatro horas de auto entrenamiento, el nivel de súper gran maestro y para ello ha usado su técnica de redes neuronales de aprendizaje reforzado. AlphaGo ha logrado entender más de 500 años de experiencia en ajedrez en tan sólo unas horas. Algo inconcebible e impresionante.

El algoritmo desarrollado por Google y DeepMind, sintetiza todo el conocimiento del ajedrez y para demostrar este nivel, los investigadores decidieron poner como rival a StockFish, el mejor programa de ajedrez de código abierto, que está entre los tres mejores programas (incluyendo los comerciales), del mundo.

AlphaGo venció a Stockfish en un encuentro a 100 partidas, por 28-0 y 72 empates. Es decir, el poderoso StockFish no pudo ganar una sola partida. Esto solamente habla de la capacidad del algoritmo de DeepMind, el cual ni siquiera necesita bases de partidas, tablas de finales o podas alpha-beta para correr.



El artículo “Mastering Chess and Shogi by Self-Play with a General Reinforcement Learning Algorithm” describe el trabajo realizado y sin duda es un parteaguas en el mundo del ajedrez por computadora. El enfoque es tan diferente a todo lo anterior hecho en esta disciplina que habrá que estudiar cómo es que este algoritmo de Google y DeepMind se está volviendo una de las maneras más eficientes para atacar problemas que no tienen solución definitiva y que se han atacado antes a través de heurísticas

Tuesday, April 23, 2013

Hoy es mi cumpleaños

y además de los amigos que me han felicitado (incluso aquellos que hace tanto que no veo), de la alegría de saber que a uno lo quieren, de todas estas cosas buenas que pasan, me encuentrto en Google esta imagen (la que ilustra esta nota). Puse el cursor del ratón sobre la imagen y apareció la leyenda: "¡Feliz cumpleaños, Manuel!" Al darle click al logo de Google hecho con pasteles, me encuentro que me remite a mi perfil en Google+. Me pareció un gran detalle. Quiero creer que como estoy en Google+ y saben mi fecha de ciumpleaños, redireccionan a una página con este doodle.

Sunday, February 12, 2012

Un bonito regalo


Ayer me regalaron un muñequito del robot Android, el cual es una figura decorativa con la imagen del robot/logotipo que da nombre al sistema operativo móvil de Google. Llevaba tiempo buscando esta figura y la había pedido a amigos que iban a Estados Unidos a las ferias de cómputo, pero con poco éxito. Finalmente un amigo me trajo el encargo hecho y además, me lo regaló. Maravilloso.

La empresa que los produce es Dyzplastic.com y hacen esta imagen en todos sabores y colores. Han encontrado un nicho de mercado y si usted es amante de la tecnología, o si le caen bien los de Google, tarde que temprano querrá hacerse de este muñequito para adornar el escritorio donde tiene la computadora.

La gente de Dyzplastic los hace en materiales diferentes, incluso algunos brillan en la noche. Los hay para pintarlos de acuerdo a sus gustos y hay incluso algunos con temas culturales. Por ejemplo, hay una serie de dragones chinos y otra con la figura de android como calaverita de Posadas.

Simpático asunto, pues. Ahora tendré que completar mi colección con alguna figura de los Angry Birds, otro tema popular en estos días.

Sunday, July 10, 2011

La táctica de Google


Cuando empezó GMail, el servicio de correo electrónico gratuito de Google, solamente se podía acceder a él previa invitación de alguien. A diferencia de otros servicios similares, aquí se necesitaba tener una invitación de alguien, que por alguna razón tenía estas cortesías virtuales, para poderse dar de alta y probar lo que en ese entonces era el novísimo servicio de Gmail. A mí me quedó claro que esta idea fue un buen inicio para el servicio que ofrece el gigante de las búsquedas.

Ahora, con Google+, una nueva red social que quiere quitarle empuje a Facebook, Google inició con la misma táctica: solamente se puede acceder a ella si se tiene una invitación de alguien para poder entrar. De esta manera no faltaron los desesperados que querían ya -antes que nadie- probar las mieles de lo que Google ofrecer en lo que viene a ser la competencia más interesante de Facebook en los últimos años. Por lo que a mí respecta, me parece evidente que en poco tiempo, relativamente, Google+ empezará a hacer más ruido y probablemente Facebook empiece a perder adeptos, aunque evidentemente, con 500 millones de usuarios, es difícil que desaparezca (*).

Una ventaja de Google+ sobre Facebook es sin duda la posibilidad de incorporar y ligar el nuevo servicio con los anteriores servicios que Google ofrece. Así, podrá ligarse fácilmente a Google+ el GMail, o Google Documents, o desde luego, el sistema de búsquedas que le ha dado tanto dinero y popularidad a esta empresa.

Facebook, por su parte, tiene que trabajar todo desde su única plataforma. Así entonces, su sistema de mensajes lo adecua para que funcione de alguna manera como correo electrónico. Otros servicios los tiene que implantar (no uso implementar, porque no existe como verbo), desde su plataforma de aplicaciones externas. Quizás ahí esté el problema de Facebook que a la larga podría destronarlo del éxito actual y del ser el número uno en redes sociales: es una sola plataforma para todo, mientras que Google tiene muchos frentes. Por una parte, Google puede ligar sus N servicios a través de mecanismos que -desde luego- tendrán que programar, pero que en cualquiera de los casos, ya funcionan adecuadamente aparte. Facebook tiene el problema de generar todas esas aplicaciones que Google ya tiene, pero habrá que ver además si las puede integrar como planea Google. Creo que la mesa está servida y Mark Zuckenberg podría estar ya preocupado por el futuro de su popular red social que, claramente, no disminuirá abruptamente, pero quizás en unos tres o cuatro años, quizás menos, ya no hablemos de Facebook como la red social dominante y ahora todo se enfoque a Google+. Habrá que ver si mi predicción es correcta.

Por lo demás, ya veo más mensajes en mi buzón de Gmail en donde se me dice quiénes ya me tienen en sus círculos de amigos. El esquema de Google va echándose a andar y evidentemente le están metiendo todos los recursos necesarios porque saben que Facebook es un gran  negocio y el gigante de las búsquedas no se quiere quedar sin su parte del pastel
____

(*) Orkut, el primer esfuerzo de red social de Google, que nació en el 2004, tiene unos diez millones de usuarios, y aunque hace poco ruido, parece que es muy popular en Brasil y en la India.