Mostrando entradas con la etiqueta Big data casero. Mostrar todas las entradas
Mostrando entradas con la etiqueta Big data casero. Mostrar todas las entradas

viernes, 19 de febrero de 2016

124. Tercer intento antes del Supermartes. Carolina del Sur y Nevada.

25/02/2016. ¿Remonta Hillary Clinton?

Ja! Pues otra vez me colé. Los demócratas no votan en Carolina del sur hasta el 27!!
Lo bueno es que he repasado los resultados previos, y ya voy viendo qué funciona. Lo que vale no son las búsquedas de  hillary clinton vs. bernie sanders, ni hillary vs sanders, sino clinton vs sanders. Y la cosa está así:

Ahí lo veis, desde hace dos días remonta Clintos frente a Sanders y ya está en un 60%. Para la media semanal, aún no se nota demasiado, pero veremos cómo son de sensibles los norteamericanos a los cambios..
La cosa queda así (media última semana)



23/02/2016 


Vaya lío! Resulta que ni hoy es el Super Tuesday ni el pasado sábado tocaba elegir a los demócratas en South Carolina, sino en Nevada. y hoy toca GOP en Nevada. Encima no son primarias sino Caucus. Este sistema electoral norteamericano está resultando aún más complicado de lo que pensaba que era. 

En fin. A ver si para el día 30 que es el Super Tuesday puedo estudiar los datos de Google con algo más de tiempo y hacer previsiones de forma un poco menos atropellada.

1. Demócratas de South Carolina. 

De cualquier modo, para lo de hoy y como era de esperar, en estos tres días, las tendencias de búsquedas han variado poco. Aunque Clinton parece ganar terreno, la diferencia es tan grande que apenas se notará. 



Total, que el pronóstico es que Sanders arrasa 2 a 1. 

2. Republicanos en Nevada.

Caucus republicano en Nevada. No tengo nada claro que el sistema de caucus sea tan representativo como el de primarias abiertas (o incluso cerradas), de modo que no sé hasta que punto los resultados de búsquedas en Google (que sí son abiertas) pueda aplicarse en este caso. Ya veremos

Hay una ciudad en este estado que se llama Carson, así que he tenido que hacer las búsquedas con los nombres completos de los candidatos. Las búsquedas de john kasich son tan bajas que no aparece en el registro anual (por datos semanales).


Como en en el resto de estados, las búsquedas de Trump se salen, y sospecho que aquí también estén proporcionalmente por encima del porcentaje de votos que sacará. Si hiciera caso a los últimos datos semanales tal cual, Trump sacaría el 52 % los votos, Cruz un 25 %, Kasich un 0 %, Carson un 7 % y Rubuio el 15%. Pero para refinar un poco me voy a los datos horarios de búsquedas en la última semana. Con las siguientes salvedades:
1.- De todos salvo de Kasich tomo los datos de búsquedas de nombre y apellido.
2.- Considero que los votos van proporcionales a las búsquedas salvo para Trump, del que tomo como representativos los valores mínimos (de 7 horas) para contarrestar su excesiva popularidad.
Queda así:


Se ve claro que Trump parece perder fuelle en los últimos días. Puede que empiece a meter la pata de más. Por el contrario Rubio parece lanzarse a la carrera hacia la segunda posición. Calculo la media de los dos últimos días. Este es el resultado:

20/02/2016

Primarias abiertas en Carolina del Sur, quedan solo tres días para el Super Tuesday y me ha pillado el toro. 

El único cambio que hago respecto de los cálculos para New Hampshire es que a Sanders y Hillary les daré una previsión de voto proporcional a sus búsquedas. O sea, que haré lo mismo que con los candidatos GOP: Y empiezo por ellos. 
Estimación de voto a partir de búsquedas semanales. Kasich no aparece porque no llega a un mínimo de búsquedas suficiente según Google Trends. La última semana con datos es la del 7 al 13 de febrero y Cruz y Rubio se situan en torno al 20 %; Bush y Carson en torno al 7 % y Trump en el 45 %.
Estimación de voto a candidatos del GOP a partir de busquedas horarias desde el 8 de febrero hasta el 19 de febrero a las 8 de la tarde, hora portuguesa (la que me da google Trends por defecto). La media de los resultados es mi apuesta. 


Y para Hillary y Sanders, a partir de búsquedas horarias:


Y resultados previstos:
Hasta mañana.



sábado, 6 de febrero de 2016

120. Así va la negociación en Google: Cs, desaprecido; PP y PSOE, los amos del cotarro.

El 20D hundió las expectativas de la marca Cs en apenas 24 horas y no levanta cabeza. Ciudadanos no interesa y tampoco parece capaz de evitarlo. Me dicen que espere, que volverá, que la situación le favorece a la larga, y es posible, quién sabe, pero no lo veo. Yo creo que su promesa de convertirse en alternativa fracasó el 20D y por eso el desplome, porque carecen de otro mensaje que vender. 

Búsquedas relativas de los 5 partidos en Google. Inmediatamente a las elecciones (1) PP y PSOE recogieron la mitad de la pérdida de Cs. E inicio de la Legislatura sirvió a Pod para convertirse en protagonista a costa de PP y PSOE, pero poco a poco desapareció el efecto y  PP y el PSOE compiten ahora por hacerse los 20 puntos perdidos por el Cs. 

Así que a Cs lo que les queda es negociar lo mejor posible su situación actual de comparsa, pero solo son necesarios en el pacto Podemos-PSOE-Cs, y parece que Pablo Iglesias no aceptará ese pacto que le dejaría a un lado. 

Iglesias pretende una gran coalición de izquierdas que necesariamente tendría a Podemos como eje bisagra, pues el único partido que ya ha demostrado capacidad de entenderse con movimientos locales e independentistas. 

Por la otra banda, Rajoy sabe que está en manos del PSOE, y ni disimula su desprecio por Naranjito (1,2). 

Los votos. 

Tras el 20D, las búsquedas de Cs cayeron 20 puntos que se han venido disputando los distintos partidos. Si estuviéramos en TV, serían 20 puntos de share, y eso es un enorme espacio político de interés público. ¿Es traducible directamente en votos? El CIS ya ha dicho que no, pues lo matiene en un 13,3 % (solo 0,6 menos que los 13,9 del 20D). 
El CIS hizo su trabajo de campo para el Barómetro de enero la semana del 04 al 11 de enero,  justo cuando Cs pareció recuperar el interés público. 


Sin embargo, el CIS hizo su trabajo de campo del 4 al 11 de enero, justo cuando Cs parecía resucitar. Y si comparamos el Barómetro de enero con con el anterior Barómetro de noviembre de 2015, cuando le asignaba nada menos que el 19 % de intención de voto, tenemos que Cs ha caído 5,7 puntos. Así que no, pero sí, Cs está desaparecido.

Y estos son mis resultados:

Voto estimado para la semana del 1 al 5 de febrero: PP: 31,6; PSOE: 25,8; Cs: 6,7; IU: 3,1; Pod:19,9.

Esta negociación la está ganando el bipartidismo. 





lunes, 1 de febrero de 2016

119. Estimación de paro registrado enero de 2016. +113.915 parados.

Esperando los resultados de Iowa casi olvido la estimación de paro de enero de 2016. En una hora o así la dará el Gobierno. Veremos qué nos cuentan.

Google avanza un mal dato: +113.915 nuevos parados.



No salimos de los niveles de 2013. Este país sigue en coma.


lunes, 18 de enero de 2016

113. Un pequeño experimento. Perfume, paro y la escuela austriaca.

Últimamente no hay discurso institucional que se precie sin su contador de palabras.
La verdad es que lo que nos ofrecen no pasa de ser un relleno pop en el blanco del periódico, un medio para tapar el vacío, vamos. 

¿Pero qué hay detrás de esta numeración del texto? ¿Existe una economía de las palabras? ¿Hay un mensaje implícito en la mera repetición? ¿Hay una inteligencia numérica en el discurso, en la elección de una u otra palabra? ¿Y cómo funciona esta economía? ¿Las palabras representan de modo figurado (artificial, arbitrario) o bien se habla en correspondencia con la economía de los objetos que la lengua pretende representar?

Pongamos, por ejemplo, la sinonimia de colonia y perfume. Son lo mismo, o pueden serlo, pero sabemos que el perfume tiene un plus económico. Lo común es decir colonia. Un perfume es algo más exclusivo, caro, incluso snob. Sé que nunca escucharé colonia en vez de perfume de un modo arbitario en muchas tiendas. En la web del supermercado Eroski, sin embargo, evitan la palabra perfume, todos son colonias. Decir perfume en vez de colonia es una elección que aporta un plus de información y precio. Quería saber si manejamos esa información de un modo económico, numérico. Y sí. 

Búsquedas de perfume y colonia en Google de 2004 hasta principios de 2016. Los picos de búsquedas se repiten cada Navidad, con su máximo la semana de Reyes.
Desde 2004 las búsquedas de perfume y colonia se han ido igualando. Podría significar que las ventas de perfume se igualan con las de colonia, o que buscamos más perfume pues un buen precio supone ahí más ahorro. Lo malo es que no dispongo de esos datos de ventas.

Pero siempre hay remedio. Como entendemos que los perfumes son más caros, pensé que la relación perfume/colonia podría correlacionar con el crecimiento del PIB. Lo pensé pero no, en realidad lo hace con el paro.
Descontando 2007 R2 se eleva a 0,88

En resumen, sobre la tendencia general que tiende a igualar las búsquedas de perfume y colonia  y cuya razón económica no puedo evaluar, existe un uso relativo de colonia/perfume en las búsquedas de Navidad que viene limitado por el dinero disponible para consumo y, en último término, por el nivel de paro.

No usamos el lenguaje al azar, pero es que además, cuantificamos en el leguaje la realidad económica.

El discurso no es un constructo artificial, metafórico y ajeno a aquello que refiere. Lo reproduce, o busca reproducirlo y en el orden económico esto lo conseguimos mediante la elección de las palabras que usamos. Conocemos el valor de las cosas y le damos ese valor a las palabras que las representan mediante el delicado equilibrio con el que construimos nuestro discurso. Usamos colonia, una palabra polísémica, como forma común para referirnios a un aroma de uso personal y para la variedad barata. Pero para las variedades caras y más excepcionales de colonia empleamos la más exclusiva forma perfume. Como el perfume es más raro y valioso, lo usamos menos y con más cuidado; nos reservamos su uso. Así es como identificamos enseguida al snob y pretencioso, porque usa de forma común palabras que  por lo común usamos con cuidado. Y así es como logramos ajustar las búsquedas en internet de aquello que demandamos (perfume o colonia) a nuestras posibilidades de gasto, limitadas, en este caso, por el paro.


Posdata: 

Para rizar el rizo, quería comprobar si la relación entre el uso general de colonia y perfume en el leguaje común tiene relación directa con su precio relativo. Así debería ser. Para comprobar el uso general, hice una búsqueda en Ngram de Google de 1800 a 2008 (el último año que permite la aplicación).

Como sule ocurrir con los precios relativos, apesar de las crisis de precios (puede que se mezcle aquí también lo colonial), la relación es bastante estable a largo plazo y parece que se estabiliza en el siglo XX.


Desde 1970, colonia se usa en torno a 4-7 veces lo que perfume. Como no hay estándar, es muy difícil dar un precio medio o base, pero por lo que he visto un perfume corriente puede costar 60 euros (100 ml), y la misma cantidad de colonia debería estar entre los 8-15 euros. Creo que es más o menos donde están, pero en cualquier caso sí están ahí los perfumes genéricos de imitación (1, 2, 3).

Si alguien tiene ganas y puede aportar alguna seguridad respecto de estos precios, quedaré eternamente agradecido.


.....

Ah! y me queda lo de la Escuela Austriaca.

En realidad, este post se me ocurrió después de ver esta videocharla.

La escuela económica austriaca supone que la matemática es incapaz de modelizar el acto de elección y creatividad humana que fundamentan la acción económica y en consecuencia desdeña las aproximaciones matemáticas a la realidad porque éstas no alcanzan a reproducir la complejidad del mundo. En definitiva, supone que el mundo económico es indecible de modo matemático, aunque el discurso sí puede hacerlo. 

Bien, pensé, sea. Supongamos que la lógica del discurso es superior a la del número. Pero entonces, ¿Qué tiene la palabra que añade a la matemática, en qué es superior? Si la palabra incluye la indeterminación del acto económico, y si por eso, lo reproduce, ¿es superior el discurso al número en la incertidumbre que añade? ¿Cómo puede ser una comprensión difusa, borrosa o gruesa de un hecho más certera que una comprensión fina y clara que daría la lógica matemática?

Bien. Ya tengo la respuesta. La matemática no es inferior al discurso, al menos ya no. Como afirma en un momento el ponente en el video (y le discuten/reprochan) el problema de la matemática para von Mises y los defensores de la praexología es que un modelo continuo de la realidad económica no puede integrar la lógica económica discreta, sujeta a eventos disruptivos y cambios en las variables. Hasta hace muy poco, sólo el discurso lógico/literario (también discreto) podía construir un correlato del intercambio económico, aunque esto sólo fuera posible mediante la instrospección y, en cierto modo, la iluminación de personas de talento y educación como Menger y sucesores.

Lo que el big data del uso de colonia/perfume, y otros evidencian es que implícito y oculto tras el discurso literario hay un uso numérico del lenguaje que constituye un mercado de palabras que reproduce el mercado del mundo. Me pregunto si esa instrospección de los praexólogos no apelaba en realidad a la lógica clásica sino a esta otra realidad numérica del discurso, a la que accedían de un modo más o menos subconsicente.

Da igual, gracias a la inmensa capacidad de cálculo de los ordenadores, a internet y el intercambio de información, mucho mayor ya que el intercambio meramente económico, esa realidad numérica del discurso empieza a ser accesible a cualquiera. 

jueves, 10 de diciembre de 2015

91. Tracking del voto. Semana 3 al 9 de diciembre.

La campaña se va animando, y los que más, Podemos. De cualquier forma, nada que ver la repercusión del Debate a 9 con el Debate a 4. A nadie le importan los segundones ni los programas. Guste o no, España es una democracia presidencialista y el Parlamento una cámara para elegir al Presidente/Primer Ministro. 

La proyección de votos de las búsquedas en Google mantiene al PP entre el 26-27 %, sigue desinflando poco a poco a Cs hacia el 15 % y sube Podemos también hacia el 15 %, que parece ser el atractor de estabilidad a largo plazo de ambos partidos. PSOE e IU, como acostumbran, son los más estables. 





martes, 1 de diciembre de 2015

86. Paro de noviembre adelantado a partir de búsquedas en Google: +17.493

A estas alturas ya hay pocas dudas de lo poco que significa el número de parados registrados que facilita el INEM (1, 2, 3, 4, 5). 

Respecto a la relación significativa que liga las búsquedas de "paro" en Google y el paro real que sufre España, la he explicado aquí y aquí. Según esta relación, no adulterada por los cuestos que convierten subempleados en trabajadores y otros engaños estadísticos, el paro real en España es de 4.851.355 parados (con los estándares de 2009), unos 700.000 más de los que reconoce este Gobierno.

Bueno, y en este negro panorama, la previsión a partir de búsuqedas en Google de este noviembre no es de lo peor, aunque parece demostrar que el efecto contable de la precarización ya no da para más. Las milagrosas reducciones invernales del paro de 2013 y 2014 se han agotado. 


La mecánica piramidal que sustena el fraude empieza a resquebrajarse y disimular necesita una nueva minusvaloración del mercado de trabajo.   






  

lunes, 19 de octubre de 2015

79. La carrera electoral para las generales del 20-D. Desde enero de 2015 hasta hoy.

Desde hace unas semanas, cada nueva encuesta coloca o descoloca a este u otro partido en  la cerrada carrera hacia Moncloa provocando enormes soponcios informativos. Como en las más emocionantes carreras, parece que no hay favoritos y que todo dependerá del sprint final. ¿Es así?

Media de las encuestas publicadas en 2015

En el gráfico de arriba, de encuestas promedidadas que tomé de aquí, lo que se ve es:

1.- Tres partidos (PP, azul; PSOE, rojo; IU, verde) con pequeños cambios en estimación de voto, 

2.- Dos partidos (Podemos, morado; Ciudadanos, naranja) con variaciones grandes en estimación de voto a lo largo del año. 

3.- El bipartidismo PP-PSOE no solo resiste, sino que sube ligeramente. 

Vale. La cosa promete. Ahora veamos qué dicen las búsquedas en Google. 

Puede que a primera vista el gráfico de búsquedas no se parezca demasiado al de arriba. Pero sí. Comencé a utilizar Google para adelantar el resultado lectoral de las europeas de 2014 y a partir de entonces a analizar las previsiones electorales. Considerando los recursos dedicados, una o dos horas, como mucho una tarde por entrada, creo que la cosa no ha ido del todo mal. 

Desde el primer intento, he ido cambiando algunas cosas. Hoy voy a hacer las estimación con los siguientes supuestos:

1.- Para resultados de PP, PSOE e IU me guiaré por regresión entre el histórico de búsquedas y resultados electorales y estimaciones del CIS. Hay suficientes datos y los errores asociados son altos, pero aceptables.


La novedad viene ahora:

2.- Podemos y Cs recogerán todo el voto que PP, PSOE e IU no sean capaces de reclutar. PP y PSOE perdían intención de voto incluso cuando Podemos no existía ni Cs se veía como alternativa. Lo que han hecho estos dos partidos (primero Podemos) es capitalizar la abstención, a izquierda y derecha. 


Y para poder conjugar 1 y 2, necesito un tercer supuesto que es:

3.- Los cinco partidos obtendrán el 85 % del voto válido. Es una estimación creo que atinada y prudente. En las tres últimas generales los cuatro primeros partido de ámbito nacional sumaron el 85.01 % (2011), el 88,77 % (2008) y el 85,3 % (2004).

Bien. Pues aplicando 1, 2, 3, el resultado para 2015 es:



Por el momento voy a ahorrar las valoraciones y en su lugar haré un par de apaños. 

A.- Descontando Cañetes y otros efectos (electorales).

Llamo efecto Cañete a una subida de interés puntual por un determinando partido que no se traduce en aumento de votos, en definitiva, un pico informativo que no despierta adhesión. El efecto Cañete pude ser causado por unas declaraciones desafortunadas, un candidato especialmente jugoso para la prensa, un escándalo, unas elecciones, un cambio de gobierno, un congreso de partido ..lo que sea. El efecto Cañete viene a desmentir aquello de: que hablen de uno aunque sea bien. Pues no, un trending topic puntual no da votos. En lenguaje formal, el efecto Cañete vendrían a ser la cola de anómalos a la derecha de la distribución. 

Para eliminar los efectos Cañete recorto los picos de interés y reduzco las búsquedas a valores mínimos. Los retoques son en tres fechas: febrero para Podemos (el escándalo de la paralela de Monedero); abril-mayo para todos (elecciones); y un par de semanas en septiembre (elecciones catalanas) y octubre con las campañas en prensa sobre posibles vuelcos electorales entre PP y Ciudadanos. 

En linea fina las búsquedas reales y en gruesa las búsquedas 
Y este es el resultado:

Lo cierto es que no hay graves variaciones. Los escándalos y las elecciones generan picos de atención e interés y puede que hasta puntos de inflexión, pero no discontinuidades en las tendencias a largo. 

B.- Entre Podemos y Ciudadanos

Uno de los grandes asuntos de etas elecciones es el reparto entre Pod y Cs del voto huido del bipartidismo. En las soluciones anteriores consideré que cada búsqueda relativa de Podemos o Ciudadanos era un porcentaje similar de votos a unos y otros. pero lo cierto es que no es así. Hasta ahora, Cs ha tenido más votos por búsquedas relativas que Podemos, en concreto, entre un 1,3 y un 1,4 más. Como solución, le daré a Ciudadanos 1/3 más de votos por cada búsqueda relativa que Podemos. He aquí el resultado (con Cañetes y todo).


En fin, esto es lo que hay. 


viernes, 5 de junio de 2015

67. Solución al desajuste entre búsquedas de paro en Google y paro registrado: Un gran fraude.

Cada día hay más evidencias de que esta recuperación económica viene trampeada. La riqueza es menor, los déficit siguen disparados y los desequilibrios se agudizan. No pinta nada bien. Como siempre, el crecimiento de España sigue dependiendo del exterior, de un crecimiento importado. Pero es que además las cuentas del Estado son artificios contables. La Deuda Pública oficial es de 1 billón de euros, pero la real se situa entre 1,3 billones y 1,5 billones. El Gobierno juega con dados marcados No es extraño que la gente no se crea la recuperación de Rajoy.

El paro registrado INEM: ¿recuperación o fraude?

En España, el indicador económico fundamental es el del paro. Ahí lo ha apostado todo Rajoy. Y dice que está en racha, y que vamos fogueados. Después de tres años y medio las cifras oficiales situan el paro a niveles de octubre de 2011 y en verano serán mejores que las del último verano de ZP. O sea, que estamos recuperado lo perdido. Y Rajoy promete que a partir de ahora es cuando empezaremos a ganar de verdad. Pero lo cierto es que la burra no la vende. Aquí ya nadie se cree nada. Y la gente tiene razón. 

Mariano Rajoy se mostrará muy ufano de que tras cuatro años el número de parados sea cincuenta o cien mil menos que cuando lo dejó ZP, pero en realidad las horas de trabajo en el 1T de 2015 (desestacionalizadas) eran 230 millones menos que las de 1T de 2012 y 350 millones de horas menos que en el 4T de 2011, el último de ZP. 

Hay un desajuste entre la evolución del número de parados y la evolución del número de horas trabajadas, y desde la primavera del año pasado hay un desajuste cada vez mayor entre paro registrado en el INEM y las búsquedas de paro en Google, un desajuste que he discutido ene este blog unas cuantas veces. Ambos desajustes están relacionados. Ambos evidencian el fraude que esconde las cifras de empleo. 

No puede haber más empleo que horas trabajadas.

Bien. He aquí la prueba de que Google es mejor indicador del paro real que el INEM: 

Las búsquedas de paro en Google son un indicador mucho más fiable de las horas trabajadas en España que el paro INEM. 

Lo subrayo porque lo merece. Las horas trabajadas son un indicador mucho más real de la actividad económica que ese paro INEM que considera contratos fijos a azafatas que trabajan tres meses al año (y a las que prohiben trabajar en otras compañías) y a contratos temporales que en uno de cada tres casos no llegan a la semana de duración. Unos y otros están fuera de las listas del paro. 

Las evidencias de la trampa estadística van abriéndose paso poco a poco entre los digitales (1, 2, 3). Y es que no hay color. Las medias trimestrales de búsquedas de paro en Google correlacionan con un R2=0,91 con las horas trabajadas en España según datos del INE; el paro registrado INEM lo hace con un R2=0,73.

El caso es que antes de la primavera de 2014 el paro del INEM sí correlacionaba con las horas trabajadas y con las búsquedas de paro con un R2=0,9. Los tres indicadores iban parejos. Fue a partir de abril de 2014 que el paro INEM comenzó a descender sin que aumentasen las horas trabajadas ni la sensación de los españoles de que el paro disminuía. 



Según la correlación de Google antes de este desajuste, el paro actual, real, sería de 4,8 millones de personas y no 4,2 como asegura el Gobierno. 

El veranillo del empleo y el invierno que se avecina. 

Bien. La explicación a la divergencia está en la estacionalidad. El empleo en España sigue un ciclo estacional: en primavera y verano se crean empleos que se destruyen en otoño e inverno. Estos empleos estacionales, que ayudan pero no sacan a nadie de pobre, son en muchos casos empleos de subsistencia que apenas tienen reflejo en las búsquedas de paro en Google. Lo curioso es que a los economistas tampoco les gustan demasiado esta oscilación estacional del empleo porque enmascara la relidad y la tendencia a largo plazo, y por eso usan datos desestacionalizados. 

Pues eso es lo que nos da Google Trends: un dato desestacionalizado del paro directamente ligado a las horas trabajadas. 

Lo que estamos viviendo desde hace un año es una transformación del empleo a largo plazo en empleo estacional. Vivimos un gran veranillo del empleo. 

En definitiva: decir que el empleo aumenta en España es algo que solo permite una mala estadística. 

Más empleos de mierda para hacer el mismo trabajo o menos.

Lo que hay que ver es la tendencia subyacente o desestacionalizada del empleo. Ésta nos la da Google Trends: que en el último año y medio no solo no baja sino que sube ligeramente. 

El presente veranillo no se basa creación sino división de los viejos empleos en cantidad de nuevos (esto sí que es división del trabajo), una política económica que ha apostado por reventar el mercado de trabajo mediante la caída de los salarios, haciendo la vista gorda y permitiendo que España sea uno de los países con más casos de explotacion laboral... en definitiva, un país de mano de obra barata, una nueva China en Europa. Justo ahora que el modelo chino se agota...

Todos sabemos qué viene despues del verano. 

Google Trends como inidicador económico.

Para terminar, por supuesto, el Gobierno es perfectamente consciente de su engaño. Pero no solo eso, sabe que su fraude no acaba de cuajar y que la gente no se lo acaba de creer, porque esto que hago yo aquí para quién quiera leerlo, lo hace también  un proyecto de investigación de la UPV financiado por el Estado. 

Para quien quiera profundizar, he encontrado una tesis de uno de los investigadores del proyecto, y referencias más antiguas a la aplicación de Google Trends a la predición adelantada de paro, algo similar en Perú, y uno general del Banco de España sobre indicadores económicos adelantados. 



martes, 2 de junio de 2015

66.- Adelanto de paro registrado en mayo de 2015 a partir de búsquedas en Google.

Como vengo haciendo desde hace año y medio, doy la cifra de paro registrado del mes que termina a partir de las búsquedas Google.



Según lo que puede deducirse de la correlación, el paro registrado bajará en -63.233 personas.

Claro que si atendemos a la evolución del mes de mayo año a año, lo esperable el paro bajará al doble, en torno a unas -120.000 personas.


Ya he discutido unas cuantas veces de esta divergencia en anteriores entradas (aquí, por ejemplo).

Creo que mañana darán el resultado. Veremos.


domingo, 24 de mayo de 2015

65. Las elecciones de hoy según las búsquedas en Google los ultimos 30 días.

Mucho ha cambiado el panorama desde hace tan solo un par de meses. Podemos, que volaba por encima de los demás partidos en búsquedas en Google, ha caído al nivel del resto. 

Búsquedas en Google del 24/4 al 21/5

Aunque sigue siendo el primero, Podemos es ahora uno más, y durante unos días incluso iba a la altura de Cs y PP en búsquedas. ¿Pierde intención de voto o se está igualando la relación entre búsquedas y votos a la de los partidos consolidados? Yo creo que ambas cosas. 

Aquí tenéis el gráfico de búsquedas de los últimos 90 días tomado hoy mismo, o sea, incluyendo las búsquedas del viernes 22 de mayo que muestran el acelerón final, el pico del "momento electoral". Como quedó claro en las andaluzas, mejor no hacer caso de este sprint de última hora, 

Así que vamos con los datos. Abajo la Tabla de búsquedas relativas de PP, PSOE, Cs, IU (se siente UPyD ya no existe) y Podemos en los últimos 10 y 28 días. No hay cambios significativos. 


Y ahora la gran incógnita. ¿Cómo se traduce eso en votos? Ah, la clave! Es  el factor de conversión.  la cocina, lo que los electoralistas hacen al tarducir intención de voto directo a voto real: el arte del asunto. 

Como no me he parado a comparar los resultados de búsquedas con los resultados de encuestas, no tengo más referencias que las andaluzas y las pasadas europeas de hace un año, cuando la gran sorpresa de Podemos. Mucho ha cambiado todo desde entonces, e incluso desde las andaluzas... Además, estas son municipales y autonómicas, o sea que poco que ver con las otras dos... 

Pero basta de excusas! Como decían en la tele, hemos venido a jugar...


La tabla de arriba es la tarnsformación de búsquedas en votos multiplicando por los factores que doy (entre paréntesis). La primera fila es como sería si cada búsquedas significase lo mismo para cada partido, que no es así. La segunda es con los factores vistos en las pasadas elecciones europeas y andaluzas, la tercera (mi elección) y la cuarta son opciones intermedias. 

Suponiendo que los 5 partidos que se muestran sumen el 80 % de los votos totales, estos serán los resultados: 


No puede ser más simple. A ver qué pasa. 






viernes, 10 de abril de 2015

59. El paro registrado en España. Cuando cambia la vara de medir.

En abril de 2014 pasó algo muy gordo en España: el gobierno aseguró que el principal problema del país comenzaba a soucionarse pero los españoles nos negamos a creerlo.

Abajo las cifras de paro registrado desde 2010 y la espectacular caída de la primavera de 2014.


Cierto que el paro sigue un ciclo anual y más o menos desciende en primavera, pero esta vez hubo una diferencia de calado: La gente no se ha enterado. O no se ha dado por enterada. Abajo tenéis la curva de parados del INEM y la de parados calculados según búsquedas en Google. Por primera vez en tres años la caída del paro no tenía una respuesta correlacionable en Google. 


En las gráficas de abajo tenéis los datos mensuales de paro del 01/2010 al 03/2015 enfrentados a las búsquedas de Google. En la primera gráfica se correlacionan todos los datos, lo que resulta en una pobre R2 de 0,77. En la segunda se correlacionan por un lado del 01/2010 al 03/2014 (R2 de 0,92) y por otro del 06/2014 hasta el 03/2015, que aparecen descolgados bajo la línea de tendencia anterior y no muestran correlación alguna. 
(Los triángulos negros son los meses de 05/2014 y 06/2014)


Como se deduce de la tendencia lineal de 2010, cada 20.000 parados más o menos suponían un punto más de interés (relativo) en las búsquedas de paro en Google. De abril a mayo de 2014 el paro registrado cayó en unas 350.000 personas, y eso debería haber rebajado las búsquedas relativas unos 16-17 puntos menos, es decir que deberían estar en 55-60 en lugar de los 70-75. No fue una caída menor y debería haberse notado. Pero no.


De hecho, no he podido encontrar en Google ningún cambio significativo esa primavera de 2014 en torno a las búsquedas de paro. Ni paro autonomos, alta paro, paro baja, (arriba), ni  paro INEM , paro cobrar (abajo), 

ni trabajo, empleo (arriba) ni buscar trabajo, oferta empleo (abajo) ni ninguna otra palabra o combinación relacionada que pudo habérseme ocurrido sufrió una caída significativa esa primavera. 


El caso es que el problema no está en Google, sino en la percepción pública de esa supuesta bajada del paro. Los datos del Barómetro del CIS confirman que aquí no ha pasado nada extraordinario, es decir, que la valoración del problema del paro no sufrió ningún cambio en la primavera de 2014. 

Y por favor, prestad atención al ciclo anual de preocupación (a trazos, lo mismo suavizado a 5 meses), porque además de una ligera tendencia general descendente presenta un bien marcado ciclo estacional, muy semejante al del paro. 


La cuestión ahora es: ¿se equivoca la gente y es demasiado pesimista, como nos quiere convencer Rajoy o malcuenta el INEM, como creo yo? 


En el gráfico de arriba, en negro, os muestro la tenencia que llevaría el paro registrado a partir de 07/2014 si añadimos 350.000 parados a las cuentas del INEM (en gris), es decir, como si el descenso de la primavera de 2014 no se hubiese producido.  


Y en este último, os pongo la correlación entre búsquedas de paro en Google y el paro INEM + 350.000 a partir de 07/2014 (los puntos en negro del anterior gráfico). De nuevo R:0,93. Así la correlación no se resiente lo más mínimo. 

¿Qué está pasando?

El paro tiene un pulso anual que como vemos abajo se refleja en el Barómetro del CIS con 3-4 meses de retraso pero no en Google. 
(escala de miles de empleos para paro y adimensionales las otras dos variables)
Sin embargo, el Barómetro del CIS es un nulo indicador del total de paro mientras que las búsquedas en Google de paro si correlacionan muy bien con el total de paro, como hemos visto. Así pues, las búsqedas de paro en Google parecen informar de un nivel de paro subyacente.Y esto nos lleva a la primera posibilidad que explicaría qué está pasando: 


1.- La caída de marzo pasado fue temporal y responde a un truco contable. 

Como apunté hace meses, el Gobierno está repartiendo la miseria, troceando empleos convirtiéndolos en varios subempleos. No hay más trabajo, o apenas, como indican las horas trabajadas o los ingresos de la Seguridad Social, solo está más repartido, pero este truco no engañaría a Google. Veamos.


Arriba tenéis la evolución de nuevos contratos laborales sin suavizar y con su característico ciclo anual (la hendidura es el parón de agosto). Se aprecia bien claro que empezando 2013 hay un cambio de tendencia, coincidiendo con la caída en la variación de búsquedas mensuales de paro en Google que se ve en el gráfico anterior.  


Arriba tenéis la variación interanual del número de contratos. De nuevo se repite el cambio de tendencia en el segundo semestre de 2012. Pero en 2014 vuelve a notarse un nuevo cambio de tendencia. ¿Será ésta la quía de las búsquedas de paro en Google? 

La trampa es que para "eliminar el paro" sin crear empleo nuevo, el Gobierno debe procurar que la precarización se multiplique. Es como un sistema piramidal, necesita incoporar gente nueva a la red para que el "crecimiento",sea creíble. Si disminuye la velocidad de captación de incautos, todo el tinglado se resiente. 

2.- Google no detecta bien caídas del paro. 

Es una posibilidad. Si hay una relación entre contratos y la búsqueda de paro en Google -y parece que la hay-, el aumento de actividad económica y empleo -de contratos- aumentaría las búsquedas de paro, aunque lo que hay es más trabajo. 

En este caso tendría razón el Gobierno y yo estaría encabezonado por culpa de un artefacto en la medición de Google. Grrrrr!!!

3.- La caída del paro no se hace por el camino de subida sino por otro (cambia la correlación). 

Es una variante de 2. Pero lo mejor es explicarlo con un gráfico. 

Creo que se entiende, el problema es que en el cambio de subir a bajar el paro habría un momento de indefinición estadística (2013) y luego ¡zas! un salto brusco a la nueva situación (caída del paro).

Está por ver cuál de las tres opciones será la correcta: Pero ahora viene la primavera, abril, mayo y junio, los meses de mayor caída del paro, suficiente variación como para confirmar o desmentir sospechas. Según qué suceda, ya no habrá dudas.