Mostrando las entradas con la etiqueta 2012. Mostrar todas las entradas
Mostrando las entradas con la etiqueta 2012. Mostrar todas las entradas

25 septiembre 2012

Combinando las encuestas - Entrega 7

Ya a menos de dos semanas de las elecciones traigo lo que puede ser el penúltimo analisis de las encuestas. En esta séptima entrega vemos que la brecha sigue disminuyendo (en la entrega 6  era de 6 puntos porcentuales. En esta oportunidad es de 4. Salvo la disminucion de 2 puntos en un mes en la brecha no hay más novedades (los sesgos siguen igual - ver más abajo).

HCF 52% -HCR 48%

Sesgos de encuestadoras:

20 septiembre 2012

Evolución de las tendencias...



Aprovecho esta oportunidad en la que estamos a tres semanas de las elecciones para reportar como ven las elecciones las diferentes encuestadoras.

- Consultores 21: Ha dado la elección cerrada de forma consistente. En sus últimas dos encuestas Capriles está por encima de Chávez.

- Consultores 30.11: Da constantemente a Chávez por encima de 50% con poca variación. Sin embargo muestra a Capriles subiendo. Hay que considerar su alto sesgo pro-gobierno (ver aqui o aqui).

- Datanalisis: Muestra a Chávez constantemente liderando pero con un número de indecisos más grande que la brecha. En sus encuestas con entrevistas en hogares (no las telefánicas realizadas en el último mes) muestra a Capriles subiendo rapidamente.

- GISXXI: Su alto sesgo pro-gobierno (ver aqui o aqui) hace ver que la elección está ganada y que es una perdida de tiempo. Si correjimos por sus 15 puntos de sesgo entonces la cosa no está tan clara.

- Hinterlaces: Muestra a Chávez rondando el 50% (por debajo), es la única encuestadora que muestra una tendencia consistente de disminución de votos para Capriles...sí, la única.

- ICS: Junto con Consultores 30.11 y GISXXI muestran una brecha enorme e insuperable... se aplica el  mismo comentario  (ver aqui).

- IVAD: Muestra tanto a Chavez como a Capriles bajando, aunque la caida de Capriles paro.

- Keller: No tengo más que un punto.

- Otras (ventaja Chávez): Un grupo de encuestadoras de las que tengo poco conocimiento y más importante tengo pocas encuestas (<3) y que muestran a Chávez arriba constantemente...

- Otras (ventaja Capriles): Un grupo de encuestadoras de las que tengo poco conocimiento y más importante tengo pocas encuestas (<3) y que muestran a Capriles arriba constantemente... Keller podría pertenecer a este grupo...

- Predicmatica: Aparece sola porque ya han publicado tres encuestas, pero mis amigos de Caracas Chronicles dudan de su calidad. Muestran una elección cerrada con Capriles arriba (antes pertenecia al grupo de Otras).

- Varianzas: Como C21 ha mostrado la elección cerrada desde el principio. Sin embargo, en análisis previos (ver aqui o aqui)no le he encontrado ningún sesgo así que pareciera ser la que está representando las cosas correctamente...amanecerá y veremos


30 agosto 2012

Encuestadoras Venezolanas, sus records y la Elección del 2012 - Actualización de Agosto


Este análisis, originalmente escrito en inglés como contribución al blog “Venezuelan Politics and Human Rights” lo traduzco, con ciertas modificaciones, en esta entrada del blog. (El artículo original se encuentra aquí). 

Faltando un poco más de un mes para las próximas elecciones presidenciales en Venezuela las encuestas siguen sin reflejar claramente el escenario electoral. Durante este último mes ha sido publicado un nuevo grupo de encuestas con resultados en el rango de 20 puntos a favor del Presidente Chávez hasta 2 puntos a favor de Henrique Capriles Radonski. Dada esta divergencia sigue siendo útil el ejercicio presentado el mes pasado (ver aquí). En esta oportunidad utilizaré entonces las correcciones definidas en la oportunidad anterior y las aplicaré a la última encuesta disponible de cada encuestadora para ver la evolución del panorama.

Recapitulando

Primero, hagamos un breve repaso al post anterior. En esa oportunidad argumenté que las encuestadoras tienden a errar, típicamente, en una dirección específica (a favor del gobierno o de la oposición), esto permite determinar unas medidas de sesgo con las cuales corregir las actuales predicciones. Segundo, en esa oportunidad resalté la existencia de dos escenarios basados en la historia electoral reciente de Venezuela: 1) un escenario en el que las encuestas dan a la oposición por delante, pero en los que el gobierno gana (2004 y 2009); 2) un escenario en donde el gobierno va por delante pero la oposición gana o llega muy cerca de hacerlo (como en 2007 y 2010). Estos dos escenarios sirven como base de dos medidas de “corrección” para las encuestas actuales. Una tercera medida de corrección se basa en el promedio de todos los errores para las elecciones anteriores. Estos términos de corrección se pueden apreciar en la Tabla 1.

 Tabla 1.  Sesgos por encuestadoras y proceso electoral


A propósito de unos comentarios muy útiles que he recibido quisiera explicar brevemente porque escogí el promedio de todas las encuestas pre-electorales para crear mi término de corrección, en vez de usar la última encuesta.

Varios comentarios recibidos me sugerían que al promediar todas las encuestas de cada encuestador dentro de un ciclo electoral, sin importar cuando fue realizada la encuesta, estoy penalizando a las encuestadoras “buenas” que predijeron correctamente una evolución cambiante en el transcurso del ciclo electoral (por ejemplo en el referéndum del 2004 la oposición estaba por delante en Junio pero el gobierno la pasó en los dos últimos meses. Esta preocupación es válida. Sin embargo, podemos ponerlo gráficamente y ver la figura 1. Aquí se puede observar las diferentes predicciones realizadas por cada encuestadora para la elección parlamentaria de 2010. También se puede ver una línea horizontal que demarca el porcentaje real de votos obtenidos por el gobierno (rojo) y la oposición (azul), la elección estuvo tan cerrada que las líneas parecen una sola.

Figure 1. Evolución a través del tiempo  de la intención de voto de diferentes encuestadoras par alas elecciones parlamentarias de 2010 


El problema entonces está en que al no existir una medida valida de opinión pública “real” en ningún punto antes de la elección no existe ninguna forma confiable de evaluar ninguna encuesta. Además, existe un problema intrínseco con solo usar la última encuesta antes de la elección. Si solo usamos la última encuesta para estimar el sesgo podríamos errar y dar una evaluación positiva a encuestadoras malas. Digamos que existen dos encuestadoras - una que consistentemente favorece al gobierno y otra que consistentemente favorece a la oposición. A medida que avanza la campaña dan encuestas muy diferentes pero al final las dos llegan al resultado “correcto”. ¿Significa esto que sus encuestas no estaban sesgadas? Claro que no.

Así pues esto termina siendo una decisión analítica de: a quien penalizar y a quien premiar. Si utilizamos el promedio –como hago yo- penalizamos a las encuestadoras buenas; si utilizamos la última encuesta premiamos a las malas. Yo prefiero penalizar a las encuestadoras buenas antes que premiar a las malas porque me parece el mejor de dos males. Además, en esta etapa de la elección, la preocupación de la gente es sobre la veracidad y validez de las encuestas actuales y no de las que saldrán justo antes de la elección.

La elección del 2012 – Actualización de Agosto

Desde mi ultimo análisis al final de Julio, varias encuestas nuevas se han hecho publicas; la mayoría de ellas con campo entre finales de Julio y principios de Agosto. La única encuestadora de la cual no tengo ninguna encuesta nueva es Keller; por lo tanto no será incluida en este análisis (esta exclusión no afecta los resultados del análisis). La tabla 2 muestra las predicciones con las fechas de cada encuesta y las tres correcciones mencionadas anteriormente: la corrección del escenario 2009 donde la oposición estuvo por debajo de su predicción; la corrección 2010 donde el gobierno estuvo por debajo de su predicción; y la corrección promedio.

Como se puede ver en el escenario 2010, el mas competitivo - y yo creo el mas realista – ninguna encuestadora tiene a Chávez por encima del 50% (después de la corrección); la que da mas intención de voto es Varianzas con 49%. Con respecto a la oposición, la única encuestadora que da a Capriles una predicción corregida de menos de 30% es Hinterlaces, el resto al contrario dan una intención de voto a Capriles en el rango de 35 a 44.

Tabla 2.  Ultima predicción disponible, por encuestadora, para la elección del 2012 y corrección masada en dinámicas electorales alternativas



Finalmente, cuando vemos estas encuestas corregidas juntas (tomando el promedio del escenario 2010) y las comparamos con los resultados del  grupo de encuestas anteriores obtenemos la figura 2. Aquí hay varias cosas importantes que resaltar:
1)      Chávez se mantiene debajo del 50%. Su promedio, aunque baja un poco se mantiene estable. En esta oportunidad, sin embargo, pareciera que el rango de sus valores se encogió lo que significa que las diferentes encuestadoras están de alguna forma llegando a un consenso en la ubicación numérica de Chávez.
2)      Los números de Capriles han aumentado de 34 a 37. Considerando que Chávez esta en 46 esto ubica la diferencia entre ambos en 9 puntos porcentuales. Sin embargo, a diferencia de los números de Chávez el rango de certeza de alrededor del promedio de Capriles aumento, lo que significa que hay poco consenso entre los encuestadores de la ubicación real de Capriles. 

Figura 2. Promedio de rango de las predicciones corregidas (escenario 2010) par alas encuestas de Julio y Agosto.


Como van las cosas puedo decir que la elección se esta haciendo mas cerrada. En muchos países una diferencia de 10 puntos se consideraría una victoria segura del candidato a la relección. Sin embargo, hay varios factores que hacen que Venezuela sea diferente. Primero, existe un número muy grande de electores indecisos (como un 20%) Su decisión de votar o no puede tener un impacto significativo, especialmente en el escenario de que se decanten masivamente por una alternativa. Segundo, Capriles ha venido aumentando su intención de voto consistentemente, inclusive en encuestadoras pro-gobierno, mientras Chávez permanece estático. Si esta tendencia continua, entonces Capriles estará en posición de cerrar la diferencia que existe entre ambos.

Además de todo esto, la explosión en la refinería de Amuay en la que murieron al menos 39 personas podría impactar la elección. Esto es el equivalente a lo que se denomina en política estadounidense una “Sorpresa de Octubre” (porque es un mes antes de las elecciones en Noviembre, algo de último minuto que altera la elección). Un buen manejo de la crisis por parte del gobierno puede mejorar la posición de Chávez en las encuestas, mientras que una mala gestión puede terminar de convencer a los indecisos a votar en su contra.  Similarmente, una politización extrema de esta por parte de la oposición puede impactar negativamente a Capriles ya que podría recordarle a los indecisos a la oposición pre-2006. 

----------------

Un último punto es que estos resultados son consistentes con el último análisis de combinación de encuestas que publiqué el día de ayer (ver aquí).

10 agosto 2012

Dime con quien andas y te dire quien eres...


Hoy decidí hacer un pequeño análisis que muestre mes a mes donde ubica cada encuestadora la intención de voto por Chávez y por Capriles. Les presento entonces una serie de gráficos que presentan en el eje vertical a Chávez y en el eje horizontal a Capriles. Hay en cada gráfico una línea horizontal en 50% y una línea vertical en 40%. Son dos números aleatorios que escogí porque me parece que ayudan a visualizar cuatro grupos de encuestadoras. Los grupos son:
  1. Las encuestadora que dan más de 50% a Chávez y menos de 40% a Capriles (arriba a la izquierda).
  2. Las encuestadoras que dan más de 50% a Chávez y más de 40% a Capriles (arriba a la derecha).
  3. Las encuestadoras que dan menos de 50% a Chávez y menos de 40% a Capriles (abajo a la izquierda).
  4. Las encuestadoras que dan menos de 50% a Chávez y más de 40% a Capriles (abajo a la derecha).

Como se puede observar las distintas encuestadoras son bastante consistentes en donde ubican a la intención de voto a los candidatos y por eso al final les dejo un ultimo grafico que promedia las distintas encuestas de cada encuestadora. 







31 julio 2012

Encuestadoras Venezolanas, sus records y la Elección del 2012

El próximo 7 de Octubre los venezolanos escogeremos el presidente de la republica que gobernará los próximos 6 anos, las dos opciones: Hugo Chávez y Henrique Capriles Radonski. En este blog he hecho diferentes análisis históricos así como análisis de la evolución de las encuestas actuales. Lo que no he hecho es presentar un análisis que mezcle ambos. En esta oportunidad utilizo 64 encuestas para presentar un análisis de sesgo pro-gobierno y pro-oposición en cinco procesos electorales: El referendo revocatorio de 2004, la elección presidencial de 200, los referendos de 2007 y 2009, y la elección parlamentaria de 2010. Este análisis, originalmente escrito en inglés como contribución al blog “Venezuelan Politics and Human Rights” lo traduzco, con ciertas modificaciones, en esta entrada del blog. (El artículo original se encuentra aquí). Veamos entonces los números.



Referendo Revocatorio de 2004

La figura 1 presenta la última encuesta, antes del revocatorio, llevada a cabo por cada una de las encuestadoras. Las barras horizontales azules muestran la predicción de votos de la opción opositora (SI), mientras que la barra roja muestra la intención de votos de la opción oficialista (NO). Las líneas verticales representan el resultado real de la elección. Entonces, cuando vemos la figura 1 se puede observar claramente que tres encuestadoras predijeron con relativa certeza el resultado electoral: Datanalisis, Hinterlaces y  Varianzas. Al contrario, dos encuestadoras predijeron que la oposición ganaría: Datos predecía que la oposición ganaría ampliamente mientras que Consultores 21 daba un resultado más parejo.


Figura 1. Predicción de la última encuesta antes del Revocatorio

Estos resultados se repiten cuando vemos el sesgo pro-gobierno y pro-opositor. En la figura 2 incluyo todas las encuestas de las diferentes encuestadoras durante el proceso del 2004. El gráfico incluye el promedio de las diferencias entre el resultado real y las predicciones de cada encuestadora. Como se puede observar, tanto Consultores 21 como Datos tienen sesgos significativos en favor de la oposición mientras que las otras tres encuestadoras muestran sesgos muy bajos.


Figura 2. Sesgo promedio por encuestadora en encuestas previas al Revocatorio


Elección presidencial de 2006

Como punto de partida para este análisis debo decir que no creo que la elección presidencial del 2006 sorprendiera a nadie. A través de todo el proceso se hizo evidente que Chávez ganaría sin mayores dificultades la elección contra Manuel Rosales. Sin embargo, siempre existieron rumores sobre el voto secreto y la “espiral del silencio”; esto, se argumentaba, haría la diferencia para darle la victoria a Rosales.
Los dos gráficos siguientes no representan ninguna sorpresa sino más bien una confirmación del análisis de esta elección. La mayoría de las encuestadoras pudieron predecir con relativa certeza los resultados, por ejemplo Consultores 21 tiene menos de un 5% de sesgo pro-oposición. La única encuesta que  exhibe un sesgo extremadamente alto en favor de la oposición es la realizada por el Observatorio Hanna Arendt, que utilizo lápices de tres colores como método para predecir el ganador, esto basado en la teoría dela espiral del silencio. Utilizando este método en el cual se divide la muestra de participantes en tres grupos y a los integrantes de cada grupo les corresponde votar con un lápiz de un color (amarillo, azul o rojo), se encontró una diferencia muy grande entre la intención de voto del grupo que votaba con lápiz rojo y del que votaba con lápiz azul.


Figura 3. Predicción de la última encuesta antes de la elección presidencial

Figura 4. Sesgo promedio por encuestadora en encuestas previas a la elección presidencial



Referéndum Constitucional del 2007


El referendo del 2007 es interesante porque fue una elección muy cerrada. Es también la elección en la que empezamos a ver la existencia de encuestadoras no-tradicionales con amplios márgenes de ventaja para el gobierno. En cuanto a los resultados vemos que tres firmas lograron predecir correctamente la elección en su última encuesta, estas son: Consultores 21, Datanalisis e Hinterlaces. Por el contrario, tres encuestadoras hicieron un análisis que distaba bastante de los resultados reales: 30.11 Consultores, IVAD y Keller.


Figura 5. Predicción de la última encuesta antes del referendo



La figura 5 compara la última predicción de cada encuestadora con el resultado de la elección. Cuando se promedian los sesgos de las diferentes encuestas vemos algunas diferencias (figura 6). Igual que en el grafico anterior vemos sesgos considerables en favor del oficialismo por Consultores 30.11 y por el IVAD. Vemos sesgos de tamaño mediano (5 puntos) por Datanalisis (en favor de la oposición) y Keller (pro gobierno). Y vemos sesgos pequeños en las encuestas de Consultores 21 e Hinterlaces. Estas diferencias son en parte debido a la naturaleza cambiante de la elección que se volvió más y más cerrada a medida que discurría la campaña.

Figura 6. Sesgo promedio por encuestadora en encuestas previas al Referendo





Referendo Constitucional 2009

Encontrar encuestas para el referéndum del 2009 fue bastante difícil. Para este proceso solo pude obtener datos verificables de 5 encuestas: 3 de Datanalisis y 2 de Hinterlaces. Sin embargo, dada la importancia de esta elección decidí utilizar un juego de datos que no pasaría los estándares normales de las publicaciones académicas: el artículo de Wikipedia sobre el referéndum del 2009. Gracias a este artículo logre obtener información de 23 encuestas de 8 encuestadoras diferentes. De estas encuestas, sin embargo, solo pude verificar independientemente 2 ya que los links de las otras no se encuentran activos. La figura 7 muestra la ultima encuesta para cada consultora. Como se puede observar existe un sesgo bastante alto en favor de la oposición. Igual que en los análisis anteriores, para cada una de las encuestadoras obtuve el promedio de sus errores (que se pueden observar en la figura 8). Como se puede observar Keller e Hinterlaces tienen los sesgos pro-oposición más grandes. Asimismo se puede ver como la mayoría de las encuestadoras erraron del lado de la oposición. Resulta interesante que tanto el IVAD como GISXXI, dos encuestadoras que usualmente tienen sesgos grandes, estuvieron acertados en esta oportunidad.


Figura 7. Predicción de la última encuesta antes del referendo

Figura 8. Sesgo promedio por encuestadora en encuestas previas al Referendo


Elección Parlamentaria de 2010

La ultima elección en la que participamos los Venezolanos, antes de esta elección presidencial que se avecina, fue la elección de los miembros de la Asamblea Nacional en 2010. Esta elección, como la del 2007, fue muy cerrada –por lo menos en cuanto al porcentaje de votos-. La diferencia de votos entre el gobierno y la oposición fue muy difícil de predecir y (como se puede ver en la figura 9) solo una encuestadora logro predecir en su última encuesta: Hinterlaces Consultores 21. Dos encuestadoras más estuvieron cerca también Consultores 21 Datanalisis y Varianzas, a su vez seguidas por Hinterlaces y GISXXI. Del otro lado de Hinterlaces Consultores 21 se encuentra GISXXI IVAD, que erró del lado del gobierno en más de 10 puntos porcentuales.

Figura 9. Predicción de la última encuesta antes de la elección parlamentaria



Mientras la ultima encuesta provee resultados interesantes, ver los promedios de estos errores nos da una idea mas completa de la elección. En la figura 10 podemos ver que tres encuestadoras tuvieron un sesgo pro-gobierno de mas de 5 puntos porcentuales: Datanalisis, GISXXI e IVAD. Una encuestadora, Keller, tuvo un sesgo mediano en favor de la oposición, y otras tres tuvieron sesgos pequeños en favor de la oposición: Consultores 21, Hinterlaces y Varianzas.


Figura 10. Sesgo promedio por encuestadora en encuestas previas a la elección parlamentaria


La elección del 2012

Que significa todo esto? Significa que las encuestadoras cometen errores, típicamente favoreciendo al mismo lado – aunque existe cierta variación. La tabla siguiente muestra el error promedio de cada encuestadora a favor del gobierno (fila superior) y a favor de la oposición (fila inferior). Números positivos indican que la encuestadora dio mayor intención de votos que los votos reales que obtuvo una opción. Números negativos indican que la encuesta daba números por debajo de la realidad. Por ejemplo, Datanalisis ha cometido errores tanto a favor del gobierno (2006 y 2010) como a favor de la oposición (2004 y 2007); lo mismo ocurre con el IVAD que ha cometido errores grandes pero en lados diferentes. Otras consultoras por el contrario son más consistentes en el lado al que tienden a favorecer. Por ejemplo, Consultores 21 tiende a favorecer a la oposición. Hay una encuestadora (de la que tengo poco conocimiento) que ha sido bastante consistente en tener errores muy bajos. Esta encuestadora, Varianzas, ha cometido errores que están dentro del margen de error de sus encuestas. Sin embargo, solo cuento con encuestas de dos procesos electorales para esta firma. La última columna indica el error promedio de los cinco procesos electorales para cada encuestadora.


Tabla 1. Sesgos por encuestadoras y proceso electoral


La tabla 2 muestra la ultima encuesta de cada encuestadora para este proceso electoral. Incluye las fechas de inicio y cierre de campo y la predicción. Yo agregue tres columnas que llamo predicción “corregida”. Dos de estas representan escenarios electorales diferentes. En el primer escenario, se piensa que la oposición esta por delante pero termina perdiendo (como en 2004 y 2009); este escenario utiliza el error del 2009 para generar una corrección. En el segundo escenario se piensa que el gobierno va por delante pero termina ganando la oposición (como en 2007 y –relativamente- en 2010); en este caso se utiliza el error del 2010 como factor de corrección. Finalmente existe un escenario intermedio que utiliza el promedio de los errores para corregir las diferentes predicciones de cada encuestadora.
La última fila de la tabla indica el promedio de todas las encuestas y todas las correcciones. Los tres escenarios “corregidos” apuntan a donde puede terminar la elección del 2012 en base a las encuestas actuales y en base a cada uno de los posibles escenarios. Por ejemplo, si la dinámica de la elección es similar a la del 2009 entonces esta elección presidencial seria como la del 2006 y terminaría en una victoria amplia de Chávez. Si, por el contrario, la dinámica es mas como las elecciones de 2007 y 2010 entonces los indecisos, o Ni-Ni, serán un factor importante. Según esta dinámica la diferencia entre Chávez y Capriles se reduciría a  12 puntos, con Chávez por debajo del 50%. Finalmente, utilizando la corrección en base al promedio Chávez tendría una ventaja de 19 puntos.


Tabla 2. Predicciones corregidas


En este punto tengo que decir que, en base a otros análisis que he realizado y puesto en este blog, me inclino hacia el escenario número 2 que indica que la elección se encuentra en 46-34. Esto no solo es consistente con mis análisis sino además con la estrategia opositora –de unidad- que se asemeja más a las estrategias del 2007 y 2010 que a la del 2004 o 2009.
En términos generales estos estimados muestran una contienda en donde Chávez tiene la delantera, pero por un margen menor que el numero de indecisos. La dirección que tome este grupo de electores podría alterar significativamente la contienda. Para ver esto más claramente veamos un último grafico. La figura 11 muestra la predicción corregida promedio para las 8 encuestadoras tanto para Chávez como para Capriles. Muestra también los valores máximos y mínimos para ambos (todo esto basado en el escenario 2). La forma de interpretar este grafico es la siguiente: Chávez esta en algún punto del rango entre 39 y 49, con un promedio de 46%. Capriles esta en el rango entre 27 y 43, con un promedio de 34. Estos rangos tienen 5 puntos de coincidencia, que significa es esta elección todavía no se ha decidido, especialmente si consideramos que la mayoría de estas encuestas se realizo antes de que la campaña comenzara oficialmente y que la gente empezara a prestarle atención a la elección.


Figura 11. Rango de predicción promedio corregida









****** Este post fue modificado el 1/Agosto/2012 debido a un error en la creación de la figura 9. Este error no altera ninguna de las estimaciones de sesgo presentadas en la última sección del artículo.

28 junio 2012

En sus marcas, listos, ...



Ya estamos por empezar oficialmente la campaña para las elecciones presidenciales que se llevaran a cabo el 7 de Octubre. Así que antes de que empiece la campaña es bueno ver donde están los números de los dos candidatos principales y cómo han evolucionado desde principios del 2011. Espero entonces traer un poco de perspectiva a este tan convulsionado espacio en el que abunda información que a su vez se contradice, generándole dolores de cabeza a más de uno que quiere saber qué está pasando. Sin más nada que decir comienzo a mostrar números y gráficos.

En la última entrega de Combinando las encuestas mostré que hasta hace un mes se podía decir que había un empate técnico; ya que aunque Chávez estaba por arriba en intención de voto, el error que arrojaba el análisis que hice era muy grande dadas las grandes diferencias entre las diferentes encuestas (Ver másdel post aquí). En esta oportunidad voy por una estrategia más sencilla mientras espero por más encuestas.



Comencemos entonces por ver cómo ha evolucionado la intención de voto por Chavez y por Capriles* desde Enero de 2011.

Al poner todas las encuestas, sin importar la encuestadora, y promediar los números en base al mes en el que se realizó la encuesta, podemos observar que el presidente Chávez cuenta con una intención de voto que ronda el 52%, mientras que el candidato de la oposición (Capriles Radonski) cuenta con un promedio del 30%. Es importante dejar claro, sin embargo, que hay un 18% de votantes que no han decidido que hacer. 









Sin embargo, como hemostrado anteriormente, no todas las encuestadoras son iguales. Existen sesgos inherentes a los cuestionarios, técnicas de muestreo, muestras, etc., que se reproducen en las diferentes encuestas de una misma encuestadora de forma bastante sistemática. Así pues, es necesario ver la evolución en base a como cada encuestadora muestra la carrera.

Al hacer este ejercicio podemos ver que hay un grupo de encuestadoras que muestra la elección más cerrada, en estas encontramos a Consultores 21, Datanalisis, Keller,  Hinterlaces y Varianzas; mientras que otras como GIS XXI, ICS, IVAD y Consultores 30.11 muestran un escenario con una ventaja más amplia a favor del candidato oficialista. 


Hago un breve corte aquí para decirle al lector que el hecho de que el CNE ahora "regulará" a las encuestadoras no creo que vaya a repercutir en la confiabilidad de los datos, ni en disminuir las diferencias entre las encuestadoras, por el contrario dará una falsa sensación de calidad (como dije aquí).






En un esfuerzo de entender mejor lo que sucede decidí seguir la forma en la que muchos se refieren a las encuestadoras en base a su trayectoria en el mercado venezolano. De esta forma podemos distinguir encuestadoras con una larga trayectoria (históricas) y otras de más reciente data (nuevas). Así pues agrupe en encuestadoras históricas a: Consultores 21, Datanalisis, Hinterlaces, IVAD y Keller; mientras que como encuestadoras nuevas puse a: Consultores 30.11, GisXXI, ICS y Varianzas.
Al hacer el promedio en base a estas dos categorías obtenemos lo siguiente:
  1. -    En el grupo de encuestadoras nuevas: el presidente Chávez cuenta con más del 50% de intención de votos, mientras que Capriles Radonski cuenta con alrededor del 25%.
  2. -    En el grupo de encuestadoras históricas: el presidente Chávez cuenta con poco menos del 50% de la intención de votos, mientras que Capriles Radonski está en el 40%.





Feliz inicio de período electoral!




14 junio 2012

HCR: Consistencia de mensaje

El discurso de inscripción de la candidatura ante el CNE es el cuarto discurso importante que da Henrique Capriles-Radonski en su carrera a Miraflores. El primero fue cuando lanzó su candidatura, el segundo cuando vence en las primarias, y el tercero cuando recibe las credenciales de la Junta Electoral de la MUD. En todos estos discursos Capriles ha mantenido una consistencia de mensaje muy importante en una campaña electoral. Los temas de educación y progreso han sido hilo conductor de sus mensajes y de sus campañas y aunque hay obvia fluctuaciones en el grado de importancia que diferentes temas adquieren en momentos determinados la consistencia general sigue presente. Digo esto después de analizar tres de estos cuatro discursos, (1) el de lanzamiento, (2) el de la victoria en las primarias, y (3) el de su inscripción ante el CNE. Cada discurso muestra tanto la particularidad del evento como el mensaje global del candidato. 

Por ejemplo, al ver las 20 palabras más frecuentes en cada discurso vemos las dinámicas particulares de cada momento. En el discurso de lanzamiento Capriles se presenta a el y a su "autobus del progreso", en el discurso de las primarias reitera su mensaje con un llamado importante a la "Unidad" -esta palabra no estaba en su discurso anterior-; finalmente en la inscripción de su candidatura incluye nuevas palabras relacionadas directamente al acto como "candidato" o "salgamos" (a votar). 

En cuanto a la similitud de los discursos se puede decir que Capriles no solo utiliza los mismos elementos en sus diferentes mensajes sino que los utiliza en una proporción similar. Al hacer un análisis de frecuencias de las diferentes palabras se observa que estas se comportan de manera similar en los diferentes discursos. Esto es importante ya que permite al candidato afianzar su mensaje y al elector conocer al candidato. En general se puede ver que Capriles mantiene una consistencia de mensaje bastante alta, la única incosistencia que me pareció interesante con respecto a su inscripción ante el CNE fue la ausencia de la palabra "Camino" muy común de sus discursos anteriores y parte central de su mensaje de campaña.


Veinte palabras más frecuentes



Discurso de lanzamiento de candidatura



 Discurso después de la victoria en las Primarias de la MUD


Discurso antes de la inscripción en el CNE


02 abril 2012

Los errores de las encuestas para las primarias


Finalmente me senté a revisar las encuestas de las primarias a mi disposición comparándolas  con los resultados reales (reportados por el CNE). Antes de continuar aclaro que sólo tengo encuestas publicadas en 2011 y nada publicado en enero o febrero del 2012. Sin embargo, creo que igual son datos que sirven para analizar el desempeño de las diferentes encuestadoras más aún en el actual clima de guerra de encuestas en el que nos encontramos. 


En total 25 encuestas de 6 encuestadoras fueron analizadas. Aquí pueden ver las encuestas en un gráfico.




Que tanto acertaron las distintas encuestadoras?



La siguiente tabla muestra el número de veces que las encuestas dieron a Henrique Capriles-Radonski (cuando se le suma la intención de voto por Leopoldo López) a 5 o menos puntos de diferencia del resultado real, entre 5 y 15 puntos de diferencia y a más de 15 puntos de diferencia. Igual para Pablo Pérez (la segunda de las tablas). Como se puede observar sólo un número reducido de encuestas (6 para HCR y 5 para PP) logró estar a 5 o menos puntos de diferencia.



Fueron los errores iguales para ambos candidatos?

Una pregunta importante después de ver que que tanto se equivocaron las encuestas es saber si estos errores fueron iguales para ambos candidatos. Esto lo digo porque en un contexto de dos candidatos hay tres tipos de formas de cometer error:
a) Errores similares para ambos candidatos. Es decir que si una encuesta, comparada con el porcentaje de votos reales, dio 5 puntos más a un candidato, le dio 5 puntos menos al otro.
b) Errores inversos para los candidatos. Es decir, mientras más se equivocaba en un candidato menos se equivocaba con el otro. 
c) Error constante para uno y variable para otro candidato. Es decir, con un candidato acertó el resultado mientras que con el otro no.


Para ver estos comportamientos realicé un análisis en dos etapas. Primero comparé que tanto se equivocaron el conjunto de las encuestas para cada candidato y segundo evalué el comportamiento de las encuestas por casa encuestadora para ver si existen patrones diferentes para cada una.


Comparando la diferencia de votos estimados y reales


La primera etapa consistió en ver que tan lejos estuvieron las encuestas de la realidad electoral comparando la diferencia entre el porcentaje de votos obtenido por Henrique Capriles Radonski (60.39%) y los números de cada una de las encuestas. Lo mismo para el candidato de UNT (y cia.) Pablo Pérez quien obtuvo 30.69%. Estas medidas obtenidas van de 0 a 44 puntos, esto significa que mientras algunas encuestas básicamente acertaron los resultados otras se pelaron por bastante. Debido a que las encuestas analizadas se hicieron antes de la alianza entre Leopoldo López y Capriles Radonski analicé también la diferencia entre el porcentaje de votos de Capriles y la suma de los porcentajes de intención de voto de Capriles y López. La siguiente tabla muestra algunas medidas estadísticas de estas tres variables.


Como se puede observar el error promedio de Intención de voto vs. Porcentaje de votos fue de 13.75 puntos para Pablo Pérez, de casi 28 puntos para Capriles Radonski, pero de 17 puntos para Capriles Radonski cuando se le suma la intención de voto de Leopoldo López. 

Esta figura muestra un poco mejor estas relaciones. Cada punto en el grafico es la comparación del error de una encuesta con respecto a Capriles vs el error con respecto a Pablo Pérez.

En un mundo ideal la tendencia del error seria una línea inclinada que indique que la encuesta se equivocó igual para ambos candidatos. Otras opciones serían una línea recta que indicaría que las encuestas variaron en el error de un candidato mientras que no variaron para el otro. Una tercera alternativa sería una relación inversas, a mayor error de un candidato menor del otro (esta es un poco más difícil que ocurra pero puede suceder en caso por ejemplo de que lo que este cambiando sean los indecisos).

Como se puede ver en la gráfica la relación del conjunto de las encuestas es bastante buena a medida que aumenta el error para un candidato aumenta para el otro. Sin embargo hay dos encuestas que rompen un poco con este patrón de “igualdad de errores”. Estas dos son los dos puntos negros (que indican encuestas de datanalisis) cerca del 20. Como da a entender la grafica estas dos encuestas tuvieron un mayor error para Pablo Pérez que para Henrique Capriles.

Es importante destacar que cuando se evalúa la diferencia entre la alianza Capriles-Leopoldo y Pablo Pérez los resultados son similares.                                        


Todas las encuestadoras se equivocaron igual?

La segunda parte del análisis consistió en revisar los errores por casa encuestadora. En la siguiente figura podemos ver parte de este análisis.  En este gráfico hay dos datos resaltantes. El primer hecho resaltante es que hay una encuestadora (Datanalisis) que tiene un patrón de errores completamente distinto al resto. Este patrón consiste en que a mayor el error hacia Capriles Radonski y menor el error hacia Pablo Pérez, y viceversa. El segundo dato relevante es que hay dos encuestadoras (IVAD y Keller) cuyos errores son bastante elevados tanto para Capriles como para Pablo Perez.

Esto ultimo queda resaltado cuando se realiza un analisis estadístico del error. Los resultados de este modelo lineal dicen lo siguiente:
1)      No existe relación entre el error hacia Pablo Pérez y hacia Henrique Capriles.
2)      Las encuestadoras IVAD y Keller dan mayor error a Capriles Radonski que el resto de las encuestadoras (19 y 16 puntos respectivamente).
3)      Cuando se considera solo la intención de voto para Henrique Capriles las encuestadoras tuvieron un error promedio de 17 puntos, sin embargo al considerar la alianza Capriles-Leopoldo el erro promedio bajó a 0.

A quien desee ver los resultados específicos del modelo aquí le dejo la tabla del análisis. Si quieren más detalle me pueden mandar un mensaje.

* Significa que estadísticamente significativo de 0.