Ya a menos de dos semanas de las elecciones traigo lo que puede ser el penúltimo analisis de las encuestas. En esta séptima entrega vemos que la brecha sigue disminuyendo (en la entrega 6 era de 6 puntos porcentuales. En esta oportunidad es de 4. Salvo la disminucion de 2 puntos en un mes en la brecha no hay más novedades (los sesgos siguen igual - ver más abajo).
HCF 52% -HCR 48%
Sesgos de encuestadoras:
Mostrando las entradas con la etiqueta 2012. Mostrar todas las entradas
Mostrando las entradas con la etiqueta 2012. Mostrar todas las entradas
25 septiembre 2012
20 septiembre 2012
Evolución de las tendencias...
Aprovecho esta oportunidad en la que estamos a tres semanas de las elecciones para reportar como ven las elecciones las diferentes encuestadoras.
- Consultores 21: Ha dado la elección cerrada de forma consistente. En sus últimas dos encuestas Capriles está por encima de Chávez.
- Consultores 30.11: Da constantemente a Chávez por encima de 50% con poca variación. Sin embargo muestra a Capriles subiendo. Hay que considerar su alto sesgo pro-gobierno (ver aqui o aqui).
- Datanalisis: Muestra a Chávez constantemente liderando pero con un número de indecisos más grande que la brecha. En sus encuestas con entrevistas en hogares (no las telefánicas realizadas en el último mes) muestra a Capriles subiendo rapidamente.
- GISXXI: Su alto sesgo pro-gobierno (ver aqui o aqui) hace ver que la elección está ganada y que es una perdida de tiempo. Si correjimos por sus 15 puntos de sesgo entonces la cosa no está tan clara.
- Hinterlaces: Muestra a Chávez rondando el 50% (por debajo), es la única encuestadora que muestra una tendencia consistente de disminución de votos para Capriles...sí, la única.
- ICS: Junto con Consultores 30.11 y GISXXI muestran una brecha enorme e insuperable... se aplica el mismo comentario (ver aqui).
- IVAD: Muestra tanto a Chavez como a Capriles bajando, aunque la caida de Capriles paro.
- Keller: No tengo más que un punto.
- Otras (ventaja Chávez): Un grupo de encuestadoras de las que tengo poco conocimiento y más importante tengo pocas encuestas (<3) y que muestran a Chávez arriba constantemente...
- Otras (ventaja Capriles): Un grupo de encuestadoras de las que tengo poco conocimiento y más importante tengo pocas encuestas (<3) y que muestran a Capriles arriba constantemente... Keller podría pertenecer a este grupo...
- Predicmatica: Aparece sola porque ya han publicado tres encuestas, pero mis amigos de Caracas Chronicles dudan de su calidad. Muestran una elección cerrada con Capriles arriba (antes pertenecia al grupo de Otras).
- Varianzas: Como C21 ha mostrado la elección cerrada desde el principio. Sin embargo, en análisis previos (ver aqui o aqui)no le he encontrado ningún sesgo así que pareciera ser la que está representando las cosas correctamente...amanecerá y veremos
30 agosto 2012
Encuestadoras Venezolanas, sus records y la Elección del 2012 - Actualización de Agosto
Este análisis, originalmente escrito en inglés como contribución al blog “Venezuelan Politics and Human Rights” lo traduzco, con ciertas modificaciones, en esta entrada del blog. (El artículo original se encuentra aquí).
Faltando un
poco más de un mes para las próximas elecciones presidenciales en Venezuela las
encuestas siguen sin reflejar claramente el escenario electoral. Durante este último
mes ha sido publicado un nuevo grupo de encuestas con resultados en el rango de
20 puntos a favor del Presidente Chávez hasta 2 puntos a favor de Henrique
Capriles Radonski. Dada esta divergencia sigue siendo útil el ejercicio presentado
el mes pasado (ver aquí). En esta oportunidad utilizaré entonces las
correcciones definidas en la oportunidad anterior y las aplicaré a la última
encuesta disponible de cada encuestadora para ver la evolución del panorama.
Recapitulando
Primero,
hagamos un breve repaso al post anterior. En esa oportunidad argumenté que las
encuestadoras tienden a errar, típicamente, en una dirección específica (a favor
del gobierno o de la oposición), esto permite determinar unas medidas de sesgo
con las cuales corregir las actuales predicciones. Segundo, en esa oportunidad
resalté la existencia de dos escenarios basados en la historia electoral
reciente de Venezuela: 1) un escenario en el que las encuestas dan a la oposición
por delante, pero en los que el gobierno gana (2004 y 2009); 2) un escenario
en donde el gobierno va por delante pero la oposición gana o llega muy cerca de
hacerlo (como en 2007 y 2010). Estos dos escenarios sirven como base de dos
medidas de “corrección” para las encuestas actuales. Una tercera medida de corrección
se basa en el promedio de todos los errores para las elecciones anteriores. Estos
términos de corrección se pueden apreciar en la Tabla 1.
Tabla 1. Sesgos por encuestadoras y proceso electoral
A propósito
de unos comentarios muy útiles que he recibido quisiera explicar brevemente
porque escogí el promedio de todas las encuestas pre-electorales para crear mi término
de corrección, en vez de usar la última encuesta.
Varios
comentarios recibidos me sugerían que al promediar todas las encuestas de cada
encuestador dentro de un ciclo electoral, sin importar cuando fue realizada la
encuesta, estoy penalizando a las encuestadoras “buenas” que predijeron
correctamente una evolución cambiante en el transcurso del ciclo electoral (por
ejemplo en el referéndum del 2004 la oposición estaba por delante en Junio pero
el gobierno la pasó en los dos últimos meses. Esta preocupación es válida. Sin
embargo, podemos ponerlo gráficamente y ver la figura 1. Aquí se puede observar
las diferentes predicciones realizadas por cada encuestadora para la elección parlamentaria
de 2010. También se puede ver una línea horizontal que demarca el porcentaje real
de votos obtenidos por el gobierno (rojo) y la oposición (azul), la elección estuvo
tan cerrada que las líneas parecen una sola.
Figure 1. Evolución
a través del tiempo de la intención de
voto de diferentes encuestadoras par alas elecciones parlamentarias de 2010
El problema entonces está en que al no existir una medida valida de opinión pública “real” en ningún
punto antes de la elección no existe ninguna forma confiable de evaluar ninguna
encuesta. Además, existe un problema intrínseco con solo usar la última
encuesta antes de la elección. Si solo usamos la última encuesta para estimar
el sesgo podríamos errar y dar una evaluación positiva a encuestadoras malas. Digamos
que existen dos encuestadoras - una que consistentemente favorece al gobierno y
otra que consistentemente favorece a la oposición. A medida que avanza la
campaña dan encuestas muy diferentes pero al final las dos llegan al resultado “correcto”.
¿Significa esto que sus encuestas no estaban sesgadas? Claro que no.
Así pues esto termina siendo una decisión analítica de: a quien penalizar y a quien
premiar. Si utilizamos el promedio –como hago yo- penalizamos a las
encuestadoras buenas; si utilizamos la última encuesta premiamos a las malas.
Yo prefiero penalizar a las encuestadoras buenas antes que premiar a las malas
porque me parece el mejor de dos males. Además, en esta etapa de la elección,
la preocupación de la gente es sobre la veracidad y validez de las encuestas
actuales y no de las que saldrán justo antes de la elección.
La elección del 2012 – Actualización de Agosto
Desde mi
ultimo análisis al final de Julio, varias encuestas nuevas se han hecho
publicas; la mayoría de ellas con campo entre finales de Julio y principios de
Agosto. La única encuestadora de la cual no tengo ninguna encuesta nueva es
Keller; por lo tanto no será incluida en este análisis (esta exclusión no
afecta los resultados del análisis). La tabla 2 muestra las predicciones con
las fechas de cada encuesta y las tres correcciones mencionadas anteriormente:
la corrección del escenario 2009 donde la oposición estuvo por debajo de su predicción; la corrección 2010 donde
el gobierno estuvo por debajo de su predicción; y la corrección promedio.
Como se
puede ver en el escenario 2010, el mas competitivo - y yo creo el mas realista –
ninguna encuestadora tiene a Chávez por encima del 50% (después de la corrección);
la que da mas intención de voto es Varianzas con 49%. Con respecto a la oposición,
la única encuestadora que da a Capriles una predicción corregida de menos de
30% es Hinterlaces, el resto al contrario dan una intención de voto a Capriles
en el rango de 35 a 44.
Tabla 2.
Ultima predicción disponible, por encuestadora, para la elección del
2012 y corrección masada en dinámicas electorales alternativas
Finalmente,
cuando vemos estas encuestas corregidas juntas (tomando el promedio del escenario
2010) y las comparamos con los resultados del
grupo de encuestas anteriores obtenemos la figura 2. Aquí hay varias
cosas importantes que resaltar:
1) Chávez se mantiene debajo del 50%. Su
promedio, aunque baja un poco se mantiene estable. En esta oportunidad, sin
embargo, pareciera que el rango de sus valores se encogió lo que significa que
las diferentes encuestadoras están de alguna forma llegando a un consenso en la
ubicación numérica de Chávez.
2) Los números de Capriles han
aumentado de 34 a 37. Considerando que Chávez esta en 46 esto ubica la diferencia
entre ambos en 9 puntos porcentuales. Sin embargo, a diferencia de los números de
Chávez el rango de certeza de alrededor del promedio de Capriles aumento, lo
que significa que hay poco consenso entre los encuestadores de la ubicación real
de Capriles.
Figura 2. Promedio de rango de las predicciones corregidas (escenario
2010) par alas encuestas de Julio y Agosto.
Como van
las cosas puedo decir que la elección se esta haciendo mas cerrada. En muchos países
una diferencia de 10 puntos se consideraría una victoria segura del candidato a
la relección. Sin embargo, hay varios factores que hacen que Venezuela sea
diferente. Primero, existe un número muy grande de electores indecisos (como un
20%) Su decisión de votar o no puede tener un impacto significativo,
especialmente en el escenario de que se decanten masivamente por una
alternativa. Segundo, Capriles ha venido aumentando su intención de voto
consistentemente, inclusive en encuestadoras pro-gobierno, mientras Chávez
permanece estático. Si esta tendencia continua, entonces Capriles estará en posición
de cerrar la diferencia que existe entre ambos.
Además de
todo esto, la explosión en la refinería de Amuay en la que murieron al menos 39
personas podría impactar la elección. Esto es el equivalente a lo que se
denomina en política estadounidense una “Sorpresa de Octubre” (porque es un mes
antes de las elecciones en Noviembre, algo de último minuto que altera la elección).
Un buen manejo de la crisis por parte del gobierno puede mejorar la posición de
Chávez en las encuestas, mientras que una mala gestión puede terminar de
convencer a los indecisos a votar en su contra.
Similarmente, una politización extrema de esta por parte de la oposición
puede impactar negativamente a Capriles ya que podría recordarle a los
indecisos a la oposición pre-2006.
----------------
Un último punto es que estos resultados son consistentes con el último análisis de combinación de encuestas que publiqué el día de ayer (ver aquí).
10 agosto 2012
Dime con quien andas y te dire quien eres...
Hoy
decidí hacer un pequeño análisis que muestre mes a mes donde ubica cada
encuestadora la intención de voto por Chávez y por Capriles. Les
presento entonces una serie de gráficos que presentan en el eje vertical a
Chávez y en el eje horizontal a Capriles. Hay en cada gráfico una línea horizontal
en 50% y una línea vertical en 40%. Son dos números aleatorios que escogí porque
me parece que ayudan a visualizar cuatro grupos de encuestadoras. Los grupos
son:
- Las encuestadora que dan más de 50% a Chávez y menos de 40% a Capriles (arriba a la izquierda).
- Las encuestadoras que dan más de 50% a Chávez y más de 40% a Capriles (arriba a la derecha).
- Las encuestadoras que dan menos de 50% a Chávez y menos de 40% a Capriles (abajo a la izquierda).
- Las encuestadoras que dan menos de 50% a Chávez y más de 40% a Capriles (abajo a la derecha).
Como se
puede observar las distintas encuestadoras son bastante consistentes en donde
ubican a la intención de voto a los candidatos y por eso al final les dejo un
ultimo grafico que promedia las distintas encuestas de cada encuestadora.
31 julio 2012
Encuestadoras Venezolanas, sus records y la Elección del 2012
El próximo 7 de Octubre los venezolanos escogeremos el presidente de la republica que gobernará los próximos 6 anos, las dos opciones: Hugo Chávez y Henrique Capriles Radonski. En este blog he hecho diferentes análisis históricos así como análisis de la evolución de las encuestas actuales. Lo que no he hecho es presentar un análisis que mezcle ambos. En esta oportunidad utilizo 64 encuestas para presentar un análisis de sesgo pro-gobierno y pro-oposición en cinco procesos electorales: El referendo revocatorio de 2004, la elección presidencial de 200, los referendos de 2007 y 2009, y la elección parlamentaria de 2010. Este análisis, originalmente escrito en inglés como contribución al blog “Venezuelan Politics and Human Rights” lo traduzco, con ciertas modificaciones, en esta entrada del blog. (El artículo original se encuentra aquí). Veamos entonces los números.
Referendo
Revocatorio de 2004
La figura 1
presenta la última encuesta, antes del revocatorio, llevada a cabo por cada una
de las encuestadoras. Las barras horizontales azules muestran la predicción de
votos de la opción opositora (SI), mientras que la barra roja muestra la intención
de votos de la opción oficialista (NO). Las líneas verticales representan el
resultado real de la elección. Entonces, cuando vemos la figura 1 se puede
observar claramente que tres encuestadoras predijeron con relativa certeza el
resultado electoral: Datanalisis, Hinterlaces y
Varianzas. Al contrario, dos encuestadoras predijeron que la oposición ganaría:
Datos predecía que la oposición ganaría ampliamente mientras que Consultores 21
daba un resultado más parejo.
Figura 1. Predicción de la última encuesta antes del Revocatorio
Estos
resultados se repiten cuando vemos el sesgo pro-gobierno y pro-opositor. En la
figura 2 incluyo todas las encuestas de las diferentes encuestadoras durante el
proceso del 2004. El gráfico incluye el promedio de las diferencias entre el
resultado real y las predicciones de cada encuestadora. Como se puede observar,
tanto Consultores 21 como Datos tienen sesgos significativos en favor de la oposición
mientras que las otras tres encuestadoras muestran sesgos muy bajos.
Figura 2. Sesgo promedio por encuestadora en encuestas previas al Revocatorio
Elección
presidencial de 2006
Como punto
de partida para este análisis debo decir que no creo que la elección presidencial
del 2006 sorprendiera a nadie. A través de todo el proceso se hizo evidente que
Chávez ganaría sin mayores dificultades la elección contra Manuel Rosales. Sin
embargo, siempre existieron rumores sobre el voto secreto y la “espiral del
silencio”; esto, se argumentaba, haría la diferencia para darle la victoria a
Rosales.
Los dos gráficos
siguientes no representan ninguna sorpresa sino más bien una confirmación del análisis
de esta elección. La mayoría de las encuestadoras pudieron predecir con
relativa certeza los resultados, por ejemplo Consultores 21 tiene menos de un
5% de sesgo pro-oposición. La única encuesta que exhibe un sesgo extremadamente alto en favor
de la oposición es la realizada por el Observatorio Hanna Arendt, que utilizo lápices
de tres colores como método para predecir el ganador, esto basado en la teoría dela espiral del silencio. Utilizando este método en el cual se divide la muestra
de participantes en tres grupos y a los integrantes de cada grupo les
corresponde votar con un lápiz de un color (amarillo, azul o rojo), se encontró
una diferencia muy grande entre la intención de voto del grupo que votaba con lápiz
rojo y del que votaba con lápiz azul.
Referéndum Constitucional del 2007
Figura 3. Predicción de la última encuesta antes de la elección presidencial
Referéndum Constitucional del 2007
El
referendo del 2007 es interesante porque fue una elección muy cerrada. Es también
la elección en la que empezamos a ver la existencia de encuestadoras
no-tradicionales con amplios márgenes de ventaja para el gobierno. En cuanto a
los resultados vemos que tres firmas lograron predecir correctamente la elección
en su última encuesta, estas son: Consultores 21, Datanalisis e Hinterlaces.
Por el contrario, tres encuestadoras hicieron un análisis que distaba bastante
de los resultados reales: 30.11 Consultores, IVAD y Keller.
Figura 5. Predicción de la última encuesta antes del referendo
La figura 5
compara la última predicción de cada encuestadora con el resultado de la elección.
Cuando se promedian los sesgos de las diferentes encuestas vemos algunas
diferencias (figura 6). Igual que en el grafico anterior vemos sesgos
considerables en favor del oficialismo por Consultores 30.11 y por el IVAD.
Vemos sesgos de tamaño mediano (5 puntos) por Datanalisis (en favor de la oposición)
y Keller (pro gobierno). Y vemos sesgos pequeños en las encuestas de
Consultores 21 e Hinterlaces. Estas diferencias son en parte debido a la
naturaleza cambiante de la elección que se volvió más y más cerrada a medida
que discurría la campaña.
Figura 6. Sesgo promedio por encuestadora en encuestas previas al Referendo
Referendo
Constitucional 2009
Encontrar
encuestas para el referéndum del 2009 fue bastante difícil. Para este proceso
solo pude obtener datos verificables de 5 encuestas: 3 de Datanalisis y 2 de
Hinterlaces. Sin embargo, dada la importancia de esta elección decidí utilizar
un juego de datos que no pasaría los estándares normales de las publicaciones académicas:
el artículo de Wikipedia sobre el referéndum del 2009. Gracias a este artículo
logre obtener información de 23 encuestas de 8 encuestadoras diferentes. De
estas encuestas, sin embargo, solo pude verificar independientemente 2 ya que
los links de las otras no se encuentran activos. La figura 7 muestra la ultima
encuesta para cada consultora. Como se puede observar existe un sesgo bastante
alto en favor de la oposición. Igual que en los análisis anteriores, para cada
una de las encuestadoras obtuve el promedio de sus errores (que se pueden
observar en la figura 8). Como se puede observar Keller e Hinterlaces tienen
los sesgos pro-oposición más grandes. Asimismo se puede ver como la mayoría de
las encuestadoras erraron del lado de la oposición. Resulta interesante que
tanto el IVAD como GISXXI, dos encuestadoras que usualmente tienen sesgos
grandes, estuvieron acertados en esta oportunidad.
Figura 7. Predicción de la última encuesta antes del referendo
Elección
Parlamentaria de 2010
La ultima elección
en la que participamos los Venezolanos, antes de esta elección presidencial que
se avecina, fue la elección de los miembros de la Asamblea Nacional en 2010.
Esta elección, como la del 2007, fue muy cerrada –por lo menos en cuanto al
porcentaje de votos-. La diferencia de votos entre el gobierno y la oposición fue
muy difícil de predecir y (como se puede ver en la figura 9) solo una
encuestadora logro predecir en su última encuesta: Hinterlaces Consultores 21. Dos
encuestadoras más estuvieron cerca también Consultores 21 Datanalisis y Varianzas, a su vez seguidas por Hinterlaces y GISXXI. Del otro
lado de Hinterlaces Consultores 21 se encuentra GISXXI IVAD, que erró del lado del gobierno en más
de 10 puntos porcentuales.
Mientras la
ultima encuesta provee resultados interesantes, ver los promedios de estos
errores nos da una idea mas completa de la elección. En la figura 10 podemos
ver que tres encuestadoras tuvieron un sesgo pro-gobierno de mas de 5 puntos porcentuales:
Datanalisis, GISXXI e IVAD. Una encuestadora, Keller, tuvo un sesgo mediano en
favor de la oposición, y otras tres tuvieron sesgos pequeños en favor de la oposición:
Consultores 21, Hinterlaces y Varianzas.
****** Este post fue modificado el 1/Agosto/2012 debido a un error en la creación de la figura 9. Este error no altera ninguna de las estimaciones de sesgo presentadas en la última sección del artículo.
Figura 10. Sesgo promedio por encuestadora en encuestas previas a la elección parlamentaria
La elección
del 2012
Que
significa todo esto? Significa que las encuestadoras cometen errores, típicamente
favoreciendo al mismo lado – aunque existe cierta variación. La tabla siguiente
muestra el error promedio de cada encuestadora a favor del gobierno (fila
superior) y a favor de la oposición (fila inferior). Números positivos indican
que la encuestadora dio mayor intención de votos que los votos reales que
obtuvo una opción. Números negativos indican que la encuesta daba números por debajo
de la realidad. Por ejemplo, Datanalisis ha cometido errores tanto a favor del
gobierno (2006 y 2010) como a favor de la oposición (2004 y 2007); lo mismo
ocurre con el IVAD que ha cometido errores grandes pero en lados diferentes. Otras
consultoras por el contrario son más consistentes en el lado al que tienden a
favorecer. Por ejemplo, Consultores 21 tiende a favorecer a la oposición. Hay
una encuestadora (de la que tengo poco conocimiento) que ha sido bastante
consistente en tener errores muy bajos. Esta encuestadora, Varianzas, ha
cometido errores que están dentro del margen de error de sus encuestas. Sin
embargo, solo cuento con encuestas de dos procesos electorales para esta firma.
La última columna indica el error promedio de los cinco procesos electorales para
cada encuestadora.
Tabla 1. Sesgos por encuestadoras y proceso electoral
La tabla 2
muestra la ultima encuesta de cada encuestadora para este proceso electoral.
Incluye las fechas de inicio y cierre de campo y la predicción. Yo agregue tres
columnas que llamo predicción “corregida”. Dos de estas representan escenarios
electorales diferentes. En el primer escenario, se piensa que la oposición esta
por delante pero termina perdiendo (como en 2004 y 2009); este escenario
utiliza el error del 2009 para generar una corrección. En el segundo escenario
se piensa que el gobierno va por delante pero termina ganando la oposición (como
en 2007 y –relativamente- en 2010); en este caso se utiliza el error del 2010
como factor de corrección. Finalmente existe un escenario intermedio que
utiliza el promedio de los errores para corregir las diferentes predicciones de
cada encuestadora.
La última
fila de la tabla indica el promedio de todas las encuestas y todas las
correcciones. Los tres escenarios “corregidos” apuntan a donde puede terminar
la elección del 2012 en base a las encuestas actuales y en base a cada uno de
los posibles escenarios. Por ejemplo, si la dinámica de la elección es similar
a la del 2009 entonces esta elección presidencial seria como la del 2006 y terminaría
en una victoria amplia de Chávez. Si, por el contrario, la dinámica es mas como
las elecciones de 2007 y 2010 entonces los indecisos, o Ni-Ni, serán un factor
importante. Según esta dinámica la diferencia entre Chávez y Capriles se reduciría
a 12 puntos, con Chávez por debajo del
50%. Finalmente, utilizando la corrección en base al promedio Chávez tendría una
ventaja de 19 puntos.
Tabla 2. Predicciones corregidas
En este
punto tengo que decir que, en base a otros análisis que he realizado y puesto
en este blog, me inclino hacia el escenario número 2 que indica que la elección
se encuentra en 46-34. Esto no solo es consistente con mis análisis sino además
con la estrategia opositora –de unidad- que se asemeja más a las estrategias
del 2007 y 2010 que a la del 2004 o 2009.
En términos
generales estos estimados muestran una contienda en donde Chávez tiene la delantera,
pero por un margen menor que el numero de indecisos. La dirección que tome este
grupo de electores podría alterar significativamente la contienda. Para ver
esto más claramente veamos un último grafico. La figura 11 muestra la predicción
corregida promedio para las 8 encuestadoras tanto para Chávez como para
Capriles. Muestra también los valores máximos y mínimos para ambos (todo esto
basado en el escenario 2). La forma de interpretar este grafico es la siguiente:
Chávez esta en algún punto del rango entre 39 y 49, con un promedio de 46%.
Capriles esta en el rango entre 27 y 43, con un promedio de 34. Estos rangos
tienen 5 puntos de coincidencia, que significa es esta elección todavía no se
ha decidido, especialmente si consideramos que la mayoría de estas encuestas se
realizo antes de que la campaña comenzara oficialmente y que la gente empezara
a prestarle atención a la elección.
Figura 11. Rango de predicción promedio corregida
****** Este post fue modificado el 1/Agosto/2012 debido a un error en la creación de la figura 9. Este error no altera ninguna de las estimaciones de sesgo presentadas en la última sección del artículo.
28 junio 2012
En sus marcas, listos, ...
Ya estamos por empezar oficialmente la campaña para las elecciones presidenciales que se llevaran a cabo el 7 de Octubre. Así que antes de que empiece la campaña es bueno ver donde están los números de los dos candidatos principales y cómo han evolucionado desde principios del 2011. Espero entonces traer un poco de perspectiva a este tan convulsionado espacio en el que abunda información que a su vez se contradice, generándole dolores de cabeza a más de uno que quiere saber qué está pasando. Sin más nada que decir comienzo a mostrar números y gráficos.
En la última entrega de Combinando las encuestas mostré que hasta hace un mes se podía decir que había un empate técnico; ya que aunque Chávez estaba por arriba en intención de voto, el error que arrojaba el análisis que hice era muy grande dadas las grandes diferencias entre las diferentes encuestas (Ver másdel post aquí). En esta oportunidad voy por una estrategia más sencilla mientras espero por más encuestas.
Comencemos entonces por ver cómo ha evolucionado la intención de voto por Chavez y por Capriles* desde Enero de 2011.
Al poner todas las encuestas, sin importar la encuestadora, y promediar los números en base al mes en el que se realizó la encuesta, podemos observar que el presidente Chávez cuenta con una intención de voto que ronda el 52%, mientras que el candidato de la oposición (Capriles Radonski) cuenta con un promedio del 30%. Es importante dejar claro, sin embargo, que hay un 18% de votantes que no han decidido que hacer.
Sin embargo, como hemostrado anteriormente, no todas las encuestadoras son iguales. Existen sesgos
inherentes a los cuestionarios, técnicas de muestreo, muestras, etc., que se
reproducen en las diferentes encuestas de una misma encuestadora de forma
bastante sistemática. Así pues, es necesario ver la evolución en base a como
cada encuestadora muestra la carrera.
Al hacer este ejercicio
podemos ver que hay un grupo de encuestadoras que muestra la elección más
cerrada, en estas encontramos a Consultores 21, Datanalisis, Keller, Hinterlaces y Varianzas; mientras que otras
como GIS XXI, ICS, IVAD y Consultores 30.11 muestran un escenario con una ventaja más
amplia a favor del candidato oficialista.
Hago un breve corte aquí para decirle al lector que el hecho de que el CNE ahora "regulará" a las encuestadoras no creo que vaya a repercutir en la confiabilidad de los datos, ni en disminuir las diferencias entre las encuestadoras, por el contrario dará una falsa sensación de calidad (como dije aquí).
Hago un breve corte aquí para decirle al lector que el hecho de que el CNE ahora "regulará" a las encuestadoras no creo que vaya a repercutir en la confiabilidad de los datos, ni en disminuir las diferencias entre las encuestadoras, por el contrario dará una falsa sensación de calidad (como dije aquí).
En un esfuerzo de entender mejor lo que sucede decidí seguir la forma en la que muchos se refieren a las encuestadoras en base a su trayectoria en el mercado venezolano. De esta forma podemos distinguir encuestadoras con una larga trayectoria (históricas) y otras de más reciente data (nuevas). Así pues agrupe en encuestadoras históricas a: Consultores 21, Datanalisis, Hinterlaces, IVAD y Keller; mientras que como encuestadoras nuevas puse a: Consultores 30.11, GisXXI, ICS y Varianzas.
Al hacer el promedio en
base a estas dos categorías obtenemos lo siguiente:
- - En el grupo de encuestadoras nuevas: el presidente Chávez cuenta con más del 50% de intención de votos, mientras que Capriles Radonski cuenta con alrededor del 25%.
- - En el grupo de encuestadoras históricas: el presidente Chávez cuenta con poco menos del 50% de la intención de votos, mientras que Capriles Radonski está en el 40%.
Feliz inicio de período electoral!
14 junio 2012
HCR: Consistencia de mensaje
El discurso de inscripción de la candidatura ante el CNE es el cuarto discurso importante que da Henrique Capriles-Radonski en su carrera a Miraflores. El primero fue cuando lanzó su candidatura, el segundo cuando vence en las primarias, y el tercero cuando recibe las credenciales de la Junta Electoral de la MUD. En todos estos discursos Capriles ha mantenido una consistencia de mensaje muy importante en una campaña electoral. Los temas de educación y progreso han sido hilo conductor de sus mensajes y de sus campañas y aunque hay obvia fluctuaciones en el grado de importancia que diferentes temas adquieren en momentos determinados la consistencia general sigue presente. Digo esto después de analizar tres de estos cuatro discursos, (1) el de lanzamiento, (2) el de la victoria en las primarias, y (3) el de su inscripción ante el CNE. Cada discurso muestra tanto la particularidad del evento como el mensaje global del candidato.
Por ejemplo, al ver las 20 palabras más frecuentes en cada discurso vemos las dinámicas particulares de cada momento. En el discurso de lanzamiento Capriles se presenta a el y a su "autobus del progreso", en el discurso de las primarias reitera su mensaje con un llamado importante a la "Unidad" -esta palabra no estaba en su discurso anterior-; finalmente en la inscripción de su candidatura incluye nuevas palabras relacionadas directamente al acto como "candidato" o "salgamos" (a votar).
En cuanto a la similitud de los discursos se puede decir que Capriles no solo utiliza los mismos elementos en sus diferentes mensajes sino que los utiliza en una proporción similar. Al hacer un análisis de frecuencias de las diferentes palabras se observa que estas se comportan de manera similar en los diferentes discursos. Esto es importante ya que permite al candidato afianzar su mensaje y al elector conocer al candidato. En general se puede ver que Capriles mantiene una consistencia de mensaje bastante alta, la única incosistencia que me pareció interesante con respecto a su inscripción ante el CNE fue la ausencia de la palabra "Camino" muy común de sus discursos anteriores y parte central de su mensaje de campaña.
Veinte palabras más frecuentes
Discurso de lanzamiento de candidatura
Discurso después de la victoria en las Primarias de la MUD
Discurso antes de la inscripción en el CNE
02 abril 2012
Los errores de las encuestas para las primarias
Finalmente
me senté a revisar las encuestas de las primarias a mi disposición comparándolas con los
resultados reales (reportados por el CNE). Antes de continuar aclaro que sólo tengo encuestas
publicadas en 2011 y nada publicado en enero o febrero del 2012. Sin embargo, creo que igual son datos que sirven para analizar el desempeño de las
diferentes encuestadoras más aún en el actual clima de guerra de encuestas en el que nos encontramos.
En total 25 encuestas de 6 encuestadoras fueron analizadas. Aquí pueden ver las encuestas en un gráfico.
En total 25 encuestas de 6 encuestadoras fueron analizadas. Aquí pueden ver las encuestas en un gráfico.
Que tanto acertaron las distintas encuestadoras?
La siguiente tabla muestra el número de veces que las encuestas dieron a Henrique Capriles-Radonski (cuando se le suma la intención de voto por Leopoldo López) a 5 o menos puntos de diferencia del resultado real, entre 5 y 15 puntos de diferencia y a más de 15 puntos de diferencia. Igual para Pablo Pérez (la segunda de las tablas). Como se puede observar sólo un número reducido de encuestas (6 para HCR y 5 para PP) logró estar a 5 o menos puntos de diferencia.
Una pregunta importante después de ver que que tanto se equivocaron las encuestas es saber si estos errores fueron iguales para ambos candidatos. Esto lo digo porque en un contexto de dos candidatos hay tres tipos de formas de cometer error:
a) Errores similares para ambos candidatos. Es decir que si una encuesta, comparada con el porcentaje de votos reales, dio 5 puntos más a un candidato, le dio 5 puntos menos al otro.
b) Errores inversos para los candidatos. Es decir, mientras más se equivocaba en un candidato menos se equivocaba con el otro.
c) Error constante para uno y variable para otro candidato. Es decir, con un candidato acertó el resultado mientras que con el otro no.
Para ver estos comportamientos realicé un análisis en dos etapas. Primero comparé que tanto se equivocaron el conjunto de las encuestas para cada candidato y segundo evalué el comportamiento de las encuestas por casa encuestadora para ver si existen patrones diferentes para cada una.
Comparando la diferencia de votos estimados y reales
La primera etapa consistió en ver que tan lejos estuvieron las encuestas de la realidad electoral comparando la diferencia entre el porcentaje de votos obtenido por Henrique Capriles Radonski (60.39%) y los números de cada una de las encuestas. Lo mismo para el candidato de UNT (y cia.) Pablo Pérez quien obtuvo 30.69%. Estas medidas obtenidas van de 0 a 44 puntos, esto significa que mientras algunas encuestas básicamente acertaron los resultados otras se pelaron por bastante. Debido a que las encuestas analizadas se hicieron antes de la alianza entre Leopoldo López y Capriles Radonski analicé también la diferencia entre el porcentaje de votos de Capriles y la suma de los porcentajes de intención de voto de Capriles y López. La siguiente tabla muestra algunas medidas estadísticas de estas tres variables.
a) Errores similares para ambos candidatos. Es decir que si una encuesta, comparada con el porcentaje de votos reales, dio 5 puntos más a un candidato, le dio 5 puntos menos al otro.
b) Errores inversos para los candidatos. Es decir, mientras más se equivocaba en un candidato menos se equivocaba con el otro.
c) Error constante para uno y variable para otro candidato. Es decir, con un candidato acertó el resultado mientras que con el otro no.
Para ver estos comportamientos realicé un análisis en dos etapas. Primero comparé que tanto se equivocaron el conjunto de las encuestas para cada candidato y segundo evalué el comportamiento de las encuestas por casa encuestadora para ver si existen patrones diferentes para cada una.
Comparando la diferencia de votos estimados y reales
La primera etapa consistió en ver que tan lejos estuvieron las encuestas de la realidad electoral comparando la diferencia entre el porcentaje de votos obtenido por Henrique Capriles Radonski (60.39%) y los números de cada una de las encuestas. Lo mismo para el candidato de UNT (y cia.) Pablo Pérez quien obtuvo 30.69%. Estas medidas obtenidas van de 0 a 44 puntos, esto significa que mientras algunas encuestas básicamente acertaron los resultados otras se pelaron por bastante. Debido a que las encuestas analizadas se hicieron antes de la alianza entre Leopoldo López y Capriles Radonski analicé también la diferencia entre el porcentaje de votos de Capriles y la suma de los porcentajes de intención de voto de Capriles y López. La siguiente tabla muestra algunas medidas estadísticas de estas tres variables.
Esta figura muestra un poco mejor estas relaciones. Cada punto en el grafico es la comparación del error de una encuesta con respecto a Capriles vs el error con respecto a Pablo Pérez.
En un mundo ideal la tendencia del error seria una línea inclinada que indique que la encuesta se equivocó igual para ambos candidatos. Otras opciones serían una línea recta que indicaría que las encuestas variaron en el error de un candidato mientras que no variaron para el otro. Una tercera alternativa sería una relación inversas, a mayor error de un candidato menor del otro (esta es un poco más difícil que ocurra pero puede suceder en caso por ejemplo de que lo que este cambiando sean los indecisos).
Como se puede ver en la
gráfica la relación del conjunto de las encuestas es bastante buena a medida
que aumenta el error para un candidato aumenta para el
otro. Sin embargo hay dos encuestas que rompen un poco con este patrón de
“igualdad de errores”. Estas dos son los dos puntos negros (que indican encuestas
de datanalisis) cerca del 20. Como da a entender la grafica estas dos encuestas
tuvieron un mayor error para Pablo Pérez que para Henrique Capriles.
Es importante destacar que cuando se
evalúa la diferencia entre la alianza Capriles-Leopoldo y Pablo Pérez los
resultados son similares.
Todas las encuestadoras se equivocaron igual?
La segunda
parte del análisis consistió en revisar los errores por casa encuestadora. En
la siguiente figura podemos ver parte de este análisis. En este gráfico hay dos datos resaltantes. El
primer hecho resaltante es que hay una encuestadora (Datanalisis) que tiene un
patrón de errores completamente distinto al resto. Este patrón consiste en que
a mayor el error hacia Capriles Radonski y menor el error hacia Pablo Pérez, y
viceversa. El segundo dato relevante es que hay dos encuestadoras (IVAD y
Keller) cuyos errores son bastante elevados tanto para Capriles como para Pablo
Perez.
Esto ultimo queda resaltado cuando se realiza un
analisis estadístico del error. Los resultados de este modelo lineal dicen lo
siguiente:
1) No existe relación entre el error hacia Pablo Pérez y hacia
Henrique Capriles.
2) Las encuestadoras IVAD y Keller dan
mayor error a Capriles Radonski que el resto de las encuestadoras (19 y 16
puntos respectivamente).
3) Cuando se considera solo la
intención de voto para Henrique Capriles las encuestadoras tuvieron un error
promedio de 17 puntos, sin embargo al considerar la alianza Capriles-Leopoldo
el erro promedio bajó a 0.
A quien desee ver los resultados específicos del modelo aquí le dejo la tabla del análisis. Si quieren más detalle me pueden mandar un mensaje.
Suscribirse a:
Entradas (Atom)




























