¿Puede la IA adivinar qué número saldrá en la lotería?
Algunos medios en Costa Rica usan esa pregunta para atraer lectores. En Caja de Arena nos dimos a la tarea de experimentar con la premisa y estos son nuestros resultados.
.jpg)
No, fin de la historia. Sin embargo, aún así hicimos la prueba, pero...
¿Por qué preguntar lo obvio?
Hace unos días publicamos en Caja de Arena el experimento titulado "El país que le pregunta a la máquina por el número ganador" donde analizamos 9.025 notas de la prensa costarricense publicadas entre enero y septiembre de 2026 y extraídas mediante www.mihaiku.com. De las 1.472 que mencionaban inteligencia artificial, 61 eran predicciones de lotería y fútbol. Ese grupo resultó el más anclado en el país, con actores nacionales en el 60,7% de los casos, y el menos cuestionado: ninguna de esas notas fue clasificada con tono negativo.
La conclusión general del análisis fue que la prensa transcribe más de lo que interroga. Este experimento hace la pregunta que faltaba sobre ese marco: si la máquina realmente adivina. La respuesta se conoce desde antes de empezar, pero conocerla no es lo mismo que demostrarla con los datos oficiales del país y con las notas que efectivamente circularon. Por eso lo medimos.
El experimento tiene tres partes. Primero, contrastamos cada número que la prensa atribuyó a una IA con el resultado oficial del sorteo. Segundo, construimos 32 métodos de predicción, desde el conteo de frecuencias hasta una red neuronal, y los pusimos a competir contra el azar. Tercero, dejamos que el modelo ganador predijera 2026 en las mismas fechas que la prensa.
El oráculo semanal
Catalogamos 50 notas que publicaron números atribuidos a una inteligencia artificial para sorteos de la Junta de Protección Social (JPS), entre diciembre de 2024 y septiembre de 2026. La Teja publicó 46 de ellas, NCR Noticias tres y El Financiero una. Desde finales de 2025, La Teja convirtió el formato en una sección casi fija para los domingos de Lotería Nacional y los martes y viernes de Chances.
Ver los datos
Las notas rara vez dicen qué inteligencia artificial usaron. Solo una de las 46 de La Teja la nombra en el cuerpo del texto; en las demás, ChatGPT o Gemini aparecen únicamente en el crédito de la imagen. Casi todas cierran con la leyenda «Nota realizada con ayuda de IA»: la herramienta que supuestamente elige el número también redacta la nota que lo anuncia.
Ciento seis números, un acierto
Las 50 notas publicaron 106 números. Los contrastamos todos con el primer premio oficial de cada sorteo. Hubo un acierto. Una persona que eligiera números completamente al azar, en los mismos sorteos y en la misma cantidad, habría acertado en promedio 1,06 veces. La prensa acertó exactamente lo que acierta el azar.
Ver los datos
El único acierto merece contexto. El 18 de noviembre de 2025, una nota publicó quince números distintos para un mismo sorteo de Chances, y uno de ellos fue el 32, que salió esa noche. Cubrir quince de cien números da una probabilidad de 15 % de atinar a alguno. Ninguna de las 42 combinaciones de número y serie publicadas, que es lo que paga el premio mayor, coincidió con el resultado.
La huella de la máquina
Los números publicados no se reparten como lo haría el azar. El 27 apareció en siete notas distintas y la serie 318 en cinco. Simulamos 10.000 catálogos en los que cada nota elige al azar, y una repetición así aparece con probabilidad de 0,3 % para el 27 y de 0,01 % para el 318. Cuarenta de los cien números posibles nunca fueron publicados.
Ver los datos
Esa concentración no dice nada sobre los sorteos; dice algo sobre la herramienta. Un generador de texto que «elige al azar» repite preferencias propias, y una redacción que lo consulta cada semana las acumula. La combinación 47-318 se publicó para dos sorteos distintos, en diciembre de 2025 y en mayo de 2026. El 47, además, no salió en ningún sorteo ordinario entre 2019 y 2025.
Lo que promete el titular
De las 50 notas, 36 aclaran en el cuerpo que la combinación no tiene más probabilidad que cualquier otra. Esa aclaración convive con justificaciones que la contradicen. Una nota de junio afirma que no existe cálculo capaz de anticipar el resultado y, más adelante, que «los números de la misma familia suelen mantener cierta inercia». Otras invocan patrones estadísticos, combinaciones poco repetidas o numerología.
Ver los datos
Catorce notas no aclaran en ningún lugar que el resultado depende del azar, y cinco titulares sugieren directamente que la inteligencia artificial sabe qué saldrá. La distancia entre titular y cuerpo explica el tono neutro que CA-001 encontró en este marco: la nota no afirma nada falso de forma literal, pero el lector de titulares recibe la promesa sin la aclaración.
Treinta y dos maneras de intentarlo
La segunda parte del experimento abandona la prensa y prueba la pregunta en serio. Usamos los resultados oficiales publicados por la JPS en su portal de datos abiertos: 247 sorteos ordinarios de Lotería Nacional y 6.325 sorteos de Nuevos Tiempos entre 2019 y 2025 (Junta de Protección Social [JPS], 2026). Cada juego se analizó por separado.
Construimos 32 métodos de predicción en nueve familias. Entre ellas están las intuiciones populares, como los números calientes, los fríos o la repetición del último resultado; los métodos estadísticos, como las frecuencias con suavizado y las cadenas de Markov; y el aprendizaje automático, con una regresión logística y una red neuronal. Cada método asigna una probabilidad a cada uno de los cien números usando solo sorteos anteriores.
Ver los datos
Las reglas se fijaron por escrito antes de tocar los datos. El 60 % más antiguo de los sorteos sirvió para entrenar, el 20 % siguiente para elegir al mejor método y el 20 % más reciente quedó guardado bajo candado para un único examen final. La métrica fue la ventaja en log loss frente al azar: cuánta más probabilidad asigna el modelo al número que efectivamente sale.
Nuevos Tiempos: el azar ganó la competencia
En Nuevos Tiempos, con 1.265 sorteos de validación, ninguno de los otros 31 métodos superó al azar. Ni la red neuronal ni los números calientes lograron asignar más probabilidad al resultado real que una distribución uniforme. El ganador de la competencia fue, por lo tanto, el propio azar, y en el examen final empató con él por definición.
Este resultado tiene peso porque la prueba tenía potencia. Con 1.265 sorteos en el examen final, un sesgo del 14 % en la frecuencia de algún número habría sido detectable. No apareció ninguno. El veredicto preregistrado es que no hay evidencia de predictibilidad: los datos oficiales de siete años no contienen un patrón que estos métodos pudieran aprovechar.
Lotería Nacional: un ganador que el azar fabrica
En Lotería Nacional, el método de frecuencias ganó la competencia con una ventaja pequeña sobre el azar. En el examen final, con 50 sorteos, mantuvo una ventaja mínima cuyo intervalo de confianza incluía el cero. Para saber si eso significaba algo, repetimos el procedimiento completo, con los 32 métodos y la misma competencia, sobre 1.000 loterías simuladas.
Ver los datos
En el 87 % de esas loterías justas, algún método le ganó al azar durante la competencia. Solo el 20 % siguió ganando en el examen final. Un ganador como el real apareció en una de cada diez loterías justas. Con 247 sorteos no es posible distinguir un sesgo pequeño del ruido: el veredicto preregistrado es que los datos son insuficientes.
Los fríos ya estaban previstos
La fábrica de patrones también opera sobre los datos reales. En los 247 sorteos ordinarios, diez números nunca salieron y el 60 salió ocho veces, más del triple de lo esperado. Parece una señal. Sin embargo, una lotería perfectamente justa con 247 sorteos produce en promedio 8,4 números ausentes, y la distribución observada calza con la que predice el azar.
Ver los datos
El 60 que nunca salió
La última prueba enfrentó al modelo ganador con la prensa en el mismo terreno. Sin modificarlo, le pedimos predecir los 32 sorteos ordinarios de 2026, del 4 de enero al 27 de septiembre, cada uno con la información disponible antes de la fecha. Ninguno de esos sorteos había participado en el entrenamiento, la competencia ni el examen final.
Ver los datos
El modelo recomendó el 60 como número más probable en las 32 fechas, por ser el más frecuente del período anterior. El 60 no salió ni una vez. En los 18 sorteos para los que La Teja publicó un número, la prensa acertó cero veces y el modelo también. Su ventaja global sobre el azar fue mínima y no distinguible del ruido: una de cada siete secuencias aleatorias la iguala.
Cuánto habría que esperar
La razón de fondo es aritmética. Una lotería con cien números posibles exige una cantidad enorme de sorteos para revelar un sesgo pequeño. Detectar que un número sale un 3 % más de lo que debería requiere unos 27.500 sorteos de prueba: 528 años de Lotería Nacional al ritmo de un sorteo semanal, o 30 años de Nuevos Tiempos.
Ver los datos
La segunda pregunta
Ninguna inteligencia artificial, la de la prensa ni la nuestra, adivinó la lotería. El hallazgo útil es otro: el procedimiento que produce titulares, consultar muchas veces y quedarse con lo que parece funcionar, fabrica patrones convincentes a partir de puro azar. Un medio que hace la segunda pregunta no necesita más tecnología, sino separar los datos con los que se elige de los datos con los que se comprueba.
Metodología
Notas de prensa. El catálogo combina 39 notas encontradas en el corpus de CA-001 mediante un filtro documentado y 11 notas halladas por búsqueda web. Cada número se transcribió del texto literal de la nota. Los resultados oficiales provienen de los reportes históricos de datos abiertos de la JPS, de las listas oficiales de cada sorteo y de un compilado de resultados de 2026 verificado contra ellas.
Prueba contra el azar. Para la prensa se usó una distribución nula exacta que trata al sorteo, y no a la nota, como unidad independiente. Para los modelos se usó un gemelo sintético que repite la selección completa sobre loterías justas, de modo que el valor p descuenta la búsqueda entre 32 métodos. Las repeticiones entre notas se evaluaron con 10.000 simulaciones.
Controles. El protocolo, los cortes de datos y la regla de veredicto se versionaron antes de entrenar. El examen final se ejecutó una vez detrás de un candado que registra cada acceso. Un error en tres métricas secundarias obligó a una segunda lectura autorizada, que verificó que la métrica principal y los veredictos no cambiaban. Ambas lecturas constan en el registro.
Limitaciones. El catálogo no incluye todas las notas publicadas, sino las halladas en el corpus y en la búsqueda. Los parámetros de cada juego se verificaron por observación de los datos oficiales y no contra el reglamento. La comparación de 2026 entre prensa y modelo es descriptiva: con 18 sorteos, ninguna diferencia sería distinguible. Este análisis no recomienda números ni estrategias de juego.
Reproducción. Código, datos, protocolo y registro de decisiones están en el repositorio del experimento. Las cifras de este texto se regeneran con uv run jps-lottery build-report. Los datos de cada figura están en la carpeta datos/ y la lista de las 50 notas analizadas, con sus enlaces, en las 50 notas analizadas.
Referencias
Ávalos Elizondo, M. (2026, 14 de septiembre). El país que le pregunta a la máquina por el número ganador (Experimento CA-001). Caja de Arena. https://www.cajadearena.com/experimentos/el-pais-que-le-pregunta-a-la-maquina-por-el-numero-ganador
Junta de Protección Social. (2026). Reportes de números favorecidos 2019–2025 de Lotería Nacional, sorteos extraordinarios, Lotería Popular y Nuevos Tiempos [Conjuntos de datos]. https://www.jps.go.cr/transparencia/datos-abiertos
Fuente: análisis propio con datos de la Junta de Protección Social y del corpus de CA-001.
Ficha técnica
- CA-007
- Experimento
- Completado
- 10 min
- Python · Vega-Lite
- La prensa publicó 106 números y acertó uno; el azar habría acertado 1,06. Ninguno de los 32 métodos propios le ganó al azar.