FÚTBOL & TECNOLOGÍA
De dónde sacan los datos las aplicaciones de deportes
Nadie escribe a mano los resultados de cada jornada. Las aplicaciones los leen de una fuente que los publica. Lo interesante es lo que pasa después: los datos reales casi nunca llegan limpios.
Una fuente que todos pueden leer
Existen proyectos abiertos que publican los resultados de las ligas para que cualquiera los use. Uno de ellos es openfootball, cuyos datos están dedicados al dominio público: se pueden usar sin pagar y sin pedir permiso.
Para esta guía usé la temporada 2025/26 de la Premier League: 380 partidos jugados, cada uno con sus equipos, la fecha y el marcador.
Los datos reales vienen con sorpresas
Al revisarlos encontré dos cosas que habrían dañado la tabla si nadie las hubiera visto:
- El marcador no siempre se escribe igual. En 27 de los 380 partidos el resultado venía en otro formato que en los otros 353. Un sistema que solo entiende uno de los dos se habría saltado esos partidos sin avisar.
- Los nombres no son uniformes. Aparecen como "Liverpool FC" o "AFC Bournemouth". Para el sistema, "Liverpool" y "Liverpool FC" serían dos equipos distintos, así que hay que unificarlos.
Ninguno de los dos problemas es grave si se detecta a tiempo. El peligro está en no mirar.
Cómo saber si las cuentas están bien
Con los partidos ya limpios calculé la tabla completa y la comparé con la tabla publicada por otra fuente distinta, TheSportsDB. Los cinco primeros coincidieron en puntos y goles:
- Arsenal: 85 puntos, 71 goles a favor y 27 en contra.
- Manchester City: 78 puntos.
- Manchester United: 71 puntos.
- Aston Villa: 65 puntos.
- Liverpool: 60 puntos.
Comparar contra otra fuente es lo que da confianza. Dos listas hechas por separado que dan el mismo resultado es mucho más sólido que confiar en una sola.
Qué tiene que ver con tu negocio
Casi todos los negocios reciben datos de afuera: la lista de precios de un proveedor, el archivo de un cliente, el reporte de un banco. Y casi siempre llegan con el mismo tipo de problemas: formatos distintos, nombres escritos de varias maneras, filas que faltan.
Un buen sistema no asume que los datos están bien. Los revisa al entrar, unifica lo que viene distinto y, cuando es importante, los compara contra otra fuente antes de usarlos.
Qué sigue en esta serie
En la próxima guía hablo de lo que pasa con esa información una vez que el sistema la tiene: dónde se guarda y cómo se protege.