Jeje, ta gracioso el chiste, pero bueno ya que me brindas la ocasion, aprovecho:
Eso se llama sesgo confirmatorio: ignorar la evidencia que no te interesa. Para evaluar la fiabilidad se debe saber no solo en cuantas ocasiones acierta, sino tambien en cuestas ocasiones no acierta.
Por ejemplo, si cada dia predices que va a haber un evento determinado a 7 dias vista, tarde o temprano vas a acertar.
Como dicen en ingles: 'hasta un reloj roto da la hora correcta dos veces al dia'
jejjeje eso se llama Tergiversar: Desfigurar o interpretar erróneamente o a proposito palabras o sucesos. Yo no digo que siempre acierta, yo digo que también lo hace. No evaluó el modelo, para eso están los reanalisis que imagino que no haga falta decir como funcionan. Por cierto mi "reloj" cuando no funciona no marca dos veces la hora correcta, es digital. 
Jaja, vale, vamos a jugar a probabilidades mientras llega el frente...
Si es verdad que no dijiste que siempre acertaban. Y yo no dije que nunca acertaban. Yo lo que dije es que no tiene sentido consultarlos mas alla de 5 dias por que eso es como consular un dado (o una moneda): tambien 'acierta' si lo tiras suficientes veces. Con eso no quiere decir que uno tenga que prestarle atencion como instrumento de pronostico.
No evaluaras los modelos explicitamente pero implicitamente los valoramos, si no no los consultariamos. Un modelo tiene valor en tanto en cuanto acierta mas a menudo de lo que no acierta; y los reanalisis muestran que mas alla de 5 dias los modelos son esencialmente 'dados', es decir, la probabilidad de que acierten es tan alta como que no acierten.
Por cierto que un modelo que
nunca acierta es tan valioso como uno que siempre lo hace: nos dice lo contrario de lo que realmente va a ocurrir.
Incluso un reloj
de pared roto da la hora correcta dos veces al dia