Aller au contenu principal
OceanData Consulting
Scoreboard · méthode

Comment ces chiffres sont produits

Ce que mesure le scoreboard, avec quelles données, et ce que ses chiffres ne valent pas encore. Sans cette page, le tableau n’est pas vérifiable.

← Retour au scoreboard

Principe

Un post-traitement du modèle physique, pas un remplacement

L'IA ne produit pas une prévision de zéro : elle corrige celle du modèle physique officiel.

Chaque jour à 06 h UTC, le pipeline récupère la prévision physique de référence pour chaque station, puis un modèle de post-traitement appris sur l’historique de cette même station en corrige la sortie sur les 48 heures à venir.

Pour la hauteur significative de houle, cette référence n’est pas la même partout : cinq modèles de vagues sont comparés station par station — Météo-France (MFWAM), ECMWF WAM, DWD EWAM et GWAM, NCEP GFS-Wave — et celui qui prévoit le mieux le site devient sa référence. C’est donc au meilleur des cinq que l’IA est confrontée, pas à un modèle choisi une fois pour toutes ; le modèle retenu est nommé sur le tableau et sur chaque page de station. Pour le niveau d’eau, la référence est une analyse harmonique de marée.

Le modèle de post-traitement lui-même est choisi automatiquement, station par station, à l’entraînement, et son identité est nommée au même endroit que la référence physique. Trois familles existent : un gradient boosting (histogram gradient boosting, « hgb »), une régression linéaire régularisée (« ridge »), ou un gradient boosting distinct par tranche d’échéance — 1 à 12 h, 13 à 24 h, 25 à 48 h (« hgb-per-lead »). Une station qui tourne en ridge n’est pas une station où le modèle a échoué à faire mieux : c’est le plancher de comparaison du projet, la régression linéaire captant déjà le gain sur cette station sans qu’un modèle plus sophistiqué y ajoute quoi que ce soit de mesurable. Le nom du modèle n’est publié que lorsqu’il est identifiable ; à défaut, aucun n’est inventé et rien ne s’affiche à sa place.

Le modèle prend en entrée la prévision physique elle-même, l’erreur récente de cette prévision face aux observations, et un forçage de vent 10 m. Pour les marégraphes, il ne prédit que le résidu — l’écart entre l’observation et l’harmonique — et le niveau publié est reconstitué en « harmonique + résidu prédit ».

Le lendemain, la prévision émise la veille est confrontée aux observations réellement arrivées, et l’erreur absolue moyenne du jour est calculée pour l’IA comme pour la physique, sur exactement les mêmes points. Rien n’est réécrit après coup : une journée sans observation exploitable reste marquée comme manquante et n’entre dans aucune moyenne.

Tous les horodatages du scoreboard, de son API et de ses graphiques sont en UTC.

Mise en ligne

Une station qui ne gagne rien ne publie aucun chiffre d’IA

Une station n'est publiée que si le modèle y gagne au moins 5 % de MAE sur la prévision physique. Les autres restent affichées, sans chiffre.

Sous ce seuil, le modèle ne trouve pas de signal exploitable dans les données actuelles pour cette station. Elle reste listée sur le scoreboard, suivie, et sans chiffre d’IA — la retirer rendrait les autres invérifiables. Le tableau du scoreboard nomme celles qui sont actuellement dans ce cas, et l’indique sur chaque ligne.

Une station peut aussi passer le seuil tout en portant une réserve supplémentaire : le modèle n’y bat pas sa propre baseline une fois celle-ci débiaisée. Son gain affiché est alors d’abord une constante retirée à la prévision physique, pas du savoir météo-océanique. Ces stations sont signalées comme telles, sur le tableau comme sur leur page de détail.

Limites assumées

Ce que ces chiffres ne valent pas encore

Quatre réserves qui portent sur le gain affiché lui-même. Elles sont mesurées, pas rhétoriques.

Une part du gain n’est qu’une correction de biais

Évaluation d’entraînement du 3 août 2026, gain affiché puis gain une fois retiré à la prévision physique son seul biais moyen — Les Pierres Noires +25,8 % → +25,9 % ; Belle-Île +14,1 % → +11,7 % ; Cherbourg +19,3 % → +3,0 % ; Anglet +9,8 % → +5,4 % ; Brest +22,9 % → −5,4 % ; Saint-Malo −13,4 % → −14,1 %. Aux Pierres Noires, le gain ne doit rien au biais. À Cherbourg et à Brest, il en vient presque entièrement : c’est pourquoi la première n’est pas publiée et la seconde porte une réserve. Le chiffre à citer est toujours le second.

Les marégraphes sont encore entraînés sur du vent de réanalyse

Un modèle entraîné sur un vent connu après coup, puis servi avec un vent prévu, est évalué trop favorablement : la prévision porte une erreur d’échéance que la réanalyse n’a pas. Le ré-entraînement du 3 août 2026 a levé cette réserve sur les stations de houle — leur forçage d’entraînement vient désormais d’archives de prévisions réellement émises (ARPEGE Europe, ECMWF IFS, ICON-EU), soit exactement le type de donnée reçu en production. Elle reste entière sur les deux marégraphes, toujours entraînés sur la réanalyse ERA5 : leurs chiffres sont optimistes tant qu’ils n’ont pas été ré-entraînés à leur tour.

Les échéances 25–48 h sont scorées avec un jour de retard

Une journée n’est d’abord scorée que sur les échéances dont l’observation existe déjà, soit les 24 premières heures ; le reste de l’horizon est marqué en attente et complété lors d’un run ultérieur, quand les observations arrivent. Une journée récente peut donc être affichée sur 24 h d’abord, puis sur 48 h. Aucune valeur n’est réécrite : seules des échéances manquantes sont ajoutées.

Les longues échéances de la référence sont approchées à l’entraînement

La baseline d’entraînement des stations de houle est reconstituée depuis les archives de prévisions Open-Meteo, qui restituent surtout les runs les plus frais : les échéances lointaines y sont mieux représentées que ce qu’un run réel de 48 h aurait donné. Le modèle a donc appris à corriger une référence légèrement trop bonne aux grandes échéances. Le pipeline archive chaque jour la prévision réellement servie pour lever cette approximation à son tour.

Sources et crédits

D’où viennent les données

Les attributions ci-dessous sont des obligations de licence attachées aux données utilisées, pas des remerciements.

  • Candhis — Cerema

    Observations de houle (Hs) des quatre bouées : Les Pierres Noires, Belle-Île, Anglet, Cherbourg extérieur.

    Données de houle in situ : réseau Candhis, Cerema.

  • REFMAR — SHOM

    Observations de niveau d’eau des marégraphes RONIM de Brest et Saint-Malo, en quasi temps réel.

    Données marégraphiques : SHOM / REFMAR.

  • Open-Meteo

    Prévisions de houle des cinq modèles physiques comparés — Météo-France (MFWAM), ECMWF WAM, DWD EWAM et GWAM, NCEP GFS-Wave — dont celui retenu par station comme référence. Vent à 10 m également : archives de prévisions ARPEGE Europe, ECMWF IFS et ICON-EU pour l’entraînement des stations de houle, réanalyse ERA5 pour celui des marégraphes, prévision ARPEGE Europe pour l’inférence.

    Weather and marine data by Open-Meteo.com — Météo-France MFWAM and ARPEGE, ECMWF WAM and IFS, DWD EWAM/GWAM and ICON, NCEP GFS-Wave, and ERA5 reanalysis (Copernicus Climate Change Service / ECMWF), served under CC BY 4.0.

    L’offre gratuite d’Open-Meteo est réservée à un usage non commercial. Ce scoreboard est public, sans publicité ni accès payant : l’usage est non commercial et assumé comme tel. Une monétisation de cette page imposerait de basculer sur l’offre payante d’Open-Meteo ou sur les sources primaires (CDS pour ERA5, Météo-France pour ARPEGE).

Intégrer le badge

Afficher le verdict d’une station sur votre propre site

Un badge compact, en iframe, avec la MAE 7 jours de la station et un lien vers sa page de détail sur le scoreboard. La ligne d’attribution sous le badge fait partie du code à copier : un lien placé à l’intérieur de l’iframe reste, pour un moteur de recherche, un lien de notre site vers lui-même — seul celui posé dans votre page signale la source.

<iframe src="https://oceandataconsulting.fr/scoreboard/widget/brest" width="320" height="180" style="border:0" loading="lazy" title="Metocean Scoreboard — brest"></iframe>
<p><a href="https://oceandataconsulting.fr/scoreboard/brest">Scoreboard metocean IA — OceanData Consulting</a></p>
Qui publie ce scoreboard

OceanData Consulting

Ce scoreboard est produit et publié par OceanData Consulting, cabinet indépendant de modélisation océanique et d’analyse de données marines. Le pipeline qui l’alimente est ouvert : le code, la configuration des stations, les verdicts de mise en ligne et les fichiers de résultats quotidiens sont consultables et rejouables.