[36] Le contrôle de rejouabilité tourne aussi sur le serveur #181
No reviewers
Labels
No labels
Compat/Breaking
EC01
EC02
EC03
EC04
EC05
EC06
Kind/BDD
Kind/Back
Kind/Bug
Kind/CICD
Kind/Cloud
Kind/Contenu
Kind/Data
Kind/Documentation
Kind/Enhancement
Kind/Feature
Kind/Front
Kind/IA
Kind/Infra
Kind/Monitoring
Kind/Security
Kind/Testing
Portée/Post-jury
Priority
Critical
Priority
High
Priority
Low
Priority
Medium
Reviewed
Confirmed
Reviewed
Duplicate
Reviewed
Invalid
Reviewed
Won't Fix
Status
Abandoned
Status
Blocked
Status
Need More Info
ops/alerte
No milestone
No project
No assignees
2 participants
Notifications
Due date
No due date set.
Dependencies
No dependencies set
Reference
g2/enervision!181
Loading…
Reference in a new issue
No description provided.
Delete branch "olivier/36-entrainement-modele"
Deleting a branch is permanent. Although the deleted branch may continue to exist for a short time before it actually gets removed, it CANNOT be undone in most cases. Continue?
Deux lignes dans
services/inference/bin/entrainer.sh.--deux-passes, le contrôle qui sert le quatrième critère du #36, ne pouvait pas tourner sur le serveur de la salle — c'est-à-dire au seul endroit où le ticket demande qu'il tourne.Le défaut
mktemp -t passe1-36complète le motif tout seul sur macOS. GNU coreutils, lui, exige lesXXXXXXet refuse. Le job sortait donc en échec avant d'avoir lu une seule ligne de la base, avec un message qui parle de fichier temporaire et non de modèle.La passe unique n'était pas touchée : elle ne crée aucun fichier temporaire. Seul le chemin de rejouabilité tombait, ce qui explique qu'il soit passé inaperçu jusqu'ici — l'entraînement du 07/09 s'était joué sans lui.
La preuve
Rejoué depuis ce commit, sur
enervision_prod, avec le venv du serveur :Deux entraînements sur des bornes figées, tableaux comparés ligne à ligne, aucun écart. Le quatrième critère du #36 est constaté sur les données de production, et non plus seulement affirmé.
Ce que la relecture doit savoir
Aucun test ne couvre
entrainer.sh, et ça reste vrai après ce correctif. C'est ce qui a laissé l'écart entre les deuxmktemptraverser la #166 : les 95 tests detests/unit/model/portent tous sur le paquet Python, jamais sur le lanceur. Un banc qui jouerait--deux-passescontre un module bouchonné fermerait la porte ; il n'est pas dans cette branche, qui se limite au défaut constaté.Un point de méthode est apparu en rejouant l'entraînement, sans rapport avec ce diff mais qui concerne le #36 : le critère « MAE sur les trois derniers jours » de l'ADR 0013 change de signe selon le jour où on le lance, parce que trois jours tombent parfois sur un week-end — où la série est bien plus plate et la persistance quasi imbattable.
Deux promotions ont déjà été décidées sur des fenêtres différentes. Le sujet mérite une décision de groupe plutôt qu'un arbitrage dans une branche : il n'est pas traité ici.
Approuvée. Deux lignes, et
mktemp -t modele.XXXXXXmarche sur GNU comme sur BSD.Le diagnostic est juste : la passe unique ne crée aucun temporaire, donc seul le chemin de rejouabilité tombait. C'est ce qui explique qu'il ait traversé la #166.
Rien à redire sur le diff. Ce qui suit ne le concerne pas et ne doit pas le retenir.
Ce que j'ai vu en vérifiant, et qui va au #36
J'ai relevé les huit entraînements de MLflow sur le serveur :
Ton tableau est confirmé, et il porte plus loin que tu ne l'écris.
Le modèle en ligne ne satisfait pas le critère écrit. L'ADR 0013 dit « l'alias
productionne se déplace que si la MAE du candidat sur les trois derniers jours est strictement inférieure à celle de la persistance ». Sur trois jours il perd de 14,9. La v6 porte pourtant l'alias.Et le 2,018 de la #166 n'est reproductible par aucun autre run. Tous les suivants tombent entre 16 et 25. Ce chiffre est dans le corps de la #166 fusionnée, et je l'ai repris dans la demande vers
main.Je porte ça au #36. Ta demande n'attend pas cette décision.