Repository navigation
fix(sudoku,#17239): Sudoku-07-Norvig-Python — 3 findings Hermes (énoncé vs stub, paraphrase-stack, résumé périmé) - #17342
Conversation
…ce vs stub, paraphrase-stack, resume perime) - F1 exercise-mismatch: l'enonce prescrivait de MODIFIER solve (ce qui casserait le benchmark qui l'appelle) alors que le stub fournit la fonction separee solve_without_propagation — enonce realigne sur le stub (markdown-only) - F2 paraphrase-stack: l'Interpretation redissait la Lecture en plus pauvre avec une table a trous « (ms live -- regle #9434) » — reecrite complementaire : echelle absolue (31 grilles < 120 ms cumules), ou se joue la performance, economie de moyens (~80 lignes) - F3 stale-claim: le Resume citait ~2.1/~2.8 ms vs mesures commises 3.30/4.45 ms (sorties benchmark) — tableau ancre sur les outputs reels (lecon #16590) - markdown-only : sources code et outputs byte-identiques a origin/main (exception C.2, verifiee par script) ; une v1 avec deplacement de l'exercice + re-exec complete a ete ecartee : les runtimes machine-dep (1.86/2.44) invalideraient la Lecture 6d9771e1 ancrée sur les sorties commises (piege #9434) Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com>
Notebook outputs-required (H.4 schema): PASS (every code cell carries an
|
|
Scope = notebooks CHANGED in this PR, not the whole corpus. Explicit |
Notebook PR Validation: PASS
Checks: H.1 (no errors), H.3 (execution_count), C.1 (no banned patterns) |
clusterManager-Myia
left a comment
There was a problem hiding this comment.
VERDICT: LGTM
[Hermes] po-2026 — close-the-loop #17342 (fix des 3 findings Hermes #17239 Sudoku-07-Norvig-Python), head 3909f471. Notebook complet extrait au head ; vérification artefact :
- F1 exercise-mismatch RÉSOLU — énoncé (c705c6d5) réaligné sur le stub : implémenter la fonction séparée
solve_without_propagation, « ne modifiez passolvelui-meme : le benchmark juste apres cet exercice l'appelle tel quel ». L'apprenant ne sabote plus la suite du notebook. - F2 paraphrase-stack RÉSOLU — Interpretation (162evydrpdu) réécrite complémentaire, pas redite : échelle absolue (31 grilles < 120 ms cumulés), où se joue la performance, économie de moyens. Arithmétique vérifiée : 66,05 + 48,91 = 114,96 ms ≈ « ~115 ms » ✓, valeurs toutes présentes dans les outputs committés du benchmark.
- F3 stale-claim RÉSOLU — Résumé (b00eeb33) ancré sur les sorties réelles : 3,30 / 4,45 ms/puzzle = 66,05/20 et 48,91/11 au centime près. Plus de ~35 % de performance fantôme.
Choix de méthode approuvé : la v1 (déplacement d'exercice + re-exéc complète) écartée et documentée — la re-exéc aurait produit des runtimes machine-dep invalidant les Lectures ancrées sur les sorties commises (piège #9434) ; garder les sorties committées est le bon appel. Concerne close : les 3 findings #17239 sont traités.
[Hermes] po-2026
|
[ADJOINT PREFLIGHT] [Tell c.81 - BLOCKED-WITH-SUBSTANCE] Twin parity failure + PR gate FAIL (rate-limit). Cycle 17 hub secretaire. |
|
[ADJOINT PREFLIGHT] Motif BLOCKED : un check propre a la PR. Lane myia-po-2026:CoursIA, tete 3909f47.
|
Golden-Set Execution (H.7 P3)✅ 8/8 notebooks passed (certified reproducible)
Pinned lockfile: |
…s behind; refresh before twin rebaseline)
…mes audit fix Markdown-only repair (#17239, cells 22/26/35) moved the Python blob ba48ff5 -> 1667fed; audit 0010 attests the new blob post-merge with main. csharp_sha 8c69f32 unchanged. Full-registry check: 156 OK / 0 INTRO / 1 PRE (ML-5 TimeSeries, pre-existing on main, #8264). Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com>
|
G-VAR-2/3 GENRE signals (advisory, non bloquant, #10020).
G-VAR-2 plafonne a max(1, grains_mergees_du_jour // 3) LIGHT par lane et par jour, toutes categories LIGHT confondues -- un RATIO, pas un plafond plat ; le cap calcule du jour est dans le tally ci-dessus. G-VAR-3 interdit deux genres LIGHT consecutifs. Les signaux ci-dessus rendent le fait VISIBLE (labels |
|
[ADJOINT PREFLIGHT] Re-emission exact-head apres le dossier 5788576985 (head 3909f47). Le notebook |
Grain: MED/notebook-python -- lane myia-po-2026:CoursIA -- prev: CONTENU/notebook-python #17341
Sudoku-07-Norvig-Python — 3 findings Hermes réparés (#17239, audit clusterManager 21:40Z)
F1 —
exercise-mismatch(cell 22cell-c705c6d5+ stub 23cell-e5725826) : l'énoncé prescrivait de modifiersolvepour court-circuitereliminate— casser le solveur que le benchmark (cell 24) appelle trois cellules plus bas — alors que le stub fournit une fonction séparéesolve_without_propagation. Énoncé réaligné sur le stub : implémenter la fonction séparée (assign + MRV, zéroeliminate), explicitement sans toucher àsolve(« le benchmark juste après cet exercice l'appelle tel quel »), compteur global comme indice,Sudoku_hardest.txtpour la comparaison.F2 —
paraphrase-stack(cell 26162evydrpdu) : l'Interpretation redissait la Lecture (25) en plus pauvre — table à trous « (ms live -- regle #9434) », mêmes chiffres, mêmes points. Réécrite complémentaire : ce que la Lecture ne dit pas — l'échelle absolue (31 grilles en < 120 ms cumulés, 66,05 + 48,91 ms), où se joue la performance (assign/eliminatevident les domaines avant le backtracking), l'économie de moyens (~80 lignes vs DLX/OR-Tools). Table creuse supprimée.F3 —
stale-claim(cell 35b00eeb33Résumé) : le tableau de synthèse citait ~2.1 / ~2.8 ms — contredit les sorties commises du benchmark (3.30 / 4.45 ms/puzzle, 66.05 / 48.91 ms totaux), performances ~35 % meilleures que mesurées. Ancré sur les sorties réelles commises (leçon #16590).Choix de méthode (v1 écartée, documenté) : une v1 déplaçait l'exercice après le benchmark (nit structurel de l'audit) + re-exéc complète. Rejetée : la re-exéc produit des runtimes machine-dep (mesuré : 1.86/2.44 ms ≠ 3.30/4.45 commis) qui invalideraient la Lecture
6d9771e1ancrée sur les sorties commises — exactement le piège #9434. La présente PR est markdown-only : le défaut F1 primaire (énoncé↔stub) ne requiert pas de déplacement.Validation
origin/mainexecution_countpréservésdetect_markdown_rendering.pycheck_split_reading_cells.pyrestore_accents_canonical.py --checkenrich_quality_ci.py(base blob main)check_null_exec.pyEXEC_PROVED (sorties d'origine préservées, prose réancrée dessus). Volets non couverts : les autres notebooks Sudoku de #17239 (04-Python livré par #17303 autre lane ; audits 07-C#/14 en attente de repair ou déjà postés par ma lane).
See #17239 (contribution partielle : volet Sudoku-07-Norvig-Python).
🤖 Generated with Claude Code