Skip to content

Pilote Astra Search : sweep mécanique puis audits profonds en découverte #15227

Description

@jsboigeEpita

Contexte

Pilote Search en deux bras pour comparer les profils Astra :

  1. corrective-sweeper sur des transformations mécaniques strictement allowlistées ;
  2. corrective-auditor en mode DISCOVERY sur des notebooks disjoints et des questions de domaine falsifiables.

Snapshot initial : origin/main 58b92cc267f37c04ce4ed098ad2edd5b3a9acdf2 (2026-09-08), 151 notebooks Search.

Mesure initiale

Scans canoniques relancés sur le snapshot frais :

  • source newlines : 0 finding ; aucun canari ni PR artificielle ;
  • hint headings : 0 finding ; aucune PR ;
  • horizontal rules : 34 séparateurs dans 30 notebooks ;
  • ordering advisory : 21 signaux, tous à relire, jamais auto-corrigés.

Déconfliction initiale :

Les compteurs sont des observations sur ce SHA, pas une promesse de correction : chaque vague repart d'un origin/main frais.

Bras batch — règles

Allowlist fermée :

  • scripts/notebook_tools/fix_source_newlines.py ;
  • scripts/notebook_tools/fix_hr_separator.py ;
  • scripts/notebook_tools/fix_hint_headings.py.

Bright lines : markdown mécanique seulement ; zéro changement de cellule code, output, execution_count, metadata, prose sémantique, catalogue, traduction ou twin ledger ; aucun rapport commité ; un fixer par PR ; lots de moins de 15 fichiers.

Première vague proposée : petit canari fix_hr_separator.py sur Search/Applications/CSP, après claim paths: exacte et relecture de chaque hit. Les autres sous-séries restent non claimées tant que ce canari n'est pas validé.

Bras profond — questions candidates, non encore confirmées

Priorité de réévaluation après le batch :

  1. Search-09b-SpuriousMinima.ipynb — vérifier firsthand si le seuil Burer–Monteiro emploie à tort le nombre de sommets à la place du nombre de contraintes/arêtes ;
  2. App-2-GraphColoring-Statistical-Validity-Python.ipynb — confronter les plages numériques et placeholders de prose aux sorties puis à une ré-exécution ;
  3. App-23-PRESENT-Differential-Cryptanalysis-SAT.ipynb — recalculer indépendamment les poids de trails et le seuil SAT/UNSAT annoncé.

Ce sont des questions d'audit, pas des verdicts. Chaque audit sera mono-notebook, séquentiel, déconflictué, et pourra légitimement conclure FALSE_POSITIVE sans PR.

Acceptation

Batch

  • compte canonique et compte indépendant réconciliés ;
  • zéro collision active sur chaque lot ;
  • zéro résidu éligible post-fix ;
  • diff cellule par cellule ; code, outputs, execution_count et metadata byte-identiques ;
  • validators notebook/rendu applicables verts ;
  • PRs atomiques, une classe mécanique et moins de 15 fichiers par PR.

Profond

  • 2 à 3 notebooks disjoints audités en DISCOVERY ;
  • observations, inférences et causalités explicitement distinguées ;
  • toute causalité reproduite ou ramenée à une hypothèse ;
  • correction locale confirmée livrée en PR, défaut profond rendu issue-ready, faux positif stoppé sans patch ;
  • chiffres pivots double-mesurés et self-falsification après rédaction.

Livraison

Les PRs partielles utilisent See #N. Cette issue coordonne l'expérience et ne sera pas auto-close par une vague partielle. Les résultats comparatifs finaux seront publiés sur RooSync, jamais comme rapport dans le dépôt.

Activity

  1. jsboigeEpita commented on Sep 8, 2026

    @jsboigeEpita
    ContributorAuthor

    Grain: LIGHT/notebook-dotnet — lane myia-po-2025:CoursIA-2 — prev: MED/tooling #15212

    [CLAIMED] lane myia-po-2025:CoursIA-2 -- paths: MyIA.AI.Notebooks/Search/Applications/CSP/App-11b-Picross-CSharp.ipynb, MyIA.AI.Notebooks/Search/Applications/CSP/App-15b-SportsScheduling-CSharp.ipynb, MyIA.AI.Notebooks/Search/Applications/CSP/App-16-Crossword-CSP-Csharp.ipynb, MyIA.AI.Notebooks/Search/Applications/CSP/App-19-ProceduralGeneration-WFC-Csharp.ipynb, MyIA.AI.Notebooks/Search/Applications/CSP/App-1b-NQueens-CSharp.ipynb, MyIA.AI.Notebooks/Search/Applications/CSP/App-2b-GraphColoring-CSharp.ipynb, MyIA.AI.Notebooks/Search/Applications/CSP/App-5-Timetabling-CSharp.ipynb

    Canari Astra Search : appliquer uniquement fix_hr_separator.py aux 7 cellules confirmées, puis exiger zéro résidu et identité byte-à-byte de toutes les cellules code, outputs, execution counts et metadata. Aucun autre lot Search n'est claimé par ce commentaire.

  2. jsboigeEpita commented on Sep 8, 2026

    @jsboigeEpita
    ContributorAuthor

    [RELEASED] lane myia-po-2025:CoursIA-2 — canari arrêté sans commit ni PR.

    Résultat mesuré sur 58b92cc267f37c04ce4ed098ad2edd5b3a9acdf2 : 7 séparateurs détectés et 7 conversions logiques appliquées, mais le fixer a aussi produit un diff physique 7 insertions / 43 suppressions au lieu de 7/7. Dans quatre notebooks .NET, la re-sérialisation a supprimé neuf lignes JSON de whitespace à l'intérieur de sorties text/html committées. Les objets JSON code/outputs/execution_count/metadata restaient sémantiquement identiques, mais le contrat du sweeper interdit précisément ce churn global et tout hunk output inattendu.

    Les sept fichiers ont été restaurés à HEAD ; git status --short et git diff --exit-code sont propres. Compteurs du canari : detected=7, fixable=7, applied temporairement=7 puis restaurés=7, committed=0, files_changed final=0, escalated=1 défaut d'outil (fix_hr_separator.py re-sérialise le notebook entier). La suite batch nécessite d'abord un fixer textuel qui préserve byte-à-byte tout contenu hors ligne --- ciblée.

  3. jsboigeEpita commented on Sep 8, 2026

    @jsboigeEpita
    ContributorAuthor

    Grain: DEEP/notebook-python — lane myia-po-2025:CoursIA-2 — prev: LIGHT/notebook-dotnet #15227

    [CLAIMED] lane myia-po-2025:CoursIA-2 -- paths: MyIA.AI.Notebooks/Search/Part1-Foundations/Search-09b-SpuriousMinima.ipynb

    Audit Astra DISCOVERY, sans verdict prédéterminé : vérifier firsthand la définition du paramètre m dans le seuil Burer–Monteiro, confronter code/table/outputs au théorème source, tenter de réfuter le finding, puis corriger seulement si le défaut est local, confirmé, exécutable et déconflictué. Un faux positif produit zéro patch et une release documentée.

  4. jsboigeEpita commented on Sep 8, 2026

    @jsboigeEpita
    ContributorAuthor

    [RELEASED] lane myia-po-2025:CoursIA-2 — Search-09b livré en PR #15231.

    Disposition : hypothèse principale réfutée par la source primaire (pour Max-Cut, A=diag et m=n contraintes ; |E| appartient à l'objectif). Défaut adjacent confirmé : prose du zoom alignée sur sortie committée = ré-exécution fraîche (0.5551, gradient d'ordre 10^-8). Diff 1 insertion / 1 suppression, markdown seulement ; code, outputs, execution_count et metadata inchangés. Body PR self-falsifié : tier MED et provenance des anciennes valeurs laissée comme inférence, pas causalité. CI encore en file.

  5. jsboigeEpita commented on Sep 8, 2026

    @jsboigeEpita
    ContributorAuthor

    Grain: DEEP/notebook-python — lane myia-po-2025:CoursIA-2 — prev: MED/notebook-python #15231

    [CLAIMED] lane myia-po-2025:CoursIA-2 -- paths: MyIA.AI.Notebooks/Search/Applications/CSP/App-2-GraphColoring-Statistical-Validity-Python.ipynb

    Audit Astra DISCOVERY, sans verdict prédéterminé : confronter toute prose quantitative aux sorties et à une ré-exécution fraîche ; vérifier si les comparaisons sur les mêmes graphes exigent une méthode appariée plutôt que Mann–Whitney indépendant ; vérifier que toute valeur CP-SAT qualifiée d'exacte porte un statut OPTIMAL plutôt que seulement FEASIBLE. Corriger seulement les défauts locaux confirmés, avec exécution réelle complète si le code change.

  6. jsboigeEpita commented on Sep 8, 2026

    @jsboigeEpita
    ContributorAuthor

    [RELEASED] lane myia-po-2025:CoursIA-2 — App-2 disposé en PR #15234 et issue profonde #15239.

    La PR reste strictement markdown-only : sept écarts prose-sorties corrigés, un notebook, code/outputs/execution_count/metadata byte-identiques. La contre-mesure indépendante confirme que les conclusions directionnelles restent fortes mais que Mann–Whitney suraffirme ici la force de preuve par rapport à Wilcoxon signé (1,15e-6 / 9,58e-9 / 5,85e-9 contre 7,40e-5 / 2,41e-5 / 3,28e-5). Elle confirme aussi 1 statut OPTIMAL et 19 FEASIBLE sur les 20 graphes principaux. Ces deux défauts de code/protocole sont regroupés dans #15239 pour une future PR mono-notebook avec ré-exécution complète réelle ; ils ne sont pas déclarés corrigés par #15234.

  7. jsboigeEpita commented on Sep 8, 2026

    @jsboigeEpita
    ContributorAuthor

    [AUDIT RESULT] App-23 — question profonde réfutée, aucun patch ni claim éditrice.

    Audit DISCOVERY read-only puis contre-vérification indépendante sur MyIA.AI.Notebooks/Search/Applications/Hybrid/App-23-PRESENT-Differential-Cryptanalysis-SAT.ipynb :

    • DDT recomptée : {0:159, 2:72, 4:24, 16:1} ; transitions non nulles de poids 2/3 : 24/72 ; vecteurs PRESENT 4/4 ; compaction 159→41 clauses (8 bits) et 927→59 (10 bits).
    • Frontière R=10 reproduite hors dépôt : W<=40 UNSAT, W<=41 SAT. Le témoin SAT a été décodé et re-simulé : 20 S-box actives, 1 transition lourde, poids 2*20+1=41; les 160 transitions respectent la DDT et les liaisons active/heavy.
    • Le notebook distingue correctement meilleur trail et cluster différentiel.
    • R=15/W=66 reste explicitement qualifié de résultat historique rapporté et non reproduit : incertitude conservée, pas transformée en preuve ni en défaut.
    • La branche ouverte chore(notebooks,#14209): normaliser 174 cellules source str→list sur 44 notebooks #15146 ne change pour App-23 que trois représentations markdown source: str → list[str]; comparaison des 32 cellules : metadata identique, zéro différence non-source et zéro mismatch sémantique après normalisation. Cette observation ne constitue ni review ni autorisation de merge.

    Verdict : CONFIRMED CORRECT sur les axes audités ; findings_detected=0, findings_applied=0, files_changed=0, aucune branche/PR/issue supplémentaire. Le troisième audit profond du pilote se termine donc légitimement sans correction.

  8. added 2 commits that reference this issue on Sep 9, 2026
  9. added
    candidate-deliveredReferenced by a merged PR with no post-merge activity -- candidate for close triage (#10466)
    on Sep 9, 2026
  10. jsboige commented on Sep 11, 2026

    @jsboige
    Owner

    [CLAIMED] lane myia-po-2024:CoursIA — bras batch, premiere vague canari fix_hr_separator sur Search/Applications/CSP (7 separateurs / 7 notebooks). Le bras profond q3 (App-23) est laisse de cote : deux PR ouvertes (#15447, #15146) touchent deja ce chemin. paths: MyIA.AI.Notebooks/Search/Applications/CSP/**

  11. added 2 commits that reference this issue on Sep 11, 2026
  12. added a commit that references this issue on Sep 12, 2026
  13. removed
    candidate-deliveredReferenced by a merged PR with no post-merge activity -- candidate for close triage (#10466)
    on Sep 14, 2026
  14. jsboigeEpita commented on Sep 27, 2026

    @jsboigeEpita
    ContributorAuthor

    [CLAIMED] lane myia-po-2023:CoursIA — pilote Astra #15227, tranche fix_hr_separator Search : 13 separateurs / 11 carnets (exclusions maintenues : _archive/ x2 ; exclusion MGS-10 levee : #15147 MERGED, aucune PR ouverte sur le chemin) — paths: MyIA.AI.Notebooks/Search/Part1-Foundations/Search-03b-PatternDatabases.ipynb, MyIA.AI.Notebooks/Search/Part1-Foundations/Search-06-AdversarialSearch.ipynb, MyIA.AI.Notebooks/Search/Part1-Foundations/Search-07-MCTS-And-Beyond.ipynb, MyIA.AI.Notebooks/Search/Part1-Foundations/Search-09-LinearProgramming.ipynb, MyIA.AI.Notebooks/Search/Part1-Foundations/Search-11b-Metaheuristiques-Deep-Part2.ipynb, MyIA.AI.Notebooks/Search/Part1-Foundations/Search-11b-Metaheuristiques-Deep-Part3.ipynb, MyIA.AI.Notebooks/Search/Part1-Foundations/Search-11b-Metaheuristiques-Deep-Part4.ipynb, MyIA.AI.Notebooks/Search/Part4-Metaheuristics/MGS-10-CenterBias.ipynb, MyIA.AI.Notebooks/Search/Part4-Metaheuristics/MGS-15-LandscapeAnalysis.ipynb, MyIA.AI.Notebooks/Search/Part4-Metaheuristics/MGS-16-AlgorithmSelection.ipynb, MyIA.AI.Notebooks/Search/Applications/Search/App-14-ConnectFour-Adversarial-CSharp.ipynb

  15. jsboigeEpita commented on Sep 27, 2026

    @jsboigeEpita
    ContributorAuthor

    [DELIVERED] lane myia-po-2023:CoursIA — tranche fix_hr_separator livree : PR #18003 (13 separateurs / 11 carnets, exclusions _archive x2 documentees, exclusion MGS-10 levee : #15147 MERGED, intersection nulle avec PRs ouvertes).

  16. added a commit that references this issue on Sep 27, 2026
  17. jsboige commented on Sep 27, 2026

    @jsboige
    Owner

    [CLAIMED-AMEND] lane myia-po-2023:CoursIA -- paths: MyIA.AI.Notebooks/Search/Part1-Foundations/Search-11b-Metaheuristiques-Deep-Part2.ipynb, MyIA.AI.Notebooks/Search/Part1-Foundations/Search-11b-Metaheuristiques-Deep-Part3.ipynb, MyIA.AI.Notebooks/Search/Part1-Foundations/Search-11b-Metaheuristiques-Deep-Part4.ipynb, MyIA.AI.Notebooks/Search/Part4-Metaheuristics/MGS-10-CenterBias.ipynb, MyIA.AI.Notebooks/Search/Part4-Metaheuristics/MGS-15-LandscapeAnalysis.ipynb, MyIA.AI.Notebooks/Search/Part4-Metaheuristics/MGS-16-AlgorithmSelection.ipynb

    Amend : retrait des 5 carnets jumeaux du lot (Search-03b-PatternDatabases, Search-06-AdversarialSearch, Search-07-MCTS-And-Beyond, Search-09-LinearProgramming, App-14-ConnectFour-Adversarial-CSharp). Motif mesure : twin parity (#8057) passe DRIFT_INTRODUCED sur toute edition unilaterale d'un cote jumeau ; leurs jumeaux sont propres (0 separateur) donc pas de fix symetrique, et le rebaseline ledger est interdit par les lignes rouges du pilote. Ces 5 carnets (6 separateurs residuels) redeviennent prenables par un protocole twin-aware a definir. PR #18003 reduite a 7 separateurs / 6 carnets au head b63c616.

  18. added a commit that references this issue on Sep 27, 2026
  19. jsboige commented on Oct 2, 2026

    @jsboige
    Owner

    [INFO] Bras batch épuisé — confrontation post-#18003 sur origin/main bbde4dd0ebf (mesuré 2026-10-02T01:00Z)

    Les 4 compteurs du body, re-mesurés sur un main frais :

    • source newlines : 0 finding / 179 fichiers (--scan) ;
    • hint headings : 0 finding / 179 fichiers (--scan) ;
    • séparateurs hr : 4 restants, tous dans les 2 carnets _archive que le body exclut — 0 hors exclusions ;
    • ordering advisory : 24 signaux / 23 carnets (13 LOW SECTION_GAP, 5 LOW CONSECUTIVE_CODE, 4 MED DANGLING_INTRO, 2 MED INTERP_BEFORE_CODE).

    Relecture firsthand des 6 MED : 6/6 FALSE POSITIVE.

    • App-17-VRP-Logistics [33] : l'interprétation cite le tableau comparatif de la cellule 31 (sortie précédente), pas la carte de la cellule 34 — puis [35] interprète la carte ;
    • CSP-1-Fundamentals [48] : « Sortie obtenue : … 677 » cite la sortie de la cellule 46 ;
    • CSP-1-Fundamentals-CSharp [23] : « reste la seconde question » est un pont vers la section 5.2 (markdown [24] puis code [25]) — annonce de section, pas de code immédiat ;
    • CSP-5-Optimization [16] : le code annoncé est 2 cellules plus loin (caption [17], def [18]) ;
    • Search-02-Uninformed [58] : « le code ci-dessous » = la trace vérificatrice [60] ; la marche manuelle [59] s'intercale volontairement (l'élève trace à la main avant de vérifier) ;
    • Search-11c-Empirical-Algorithm-Selection [18] : annonce le format de présentation des paradigmes de la section 4, pas un code immédiat.

    LOW résiduels, nommés : 13 SECTION_GAP = jumeaux C# sautant les sections Python-only (pattern vérifié sur 2 échantillons App-1b/App-2b — attendu par construction) ; 5 CONSECUTIVE_CODE non relus ce cycle.

    Reste ouvert : le bras profond (3 questions candidates, non confirmées). Premier audit mono-notebook (Search-09b-SpuriousMinima, seuil Burer–Monteiro) lancé ce cycle — verdict à suivre sur cette issue.

  20. jsboige commented on Oct 2, 2026

    @jsboige
    Owner

    [AUDIT RESULT] bras profond q1 — Search-09b : hypothese « seuil Burer–Monteiro en sommets au lieu des contraintes/arêtes » REFUTEE. Aucune PR, aucun patch.

    Audit DISCOVERY read-only + recalcul independant hors depot (scratchpad, jamais commis), lane myia-po-2024:CoursIA, cible MyIA.AI.Notebooks/Search/Part1-Foundations/Search-09b-SpuriousMinima.ipynb (15 cellules, 7 code, execution_count 1..7, 0 erreur commise).

    Ce que le notebook affirme (cellule markdown « B. La factorisation de Burer–Monteiro ») : Barvinok–Pataki en termes de « m contraintes affines » avec r(r+1)/2 <= m ; Burer–Monteiro 2005 avec r(r+1)/2 > m ; puis « Pour MaxCut, m = n (les n contraintes diagonales), d'ou le seuil r* = min{r : r(r+1)/2 > n} ». Le SDP de reference (cellule « A. Le probleme et sa relaxation ») est la relaxation Goemans–Williamson exacte : diag(Y)=1, Y >= 0 — soit n contraintes d'egalite affines scalaires ; les aretes W_ij n'entrent QUE dans l'objectif. La formulation du notebook est celle du theoreme.

    Ce que le code calcule (cellule r_star, sortie committue) : r_star(n) avec n = len(W), colonne d'en-tete « n (= m) ». Pour CE SDP le nombre de contraintes EST n : le code utilise donc bien le compte de contraintes ; la coincidence numerique avec le nombre de sommets est une propriete du probleme, explicitee dans la prose.

    Instances discriminantes (recalcul independant, r* re-derive par r(r+1)/2 vs m) :

    • K8 : n=8, aretes=28 → r*(m=n)=4, r*(m=aretes)=8. Committue : 4.
    • G(10, 0.5) : n=10, aretes=19 → r*(m=n)=5, r*(m=aretes)=6. Committue : 5.
    • C6 : n=6, aretes=6 → non discriminant (les deux lectures donnent 4).
    • Exercice 1 (Petersen, n=10, aretes=15) annonce r*=5 = lecture m=n (m=aretes donnerait 6).

    Les valeurs committues excluent la lecture « aretes » sur deux instances independantes : le seuil implemente est bien le compte de contraintes, jamais |E|.

    Sorties reproduites a l'identique (reexecution fraiche hors depot, memes generateurs/memes graines) : coupe brute 6.0000 / 11.8581 / 14.0000 ; SDP CLARABEL 6.0000 / 11.8584 / 14.3249 ; recensement G10 r=2 : 12/40 fallacieux, r=4,5,6 : 0/40 — coherent avec le seuil comme garantie suffisante (la proprete commancant avant r* est documentee honnetement dans « Lecture du recensement », avec la reserve non-degenerescence en section E).

    Deconfliction : cette question avait deja ete disposee par myia-po-2025:CoursIA-2 ([RELEASED] ci-dessus, meme refutation : « pour Max-Cut, A=diag et m=n contraintes ; |E| appartient a l'objectif »), et le defaut adjacent du meme audit livre en PR #15231 (MERGED, markdown-only, prose du zoom 0,5550→0,5551 et 10^-5→10^-8 — verifiee). Reducteur de claims : CLEAR, 0 fichier bloque, aucune PR ouverte sur le chemin. Ce commentaire est la contre-verification independante par une seconde lane : le verdict precedent est confirme firsthand.

    Verdict : FALSE POSITIVE sur l'axe audite. L'hypothese de depart confond deux quantites qui coincident ici (m = n = nombre de contraintes diagonales) et une troisieme qui n'appartient pas au probleme relaxe (|E|, qui ne contraint pas le SDP de Goemans–Williamson). Compteurs : findings_detected=1, findings_applied=0, files_changed=0, aucune branche, aucune PR, aucun commit.

  21. jsboige commented on Oct 3, 2026

    @jsboige
    Owner

    Grain: DEEP/notebook-python — lane myia-po-2025:CoursIA — prev: MED/notebook-python #19009

    [CLAIMED] lane myia-po-2025:CoursIA -- paths: MyIA.AI.Notebooks/Search/Applications/Hybrid/App-23-PRESENT-Differential-Cryptanalysis-SAT.ipynb — bras profond q3 : recalcul independant des poids de trails PRESENT et du seuil SAT/UNSAT annonce (question laissee de cote le 2026-09-11, aucun resultat poste). Audit DISCOVERY mono-notebook ; conclusion FALSE_POSITIVE legitime sans PR.

  22. jsboige commented on Oct 3, 2026

    @jsboige
    Owner

    [AUDIT RESULT] bras profond q3 — App-23 PRESENT : hypothese « poids de trails et seuil SAT/UNSAT a verifier » REFUTEE comme defaut — tous les chiffres annonces sont confirmes par recalcul independant. Aucune PR, aucun patch.

    Audit DISCOVERY read-only (lane myia-po-2025:CoursIA, claim c.5970846745). Methode : encodeur SAT ecrit from scratch, structurellement distinct de celui du carnet — clauses d'interdiction naives exhaustives (vs 59 implicants Quine-McCluskey compacts), ponderation par unites de poids u1/u2/u3 par S-box (vs copies de active), Cadical153 (vs Cadical195), DDT recalculee from scratch. Deux encodeurs distincts qui convergent = la semantique du modele est confirmee, pas seulement re-executee.

    Observations (mesurees) :

    Chiffre annonce par le carnet Recalcul independant Verdict
    DDT S-box : {0: 159, 2: 72, 4: 24, 16: 1} identique confirme
    24 transitions legeres poids 2 (DDT=4), 72 lourdes poids 3 (DDT=2) identique confirme
    Minima R=1..6 : 2, 4, 8, 12, 20, 24 identiques confirme
    R=10 : UNSAT(40) / SAT(41) → w_min(10)=41 UNSAT(40) + SAT(41) confirme

    Les vecteurs de test de la cellule 2 sont les KAT officiels PRESENT-80 (0x5579C1387B228445 et les trois suivants). Le carnet ne revendique nulle part un poids de Hamming — le modele est bien le poids exact -log2(DDT/16), et la prose (section 5) justifie la ponderation active/heavy qui distingue poids 2 et 3.

    Inférence (distinction assumee) : la frontiere 40/41 est une certification machine bornee, exactement comme le dit la prose du carnet (« aucun certificat DRAT/RUP n'est exporte ») — ma mesure ne change pas ce statut, elle confirme la reproductibilite par une voie d'encodage independante.

    Contre-point methodologique (observation, pas un defaut) : en poids de Hamming (popcount des sorties S-box) — modele DIFFERENT, non utilise par le carnet — le minimum R=1 tombe a 1 et atmost(40) est SAT a R=10 : les trails seraient plus legers. Le carnet a choisi le modele exact -log2, qui est le bon pour les probabilites ; ceci documente seulement que le choix du modele importe et qu'il est correctement assume.

    Self-falsification : le premier jet de mon encodeur independant avait une polarite inversee sur les litteraux de ponderation (min=1 partout, impossible dans ce modele) — attrape par le test de coherence « le poids d'un trail non trivial est >= 2 », corrige, puis les resultats ont converge avec le carnet. L'echec initial de l'outil d'audit, pas du carnet audite.

    Le bras profond q3 est clos ; q2 (App-2 GraphColoring) reste ouverte. Scratchpad de l'audit (scripts encodeurs + sorties) : hors depot, conserve en session.

  23. jsboige commented on Oct 3, 2026

    @jsboige
    Owner

    Grain: MED/notebook-python — lane myia-po-2025:CoursIA — prev: MED/notebook-python #19009

    [CLAIMED-AMEND] lane myia-po-2025:CoursIA -- paths: MyIA.AI.Notebooks/Search/Applications/Hybrid/App-23-PRESENT-Differential-Cryptanalysis-SAT.ipynb, MyIA.AI.Notebooks/Search/Applications/CSP/App-2-GraphColoring-Statistical-Validity-Python.ipynb -- tranche : bras profond q3 (clos, REFUTEE, c.5970957870) + bras profond q2 (livree, PR #19011)

  24. jsboige commented on Oct 3, 2026

    @jsboige
    Owner

    [AUDIT RESULT] bras profond q2 — App-2 GraphColoring : prose EXACTE, re-execution stable, defaut unique = ANCRAGE — corrige par PR #19011 (tableau wins/egalites imprime par la cellule du sweep + re-execution fraiche).

    Audit DISCOVERY (lane myia-po-2025:CoursIA, amend c.5971052005). Methode : re-execution papermill complete du carnet commite (kernel python3) + recompte independant du sweep (rejeu deterministe des memes sub_seeds via l'etat exact du rng).

    Observations (mesurees) :

    Chiffre cite par la prose Recompte independant Verdict
    ecarts-types « de l'ordre de 0,3 a 0,9 » 0,86 / 0,58 / 0,32 exact
    IC « largeur ≈ 0,3–0,8 couleur » 0,80 / 0,55 / 0,30 exact
    p-valeurs 7,4e-5 / 2,4e-5 / 3,3e-5 7.40e-05 / 2.41e-05 / 3.28e-05 exact
    r = 1,000 sur les trois paires 1,000 x3 exact
    OPTIMAL « 1 instance sur 20 » 1 OPTIMAL / 19 FEASIBLE exact
    p=0,1 : « ~1 couleur », « 13 des 15, egalite sur 2 » gap 1,067 ; 13/15 ; 2 egalites exact
    p>=0,4 : « de 1,5 a 3 couleurs » 1,533 -> 2,800 exact

    Placeholders : aucun (seul « a completer » = en-tete legitime des exercices ; stubs C.1 conformes).

    Le defaut confirme : la cellule du sweep densite (section 7) ne produisait aucune sortie textuelle — figure seule — tandis que la prose citait quatre nombres invérifiables depuis le commit (motif lecture-after-empty-output : nombres justes, ancrage absent). Toutes les autres cellules de prose etaient ancrees dans des sorties textuelles.

    Correction livree : PR #19011 — la cellule collecte et imprime le tableau (p, gap moyen, victoires DSATUR, egalites) avant la figure inchangee ; prose inchangee (exacte) ; re-execution C.2 fraiche 11/11 rc=0, sorties des autres cellules byte-identiques a main.

    Le bras profond est desormais epuise (q1 REFUTEE le 02/10, q3 REFUTEE ce jour, q2 livree). Les 4 compteurs du bras batch etaient a zero sur le [INFO] du 02/10 : le pilote #15227 est complet sur ses deux bras.

  25. added 2 commits that reference this issue on Oct 3, 2026
  26. added a commit that references this issue on Oct 4, 2026
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Metadata

Metadata

Assignees

No one assigned

    Labels

    No labels
    No labels

    Projects

    No projects

      Milestone

      No milestone

      Relationships

      None yet

      Development

      No branches or pull requests

      Issue actions