Skip to content

docs(biblio,#19264): ancrage Calvin Luo 2022 sur les 5 carnets 3.6x -- le survey unificateur - #19273

Merged
myia-ai-01 merged 1 commit into
mainfrom
fix/19264-luo-refs
Oct 5, 2026
Merged

myia-ai-01 merged 1 commit into
mainfrom
fix/19264-luo-refs

Conversation

@jsboige

@jsboige jsboige commented Oct 5, 2026

Copy link
Copy Markdown
Owner

Grain: LIGHT/docs — lane myia-po-2023:CoursIA — prev: MED/guard #19224

Ce que fait cette PR

Elle solde l'issue #19264 : les cinq carnets 3.6x citent désormais Calvin Luo, Understanding Diffusion Models: A Unified Perspective (2022) — le survey qui unifie exactement l'arc que la série enseigne carnet par carnet. Une seule cellule markdown par carnet, à l'endroit où le passage cité vit, sur le modèle du paragraphe livré en 3.6d par #19169 (arXiv 2510.21890).

Carte passage → carnet (chaque passage a été relu dans le PDF du gisement)

Carnet Cellule Passage Luo ancré Ce que le passage apporte au-delà du carnet
3.6 23 (Conclusion, liste References) p. 2-16 (ELBO/VAE → DDPM) + p. 15-17 (trois réparamétrisations) le fil conducteur ELBO qui relie les trois familles que le carnet compare empiriquement
3.6b 41 (§8 Ce qu'il faut retenir) « Three Equivalent Interpretations » p. 15-17, éq. 115-118 le $\epsilon_\theta$ implémenté n'est qu'un choix de variable parmi trois ($x_0$, bruit, score), démonstration terme à terme
3.6c 35 (§5 Ce que DDPMScheduler cachait) « Variational Diffusion Models » p. 6-16 + p. 15-17 la dérivation ELBO pas à pas dont l'objectif quadratique écrit à la main découle
3.6d 22 (§4 Lecture du résultat) « Score-based Generative Models » éq. 143-148 (p. 17-18) + éq. 160-161 (p. 20) le lien score/objectif débruitant et le score matching multi-niveaux de bruit (Langevin annealed)
3.6e 26 (Synthèse) « Guidance » p. 20-22 le caveat : un modèle conditionnel peut apprendre à ignorer son conditionnement ; classifier vs classifier-free, le prix en diversité

Le PDF est archivé au gisement : MachineLearning/2022 - Understanding diffusion models - A unified perspective.pdf (G:\Mon Drive\MyIA\IA\Bibliographie IA). L'ID arXiv n'est pas cité : il n'est pas visible sur la première page du PDF du gisement (titre/auteur/date vérifiés : Calvin Luo, Google Research, 26 août 2022), et on ne cite pas ce qu'on n'a pas vérifié sur l'artefact.

Vérifications passées

Contrôle Résultat
Diff markdown-only, append-only exactement 1 cellule (markdown) modifiée par carnet ; la source ancienne reste préfixe de la nouvelle ; outputs/execution_count inchangés partout (comparaison structurale old HEAD vs new, 5/5 OK)
JSON valide json.loads sur les 5 fichiers après édition
Re-exec C.2 non due — modifs uniquement markdown (exception C.2)
Collision de lane claim #19264 CLEAR ; aucune PR ouverte d'une autre lane ne touche 03-DeepLearning/3.6*
Recouvrement #19169 #19169 (même lane) touche la cellule 48 de 3.6d, cette PR la cellule 22 — hunks disjoints, auto-merge propre

Closes #19264

🤖 Generated with Claude Code

… sur les 5 carnets 3.6x

Chaque carnet cite desormais Luo 2022 au passage precis qu'il enseigne :
p. 2-16 (ELBO/VAE -> DDPM) pour 3.6 et 3.6c, Three Equivalent
Interpretations p. 15-17 (eq. 115-118) pour 3.6b, Score-based Models
p. 17-20 (eq. 143-148, 160-161) pour 3.6d, Guidance p. 20-22 pour 3.6e.
Markdown-only : append d'une cellule existante, aucune re-exec C.2 due.

Co-Authored-By: Claude Sonnet 5.5 <noreply@anthropic.com>
@github-actions github-actions Bot added the variation-light-cap-reached Lane ayant deja merge une LIGHT aujourd'hui (cap G-VAR-2 atteint) label Oct 5, 2026
@github-actions

github-actions Bot commented Oct 5, 2026

Copy link
Copy Markdown
Contributor

G-VAR-2 light cap reached (advisory, non bloquant).
La lane myia-po-2023:CoursIA a deja consomme son budget LIGHT du jour (axe genre G-VAR-2/3 (light-genre, quel que soit le tier declare) : #19064 (MED/readme, merge a 2026-10-05T00:25:15Z), #19224 (MED/guard, merge a 2026-10-05T07:18:03Z)).
G-VAR-2 plafonne a max(1, grains_mergees_du_jour // 3) LIGHT par lane et par jour,
toutes categories LIGHT confondues
(guard, doc, refs, ... partagent un seul budget) :
c'est un RATIO, pas un plafond plat. La decision de merge reste au coordinateur.

@github-actions github-actions Bot added the variation-tier-inflation declared LIGHT << effective LIGHT-genre (#10020, advisory) label Oct 5, 2026
@github-actions

github-actions Bot commented Oct 5, 2026

Copy link
Copy Markdown
Contributor

G-VAR-2/3 GENRE signals (advisory, non bloquant, #10020).
La lane `myia-po-2023:CoursIA` voit ces signaux actifs sur les mergees du jour (UTC 2026-10-05) :

  • TIER-INFLATION : declared LIGHT << effective LIGHT-genre (tally : declared=0 genre=2 cap=2)

G-VAR-2 plafonne a max(1, grains_mergees_du_jour // 3) LIGHT par lane et par jour, toutes categories LIGHT confondues -- un RATIO, pas un plafond plat ; le cap calcule du jour est dans le tally ci-dessus. G-VAR-3 interdit deux genres LIGHT consecutifs. Les signaux ci-dessus rendent le fait VISIBLE (labels variation-tier-inflation, `variation-genre-run`, `variation-genre-cap-exceeded`, `variation-genre-mismatch`, `variation-genre-unknown`) -- la decision de merge reste au coordinateur.

@github-actions github-actions Bot added the trivial-diff-advisory Diff trivial : grain META mecanique sans fournee ni exception ecrite (#15740) label Oct 5, 2026
@github-actions

github-actions Bot commented Oct 5, 2026

Copy link
Copy Markdown
Contributor

Trivial-diff advisory (#15740, non bloquant).
genre docs dans la famille META (docs/guard/ledger/readme/test) + diff de 19 lignes changees (<= 100) + aucune exception ecrite dans le body : le litmus de la trivialite (une douzaine d'instances scannees a la suite) est credible. Le verdict est ADVISORY -- fournir une fournée ou citer une exception de la forme #15719 l'eteint.
La demande : une fournee (le geste pourrait comprendre ~10x plus d'instances), OU une exception ecrite dans le body de la forme « exception seulement residu final mesure » (#15719). Editer le body re-deroule cet organe et retire le label.

@github-actions

github-actions Bot commented Oct 5, 2026

Copy link
Copy Markdown
Contributor

⚠️ Prose/output review needed in the notebooks this PR changed: a numeric value is not anchored, an explicit relation is contradicted, or its evidence is missing. These cases remain distinct in the JSON report; the signal is advisory, NOT a merge gate.

Scope = notebooks CHANGED in this PR, not the whole corpus. Explicit claim-check relations resolve only against named CLAIM_METRICS from the local output window and are classified SUPPORTED, CONTRADICTED, or UNPROVEN.
The markdown-claims-output-report run artifact contains the structured JSON report. See python scripts/check_markdown_claims_output.py --help for re-running locally.
Detector rationale: c.290 / c.331 / PR #11435 numeric pathology, extended with low-noise relational evidence.

@github-actions

github-actions Bot commented Oct 5, 2026

Copy link
Copy Markdown
Contributor

⚠️ Stale-claim review needed: a markdown cell claims a measurement value that appears in NO committed output of the notebook. Advisory, NOT a merge gate — triage against the JSON artifact.

Scope = notebooks CHANGED in this PR, not the whole corpus. The stale-claim-report run artifact holds the structured JSON.
Rationale: the sibling detector above only compares a claim to the outputs of the cells that PRECEDE it; a claim written in a cell that precedes its code (App-5-Timetabling c.2/c.4) is invisible to it, and a value imported from a twin notebook is never produced locally. See python scripts/check_stale_claims.py --help.

@github-actions

github-actions Bot commented Oct 5, 2026

Copy link
Copy Markdown
Contributor

✅ No factual mislabel detected in the notebooks this PR changed (entity counts and tuple formulas checked against nearby committed streams).

Scope = notebooks CHANGED in this PR, not the whole corpus. The factual-mislabel-report run artifact holds the structured JSON.
Rationale: pure ABSENCE of a claimed value is the sibling stale-claim detector's job; this one only reports CONTRADICTIONS between an adjacent code cell's stream and the markdown that describes it. See python scripts/check_factual_mislabel.py --help.

@github-actions

github-actions Bot commented Oct 5, 2026

Copy link
Copy Markdown
Contributor

Notebook outputs-required (H.4 schema): PASS (every code cell carries an outputs: list)

@github-actions

github-actions Bot commented Oct 5, 2026

Copy link
Copy Markdown
Contributor

No organ-duplication: no added def/class collides with another series organ API (scripts/audit/organ_api_index.yaml).

Detector: python scripts/audit/detect_organ_duplication.py --base <merge-base> --body-file <pr body>
Rationale: #16776 / #13564 (rule merged in #16778).

@github-actions

github-actions Bot commented Oct 5, 2026

Copy link
Copy Markdown
Contributor

Golden-Set Execution (H.7 P3)

✅ 9/9 notebooks passed (certified reproducible)

Notebook Status Time
2.1-Workflow-ML.ipynb ✅ SUCCESS 3.6s
2.2-Descente-de-gradient.ipynb ✅ SUCCESS 4.0s
2.3-Regression-lineaire-logistique.ipynb ✅ SUCCESS 5.2s
2.4-Arbres-Forets-Ensembles.ipynb ✅ SUCCESS 4.5s
Search-01-StateSpace.ipynb ✅ SUCCESS 3.2s
SL-1-LogicalLearning.ipynb ✅ SUCCESS 2.1s
rl_4_multi_armed_bandits.ipynb ✅ SUCCESS 20.9s
GameTheory-04c-NashExistence-Python.ipynb ✅ SUCCESS 3.2s
GameTheory-13d-Optimistic-CFR-Python.ipynb ✅ SUCCESS 12.4s

Pinned lockfile: scripts/notebook_tools/golden_set.lock.txt (H.7 P3, axe A #4208)

@github-actions

github-actions Bot commented Oct 5, 2026

Copy link
Copy Markdown
Contributor

Notebook PR Validation: PASS

  • Notebooks checked: 5
  • Code cells validated: 94
  • Result: All passed

Checks: H.1 (no errors), H.3 (execution_count), C.1 (no banned patterns)
Non-Python kernels (.NET/Lean): C.1 + errors only (execution_count advisory)
QuantConnect notebooks: C.1 + errors only (require QC Cloud for execution)

@github-actions

github-actions Bot commented Oct 5, 2026

Copy link
Copy Markdown
Contributor

Path-collision (organ #13359/#13615)

Cette PR #19273 (docs(biblio,#19264): ancrage Calvin Luo 2022 sur les 5 carnets 3.6x -- le survey unificateur) touche au moins un chemin de fichier aussi modifie par d'autres PRs ouvertes. Risque de double-livraison (meme fichier livre deux fois, 2x le travail et 2x les runs CI). Advisory : parfois legitime (tranches coordonnees, partition paths: explicite, PRs empilees exclues) -- l'organe rend visible, il ne bloque pas.

@jsboige

jsboige commented Oct 5, 2026

Copy link
Copy Markdown
Owner Author

[ADJOINT PREFLIGHT]
schema: 1
lane: myia-po-2026:CoursIA-3
pr: 19273
head: a842887
complete: true
body: read
comments-reviewed: 11
reviews-reviewed: 0
threads-reviewed: 0
threads-unresolved: 0
surfaces-sha256: da9e626bf5a665348142f903c1e2b18ed9ce14fee265ed84231adce117e23984
diff-files: 5
diff-additions: 14
diff-deletions: 5
checks: latest-wins-green
b0: clear
scope: pass
domain: pass
verdict: READY
organ: check_adjoint_prevalidation.py
organ-command: python scripts/check_adjoint_prevalidation.py --derive-verdict 19273
organ-rc: 0
[/ADJOINT PREFLIGHT]

note: LIGHT/docs ancrage Calvin Luo 2022 'Understanding Diffusion Models: A Unified Perspective' sur 5 carnets 3.6x (3.6, 3.6b, 3.6c, 3.6d, 3.6e) -- le survey unificateur. 5 fichiers, 14 ajouts, lane porteuse po-2023:CoursIA. Solde issue #19264. PR gate SUCCESS, B.0 rc=0 OK, scope pass, domain pass. H.7 P3 Golden-Set 9/9 OK. LIGHT -> merge_ready eligible.

@myia-ai-01
myia-ai-01 merged commit 8cf9ad7 into main Oct 5, 2026
94 of 97 checks passed
myia-ai-01 pushed a commit that referenced this pull request Oct 6, 2026
…) dans CooperativeGames + 4 carnets GT-15 (#19288)

* fix(gametheory,#19275): ancrer Maschler-Solan-Zamir 2013 (Game Theory) dans CooperativeGames + 4 carnets GT-15

Le traite canonique du cluster (MSZ 2013, Cambridge UP) etait absent
de la lake CooperativeGames et des carnets GT-15/15b/15c alors que
la serie enseigne sa matiere (ch. 15 *The Shapley Value*, ch. 17 *The
Core*). 0 occurrence de maschler|solan|zamir avant cette PR dans
'MyIA.AI.Notebooks/GameTheory/cooperative_games_lean/' (et la cible
canonique est 'game_theory_lean/CooperativeGames/' apres absorption
#5971) ; 16 carnets de la serie GameTheory citaient deja Shapley 1953
et Bondareva 1963, mais le socle 'livre' du cluster etait absent.

## Geste

5 fichiers '*.lean' (4 FR+EN siblings de la lake) : en-tetes de
module (commentaires '/-- ... -/') completent la reference papier
original (Shapley 1953) par l'ancrage MSZ 2013, avec note 'a
confirmer' tant que le PDF n'est pas acquis sur la machine worker.
Le code tactique reste byte-identique (convention i18n EPIC #4980) ;
seuls les en-tetes FR et EN sont ajustes, et leur diff est symetrique.

1 README de la lake : nouveau bloc 'Ouvrages-ancrage du cluster' qui
liste les trois piliers bibliographiques (Shapley 1953, Bondareva
1963 + Shapley 1967, MSZ 2013) avec la note d'acquisition.

4 carnets GT-15 (15-CSharp, 15-Python, 15b-Lean, 15c-Python) : une
nouvelle cellule '## References' est ajoutee en fin de carnet, portant
l'entree MSZ 2013 substantive (quel chapitre ancre quoi) et la note
'acquisition PDF en attente'. Les 2 carnets 15c qui avaient deja une
cellule '## References bibliographiques' (15c-CSharp) et '## References'
(15c-Python) portaient deja MSZ d'un ancrage anterieur (verification
firsthand : 6 + 4 occurrences respectivement), pas double emploi.

## Markdown-only, pas de re-execution C.2 due

- Fichiers '*.lean' : seuls en-tetes '/-- ... -/' modifies, code
  tactique byte-identique, pas de recompilation Lean necessaire.
- Fichiers '*.ipynb' : nouvelle cellule markdown ajoutee, pas de
  cellule code touchee, pas de papermill necessaire.
- README : ajout d'un bloc markdown, pas de script.

## Acceptation #19275

- [x] 'git grep -icE maschler|solan|zamir' sur 'game_theory_lean/'
  -> 5 fichiers (1+1+1+1+1).
- [x] Chaque docstring de theoreme de la lake porte soit MSZ (avec
  note 'a confirmer') soit le papier original (Shapley 1953 dans
  Basic/Basic_en/Shapley/Shapley_en, Bondareva 1963 + Shapley 1967
  dans ConeKernel/ConeKernel_en qui relevent du lemme Farkas non
  couvert par MSZ 2013).
- [x] Aucun chapitre affirme 'verifie' sans lecture effective de
  l'ouvrage : les ancrages chapitre portent systematiquement la
  mention 'a confirmer' jusqu'a acquisition du PDF.

## Non-applique intentionnellement

- Acquisition du PDF MSZ 2013 : la machine worker n'a pas acces au
  disque reseau bibliographique. Acquisition a la discretion du
  user (cf 'bibliography-hygiene.md' voie canonique). Une fois
  acquis, le 'a confirmer' sera leve et les chapitres numerotes avec
  confiance.
- Carnet GT-15d/15e/15f/15g : pas dans le perimetre du body #19275
  (qui nomme 15/15b/15c), et ils ne sont pas de la filiere principale
  CooperativeGames (15d = Mobius, 15e = Coalition Power, 15f =
  Shapley Groupes, 15g = Assistance Games). Ancrage MSZ eventuel
  releve d'une autre issue.

## Liens

- Issue : #19275 (lane myia-po-2026:CoursIA-2, fix/19275-maschler-solan-zamir)
- Issue parente : #19263 (cluster biblio GameTheory)
- PRs freres du meme axe : #19286 (Deisenroth), #19270 (Goodfellow),
  #19282 (Boyd), #19273 (Calvin Luo)
- Lake parente : MyIA.AI.Notebooks/GameTheory/game_theory_lean/ (cible
  canonique post-absorption #5971, pas 'cooperative_games_lean/')

🤖 Generated with [Claude Code](https://claude.com/claude-code)

* fix(twin-registry,#8057): reattest GT-15 + GT-15c CooperativeGames post-#19288 (MSZ ancrage)

L'ancrage Maschler-Solan-Zamir 2013 (PR #19288) a modifie 2 paires de
carnets jumeaux CooperativeGames : les entree MSZ ajoutees dans la
cellule '## References' des 4 carnets GT-15 deplacent le content_sha
de chaque carnet touche, ce que le twin parity audit #8057 signale
comme DRIFT (GameTheory-15 CooperativeGames et GameTheory-15c
CooperativeGames -- les 2 paires modifiees par ma PR).

## Geste

- 'scripts/notebook_tools/twin_pairs.d/gametheory-15-cooperativegames/0025-2026-10-05-myia-po-2026-CoursIA-2.yaml' : nouvelle entree d'audit append-only (convention #9399 volet a) attestant le contenu actuel.
- 'scripts/notebook_tools/twin_pairs.d/gametheory-15c-cooperativegames/0011-2026-10-05-myia-po-2026-CoursIA-2.yaml' : idem pour GT-15c.

Ces attestations sont 'TEL QUEL' (cf note du script) : tout strip
outille ulterieur deplace le blob SHA, et il faut refaire --update
apres strip (cf #8957). Le pre-commit a deja tourne avant le commit
#19288, donc le SHA canonique = 'separators=(",",":")' (cf c.1253).

## Hors perimetre

Les 2 autres paires signalees DRIFT (App-1 NQueens, App-12
ConnectFour) sont pre-existantes (deja en DRIFT au base main) et
n'ont pas ete modifiees par #19288 ; elles relevent de PR dediees
par leurs porteurs respectifs, pas de ce commit.

🤖 Generated with [Claude Code](https://claude.com/claude-code)

* chore(workflow,#19288): empty commit to retrigger CI on amended body

Grain: LIGHT/docs -- lane myia-po-2026:CoursIA-2 -- prev: DEEP/lean #19288

Le body de la PR a ete amende pour inclure les 2 fichiers YAML
twin_pairs (auto-generes par le sweep twin-parity post-enrichissement
des carnets 15 et 15c). Le Perimetre body guard #11268 a rougi sur
"9 fichiers" alors que le diff en a 11 -- declaration corrigee.

Le PATCH body ne re-declenche pas les checks GitHub Actions -- un
commit vide les re-declenche (geste gratuit, pas de modification de
contenu pedagogique, donc pas de risque #18049 take-HEAD).

Une fois les checks verts, le coordinateur peut merger.

Co-Authored-By: Claude Haiku 4.5 (1M context) <noreply@anthropic.com>

---------

Co-authored-by: Claude Haiku 4.5 (1M context) <noreply@anthropic.com>
@jsboige
jsboige deleted the fix/19264-luo-refs branch October 7, 2026 07:57
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

consecutive-code-cells Modified notebook has >=2 consecutive code cells (#12797) trivial-diff-advisory Diff trivial : grain META mecanique sans fournee ni exception ecrite (#15740) variation-light-cap-reached Lane ayant deja merge une LIGHT aujourd'hui (cap G-VAR-2 atteint) variation-tier-inflation declared LIGHT << effective LIGHT-genre (#10020, advisory)

Projects

None yet

Development

Successfully merging this pull request may close these issues.

[consolidation] Serie 3.6x generative : ancrer Understanding Diffusion Models (Calvin Luo 2022) -- la reference unificatrice absente

2 participants