Skip to content

enrich(genai,#13410): prose interpretative Scaling-TTC + OWUI API (densite 753/783 -> 1253/1217) - #16038

Merged
jsboige merged 1 commit into
mainfrom
feature/densite-13410-genai-texte
Sep 15, 2026
Merged

jsboige merged 1 commit into
mainfrom
feature/densite-13410-genai-texte

Conversation

@jsboige

@jsboige jsboige commented Sep 13, 2026

Copy link
Copy Markdown
Owner

Grain: DEEP/notebook-python — lane myia-po-2026:CoursIA — prev: DEEP/notebook-python #16007

Tranche densite #13410 — GenAI/Texte (16 Scaling TTC + 20 OWUI Native API)

Rotation R6, 8e famille du jour (apres ML, DecInfer, SMT/Z3, Search, Sudoku, GameTheory, SemanticWeb). Familles a figures esquivees (GenAI/Video, ICT) conformement au routage vision-QA — cette tranche est 100% sorties texte. Candidats choisis sur mesure LIVE (pedagogy_density.py sur origin/main 760cd6bec) : GenAI/Texte compte 12 notebooks sous plancher, les 2 plus bas retenus. Collision verifiee fichier par fichier : le seul PR GenAI ouvert (#16022) touche des README/MANIFEST, aucun notebook.

Notebook Avant Apres Plancher
16_Scaling_Test_Time_Compute.ipynb 753 1253 1200
20_OWUI_Native_API.ipynb 783 1217 1200

Notebooks hors twin registry (verifie) : aucune rebaseline requise.

9 cellules markdown d'interpretation placees APRES la cellule de code lue, chacune ancree sur sa sortie executee :

  • 16_Scaling (5 cellules) : le wrapper chat() (retries=2, renvoi '' en echec total = les taux sont des bornes inferieures ; temperature=0.7 fournit la diversite que BoN exige) ; l'estimateur non-biasé pass@k verifie sur les nombres affiches (pass@1 = 1 - C(2,1)/C(6,1) = 0,667, pass@2 = 1 - 1/15 = 0,933, pass@4 = 1 — la formule de Chen 2021 reprise par Snell 2024 se recompte a la main) ; une seule ligne scale (facile/moyen satures a 1,00 sur toute la ligne, difficile 0,25 -> 0,50 = le resultat central de Snell en un tableau) ; la figure traduit le tableau (plateaux contre pentes, courbes coherentes par estimation jointe) ; « egal » partout — la frontiere compute-optimale NON tranchee (a budget 4, BoN pass@4 = Reflexion K=4 sur chaque bucket ; difference entre resultat ILLUSTRATIF et conclusion statistique, puissance insuffisante assumee par le notebook).
  • 20_OWUI (4 cellules) : le contrat d'acces declare des la premiere cellule (env-first, os.getenv sans litteral, RECOVERABLE-MACHINE anticipe) ; /health = la sonde de vie et rien d'autre (liveness vs routes riches, hierarchie pour l'exercice 2) ; /api/version = la version comme contrat (0.9.6 epingle la surface des routes 0.9.x, deployment_id vide = identite non enregistree, version seule insuffisante en multi-tenant) ; le 401 = la frontiere rendue visible (401 identite manquante vs 403 droits vs 404 route, protection au niveau framework, enveloppe _http_error/_body = les erreurs se rendent au lieu de lever).

Validation

Gate Resultat
Round-trip byte-identity avant edition OK x2 (assert avant ecriture)
Cellules code byte-identiques a origin/main OK x2 (10 et 11 cellules)
Diff +209 insertions pures (commit ad419eb, hooks verts premier essai)
enrich_quality_ci.py --base --head rc=0 x2
detect_repeated_prose.py 16_Scaling : 6 -> 6 (mêmes findings, indices decales, containments DILUES 0,58->0,54 / 0,76->0,71 / 0,94->0,93 / 0,69->0,65) ; 20_OWUI : 1 -> 0 (clean, l'echo pre-existent dilue sous le seuil) — aucun finding nouveau
pre-commit (H.3, markdown-rendering, cell-parses) Passed
pedagogy_density.py (LIVE, post-commit) 1253 / 1217 — tous >= 1200

Notebooks deja executes (exec = code, 0 erreur, toutes cellules avec outputs) -> exception C.2 markdown-only, aucune re-execution requise.

See #13410

🤖 Generated with Claude Code

…nsite 753/783 -> 1253/1217)

9 cellules markdown ancrees sur les sorties executees (estimateur non-biasé pass@k verifie sur les nombres affiches, seule la ligne difficile scale 0.25->0.50, frontiere compute-optimale non tranchee a budget egal, 401 vs 403 arbre de decision, /health liveness vs /api/version contrat). Markdown-only, cellules code byte-identiques a origin/main.

See #13410

Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com>
@github-actions

Copy link
Copy Markdown
Contributor

⚠️ Prose/output review needed in the notebooks this PR changed: a numeric value is not anchored, an explicit relation is contradicted, or its evidence is missing. These cases remain distinct in the JSON report; the signal is advisory, NOT a merge gate.

Scope = notebooks CHANGED in this PR, not the whole corpus. Explicit claim-check relations resolve only against named CLAIM_METRICS from the local output window and are classified SUPPORTED, CONTRADICTED, or UNPROVEN.
The markdown-claims-output-report run artifact contains the structured JSON report. See python scripts/check_markdown_claims_output.py --help for re-running locally.
Detector rationale: c.290 / c.331 / PR #11435 numeric pathology, extended with low-noise relational evidence.

@github-actions

Copy link
Copy Markdown
Contributor

G-VAR-2/3 GENRE signals (advisory, non bloquant, #10020).
La lane `myia-po-2026:CoursIA` voit ces signaux actifs sur les mergees du jour (UTC 2026-09-13) :

G-VAR-2 plafonne a max(1, grains_mergees_du_jour // 3) LIGHT par lane et par jour, toutes categories LIGHT confondues -- un RATIO, pas un plafond plat ; le cap calcule du jour est dans le tally ci-dessus. G-VAR-3 interdit deux genres LIGHT consecutifs. Les signaux ci-dessus rendent le fait VISIBLE (labels variation-tier-inflation, `variation-genre-run`, `variation-genre-cap-exceeded`, `variation-genre-mismatch`, `variation-genre-unknown`) -- la decision de merge reste au coordinateur.

@github-actions

Copy link
Copy Markdown
Contributor

Notebook PR Validation: PASS

  • Notebooks checked: 2
  • Code cells validated: 21
  • Result: All passed

Checks: H.1 (no errors), H.3 (execution_count), C.1 (no banned patterns)
Non-Python kernels (.NET/Lean): C.1 + errors only (execution_count advisory)
QuantConnect notebooks: C.1 + errors only (require QC Cloud for execution)

@github-actions

Copy link
Copy Markdown
Contributor

Notebook outputs-required (H.4 schema): PASS (every code cell carries an outputs: list)

@github-actions

Copy link
Copy Markdown
Contributor

Golden-Set Execution (H.7 P3)

✅ 8/8 notebooks passed (certified reproducible)

Notebook Status Time
2.1-Workflow-ML.ipynb ✅ SUCCESS 11.5s
2.2-Descente-de-gradient.ipynb ✅ SUCCESS 9.2s
2.3-Regression-lineaire-logistique.ipynb ✅ SUCCESS 10.7s
2.4-Arbres-Forets-Ensembles.ipynb ✅ SUCCESS 12.1s
Search-01-StateSpace.ipynb ✅ SUCCESS 11.3s
SL-1-LogicalLearning.ipynb ✅ SUCCESS 7.3s
rl_4_multi_armed_bandits.ipynb ✅ SUCCESS 73.9s
GameTheory-04c-NashExistence-Python.ipynb ✅ SUCCESS 8.7s

Pinned lockfile: scripts/notebook_tools/golden_set.lock.txt (H.7 P3, axe A #4208)

@github-actions

github-actions Bot commented Sep 13, 2026 •

Copy link
Copy Markdown
Contributor

Path-collision (organ #13359/#13615)

Cette PR #16038 (enrich(genai,#13410): prose interpretative Scaling-TTC + OWUI API (densite 753/783 -> 1253/1217)) touche au moins un chemin de fichier aussi modifie par d'autres PRs ouvertes. Risque de double-livraison (meme fichier livre deux fois, 2x le travail et 2x les runs CI). Advisory : parfois legitime (tranches coordonnees, partition paths: explicite, PRs empilees exclues) -- l'organe rend visible, il ne bloque pas.

@jsboige jsboige left a comment

Copy link
Copy Markdown
Owner Author

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

[adjoint — preflight COMMENTED] Vérification exact-head ad419ebf89cac24c71600ba371e93a86b219ac4b

Relecture effectuée : body complet, commentaires, reviews, surface inline, diff des deux notebooks, checks latest-wins et check_unaddressed_nits.py 16038.

  • Scope : enrichissement markdown-only de 16_Scaling_Test_Time_Compute.ipynb (+110) et 20_OWUI_Native_API.ipynb (+99), sans modification des cellules code par rapport à origin/main.
  • B.0 : rc=0, aucune review et aucun thread inline ; commentaires limités aux avis automatisés.
  • CI : toutes les jambes sont vertes, y compris validation notebooks, sorties requises, ratchets output/source, positionnement des interprétations, twin parity et Quarto.
  • G-VAR : ce contenu pédagogique est bien de classe CONTENU ; aucun HOLD ne découle du signal TIER-INFLATION de la lane.
  • Séquencement : l’organe de collision signale aussi #16054 sur 16_Scaling_Test_Time_Compute.ipynb. Ce n’est pas un défaut intrinsèque de #16038, mais l’ordre doit être arbitré et le diff recontrôlé après le premier merge pour éviter une double livraison.

Recommandation adjoint : READY sous réserve du séquencement avec #16054. Lecture B.0 finale et merge réservés à myia-ai-01:CoursIA.

@jsboige
jsboige merged commit 6466986 into main Sep 15, 2026
78 of 79 checks passed
jsboige added a commit that referenced this pull request Sep 15, 2026
Conflit 16_Scaling resolu cellule par cellule :
- base = tete de branche (recalibrage Qwen + outputs commis) ;
- 5 cellules 'Lecture' de l'enrichissement #16038 greffees, RECALEES sur
  les outputs de CE run (Ping facade #14755, n=8 c=5, difficile
  0,50/0,58/0,67/0,75, verdict final 0,67 vs 0,75 <- Reflexion) ;
- cellule Limites de la branche conservee : elle subsume le fix #16293
  (bullet 'le verdict est un tirage', adapte temp 0.7 / 4 enonces).
Cellules code 10/10 byte-identiques : markdown-only, pas de re-exec due (C.2).

Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com>
jsboige added a commit that referenced this pull request Sep 16, 2026
Conflit 16_Scaling resolu cellule par cellule :
- base = tete de branche (recalibrage Qwen + outputs commis) ;
- 5 cellules 'Lecture' de l'enrichissement #16038 greffees, RECALEES sur
  les outputs de CE run (Ping facade #14755, n=8 c=5, difficile
  0,50/0,58/0,67/0,75, verdict final 0,67 vs 0,75 <- Reflexion) ;
- cellule Limites de la branche conservee : elle subsume le fix 16293 (PR)
  (bullet 'le verdict est un tirage', adapte temp 0.7 / 4 enonces).
Cellules code 10/10 byte-identiques : markdown-only, pas de re-exec due (C.2).

Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com>
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant