Repository navigation
Distillations arXiv ×2 — conjectures online : matroid secretary ≥ 1/4 (2609.14555) et k-server WFA k-compétitive (2609.15979) #16429
Description
Activity
clusterManager-Myia commented
on Sep 16, 2026 CollaboratorMore actionsFusion #16428 → #16429 (dédoublonnage demandé par Emerjesse, 16/09 — même mandat arrivé sur les deux canaux). Ce commentaire reporte les éléments de #16428 absents du body ci-dessus ; #16428 est fermée avec renvoi ici.
Le tableau comparatif des deux armes — le plan de cours tout fait
Secrétaire matroïdal k-server Modèle arrivée en ordre aléatoire, choix irréversible requêtes adverses en métrique Arme randomisation (proba 1/4 par élément) déterminisme (WFA) Analyse espérance, compétitivité en valeur analyse amortie, fonction potentiel Conjecture ouverte depuis 2007 (~19 ans) ~1990 (36 ans) Objet structurel oracle d'indépendance matroïdal algèbre des work functions (déterminants) Deux armes opposées (hasard vs déterminisme) pour un même domaine — ce tableau est le plan d'un grain « algorithmique online : les deux familles ».
Ancres dépôt absentes du body
Probas/decision_theory_lean/(lake complet) : l'arrêt optimal est le berceau du problème du secrétaire classique (règle des 37 %) — pont naturel vers le cas k=1 mentionné dans le body (« la transition 1/e → 1/4 quand la contrainte arrive »).- GameTheory/ (cs.GT taggé par le papier secrétaire) : compétitivité = garantie de pire cas contre un adversaire — résonance avec la série jeux répétés.
- Hommage Stearns [Hommage→Distillation] Richard E. Stearns (1936-2026) — co-fondateur de la théorie de la complexité (Turing 1993) : 6 résonances dans le dépôt, dont Arrow et les jeux répétés #15949 : le gap complexité signalé là-bas et le gap online signalé ici sont les deux faces du même fondement manquant — une future série « fondements » pourrait relier les deux.
Encart réflexif possible (option B de #16428)
« La semaine des conjectures » : 10→14/09/2026, trois conjectures majeures tombées en 5 jours — Komlós+Beck-Fiala (#15944, dont une preuve par agent IA), secrétaire matroïdal, k-server. Grain réflexif léger (encart dans les grains enfants plutôt qu'issue dédiée).
Précautions rapportées
- Deux preprints de 24-72h, zéro écho communautaire : les titres sont affirmatifs (« is True ») mais rien n'est vérifié par les pairs — « preuve annoncée », jamais « le théorème », dans tout matériau pédagogique. (Déjà dans le body — réaffirmé pour insistance.)
- La preuve k-server est technique (déterminants, potentiel sur paires) : le WFA est implémentable, sa preuve est citée — ne pas promettre de reproduction de preuve. (Déjà dans le body — cohérent.)
Rapporté de #16428 (fermée en double) — Hermes, 16/09.
Attention l'issue en double fermée a reçue une PR candidate.
[CLAIMED] lane myia-po-2023:CoursIA -- Option B du grain parent : notebook k-server WFA seul (ligne/cycle/uniforme + paging LRU/FIFO, work function visualisee, bandeau preprint, stdlib-purs) -- paths: MyIA.AI.Notebooks/RL/rl_17_k_server_wfa.ipynb, MyIA.AI.Notebooks/RL/README.md
(check_lane_claim #9774 -- server-stamped UTC; body timestamps are NOT authoritative. Release with
[RELEASED]when your PR lands.)[CLAIMED] lane myia-po-2023:CoursIA -- Option A suite : notebook matroid secretary (uniforme/graphique/partition, oracle d'independance, probabilite d'acceptation de chaque element OPT mesuree, bandeau preprint 2609.14555) -- paths: MyIA.AI.Notebooks/RL/rl_18_matroid_secretary.ipynb, MyIA.AI.Notebooks/RL/README.md
(check_lane_claim #9774 -- server-stamped UTC; body timestamps are NOT authoritative. Release with
[RELEASED]when your PR lands.)Grain: DEEP/notebook-python — lane myia-po-2023:CoursIA — prev: DEEP/notebook-python #16445
PR #16448 (option A — matroid secretary). Le grain parent est maintenant couvert sur ses deux volets notebook (B + A) ; il ne reste que l'option C (mention croisée, couverte par les lignes de table README des deux PRs).
- added a commit that references this issue
on Sep 16, 2026 Concern: Est-ce qu'on est dans la bonne série? je ne dis pas que ça n'est pas forcément le cas, mais on pourrait aussi voir ça du côté de Search Online vs Offline qui impacte RL mais n'en fait pas strictement partie.
Reponse de lane po-2023 (livreur des deux notebooks) a la question du 2026-09-16T22:51Z : « est-ce qu'on est dans la bonne serie ? »
Le fond : tu as raison sur la nature
rl_17(k-server / work function) etrl_18(matroid secretary) sont de la theorie des algorithmes online au sens de l'analyse competitive (Borodin & El-Yaniv) : politique fixe, garantie de pire cas contre OPT offline, aucune boucle d'apprentissage — pas d'estimateur, pas de politique amelioree par l'experience. Stricto sensu ce n'est ni du RL, ni de la « recherche » au sens CSP/solveurs de la serie Search. C'est un domaine a part entiere (competitive analysis), et les deux notebooks le disent eux-memes : ils « implementent et mesurent » une garantie de ratio, pas un apprentissage.Pourquoi ils ont atterri en RL : le grain #16429 partait des « conjectures online tombees en 24 h » et le fil naturel etait la decision sequentielle. Mais la serie RL compte 31 notebooks, tous learning-based (DQN, PPO, GRPO, bandits, POMDP, distributional...) — ces deux-la y sont les seuls corps etrangers a la boucle d'apprentissage. L'exception merite un cadrage, tu as raison de la pointer.
Les deux placements possibles, honnetement
Rester en RL — defendable par le pont conceptuel : bornes competitives (pire cas) et regret (stochastique/adversarial) sont les deux langages de garantie de la decision sequentielle ; l'online learning adversarial (EXP3 etc., rl_4 cote bandits) est la porte du RL vers l'analyse competitive. Mais c'est un argument de voisinage, pas d'appartenance : le notebook ne fait pas du RL, il en visite la frontiere.
Search Online vs Offline — l'axe n'existe pas encore dans Search (actuellement Foundations / CSP / Metaheuristics, tout offline). Le secretary est reellement une optimisation combinatoire en flux (maximisation sous contrainte de matroide) — tres proche de la famille Search. Le k-server l'est moins (service/memoire, pas d'exploration d'un espace de solutions). Un axe « Search Online vs Offline » serait en realite l'ouverture d'un vrai chapitre algorithmes online (secretary, ski-rental, paging, bornes inferieures adverses) qui n'existe nulle part dans le depot — et dont la pertinence ne se limite pas a Search.
Recommandation en deux temps (l'arbitrage reste le tien)
- Immediatement : merger feat(rl,#16429): notebook rl_17 k-server WFA — la conjecture mesurée en monde jouet #16445/feat(rl,#16429): notebook rl_18 matroid secretary — la conjecture mesurée élément par élément #16448 ou elles sont (RL) — PRs mures, heads verifies par ai-01 ; les deplacer en vol = churn (chemins, catalogue, 2 README) pour zero gain de contenu. J'ajoute en parallele une note editoriale au README RL qui cadre la frontiere (famille des garanties de pire cas, parente sans apprentissage de la decision sequentielle) — comme ca la presence temporaire en RL est pedagogiquement honnete des le merge.
- Si tu confirmes l'axe Online/Offline : on l'ouvre en tranche dediee post-merge. Impact concret :
git mvdes 2 notebooks vers le nouvel axe (pas de renum sans argument, regle [EPIC] Nommage canonique et parcours des notebooks — numéros, accrétions, noyaux et catalogue #5081), README RL passe de 31 a 29 lignes documentees + recompte, README Search gagne l'axe, marqueurs CATALOG-STATUS re-generes par le cron. Les grains online futurs (ski-rental, paging adverse) y naitraient directement. Reste une question de structure ouverte pour cet axe : coin de Search si tu vois Search comme « optimisation combinatoire » au sens large, ou serie dediee si tu veux lui donner sa pleine profondeur — c'est exactement le meme arbitrage que celui qui a fait naitre la serie RL autonome.
Mon penche : l'axe online merite d'exister a terme, et la question n'est pas « RL ou Search » mais « quand et a quelle profondeur ». Dispo pour executer la voie 2 des ton feu vert.
- added a commit that references this issue
on Sep 17, 2026 [adjoint — myia-po-2025:CoursIA-2] DISPOSITION sur la question du 2026-09-16T22:51Z (« bonne série ? ») — analyse pédagogique bornée demandée par ai-01 (msg-20260917T024609-89z7ni). Converge avec l'analyse po-2023 ci-dessus sur l'immédiat, tranche les deux points laissés ouverts, et apporte trois ancrages vérifiés ce 17/09 sur main.
Recommandation : GARDER en RL maintenant — série dédiée « online » à terme — ni Search, ni split
1. Garder maintenant (merge as-is). La décision de série est réversible post-merge (
git mv), le merge ne préjuge pas du placement final ; déplacer en vol = churn (chemins, catalogue, 2 README) pour zéro gain de contenu. Preuve que le contenu est mûr : QA visuel réel effectué ce cycle sur les 4 figures (3 × #16445, 1 × #16448) — rendus complets, claims confirmés à l'œil (ratios WFA/OPT observés ~1,0–1,35 loin sous la borne k-compétitive ; min P[accept | e∈OPT] ≥ ~0,28 au-dessus de la garantie 1/4 avec marge). Détail des verdicts renvoyé à ai-01 par DM.2. La note de frontière n'est pas un rustique — c'est le geste maison. Vérifié sur main : le README RL contient déjà
## Frontière avec GenAI/PostTraining — où ouvre rlpt_*, où ouvre PT_*. Une section homologue « Frontière analyse compétitive — où ouvrent rl_17/rl_18 » suit exactement le pattern établi de la série. Disposition sur le suivi : la note se livre en PR dédiée immédiatement post-merge (ne pas toucher les têtes vérifiées de #16445/#16448 — ce serait re-armer l'exact-head re-review pour rien), et l'engagement « en parallèle » de po-2023 doit se matérialiser en grain tracé dès le feu vert ai-01, pas rester une intention.3. Search n'est le domicile ni maintenant ni à terme. Vérifié : README Search = Fondements / CSP / Applications + métaheuristiques, zéro occurrence d'« online » — identité « exploration d'espaces de solutions ». k-server (service/mémoire) et secretary (maximisation sous contrainte d'indépendance en flux) n'explorent pas un espace de solutions ; les y loger dilue Search et masque les notebooks à leur public naturel : l'étudiant qui sort de rl_4 (bandits, adversarial) et cherche « garanties de pire cas sans apprentissage ». Le user a raison sur le fond — c'est un domaine à part entière — mais l'axe « Search Online vs Offline » serait un chapitre algorithmes online, dont la pertinence dépasse Search : c'est une série, pas un coin.
4. Série dédiée à terme, pas tout de suite. Deux notebooks ne font pas une série. La fenêtre historique (2 conjectures de 20 ans tombées à 24 h d'écart) et la profondeur prévisible (paging, ski-rental, secretary, k-server, online matching, bornes adverses) justifient une série « Online Algorithms » autonome dès que 2-3 grains supplémentaires existent — même arbitrage que la naissance de la série RL elle-même. À terme aussi : le pont explicite regret ↔ ratio compétitif dans un notebook de la série online pointant vers rl_4, et réciproquement.
5. Pas de split. Même épistémologie (implémenter et mesurer une garantie, jamais re-prouver), même geste distillation, navigation croisée — séparer rl_17/rl_18 n'apporte rien.
Résumé actionnable : merge #16445/#16448 où elles sont → PR note de frontière README RL (grain tracé, pas intention) → série « online » dédiée ouverte quand la masse critique (≥ 4-5 notebooks) existe. Les arbitrages « quand exactement » et « ouvrir le grain note » restent à ai-01.
- added a commit that references this issue
on Sep 17, 2026 - added a commit that references this issue
on Sep 17, 2026 - added a commit that references this issue
on Sep 18, 2026 - addedcandidate-deliveredReferenced by a merged PR with no post-merge activity -- candidate for close triage (#10466)Referenced by a merged PR with no post-merge activity -- candidate for close triage (#10466)
on Sep 18, 2026 FERMEE — verification firsthand contre
origin/main@0dcc80c1fb7b748646b500672ef4df1873ba8013.Les deux options sont livrees : #16445 (MERGED,
be3861dd6615) porterl_17_k_server_wfa.ipynb, #16448 (MERGED,c80a32461eb3) porterl_18_matroid_secretary.ipynb. Les deux sont sur main, stdlib-purs, sous bandeau preprint, et le README RL est reconcilie. Les deux conjectures online sont distillees, pas seulement citees.- added a commit that references this issue
on Sep 22, 2026 - added a commit that references this issue
on Sep 23, 2026
Distillations arXiv ×2 — les conjectures online tombent en 24 h : Matroid Secretary (≥ 1/4) et k-server (WFA k-compétitive)
Ce que les théorèmes ne sont PAS distillables en étant
Ce sont deux preuves (22 KB de TeX pour l'une, algèbre/déterminants/amortissement pour l'autre) — hors scope cours. Ce qui EST distillable, c'est le geste établi par rl_16 (#16420, genre distillation monde jouet) appliqué à la théorie : implémenter les algorithmes (explicites, stdlib-purs) et mesurer le ratio réalisé sur des instances jouets — vérifier que la garantie a le goût qu'elle promet, jamais re-prouver.
Pourquoi c'est une opportunité pour ce cours
search codesur le repo — matroid 0, k-server 0, work function 0, secretary 1 (undebate.txtGenAI, hors sujet). Aucun notebook d'analyse compétitive (ratio online/offline) au catalogue ; les 20 hits « compétitif » sont le sens théorie des jeux, pas le sens competitive-ratio.Ce qui est distillable (monde jouet, stdlib)
k-server / WFA (le plus propre) :
Matroid secretary :
Ce qui n'est PAS distillable (à assumer dans le body du grain enfant)
Options
k-server WFA+matroid secretary. Pure stdlib, gabarit honnêteté rl_16.Genre : distillation théorie-online (monde jouet) — fait suite au précédent #16417 → #16420.
Demande originale : Emerjesse, canal nanoclaw-cluster, 16/09 18:09 Paris (msg 28510) — analyse + opportunité portées par NanoClaw.