Tous les nouveaux projets

Projet A · Programme de recherche · initialement cadré sur 14–18 mois

Analyse topologique des données en trading quantitatif

Projet démarré le 2026-05-08 · Dernière mise à jour le 2026-05-14

View previous versions

Six macro-phases livrées sur un calendrier comprimé, jusqu’au test décisif H3 et maintenant la construction de portefeuille H4. Le plan initial de 14–18 mois était calibré sur la cadence d’un chercheur unique ; le projet avance bien en avance sur ce calendrier, et le journal de progression ci-dessous porte la date de complétion réelle de chaque phase pour qu’un lecteur puisse vérifier le rythme de façon indépendante.

Ce que nous avons fait · ce qui a marché · ce qui n’a pas marché

La découverte centrale

La topologie gagne sa place à décrire la forme de votre univers de stratégies et à décider sur cette forme, choisir un portefeuille diversifié, signaler une cohorte instable, faire tourner les stratégies par régime, et seulement lorsqu’elle ajoute un degré de liberté structurel que l’approche standard n’a pas déjà. Elle ne gagne pas sa place à prévoir comment une stratégie individuelle se comportera ; le scorecard standard l’emporte là. Cette partition prévision-vs-décision, raffinée quatre fois au cours du programme, est le résultat méthodologique central du travail, et chaque contribution phare se situe du côté décision de celle-ci.

Ce qui a marché

  • H1 : prédiction par voisinage dans l’espace de comportement

    PASS

    Les plus proches voisines de comportement d’une stratégie prédisent sa prochaine fenêtre out-of-sample bien mieux que ne le fait son propre passé, méta ΔR² ≈ +0,13 sur 182 cohortes. Le signal fondateur sur lequel tout le reste en aval repose.

  • H4 : construction de portefeuille consciente de la topologie

    PASS

    Bat Hierarchical Risk Parity à l’échelle du corpus, ΔSortino vs HRP = +0,61 (IC 95 % [+0,39, +0,82], significatif au sens de Holm). L’avantage se concentre sur la cohorte des majors L1 (+1,20) et les familles d’indicateurs de volatilité et d’oscillateurs (ATR / MACD / Stochastic %K) ; sur les familles de moyennes mobiles le résultat est plat ou négatif. Face à un simple baseline top-k-par-fiabilité à pondération égale, l’étape de cluster Mapper est statistiquement indiscernable sur le Sortino, donc la contribution topologique relève de la couverture et de la traçabilité d’audit, non du rendement brut, et face à un baseline naïf top-k classé par Sharpe in-sample le Stack topologique perd encore sur le Sortino. Une construction honnête et traçable à l’audit, voilà ce qui est livré.

  • H17 : dynamique de trajectoire de persistance des cohortes

    PASS

    La manière dont la géométrie de la population de stratégies d’une cohorte dérive à travers le walk-forward prédit la stabilité de sa performance out-of-sample (Spearman ρ ≈ +0,72), livré comme alerte au niveau de la cohorte « faites-confiance-à-cette-agrégation ».

  • Le Topology Deployment Stack

    ASSEMBLÉ

    Le pipeline orienté trader, map → select → diversify → monitor → pause/refit, construit entièrement à partir des primitives géométriques qui se sont révélées robustes, livré comme une CLI à dix commandes avec les réserves issues des résultats négatifs intégrées au texte d’aide des commandes concernées.

Partiel : utile, avec un plafond

  • H12 : détection topologique de régime + rotation de cohortes

    MARGINAL

    Le détecteur de régime lui-même est nul ; la politique de rotation de cohortes qui consomme l’état détecté fonctionne. Livré comme article, pas comme alarme de régime.

  • H13 : lissage par Laplacien de graphe du signal de voisinage

    MARGINAL

    Directionnellement positif dans 94,5 % des 182 cohortes mais faible à l’échelle du corpus ; livré comme couche de lissage optionnelle pour la famille des moyennes mobiles, pas comme victoire à l’échelle du corpus.

  • H14 : flag d’overfit par outlier géométrique

    MARGINAL

    Un complément de triage utile aux diagnostics classiques de Sharpe déflaté / PBO, les stratégies signalées par les deux sont les abandons les plus sûrs, mais pas un remplacement.

  • H16 : portefeuilles de couverture conscients de la géométrie

    MARGINAL

    Aucun de farthest-point sampling / k-DPP / couverture bayésienne ne bat le portefeuille de clusters Mapper, mais la confrontation a fait émerger le constat que la couverture sans prior de qualité n’est essentiellement que du bruit.

Ce qui n’a pas marché

  • H3 : « la topologie bat le baseline de ML moderne », le test décisif

    FALSIFIÉE

    Les caractéristiques de forme d’homologie persistante nuisent activement sur chacune des cinq cohortes les plus fortes, à travers deux représentations de caractéristiques et trois familles d’architectures. La thèse « la topologie remplace le ML » est morte, le programme s’est recadré autour de ce qui survit.

  • H2 : détection de plateaux dans l’espace des paramètres

    FALSIFIÉE

    Sous le seuil d’effet à travers trois méthodes à l’échelle du corpus ; un sauvetage dans l’espace de comportement paraissait prometteur jusqu’à ce qu’un audit causal par fenêtre montre que ~74 % en était de la fuite par anticipation.

  • H15 : prédiction topologique de risque / fragilité

    FAIL

    Le scorecard classique ex-ante prédit déjà quelles stratégies échouent de façon catastrophique (concordance hold-out ≈ 0,78 contre ≈ 0,58 pour la topologie), il n’y a aucun résidu que la topologie puisse ajouter.

  • H18 : élagage du vivier de candidats conscient de la topologie

    FAIL

    Le sélecteur exploite déjà la même structure géométrique qu’un élagueur, donc pré-élaguer son entrée ne fait que retirer ses options. La recommandation : ne pré-élaguez pas ; donnez au sélecteur tout votre corpus.

  • H19 : moniteur de dérive en direct par stratégie

    FAIL

    Le score de dérive se déclenche à la rupture classique de drawdown, pas avant (avance médiane 0 fenêtre). Livré uniquement comme aide à la visualisation ; le moniteur actionnable est le contrôle de confiance-d’agrégation au niveau de la cohorte.

  • H20 : alerte précoce de santé de couverture de portefeuille

    FAIL

    L’alarme de santé de couverture se déclenche au déclencheur classique de drawdown, pas avant (avance médiane −1,0 fenêtre sur les unités co-déclenchantes ; 0 cohorte sur 89 ne montre d’avance positive significative au sens de Holm). Livré uniquement comme diagnostic descriptif de couverture, il n’y a aucun signal d’alerte précoce actionnable ici.

  • Contrainte de portefeuille de diversité des modes de défaillance

    FAIL

    Forcer le constructeur de portefeuille à couvrir six modes de défaillance fait baisser le rendement ajusté au risque d’un montant faible mais significatif au sens de Holm (−0,09 Sortino corpus, porté par les cohortes de la famille des moyennes mobiles). Le coût est réel mais plus faible en magnitude que ne le suggérait la première mesure. Les étiquettes de modes de défaillance elles-mêmes sont utiles comme audit descriptif de portefeuille ; la version à contrainte dure est désactivée par défaut.

  • H10 / H11, homologie persistante locale + pouvoir prédictif de Fisher–Rao

    DÉPRIORISÉE

    Les deux étaient des élaborations de la thèse H3 ; H3 falsifiée, dépriorisées vers un article de suivi. L’homologie persistante locale sur une variété lisse ne porte rien.

La Phase I est close, chaque hypothèse pré-enregistrée a abouti à un verdict, y compris H5 (FAIL : aucune universalité inter-actifs mesurable entre majors L1 / alt-L1 / memes / DeFi / L2, donc chaque cohorte crypto a besoin de son propre sélecteur, le chapitre de synthèse recadre en conséquence). Encore à venir : la synthèse, les huit articles, la monographie appliquée, le package logiciel public, et un conteneur de reproductibilité archivé avec un DOI.

69%complet

18 des 26 phases terminées sur l’ensemble des trois phases du programme. La Phase I (le pilote) est terminée, chaque hypothèse pré-enregistrée a abouti à un verdict. 3 phases sont en cours sur les trois phases réunies : l’agrégation par sheaf-Laplacian de la Phase II a désormais livré un raffinement partiel de deuxième étage par-dessus sa première barre phare (un portefeuille sheaf-Tikhonov à gating cohomologique domine par Holm la configuration phare précédente sur trois des quatre découpes pré-enregistrées), et le théorème de stabilité coût-capacité a livré deux opérationnalisations complémentaires (une mesure à scénarios discrets temporellement stable avec une queue déployable de 16,4 %, et une mesure continue en points de base qui résout une dérive temporelle que la grille discrète avait manquée ; Spearman ρ entre elles = 0,0491). Le théorème, la topologie temporelle, le filtre de carnet d’ordres et le benchmark public sont encore à venir dans la Phase II. La Phase III, la ré-exécution inter-actifs et la publication de synthèse, vient séquencée après.

Base de code

81 873 lignes·270 fichiers·au 2026-05-14

Python93,1%· 76 211Rust6,8%· 5 577Shell0,1%· 85

Lignes de source à travers le pipeline d’analyse, boucles chaudes en Rust (parsing, distances, primitives d’évaluation), orchestration et analyse en Python, la surface CLI de production, et les scripts de rendu de figures. Non comptés : plus de 10 000 lignes de rapports de verdict et de notes de méthodologie rédigés.

Décomposition par module

Quinze groupes à travers la boîte à outils, ce que chacun est et grossièrement sa taille. Les comptes de lignes sont en source uniquement ; la barre par langage ci-dessus est le même total réparti par langage.

  • Cœur Rust, parsing, distances, empreinte, évaluation4 352 lignes·6 fichiers

    Le chemin chaud : le parseur de texte des journaux de trades, le format binaire compact des trades, les distances par paires entre stratégies, l’empreinte de stratégie, et les primitives d’évaluation, les boucles qui parcourent tout le corpus, donc elles vivent en Rust.

  • Liaisons Rust ↔ Python1 225 lignes·1 fichiers

    Liaisons PyO3 qui exposent le cœur Rust au côté Python, avec des tests de parité fixant les deux implémentations aux mêmes nombres.

  • Couche d’E/S1 173 lignes·3 fichiers

    Les lecteurs de journaux de trades côté Python, le parseur de texte et le lecteur de trades binaires, alimentant les historiques de stratégies dans le reste du pipeline.

  • Couche de l’espace des stratégies2 016 lignes·5 fichiers

    Construit l’espace que tout le programme étudie : l’embedding de l’espace des paramètres, les métriques de distance, l’embedding de l’espace de comportement, et le constructeur de caractéristiques causal par fenêtre (la version sûre contre la fuite de l’empreinte).

  • Couche de topologie4 133 lignes·11 fichiers

    Chaque construction topologique utilisée : homologie persistante, le détecteur de régime, les descripteurs de trajectoire de persistance, le test de plateau, les flags d’outlier géométrique / d’anomalie, le modèle de risque de type Cox, le lisseur par diffusion, plus les ajouts de la Phase II : la construction strictement causale du nerf de clusters et le module de faisceau cellulaire / sheaf-Laplacian derrière le portefeuille phare de la Phase II.

  • Couche d’évaluation3 246 lignes·10 fichiers

    L’échafaudage de mesure : le harnais de walk-forward optimisation, la validation croisée, les statistiques, la correction des tests multiples, la mutualisation et l’agrégation de cohortes, la winsorisation, le test de plateau H2, et le pont vers l’évaluateur Rust.

  • Modèles baseline5 340 lignes·18 fichiers

    Chaque comparaison face à laquelle les caractéristiques topologiques sont étalonnées : XGBoost, LightGBM et CatBoost, TabPFN, ridge, ts2vec, les apprenants topologiques persistence-image / PersLay / PersFormer / sheaf-network, le noyau sliced-Wasserstein, Fisher–Rao, les encodeurs contrastifs et topo-contrastifs, les têtes topologie-seule et topologie-augmentée, et l’ensemble empilé.

  • Clustering390 lignes·2 fichiers

    Le clusteriseur de densité ToMATo utilisé pour découper des cohortes dans l’espace des stratégies.

  • Applications CLI & échafaudage du package5 660 lignes·18 fichiers

    La ligne de commande orientée praticien, le Topology Deployment Stack à dix commandes (map, select, portfolio, audit, monitor, refit, aggregation-check, plateau-audit, universality-check, live-adapter) plus la couche de câblage du deployment-stack qui les relie, et les primitives descriptives / d’audit qui l’accompagnent : le profil de dérive par stratégie, la liste restreinte du vivier de candidats, les métriques de santé de couverture de portefeuille, et le sélecteur de couverture des modes de défaillance (les quatre livrés avec leurs verdicts FAIL intégrés au texte d’aide ; les métriques de santé de couverture et le sélecteur de modes de défaillance sont conservés comme diagnostics descriptifs, pas comme déclencheurs de décision).

  • Thème des figures176 lignes·2 fichiers

    Le thème de tracé partagé, couleurs, polices, valeurs par défaut de mise en page, avec lequel chaque figure de cette page est dessinée.

  • Scripts pilotes de phase39 049 lignes·104 fichiers

    La plus grande tranche : un script numéroté et ré-exécutable par phase et par hypothèse, le parsing du pilote et la première lumière, puis H1, H2, H3, les balayages portfolio-méta, H4, les extensions H12–H20 (H17 trajectoire PASS · H13/H14/H16 marginales · H15/H18/H19/H20 FAIL), le test de la contrainte de diversité des modes de défaillance, l’exécution à l’échelle de déploiement sur tout le corpus, H5 universalité inter-actifs (FAIL), et les ajouts de la Phase II, les baselines du substrat strictement causal, le balayage de portefeuille sheaf-Laplacian derrière le travail de construction de portefeuille topologique, l’échafaudage de balayage de frictions pour l’invariant coût-capacité, et l’audit en données gratuites pour le pilote de carnet d’ordres. Chaque script est le pipeline exact derrière un verdict, pas une esquisse de celui-ci.

  • Jobs cloud-burst1 324 lignes·9 fichiers

    Les jobs en rafale GPU qui s’exécutent hors machine sur des H100, upload de données, la recherche d’architecture, le ré-entraînement PersLay top-5, l’exécution de parité Ripser++, un job de smoke, et le script de synchronisation qui rapatrie les résultats.

  • Scripts de rendu de figures7 928 lignes·31 fichiers

    Le script matplotlib derrière chaque figure, schéma et diagramme ici, chacun lit l’artefact de verdict réel (ou le parquet de sortie d’exécution réel, pour les rendus de variété-comportement / graphe Mapper / courbe d’équité / trajectoire de persistance) et émet PNG, SVG et PDF, en anglais et en portugais là où la figure porte du texte.

  • Tests5 993 lignes·51 fichiers

    Tests unitaires pour la bibliothèque, tests de parité Rust ↔ Python, et tests de smoke de bout en bout pour chaque application CLI.

  • Benchmarks126 lignes·1 fichiers

    Le harnais de chronométrage qui décide de ce qui est descendu en Rust.

Feuille de route par phases

17 étapes & hypothèses · en séquence · cliquez sur n’importe quel nœud pour le détail

  1. Done

    Corpus (~1,4 M de backtests, 27 actifs, 8 familles d’indicateurs), l’empreinte de comportement à 45 dimensions, les matrices de distance, le pilote à 3 actifs. Constat précoce clé : la variété de l’espace de comportement est lisse, pas en blocs, ce qui a fixé la méthode H4 (Mapper, pas HDBSCAN).

  2. Done

    Les voisines de comportement d’une stratégie prédisent-elles son avenir ? Oui, le Sharpe OOS moyen des 20 plus proches voisines prédit le Sharpe de la fenêtre suivante de la stratégie bien mieux que son propre passé. Méta ΔR² = +0,130 sur 182 cohortes. PASS, la fondation sur laquelle tout l’aval repose.

  3. Done

    Les stratégies sur de larges plateaux de paramètres généralisent-elles mieux que celles sur des pics aigus ? Non, trois mesures de plateau, toutes sous le seuil. Un sauvetage dans l’espace de comportement paraissait prometteur (+0,236) jusqu’à ce qu’un audit causal par fenêtre montre que ~74 % en était de la fuite par anticipation. Falsifiée, et le piège de la fuite est désormais surveillé partout.

  4. Done

    Le test central : les caractéristiques de forme d’homologie persistante battent-elles le solide baseline de ML moderne pour prédire la performance OOS ? Non, elles nuisent activement sur chacune des 5 cohortes les plus fortes (méta ΔR² = −0,038, p = 1,07×10⁻⁵), à travers 2 représentations de caractéristiques et 3 familles d’architectures. Falsifiée. L’affirmation « la topologie bat le ML » est morte, le programme se recadre autour de ce qui survit.

  5. Done

    Un jalon de méthodologie à l’échelle du programme avant le travail de portefeuille H4 : le jeu de caractéristiques en entrée du prédicteur a été revu et verrouillé, la discipline d’évaluation causale par fenêtre a été resserrée sur chaque hypothèse, et une scission en deux classes a émergé, les méthodes qui utilisent la topologie pour décrire l’univers des stratégies sont robustes au changement de discipline, celles qui l’utilisent pour prévoir la performance d’une stratégie individuelle s’amenuisent sous celui-ci. La graine de la découverte méthodologique centrale du programme.

  6. Done

    Construire un portefeuille en échantillonnant une stratégie par cluster Mapper, pondérée par la borne inférieure de fiabilité Beta-Binomiale de chaque stratégie. À l’échelle de déploiement, chaque actif crypto × famille d’indicateurs × fenêtre walk-forward, le Stack topologique bat Hierarchical Risk Parity de +0,61 ΔSortino (IC 95 % [+0,39, +0,82], significatif au sens de Holm), concentré sur la cohorte des majors L1 et les familles d’indicateurs de volatilité et d’oscillateurs. Face à un simple baseline top-k-par-fiabilité à pondération égale, l’étape de cluster Mapper est statistiquement indiscernable sur le Sortino, donc la contribution topologique relève de la couverture et de la traçabilité d’audit, non du rendement brut, et face au baseline naïf top-k classé par Sharpe in-sample le Stack topologique perd encore sur le Sortino. Une construction battant la parité de risque, honnête et traçable à l’audit, voilà ce qui est livré.

  7. Done

    La TDA peut-elle signaler les changements de régime de marché plus tôt que le HMM standard, et cela aide-t-il à faire tourner les cohortes de stratégies ? Le détecteur topologique de régime est nul ; la politique de rotation de cohortes qui consomme l’état détecté fonctionne. MARGINAL, livré comme Article F.

  8. Done

    Le lissage par Laplacien de graphe du signal de voisinage H1 extrait-il plus que le simple moyennage ? Directionnellement positif dans 94,5 % des 182 cohortes mais faible (moyenne corpus +0,0035 ΔR² ; +0,0115 restreint à MACD). MARGINAL, livré comme couche de lissage optionnelle MACD-seul.

  9. Done

    Un score d’anomalie géométrique est-il un meilleur détecteur d’overfit que les diagnostics classiques de Sharpe déflaté / PBO ? C’est un complément de triage utile (les stratégies signalées par les deux sont les abandons les plus sûrs), pas un remplacement. MARGINAL.

  10. Done

    Les portefeuilles de couverture géométrique explicites (farthest-point sampling, k-DPP, couverture bayésienne) battent-ils le portefeuille H4-Mapper ? Non, mais ils font émerger le constat du chapitre : la couverture consciente de la qualité fonctionne, la couverture aveugle à la qualité est proche du bruit d’un portefeuille aléatoire. MARGINAL, H4 reste le diversificateur phare.

  11. Done

    La manière dont le diagramme de persistance d’une cohorte se déplace à travers les fenêtres walk-forward prédit-elle la stabilité de son Sharpe OOS ? Oui, nombre de segments de trajectoire × stabilité Spearman ρ = +0,72. PASS, livré comme diagnostic au niveau de la cohorte « faites-confiance-à-cette-agrégation ».

  12. Done

    La topologie peut-elle prédire quelles stratégies échoueront de façon catastrophique, même si elle ne peut pas prédire le niveau de Sharpe OOS ? Non, fiablement pire que les caractéristiques classiques (C-index hold-out ≈ 0,58 contre 0,78). FAIL, l’événement de défaillance a une signature nette que le scorecard standard capte déjà.

  13. Done

    Un filtre par outlier géométrique est-il une meilleure façon de réduire 30 000 backtests à une liste restreinte gérable qu’un filtre Sharpe déflaté / PBO ? Non, le sélecteur H4 sur tout le corpus bat n’importe quelle liste restreinte de 100. FAIL, ne pré-élaguez pas ; l’étape prune du Deployment Stack se fond dans select.

  14. Done

    La découverte méthodologique centrale, validée à travers chaque hypothèse et raffinée quatre fois : la topologie aide quand vous l’utilisez pour décrire votre univers de stratégies et décider sur sa forme, et seulement lorsqu’elle ajoute un degré de liberté que l’approche standard n’a pas, et que ce degré de liberté est prédictif du résultat ; elle n’aide pas quand vous l’utilisez pour prédire une stratégie individuelle. Capturée par un nouvel article, l’Article H.

  15. Done

    La topologie de l’espace de comportement est-elle assez similaire entre des actifs crypto structurellement similaires (majors L1 / alt-L1 / memes / DeFi / L2) pour justifier la mutualisation d’un sélecteur topologique entre eux ? Non, ratio bottleneck intra-cohorte / inter-cohorte 1,018 (p = 0,59) ; Gromov–Wasserstein 0,96 (p = 0,24). FAIL, chaque actif a besoin de son propre sélecteur ; ne mutualisez pas les cohortes.

  16. Done

    La distance de l’empreinte de comportement courante d’une stratégie en direct par rapport à son cluster d’origine prédit-elle un effondrement imminent de l’edge, assez tôt pour agir ? Non, le score de dérive par stratégie est coïncident-à-retardé, pas en avance : il se déclenche à la rupture classique de drawdown, jamais avant. FAIL. Conservé uniquement comme aide à la visualisation ; le moniteur actionnable est le contrôle « faites-confiance-à-cette-agrégation » au niveau de la cohorte. Il a ajouté le quatrième raffinement de la découverte centrale, un degré de liberté ajouté ne suffit pas non plus ; il doit être prédictif du résultat, et un signal de « dérive » ne porte aucune information sur le drawdown futur.

  17. Done

    Le pipeline orienté trader qu’un praticien exécute sur son propre corpus : map → select → diversify → monitor → pause/refit, construit entièrement à partir des primitives robustes d’outlier géométrique. Assemblé, une CLI à dix commandes (map, select, portfolio, audit, monitor, refit, aggregation-check, plateau-audit, universality-check, live-adapter), avec les réserves issues des FAIL intégrées au texte d’aide de chaque commande concernée. H18 et H19 tous deux terminés (l’étape prune s’est fondue dans select ; aucun déclencheur de dérive par stratégie, le contrôle de cohorte est le moniteur). Un exemple de bout en bout travaillé sur une cohorte fraîche, les chapitres runbook / déploiement en direct / étude de cas rédigés, et le package de test utilisateur externe prêt à être expédié.

Statut au 2026-05-14, la Phase I (le pilote) est terminée. H1 PASS · H2 & H3 falsifiées · H4 PASS à l’échelle du corpus (ΔSortino vs HRP = +0,61, significatif au sens de Holm, concentré sur les majors L1 et les familles d’indicateurs de volatilité et d’oscillateurs ; statistiquement indiscernable d’un simple baseline top-k-par-fiabilité à pondération égale sur le Sortino, donc la contribution topologique relève de la couverture et de la traçabilité d’audit plutôt que du rendement brut) · H5 FAIL (aucune universalité inter-actifs mesurable, chaque cohorte crypto a besoin de son propre sélecteur) · les six extensions H12–H17 : H17 PASS, quatre marginales, H15 fail · H18 fail · H19 fail · H20 fail · la contrainte de diversité des modes de défaillance fail (plus faible en magnitude que mesuré au départ mais toujours un coût net sur le rendement ajusté au risque) · la partition prévision-vs-décision · le Topology Deployment Stack assemblé. La Phase II, le programme de recherche pluri-mensuel, et la Phase III, la ré-exécution inter-actifs et la publication de synthèse, ont leurs propres feuilles de route ci-dessous.

Phase II · programme de recherche pluri-mensuel

Où cela va ensuite

7 lots de travail · séquencés théorie d’abord · cliquez sur n’importe quel nœud pour le détail

La première phase a établi la découverte méthodologique centrale du programme, la partition prévision-vs-décision, et a livré une boîte à outils déployable par-dessus. La phase suivante transforme cette découverte en théorème, construit des constructions topologiques natives de la finance que les objets génériques du pilote ne permettaient pas, et ajoute une couche de données de risque d’exécution que la première phase n’a jamais touchée. Sept lots de travail, séquencés théorie d’abord.

  1. Done

    Pré-enregistrement de second tour verrouillé. Substrat causal par fenêtre plus strict pour la construction de clusters de stratégies. Baselines re-confirmées sous le nouveau substrat, avec le classeur top-20 par Sharpe historique comme barre à battre.

  2. Planned

    Transformer la découverte méthodologique centrale du programme, la topologie gagne sa place sur les tâches côté décision, pas côté prévision, en un théorème précis, avec une tentative de falsification pré-enregistrée conçue pour le briser (autoencodeurs topologiques, RTD, persistance différentiable, PersLay à témoins locaux sur le corpus existant). Un négatif net confirme ; un positif est lui-même un résultat majeur.

  3. In progress

    Un nouvel invariant, le niveau de friction auquel la région géante profitable de l’espace des stratégies meurt, sous des filtrations de coût, de capital et de période de détention. Deux opérationnalisations complémentaires ont maintenant atterri : une mesure à scénarios discrets sur le panel de perturbations existant à 5 scénarios (baseline / frais / slippage / dérive d’entrée / entrée+indicateur) qui est temporellement stable par stratégie et a une queue déployable de 16,4 % (les stratégies qui survivent à toute l’enveloppe) ; et une mesure continue en points de base sur une grille de coût absolu à 9 points où la queue déployable se réduit à 0,34 % et une dérive temporelle rejetée par Holm apparaît à fine résolution que la grille discrète avait manquée. Spearman ρ entre les deux mesures = 0,0491, elles captent des axes véritablement complémentaires de la fragilité-au-coût, pas des grossissements du même scalaire. Le théorème de stabilité bottleneck sur l’invariant et la pente de la bifiltration (coût × temps walk-forward) comme signal « cet edge se fait évincer » sont les prochains.

  4. In progress

    Un faisceau cellulaire sur le nerf de clusters de stratégies. Sa première cohomologie caractérise exactement quand le clustering est sans perte d’information. Le sheaf-Laplacian induit donne un portefeuille basé sur la partition qui interpole entre le classement par fiabilité et le diversificateur conscient des clusters, le premier résultat phare a franchi la barre pré-enregistrée (+0,72 ΔSortino sur un baseline naïf top-20 classé par Sharpe in-sample, rejeté par Holm sur le corpus ; EMA +0,59, SMA +1,15, tous deux rejetés par Holm ; 6 des 7 familles individuellement significatives, voir l’article connexe « Une approche topologique de la construction de portefeuille »). À mi-sprint : une variante sheaf-Tikhonov à gating par la première cohomologie rejette par Holm cette configuration phare antérieure sur le groupement ALL (+0,20), sur la famille EMA (+0,53), et sur la famille MACD (+0,65), et domine par Holm trois autres baselines ; elle manque la famille SMA (−0,10, non rejetée par Holm), donc la barre pré-enregistrée « doit franchir les deux familles de moyennes mobiles » est atteinte à moitié, avec un chemin Étage 2 propre (validation croisée complète de λ, réglage du seuil, gerbe théorique par membre) pour potentiellement combler l’écart SMA. Le même lot de travail a aussi confirmé que l’obstruction de première cohomologie est découplée de la qualité de décision par cellule (Spearman ρ = −0,035 ; seuil ρ ≥ 0,40 non approché) et que restreindre la partition à une couverture récente de 8 fenêtres réduit l’obstruction avec de grandes tailles d’effet rejetées par Holm sur les deux métriques de sélection testées, les deux jambes empiriques du théorème prévision-vs-décision au niveau de la méthodologie.

  5. Planned

    Persistance zigzag et piles CROCKER sur la population de stratégies à travers les fenêtres walk-forward. La réorganisation topologique au niveau de la population devance-t-elle les ruptures de régime avant que la dérive par stratégie ne le fasse ? Rapporté dans les deux cas ; un filtre de stabilité zigzag sur le portefeuille conscient des clusters est le gain côté décision.

  6. Planned

    Homologie persistante du carnet d’ordres à cours limité crypto, ensembles de sous-niveaux de profondeur, nuages de points (prix, profondeur), zigzags de résilience post-trade, instrumentée sur les horodatages de trades du backtest existant et utilisée comme filtre d’exécution qui réduit la taille des signaux quand le carnet est topologiquement instable. Pilote en données gratuites d’abord ; flux payants uniquement sur signal positif.

  7. Planned

    Publier le corpus, l’empreinte de comportement, le protocole walk-forward, et deux tâches canoniques (prédiction de Sharpe out-of-sample vs le solide baseline tabulaire ; construction de portefeuille vs le top-20 classé par Sharpe historique) comme un benchmark public avec un classement, aux côtés d’une monographie synthétisant les positifs du programme et ses négatifs honnêtes.

Statut au 2026-05-14, re-fondation terminée (substrat causal par fenêtre plus strict verrouillé, pré-enregistrement de second tour en place, baselines re-confirmées). L’agrégation par sheaf-Laplacian a franchi sa première barre statistique pré-enregistrée (+0,72 ΔSortino sur un baseline naïf top-20 classé par Sharpe in-sample ; rejetée par Holm sur le corpus, plus grandes marges sur EMA +0,59 et SMA +1,15 ; 6 des 7 familles individuellement significatives, voir l’article connexe « Une approche topologique de la construction de portefeuille »). À mi-sprint : un portefeuille sheaf-Tikhonov à gating cohomologique rejette par Holm cette configuration phare antérieure sur le groupement ALL (+0,20 ΔSortino), sur la famille EMA (+0,53), et sur la famille MACD (+0,65), et domine par Holm trois autres baselines (H4 strictement causal +1,29 ; top-20 naïf classé par Sharpe +0,92 ; fiabilité à pondération égale +1,23) ; il manque la famille SMA (−0,10, non rejetée par Holm), donc la barre pré-enregistrée « doit franchir les deux familles de moyennes mobiles » est atteinte à moitié, avec un chemin de suivi Étage 2 propre. Le théorème de stabilité coût-capacité a livré deux mesures complémentaires (une classe de coût à scénarios discrets temporellement stable avec une queue déployable de 16,4 % ; une mesure continue en points de base qui résout une dérive temporelle rejetée par Holm que la grille discrète avait manquée ; Spearman ρ entre elles = 0,0491, les deux mesures sont essentiellement non corrélées et répondent à des questions de déploiement différentes). Le théorème, la topologie temporelle, le filtre de carnet d’ordres, et le benchmark public sont encore planifiés.

Phase III · réplication inter-actifs & publication

Après cela, ré-exécution inter-actifs, puis publication

Ré-exécuter tout le pipeline sur les majors FX et un univers actions, puis livrer la synthèse, huit articles, la monographie appliquée, l’article de synthèse long, et le package logiciel public. Périmètre futur, séquencé après la sortie des articles phares de la Phase II.

  1. In progress

    Ré-exécuter tout le pipeline crypto sur les majors FX et sur un univers actions. L’hypothèse : la découverte méthodologique centrale du programme (prévision-vs-décision) et ses deux méthodes phares côté décision (coût-capacité, agrégation par sheaf-Laplacian) tiennent inter-actifs. L’audit : rapporter honnêtement les modes de défaillance, les instruments à microstructure différente (saisonnalité intraday FX, événements de dividendes actions, heures de trading réglementées) sont les points de rupture naturels et les points dignes d’être rapportés dans les deux cas.

  2. Planned

    Huit articles (y compris l’article de méthodologie sur la partition prévision-vs-décision), la monographie appliquée, le package logiciel Topology Deployment Stack, l’article de synthèse long sur ce site, et un conteneur de reproductibilité archivé avec un DOI. Test utilisateur externe sur 1–2 praticiens hors du projet avant la publication publique.

Pas encore démarré · le périmètre se verrouille quand les articles phares de la Phase II sortent · la ré-exécution inter-actifs conditionne le chapitre de synthèse.

Phase 01 · Terminée · 2026-05-09 (Jour 1)

Fondations & pilote

Achevée le 2026-05-09, Jour 1 du programme

Le corpus compte ~1,4 M de stratégies backtestées sur 27 actifs crypto, 8 familles d’indicateurs, et 6 à 30 fenêtres walk-forward par actif. La Phase 1 a construit le parquet unifié, l’empreinte de comportement à 50 caractéristiques par stratégie, le parseur de paramètres par famille, le décodeur en flux de `trades.bin` (242 M de lignes de trade en 17 minutes), et l’infrastructure de matrices de distance qui passe à l’échelle de plus d’1 M de stratégies via Faiss IVF-PQ.

Sous-phases qui ont atterri sous la Phase 01 : (a) amorçage du dépôt public + conteneur Docker + CI ; (b) parseur de bout en bout sur 100 fichiers .txt ; (c) empreinte 42 dimensions parsée-seule + empreinte 50 dimensions complète ; (d) matrices de distance et la recherche kNN ; (e) Mapper-des-stratégies première passe + HDBSCAN première passe.

Constats de première lumière sur 3 actifs pilotes (BTC, DOGE, AVAX, 127 879 stratégies, 24,8 M de lignes au format long, 13 minutes de temps mur) : l’agrégat kNN prédit le Sharpe OOS avec un Pearson moyen de 0,94 et un Spearman de 0,37 sur le pilote, la persistance top-H₀ est uniforme de 6,0 à 7,1 unités z entre cohortes, la persistance top-H₁ (0,47–1,46) discrimine les familles d’indicateurs, et HDBSCAN trouve zéro cluster dans 23 des 24 cohortes aux paramètres verrouillés. La variété de l’espace de comportement est lisse, pas partitionnée, ce qui a changé le choix de méthode H4 de HDBSCAN brut vers Mapper / ToMATo / graphe de Reeb au verrouillage.

  • La falsifiabilité n’est pas négociable. Chaque chapitre empirique a un critère de falsification pré-enregistré verrouillé en fin de Phase 1.
  • Jalon de phase franchi : le manifeste de pré-enregistrement est immuable à partir du 2026-05-09 ; les révisions ultérieures vivent dans un document jumeau v2.
  • Toutes les sorties de la Phase 1 reproductibles bit à bit à partir de la graine verrouillée = 2026 et de l’image Docker commitée.
Nuage de stratégies BTC, projection UMAP de ~30 000 stratégies BTC backtestées sur l’empreinte causale à 45 dimensions, colorées par le Sharpe OOS moyen (z-clippé à ±3).
30 000 stratégies BTC en une figure. Chaque point est une stratégie à sa position après projection UMAP de l’empreinte de comportement à 45 dimensions. Couleur = Sharpe OOS moyen sur les fenêtres walk-forward. Trois régions structurelles ressortent : une bande de survivantes, une pointe en échec, et un îlot déconnecté entièrement détaché du nuage principal.click to open full-size

Phase 02 · Terminée · 2026-05-09 (Jour 1)

Analyse géométrique, H1 PASS, H2 FALSIFIÉE

Achevée le 2026-05-09, Jour 1, le même jour que la Phase 01

Six métriques de distance sur des populations de stratégies, espace des paramètres, espace de comportement, W₂ de courbe d’équité, Wasserstein au niveau des trades, Gromov–Wasserstein, Fisher–Rao, caractérisées. Densité et structure de variété (dimension intrinsèque via TwoNN et MLE ; suite complète d’apprentissage de variété pour la visualisation uniquement). La détection de plateaux combine des ensembles de superniveaux persistants sur le Sharpe IS, la théorie de Morse discrète sur la grille de paramètres, HDBSCAN sur l’espace joint (paramètre, Sharpe IS), et des ajustements de crête SCMS.

Sous-phases : (a) la falsification H1 verrouillée a tourné sur l’ensemble des 26 actifs × 7 familles = 182 cohortes avec CV causale par fenêtre ; (b) la première passe H2 (spec verrouillée) a tourné sur l’ensemble des 182 cohortes × 3 méthodes de plateau = 546 résultats cohorte-méthode ; (c) une tentative de sauvetage H2 dans l’espace de comportement semblait PASS à +0,236, et un audit de robustesse causal par fenêtre a montré que ~74 % de cet effet était de la fuite par anticipation. H2 se falsifie sous toute méthodologie honnête.

Résultats phares. H1 : méta ΔR² = +0,130 (p ajusté Holm < 1×10⁻³⁰⁰ ; 180/182 cohortes rejettent, 178/182 avec IC bootstrap 95 % excluant zéro, 146/182 franchissent le seuil d’effet de +0,05). H1 est le premier PASS du programme à l’échelle du corpus et le résultat fondateur sur lequel tout l’aval repose. H2 : le ΔSharpe médian est +0,002 (ph_h0), +0,035 (Morse-Smale), −0,005 (HDBSCAN) sur 182 cohortes ; aucun ne franchit le seuil verrouillé de +0,10. H2 est falsifiée.

  • Holm–Bonferroni à FWER ≤ 0,05 appliqué par famille ; bootstrap = 5000 répliques par blocs stationnaires, longueur de bloc Politis–White, graine = 2026.
  • L’audit de fuite H2 (reconstruire le graphe kNN de façon causale par fenêtre de prédiction) est le précédent méthodologique porteur du programme, le même piège est désormais activement surveillé dans chaque test en aval.
Gain de H1 sur les baselines, distribution du R² par cohorte sur l’ensemble des 182 cohortes pour B0 (caractéristiques ex-ante), B2 (B0 + agrégat kNN), et ΔR² (B2 − B0).
H1 sur l’ensemble des 182 cohortes. B0 (caractéristiques ex-ante seules) se situe à R² ≈ +0,03 ; B2 (B0 plus le Sharpe OOS des voisines de l’espace de comportement à la fenêtre de prédiction) se situe à R² ≈ +0,15 ; ΔR² est centré sur +0,124. 146/182 cohortes franchissent le seuil d’effet de +0,05 ; 178/182 avec IC bootstrap 95 % excluant zéro.click to open full-size

Phase 04 · Terminée · 2026-05-10 (Jour 2), H3 DÉCISIF : FALSIFIÉE

Topologie persistante + le test décisif H3

Achevée le 2026-05-10, Jour 2 du programme

PH à filtration unique calculée sur des complexes de Vietoris–Rips et alpha sur l’ensemble des 27 actifs × 7 familles × cohortes ; PD vectorisés en persistence images, persistence landscapes, caractéristiques de noyau sliced-Wasserstein, et embeddings PersLay. La Phase 03 a aussi mis en place la pile de baselines de ML moderne (B1 ridge, B2 XGBoost/LightGBM/CatBoost, B3 TabPFN, B4 TS2Vec, B5 encodeur contrastif de courbe d’équité, B6 stacking), le challenger H3 que la pile topologique devait battre.

Sous-phases : (a) le préliminaire H3-lite de la Phase 3 sur 11 des 182 cohortes (préliminaire NON CONCLUANT, quasi-nul) ; (b) Phase 4 Étage 1, primitives d’évaluation Rust portées via PyO3 (32/32 tests de parité passent ; accélération par primitive de 1,05× à 42×) ; (c) Étage 2, caractéristiques topologiques causales par fenêtre reconstruites par fenêtre de prédiction (l’atténuation du piège de fuite H2 +0,236) ; (d) Étage 4, B7 (LightGBM topologie-seule) + B8 (B2 + topologie 38 dimensions) ; (e) la rafale H100, B5 contrastif (5 variantes d’architecture), contrôle de viabilité de la tête supervisée B5, et B9 PersLay-image, le tout sur les top-5 cohortes H1-PASS verrouillées.

Verdict H3 : FALSIFIÉE. Le test imbriqué verrouillé B8 (B2 + topologie causale ingénierée à 38 dimensions) vs B2 seul sur les cinq cohortes H1-PASS les plus fortes : méta-FE ΔR² = −0,0378, p ajusté Holm = 1,07 × 10⁻⁵, 5/5 cohortes négatives, 4/5 avec IC bootstrap 95 % excluant zéro côté négatif. B7 (topologie-seule) atterrit dans [−0,43, −0,13], pire que de prédire la moyenne par fenêtre. Côté H100, B5 contrastif sur 5 architectures toutes dans [−0,028, −0,024] ; B5 tête supervisée −0,022 ; B9 PersLay instabilité numérique catastrophique avec des cohortes non instables ≤ +0,006. Deux représentations de caractéristiques complètement indépendantes et trois familles d’architectures indépendantes convergent vers la même réponse négative. C’est le résultat le plus net possible de la Phase 4 d’un point de vue falsificationniste.

  • Lecture honnête de pourquoi H3 a échoué : les caractéristiques de forme encodent de l’information qui corrèle avec le Sharpe OOS, mais le solide baseline tabulaire B0/B2 (Sharpe in-sample, profit factor, Sharpe déflaté, lookback OOS de la fenêtre précédente, edge LB) extrait déjà essentiellement tout le signal résiduel. Les caractéristiques de forme ajoutent de la redondance et du bruit de sélection plutôt que de l’information nouvelle à la granularité testée.
  • Le volet deep-learning de la Phase 04 a nécessité du calcul H100 loué, exécuter PersLay et les encodeurs contrastifs de courbe d’équité à une taille d’architecture de production n’est pas faisable sur la station de travail locale à 8 Go de VRAM. La rafale a été délibérément conservatrice et retirée sous budget.
Résultat négatif honnête de H3, R² OOS moyen sur les 5 cohortes H1-PASS les plus fortes. Les baselines tabulaires se regroupent près de +0,27 ; chaque méthode topologique atterrit à zéro ou en dessous.
H3 falsifiée à travers les méthodes. Les baselines tabulaires (B1 ridge +0,250, B2 CatBoost +0,288, B8 = B2 + topologie +0,267) se regroupent près de +0,27. B7 topologie-seule atterrit à −0,223 ; les cinq variantes contrastives B5 à ~−0,025 ; B9 PersLay hors échelle, négatif. Le seuil d’effet de +0,03 (ambre pointillé) n’est dépassé que par les baselines non topologiques.click to open full-size

En pause · Dépriorisée après H3 FAIL, version minimale ou article de suivi

Homologie locale persistante + géométrie de l’information

Statut changé le 2026-05-10, dépriorisée après H3

H10 demande si l’homologie locale persistante d’une ε-boule autour de chaque stratégie porte un pouvoir prédictif incrémental au-delà des caractéristiques au niveau de la cohorte. H11 recoupe l’empreinte de comportement ingénierée contre des distances Fisher–Rao sur les distributions de rendements OOS. Les deux hypothèses ont été conçues comme des élaborations de la thèse H3 (la-topologie-remplace-le-ML).

H3 falsifiée, le prior sur le fait que H10 / H11 ajoutent un signal non redondant chute fortement : leurs modes de défaillance sont structurellement similaires à celui de H3. La Phase 04 est donc dépriorisée. Le vocabulaire de détection de plateaux de la Phase 1 survit comme diagnostic par stratégie (le cas d’usage d’interprétabilité de la piste d’audit est préservé), mais les tests de pouvoir prédictif sont planifiés comme article de suivi plutôt que comme phase du programme.

Phase 06 · Terminée · H4 PASS à l’échelle du corpus · H5 FAIL, l’universalité inter-actifs ne tient pas

Portefeuilles conscients de la topologie, H4 PASS à l’échelle du corpus ; l’universalité inter-crypto (H5) ne tient pas

Achevée le 2026-05-11, Jour 4 du programme ; verdict à l’échelle du corpus atterri

H4 construit des portefeuilles qui échantillonnent une stratégie par cluster Mapper dans l’espace de comportement, pondérée par la borne inférieure Beta-Binomiale de profitabilité. Baselines : un top-k naïf classé par Sharpe in-sample, un top-k simple classé par fiabilité, HRP, NCO depuis le même vivier (moyenne-variance exclue pour le temps mur du solveur). La barre est ΔSortino ≥ 0,15 face au baseline le plus fort, bootstrappé par paires sur tout le corpus, chaque actif crypto × famille d’indicateurs × fenêtre walk-forward, à des tailles de portefeuille k ∈ {5, 10, 20, 50}, avec le bras de clustering basé sur la persistance ToMATo comme contrôle de sensibilité.

Verdict H4 : le Stack topologique de sélection-et-construction bat Hierarchical Risk Parity à l’échelle de déploiement de ΔSortino = +0,61 (IC 95 % [+0,39, +0,82], significatif au sens de Holm), avec l’avantage concentré sur la cohorte des majors L1 (+1,20 ΔSortino vs HRP, rejeté par Holm) et les familles d’indicateurs de volatilité et d’oscillateurs (ATR / MACD / Stochastic %K chacun rejeté positif par Holm) ; sur les familles de moyennes mobiles (EMA / RSI / SMA) le résultat est plat ou négatif. Face à un simple baseline top-k-par-fiabilité à pondération égale, l’étape de cluster Mapper est statistiquement indiscernable sur le Sortino (Δ apparié = −0,06, Holm-p = 0,37), donc la contribution topologique relève de la couverture et de la traçabilité d’audit, non du rendement brut, et face au baseline naïf top-k classé par Sharpe in-sample le Stack topologique perd encore sur le Sortino. La une est livrée : une construction battant la parité de risque, honnête et traçable à l’audit.

Verdict d’universalité inter-crypto H5 : FAIL. Les diagrammes de persistance de l’espace de comportement entre cohortes majors L1 / alt-L1 / memes / DeFi / L2-et-plus-récentes ne sont pas plus proches les uns des autres que des nuls mélangés par permutation, ratio bottleneck intra-cohorte / inter-cohorte 1,018 (p = 0,59) ; Gromov–Wasserstein 0,96 (p = 0,24) ; les deux bien au-dessus de la règle de falsification α = 0,01. Mutualiser un sélecteur topologique entre des actifs crypto structurellement similaires n’est pas statistiquement justifié, chaque actif a besoin de son propre sélecteur. L’Article D recadre vers la non-universalité.

La Phase 06 est indépendante de la falsification de H3 : elle teste la construction de portefeuille (diversification basée sur les clusters), pas la prédiction de niveau par stratégie. Le constat de variété lisse de la Phase 01 est le déclencheur, une fois que le clustering basé sur la densité s’est révélé inadapté à l’échelle du corpus, Mapper / graphe de Reeb a pris le relais pour H4 avant même le début de la Phase 06.

Le vrai graphe Mapper / Reeb pour le corpus de stratégies Bitcoin / MACD, ~2 000 stratégies backtestées couvertes par 17 nœuds Mapper sur la lentille du Sharpe OOS moyen, nœuds dimensionnés par occupation et colorés par Sharpe OOS moyen, arêtes = stratégies partagées ; une fine queue de nœuds à Sharpe catastrophique s’articulant en un éventail à trois branches où vit ~96 % de la population, une seule composante connexe.
La vue réelle du sélecteur sur un corpus de stratégies, Bitcoin, MACD : ~2 000 stratégies backtestées, couvertes par 17 nœuds Mapper sur la lentille du Sharpe OOS moyen. Aire du nœud ∝ occupation ; couleur du nœud = Sharpe OOS moyen ; les arêtes relient les nœuds qui partagent des stratégies. La forme est une fine queue de nœuds à Sharpe catastrophique s’articulant en un éventail à trois branches où réside ~96 % de la population, une seule crête connexe, pas une constellation de types de stratégies distincts (le clustering par densité trouve 0 cluster dans 23 des 24 cohortes). Le portefeuille H4 prend la stratégie la plus fiable de chaque nœud.click to open full-size

Phase 17 · Complète, le pipeline orienté trader (le Topology Deployment Stack)

Le Topology Deployment Stack, le pipeline du praticien

Assemblée, l’aboutissement CLI pour le praticien, construit entièrement à partir des primitives robustes d’outlier géométrique

La surface déployable est un pipeline unique qu’un trader exécute sur son propre corpus de backtests : map (la vue Mapper du corpus) → select (le portefeuille échantillonné par cluster H4, le sélecteur sert aussi de réducteur du vivier de candidats) → diversify (conscient de la couverture par-dessus H4) → monitor (le contrôle « faites-confiance-à-cette-agrégation » au niveau de la cohorte, la géométrie de cette cohorte est-elle assez stabilisée pour mutualiser dessus ?) → pause / refit (la cadence de rotation par régime plus une couche de lissage optionnelle, une politique, pas une alarme de dérive). Il est réalisé comme une CLI à dix commandes, map, select, portfolio, audit, monitor, refit, aggregation-check, plateau-audit, universality-check, live-adapter, avec un mince adaptateur en direct qui consomme la sortie d’un pipeline walk-forward existant sans aucune modification de ce pipeline, un exemple de bout en bout travaillé sur une cohorte fraîche, et les chapitres runbook / déploiement en direct / étude de cas rédigés. Chaque étape est construite à partir des primitives d’outlier géométrique qui se sont révélées robustes, excentricité du nuage, scores d’anomalie Isolation-Forest et densité kNN, couverture Mapper, les descripteurs de trajectoire de persistance, non à partir de la machinerie de régression sur cible qui a échoué ; et les réserves issues des FAIL sont intégrées au texte d’aide de chaque commande concernée (six des dix en portent une, les négatifs honnêtes font partie du livrable). Un diagnostic optionnel de liste restreinte `topo-prune` existe pour l’attention humaine (il classe une liste restreinte de 100 backtests bien mieux que le hasard et à peu près à égalité avec le top-100-par-Sharpe-in-sample), mais le chemin sur tout le corpus à travers le sélecteur bat n’importe quelle liste restreinte de 100, donc la recommandation est : ne pré-élaguez pas ; exécutez tout le corpus.

Deux hypothèses pré-enregistrées ciblaient les nouvelles étapes. H18, élagage du vivier de candidats : un filtre par outlier géométrique sur un corpus de backtests frais peut-il battre un filtre Sharpe déflaté / PBO à conserver les stratégies qui survivent out-of-sample ? Verdict : FAIL, l’étape prune se fond dans select. Il n’y a pas d’étape séparée d’élagage conscient de la topologie qui améliore l’exécution du constructeur de portefeuille H4 sur tout le corpus ; le sélecteur exploite déjà la même structure, donc pré-élaguer son entrée ne fait que retirer ses options. Cela a aiguisé la découverte centrale du programme : la robustesse au correctif de nettoyage de données est nécessaire mais pas suffisante, la topologie doit aussi ajouter un degré de liberté que le baseline n’a pas (H4 ajoute un objectif de couverture, H17 un axe de stabilité de cohorte, H12 une étiquette de régime, ils atterrissent ; H18 retire des options à un baseline qui utilise déjà la même structure, il ne peut pas). H19, surveillance de dérive en direct : la distance de l’empreinte de comportement courante d’une stratégie en direct par rapport à son cluster d’origine prédit-elle un effondrement imminent de l’edge, assez tôt pour agir ? Verdict : FAIL, le score de dérive par stratégie est coïncident-à-retardé, pas en avance : il se déclenche à la rupture classique de max-drawdown (avance médiane 0 fenêtre), retarde d’1 fenêtre sur le déclencheur de Sharpe glissant, et porte un taux de faux positifs de 68 % face à une barre de 30 % (0 cohorte sur 26 en dessous). Une stratégie qui subit un drawdown change sa distribution de rendements réalisés du seul fait d’avoir subi le drawdown, donc la géométrie s’allume après coup. Il n’y a donc aucun déclencheur de dérive par stratégie dans le Stack, le moniteur actionnable reste le contrôle de confiance-d’agrégation au niveau de la cohorte (H17 PASS), et le profil de dérive par stratégie est livré uniquement comme aide à la visualisation. H19 a ajouté le quatrième raffinement de la découverte centrale : un degré de liberté ajouté est nécessaire mais pas suffisant, il doit être prédictif du résultat, et un signal de « dérive » ne l’est pas. Les deux nouvelles hypothèses closes, le Stack est assemblé et le package de test utilisateur externe est prêt à être expédié ; les budgets de latence par étape sont rapportés (l’étape de verrouillage de silhouette par cohorte est le goulot, en cache, elle reste bien dans une fenêtre de refit en temps réel), et la TDA lourde en calcul, multipersistance, cohomologie de faisceau, est délibérément hors du chemin de production.

Phase 14 · Complète, les six hypothèses d’extension testées (H17 PASS · H12, H13, H14, H16 marginales · H15 fail)

Directions de recherche étendues (H12–H17), complètes

Ouverte le 2026-05-10 ; H12–H17 toutes atterries au 2026-05-11

H3 a clos la question centrale topologie-bat-le-ML-moderne par une réponse négative nette. Le plan a été étendu avec six nouvelles hypothèses sur des questions distinctes que le résultat H3 ne touche pas, pré-enregistrées séparément de la famille H1–H11 sous leur propre Holm–Bonferroni FWER ≤ 0,05. Les six ont maintenant été testées.

H12, détection topologique de régime sur une fenêtre glissante de rendements d’actif, et une politique de rotation de cohortes de stratégies par-dessus : MARGINAL, le détecteur topologique de régime lui-même est nul (il ne signale pas les changements de régime plus tôt que le détecteur HMM standard), mais la politique de rotation de cohortes qui consomme le signal d’état détecté fonctionne ; il est livré comme Article F. H13, lissage par Laplacien de graphe sur le graphe kNN de H1 : MARGINAL, directionnellement positif dans 94,5 % des 182 cohortes mais faible (moyenne corpus +0,0035 ΔR², sous le seuil phare de +0,02 ; Holm rejette le nul pour les 12 variantes de lissage) ; livré comme couche de lissage de production optionnelle MACD-seul (+0,0115 là). H14, détection topologique d’anomalies (flag d’overfit + flag d’edge-survivante) : MARGINAL, le score d’outlier géométrique est un complément de triage utile aux diagnostics classiques d’overfit (Sharpe déflaté, PBO) mais ne les remplace pas. H16, diversification de l’espace de comportement consciente de la géométrie (farthest-point sampling, k-DPP, acquisition par couverture bayésienne) : MARGINAL, aucun des trois algorithmes de couverture ne bat le portefeuille de clusters Mapper, mais la confrontation a fait émerger un constat au niveau du chapitre : la couverture consciente de la qualité fonctionne (la variante de couverture bayésienne se regroupe près du portefeuille phare) ; la couverture aveugle à la qualité est du bruit (farthest-point sampling et k-DPP atterrissent ~3–4 unités Sortino plus bas, près du plancher du portefeuille aléatoire). H17, dynamique de trajectoire de persistance au niveau de la cohorte sur les fenêtres walk-forward : PASS, la longueur de trajectoire du diagramme de persistance d’une cohorte et son nombre de segments prédisent la stabilité du Sharpe out-of-sample de cette cohorte (nombre de segments × stabilité Spearman ρ = +0,72 ; 5 des 8 tests de trajectoire survivent à Holm ; le baseline de diagramme de persistance statique non) ; livré comme diagnostic au niveau de la cohorte « faites-confiance-à-cette-agrégation ». H15, fragilité topologique / taux de risque via un modèle de Cox à risques proportionnels : FAIL, la topologie est fiablement pire que les caractéristiques classiques ex-ante pour prédire quelles stratégies échoueront de façon catastrophique (C-index hold-out ≈ 0,57–0,60 pour la topologie contre 0,77–0,79 pour le classique, ΔC-index −0,08 à −0,21 sur quatre modèles d’événement de défaillance) ; l’événement de défaillance a une signature nette (l’edge in-sample qui s’effondre out-of-sample) que le scorecard standard capte directement.

Valider les six extensions à travers chaque hypothèse qui touche l’empreinte de comportement à 45 dimensions a résolu la découverte méthodologique centrale à une granularité au niveau des covariables : les covariables d’outlier géométrique (excentricité du nuage, Isolation-Forest, densité kNN, couverture Mapper, les descripteurs de trajectoire de persistance) sont les primitives pratiques durables, et chaque contribution porteuse de une (le constructeur de portefeuille H4, le diagnostic d’agrégation H17, la politique de rotation H12) est construite à partir d’elles ; les covariables de régression sur cible (utiliser la topologie pour régresser sur la performance out-of-sample) s’amenuisent ou échouent ; l’homologie locale persistante sur une variété lisse est un poids mort (il n’y a ni clusters ni frontières pour que la « profondeur d’homologie » signifie quoi que ce soit par rapport à eux). Le portefeuille de sorties passe à huit articles, ajoutant l’Article H, l’article de méthodologie qui énonce cette partition prévision-vs-décision.

Phase III · M3 · Planifiée, publication publique · Phase III

Synthèse, articles, monographie, package public

Fin du programme

Portefeuille de sorties : huit articles (Plateaux & généralisation de voisinage · Topologie persistante de l’espace des stratégies · Portefeuilles conscients de la topologie · Universalité inter-crypto · Workflow topologique appliqué · Topologie de régime & rotation de stratégies · Construction de portefeuille consciente de la géométrie & fragilité topologique · Quand la topologie aide en trading quantitatif : une partition prévision-vs-décision), une monographie appliquée d’environ 150–250 pages, un package logiciel public sous licence MIT (le Topology Deployment Stack), ≥7 visualisations HTML interactives intégrées à l’article de synthèse sur daru.finance, et un DOI Zenodo pour le conteneur de reproductibilité.

Jalon de phase : un test utilisateur externe sur 1–2 praticiens hors du projet, avant la publication publique. Le livrable en une phrase, une CLI qui prend un corpus frais de stratégies backtestées et renvoie un portefeuille recommandé avec des pistes d’audit par stratégie, des scores de risque d’agrégation au niveau de la cohorte, des moniteurs de dérive, et des recommandations de cadence de refit, le tout validé avec une rigueur de thèse et reproductible depuis un conteneur public.

Scorecard du programme à 17 hypothèses, statut de chaque hypothèse pré-enregistrée au moment du verdict H3 le 2026-05-10 (H1 PASS, H2/H3/H9 FAIL, H4/H5/H6 en attente, H7/H8/H10/H11 dépriorisées, H12–H17 planifiées).
Statut de chaque hypothèse pré-enregistrée au moment du verdict H3 (2026-05-10). Un PASS (H1, le résultat de prédiction survivant). Trois FAIL (H2, H3, H9). Trois en attente (H4 élevée, H5, H6). Quatre dépriorisées (H7 multipersistance, H8 faisceau, H10 PH locale, H11 Fisher–Rao). Six nouvelles directions planifiées (H12–H17). Depuis ce rendu, voir la section des constats ci-dessous, H4 a RÉUSSI à l’échelle du corpus (ΔSortino vs HRP +0,61, significatif au sens de Holm), H17 a RÉUSSI, H12/H13/H14/H16 ont atterri en marginal, H15/H18/H19/H20 et la contrainte de diversité des modes de défaillance ont toutes ÉCHOUÉ, et l’universalité inter-actifs H5 a ÉCHOUÉ ; la figure du scorecard sera re-rendue pour le chapitre de synthèse afin de porter le tableau de bord complet de la Phase I.click to open full-size

Constats à ce jour (2026-05-14)

Des résultats concrets ont atterri à travers la Phase I, jusqu’au test décisif H3, la construction de portefeuille H4 à l’échelle du corpus, les six hypothèses d’extension H12–H17, l’assemblage du Topology Deployment Stack, et le test d’universalité inter-actifs H5. La Phase II est à mi-sprint : l’agrégation par sheaf-Laplacian a franchi sa première barre phare pré-enregistrée et atterrit maintenant un raffinement partiel de portefeuille de deuxième étage par-dessus ; le théorème de stabilité coût-capacité a livré deux opérationnalisations complémentaires de la fragilité-au-coût d’une stratégie. Les figures sont des rendus de sorties réelles des pipelines verrouillés, pas des illustrations. Les données source et la méthodologie sont documentées dans le journal du programme (l’article de synthèse long reliera tout cela à la publication).

La découverte centrale du programme

Une partition prévision-vs-décision : où la topologie aide, et où elle n’aide pas, désormais sur six jambes empiriques indépendantes

À travers chaque hypothèse testée, la valeur de la topologie se résout proprement au niveau de la covariable à partir de laquelle vous la construisez, et la partition a été raffinée quatre fois. (1) La topologie de prévision échoue ou s’amenuise, utiliser une quantité dérivée de la topologie pour prédire un résultat de performance futur a perdu face au baseline de ML moderne (H3), ou n’a pas battu les métriques classiques ex-ante (le modèle de risque), ou s’est révélée coïncidente-à-retardée sur trois moniteurs indépendants, le score de dérive par stratégie (H19), le score de risque d’agrégation par fenêtre, et l’alarme de santé de couverture de portefeuille (H20) se déclenchent tous au déclencheur classique de drawdown, pas avant. (2) La granularité est au niveau de la covariable, les descripteurs d’outlier géométrique (à quel point une stratégie est excentrique dans le nuage, scores d’anomalie Isolation-Forest et densité kNN, quelle part du graphe Mapper un portefeuille couvre, la forme de la trajectoire du diagramme de persistance d’une cohorte) sont les primitives pratiques durables, et chaque contribution porteuse de une est construite à partir d’elles (le constructeur de portefeuille H4, le diagnostic « faites-confiance-à-cette-agrégation » H17, la politique de rotation de cohortes H12) ; les covariables de régression sur cible s’amenuisent ou échouent ; et l’homologie locale persistante sur une variété lisse est un poids mort, il n’y a ni clusters ni frontières contre lesquels la « profondeur d’homologie » signifierait quoi que ce soit. (3) La robustesse ne suffit pas (le constat H18) : la topologie doit aussi ajouter un degré de liberté que l’approche standard n’a pas déjà, H4 ajoute un objectif de couverture, H17 un axe de stabilité de cohorte, H12 une étiquette de régime, donc ils atterrissent ; l’élagage du vivier de candidats pré-élaguerait un sélecteur qui exploite déjà la même structure, donc il ne fait que retirer des options, il ne peut pas aider. (4) Un degré de liberté ajouté ne suffit pas non plus (le constat H19 / H20) : il doit être prédictif du résultat, un signal de dérive ou de santé de couverture est un degré de liberté que le déclencheur classique de drawdown n’a pas, mais ces signaux ne portent aucune information sur le drawdown futur, donc ils n’aident pas ; les couches (1) et (4) sont le même fait vu de deux directions, prévoir la performance future est hors de portée, peu importe comment vous emballez le prévisionniste. La Phase II ajoute deux jambes empiriques de plus au niveau de la méthodologie. (5) L’obstruction de cohomologie de faisceau sur le nerf de clusters de stratégies est découplée de la qualité de décision par cellule, le Spearman ρ entre l’obstruction et le coût de qualité de décision par cellule est −0,035 ; le seuil pré-enregistré ρ ≥ 0,40 n’est pas approché. L’obstruction décrit la structure de couverture de la partition, pas la qualité côté décision des cellules sur lesquelles la partition est construite. (6) L’invariant de stabilité coût-capacité est temporellement stable sur l’opérationnalisation à scénarios discrets et porte une hétérogénéité inter-cohorte rejetée par Holm (les majors L1 les moins robustes au coût ; les alt-L1 les plus), les deux indiquant que l’invariant capte des faits structurels sur les stratégies sous friction, pas des faits côté décision. La revendication méthodologique centrale repose donc désormais sur six jambes empiriques indépendantes à travers plusieurs lots de travail : quatre raffinements qui ont clos la partition elle-même, plus deux jambes empiriques d’invariant structurel qui confirment que la partition tient à la couche en dessous. Version en langage clair : la topologie aide quand vous l’utilisez pour décrire la forme de votre univers de stratégies et prendre des décisions sur cette forme, choisir un portefeuille diversifié, signaler une cohorte instable, faire tourner les stratégies par régime, et seulement lorsqu’elle ajoute quelque chose que l’approche standard ne fait pas déjà, et seulement quand ce quelque chose est structurel plutôt qu’une prévision ; elle n’aide pas quand vous l’utilisez pour prédire à quel point une stratégie individuelle sera bonne ou mauvaise (les métriques standard l’emportent là). C’est le résultat méthodologique central du programme, la figure de partition à quatre couches ici cartographie l’intérieur de la partition elle-même ; les deux nouvelles jambes d’invariant structurel de la Phase II l’entourent et la renforcent, et c’est ce que le nouvel article de méthodologie, l’Article H, énonce.

La partition prévision-vs-décision à quatre couches, bandes empilées : (1) la topologie de prévision échoue ou s’amenuise (la liste des victimes) ; (2) granularité au niveau de la covariable (covariables d’outlier géométrique robustes, homologie locale persistante poids mort) ; (3) nécessité d’ajouter-un-degré-de-liberté ; (4) nécessité d’un degré-de-liberté-prédictif ; avec la bannière des survivants (le portefeuille de clusters Mapper, le diagnostic d’agrégation de cohorte, la politique de rotation par régime) en bas.
La partition prévision-vs-décision, raffinée quatre fois. Bande du haut : utiliser la topologie pour prévoir un résultat de performance futur échoue ou s’amenuise, peu importe comment c’est emballé. Deuxième bande : la valeur se situe au niveau de la covariable, les descripteurs d’outlier géométrique sont robustes et durables, les covariables de régression sur cible s’amenuisent ou échouent, l’homologie locale persistante sur une variété lisse ne porte rien. Troisième bande : la robustesse au correctif de nettoyage de données est nécessaire mais pas suffisante, la topologie doit ajouter un degré de liberté que le baseline n’a pas. Quatrième bande : un degré de liberté ajouté est nécessaire mais pas suffisant, il doit être prédictif du résultat. Bas : les contributions survivantes se situent toutes dans la zone idéale (usage de décision + ajoute un degré de liberté + ce degré de liberté est structurel, pas une prévision)., Légende (texte affiché en anglais sur l’image) : (1) forecasting topology fails or shrinks (the casualty list) = la topologie de prévision échoue ou s’amenuise (la liste des victimes) · (2) covariate-level grain (geometric-outlier covariates robust, local persistent homology dead weight) = granularité au niveau de la covariable (covariables d’outlier géométrique robustes, homologie locale persistante poids mort) · (3) adds-a-degree-of-freedom necessity = nécessité d’ajouter un degré de liberté · (4) predictive-degree-of-freedom necessity = nécessité d’un degré de liberté prédictif · survivors banner (the Mapper-cluster portfolio, the cohort-aggregation diagnostic, the regime-rotation policy) = bannière des survivants (le portefeuille de clusters Mapper, le diagnostic d’agrégation de cohorte, la politique de rotation par régime).click to open full-size

Constat Phase II, agrégation par sheaf-Laplacian, raffinement de deuxième étage

Un portefeuille sheaf-Tikhonov à gating cohomologique raffine la première une, victoire partielle de deuxième étage

Par-dessus le premier résultat phare (le portefeuille basé sur la partition rejetant par Holm un baseline naïf top-20 classé par Sharpe in-sample à +0,72 ΔSortino sur le corpus, avec les plus grandes marges sur EMA et SMA), la construction du prochain étage ajoute un régulariseur sheaf-Tikhonov dont la force est gatée par l’obstruction de première cohomologie du faisceau cellulaire sur le nerf de clusters de stratégies. Résultat : une victoire partielle de deuxième étage. La variante à gating cohomologique rejette par Holm la configuration phare à l’échelle de déploiement précédente sur le groupement ALL (+0,20 ΔSortino), sur la famille EMA (+0,53), et sur la famille MACD (+0,65), et elle domine par Holm trois autres baselines : le portefeuille H4 strictement causal (+1,29), le top-20 naïf classé par Sharpe in-sample (+0,92), et la fiabilité à pondération égale (+1,23). Elle manque la famille SMA (−0,10, non rejetée par Holm). La barre pré-enregistrée « doit franchir les deux familles de moyennes mobiles » est donc atteinte à moitié, un raffinement méthodologique significatif par-dessus la première une, avec un chemin de suivi Étage 2 propre (validation croisée complète de λ, réglage du seuil, gerbe théorique par membre) pour potentiellement combler l’écart SMA. Deux autres résultats du même lot de travail atterrissent à ses côtés : l’obstruction de première cohomologie elle-même est découplée de la qualité de décision par cellule (Spearman ρ entre l’obstruction et le coût de qualité de décision par cellule = −0,035 ; le seuil pré-enregistré ρ ≥ 0,40 n’est pas approché, un négatif net, et une nouvelle jambe empirique du théorème prévision-vs-décision au niveau de la méthodologie), et restreindre la construction de la partition à une couverture récente de 8 fenêtres walk-forward réduit l’obstruction avec de grandes tailles d’effet rejetées par Holm sur les deux métriques de sélection testées. Les deux confirment que l’obstruction suit la structure de la couverture, pas la qualité côté décision des cibles, une histoire d’invariant structurel cohérente avec le reste du programme.

Constat Phase II, théorème de stabilité coût-capacité, deux mesures complémentaires

La fragilité-au-coût d’une stratégie a deux axes complémentaires, pas un

La question du théorème de stabilité coût-capacité est opérationnelle : à quel niveau de friction une stratégie perd-elle son edge ? Deux opérationnalisations complémentaires ont maintenant atterri, et elles ne sont pas des grossissements du même scalaire. La mesure à scénarios discrets fait passer le corpus à travers un panel de perturbations à 5 scénarios (baseline / frais / slippage / dérive d’entrée / dérive d’entrée + variance d’indicateur) et rapporte la classe de friction de chaque stratégie. Elle est temporellement stable par stratégie (non rejetée par Holm sur la dérive par fenêtre de la classe), avec 16,4 % du corpus survivant à toute l’enveloppe, la queue déployable au coût. L’hétérogénéité inter-cohorte est réelle et rejetée par Holm sur les confrontations de cohérence à 5 cohortes : les stratégies des majors L1 sont les moins robustes au coût ; les alt-L1 les plus. La mesure de coût continue fait passer le même corpus à travers une grille de coût absolu en points de base à 9 points {0, 2, 5, 8, 12, 20, 35, 60, 100} et rapporte le coût en points de base auquel chaque stratégie bascule. À fine résolution, une dérive temporelle rejetée par Holm apparaît que la grille discrète avait manquée (décalage moyen de classe de coût = −0,0213 unités-de-classe-de-coût par fenêtre, p = 0,0008), et la queue déployable se réduit drastiquement (16,4 % → 0,34 %), la queue discrète masquait le point réel de défaillance au coût. Les mêmes motifs directionnels par famille / par cohorte survivent à travers les deux mesures (les stratégies de la famille MACD les plus fragiles au coût ; EMA les plus robustes ; L1 moins robuste au coût qu’alt-L1), mais la mesure de coût continue résout des écarts d’hétérogénéité 1,6× plus larges. Le constat de fond : le Spearman ρ entre les deux mesures est 0,0491, essentiellement non corrélé. Elles captent des axes véritablement complémentaires de la fragilité-au-coût et répondent à des questions de déploiement différentes. La mesure discrète dit « cette stratégie survit-elle au panel réaliste de friction d’exécution ? » ; la mesure continue dit « à quel coût absolu en points de base échoue-t-elle ? ». Une stratégie à fort turnover peut survivre au panel frais/slippage et basculer quand même à faible coût en points de base ; une stratégie à faible turnover peut être vulnérable à la dérive d’entrée et robuste quand même à un coût absolu élevé. Le théorème de stabilité coût-capacité livre donc deux mesures complémentaires, pas une, et les deux ajoutent des jambes empiriques d’invariant structurel au théorème prévision-vs-décision (les invariants décrivent la stratégie sous friction, pas sa performance cible).

Extension Phase 07, complète

Les six hypothèses d’extension H12–H17 testées ; les directions de recherche étendues se clôturent

H17, PASS : la dynamique de trajectoire de persistance des cohortes prédit la stabilité de la performance OOS (nombre de segments × stabilité Spearman ρ = +0,72) ; livré comme diagnostic au niveau de la cohorte « faites-confiance-à-cette-agrégation ». H12, MARGINAL : le détecteur topologique de régime lui-même est nul (il ne bat pas le HMM standard pour appeler les changements de régime tôt), mais la politique de rotation de cohortes de stratégies qui consomme le signal d’état fonctionne ; livré comme Article F. H13, MARGINAL : le lissage par Laplacien de graphe du signal de voisinage est directionnellement positif dans 94,5 % des 182 cohortes mais faible (moyenne corpus +0,0035 ΔR², +0,0115 restreint à MACD) ; livré comme couche de lissage optionnelle MACD-seul. H14, MARGINAL : un flag d’overfit par outlier géométrique est un complément de triage utile aux diagnostics classiques d’overfit, pas un remplacement. H16, MARGINAL : les portefeuilles de couverture géométrique explicites ne battent pas le portefeuille de clusters Mapper, mais ils font émerger le constat couverture-consciente-de-la-qualité-vs-aveugle-à-la-qualité (H4-Mapper reste le diversificateur phare). H15, FAIL : les métriques classiques ex-ante prédisent déjà bien la défaillance catastrophique d’une stratégie ; la topologie n’y ajoute rien. Bilan : un PASS, quatre marginales-mais-livrables, un échec net, et la partition prévision-vs-décision ci-dessus est ce qui les relie.

Constat Phase 16, H14 MARGINAL

Flag d’overfit topologique : un complément de triage, pas un remplacement

H14 a demandé si un score d’anomalie géométrique, à quel point une stratégie paraît inhabituelle dans le nuage de comportement de sa cohorte, est un meilleur détecteur d’overfit que les diagnostics classiques de Sharpe déflaté / PBO, et (le bras edge-survivante) si les stratégies géométriquement isolées qui survivent out-of-sample portent un edge réel digne d’être signalé. Verdict : MARGINAL. Le score d’outlier géométrique ajoute une couche de triage faible mais utile par-dessus les détecteurs classiques, les stratégies à la fois classiquement-signalées-comme-overfit et géométriquement-anormales sont les abandons les plus sûrs, mais il ne remplace pas le scorecard classique, qui fait déjà l’essentiel du travail. Il est livré dans le pipeline de déploiement comme complément, pas comme substitut.

Constat Phase 17, H15 FAIL

Prédire quelles stratégies explosent est un travail que le scorecard classique fait déjà

H15 a tenté la prédiction topologique de fragilité / taux de risque via un modèle de Cox à risques proportionnels : la topologie peut-elle prédire la probabilité qu’une stratégie échoue de façon catastrophique (large drawdown, effondrement d’edge, événement de défaillance de régime), même si elle ne peut pas prédire le niveau du Sharpe out-of-sample ? Verdict : FAIL, et dans la direction opposée à l’espoir. La topologie est fiablement pire que les caractéristiques classiques ex-ante (Sharpe in-sample, Sharpe déflaté, Sharpe OOS de la fenêtre précédente) à cela : indice de concordance hold-out ≈ 0,57–0,60 avec la topologie contre 0,77–0,79 avec les caractéristiques classiques, un ΔC-index de −0,08 à −0,21 sur quatre définitions différentes d’événement de défaillance. L’événement de défaillance se révèle avoir une signature nette, l’edge in-sample qui s’effondre out-of-sample, que les métriques standard captent directement ; il n’y a aucun résidu que la topologie puisse ajouter. La « probabilité de défaillance » était l’alternative tractable espérée au « niveau de Sharpe » ; elle ne l’est pas, parce qu’elle est déjà bien gérée.

Constat Phase 20, H18 FAIL

Ne pré-élaguez pas votre corpus de backtests, exécutez le chemin sur tout le corpus

H18 a demandé si un filtre par outlier géométrique sur un corpus frais de backtests, abandonner les excentriques / d’apparence anormale, garder le reste, est un meilleur réducteur de vivier de candidats qu’un filtre Sharpe déflaté / PBO, pour qu’un trader puisse réduire 30 000 backtests à 100 gérables avant d’exécuter le constructeur de portefeuille. Verdict : FAIL, mais un échec utile. Une liste restreinte `topo-prune` classe bien mieux qu’un 100 aléatoire et à peu près à égalité avec le top-100-par-Sharpe-in-sample, mais le chemin sur tout le corpus à travers le constructeur de portefeuille H4 bat n’importe quelle liste restreinte de 100 stratégies ; le sélecteur exploite déjà la même structure géométrique qu’un élagueur, donc pré-élaguer son entrée ne fait que retirer ses options. Donc `topo-prune` est livré comme diagnostic de liste restreinte optionnel pour l’attention humaine, l’étape `prune` du pipeline se fond dans `select`, et la recommandation est : ne pré-élaguez pas ; donnez au sélecteur tout votre corpus de backtests. Cela a aiguisé la découverte centrale du programme en une condition de suffisance : survivre au correctif de nettoyage de données est nécessaire mais pas suffisant, la topologie doit aussi ajouter un degré de liberté que l’approche standard n’a pas déjà, et pré-élaguer un sélecteur intelligent ne le fait pas.

Constat Phase 23, contrainte de portefeuille de diversité des modes de défaillance : FAIL

Forcer le portefeuille à couvrir les modes de défaillance, un coût net sur le rendement ajusté au risque, mais plus faible que mesuré au départ

Un autre axe de couverture, testé comme contrainte dure sur le constructeur de portefeuille : les stratégies ont été regroupées selon leur tendance à échouer, saignement lent, crash soudain, sensible aux frais, basculement de régime, artefact de trades rares, exposé aux queues, et il a été dit au constructeur de choisir un ensemble qui couvre ces six modes plutôt que de toujours prendre la stratégie la plus fiable dans chaque région de l’espace de comportement. Verdict : FAIL, mais un FAIL de plus faible magnitude que ne le suggérait la première mesure. Forcer l’équilibre des modes de défaillance fait baisser le rendement ajusté au risque d’un ΔSortino à l’échelle du corpus de −0,09 (IC 95 % [−0,16, −0,02], rejeté par Holm), porté presque entièrement par les cohortes de la famille des moyennes mobiles ; sur toute autre famille d’indicateurs l’effet n’est pas statistiquement significatif. L’aggravation du drawdown du pire décile rapportée à l’origine (~5 %) ne tient pas sous une mesure plus soignée (l’effet strict est −2,9 % avec l’IC 95 % chevauchant zéro). Les étiquettes de modes de défaillance elles-mêmes sont réelles et utiles comme audit descriptif (« quels modes de défaillance mes choix couvrent-ils ; l’un est-il sur-représenté ? ») et sont immunisées contre la fuite par construction. La version à contrainte dure reste désactivée par défaut : le choix le-plus-fiable-par-région du constructeur conscient de la topologie est déjà proche du point efficient sur les familles où l’edge existe, et forcer la couverture des modes de défaillance coûte plus qu’il ne rapporte.

Constat Phase 21, H19 FAIL · et le Deployment Stack est assemblé

Le moniteur de dérive en direct ne devance pas le déclencheur de drawdown, et l’outil déployable est construit

H19 a demandé si un score de dérive topologique par stratégie, churn de voisinage + effondrement de densité + dérive de position + déclin de confiance de cohorte, traité comme une alarme d’alerte précoce, se déclenche avant le déclencheur classique de drawdown, pour qu’un praticien puisse réduire la taille ou réévaluer avant que le drawdown n’arrive. Verdict : FAIL sur les deux bras. L’avance médiane du score de dérive sur le déclencheur classique de max-drawdown est de 0 fenêtre (il se déclenche à la rupture, pas avant) et il retarde d’1 fenêtre sur le déclencheur de Sharpe-glissant<0, avec un taux de faux positifs de 68 % face à une barre de 30 % (0 cohorte sur 26 en dessous). La raison est structurelle : une stratégie qui subit un drawdown change sa distribution de rendements réalisés du seul fait d’avoir subi le drawdown, donc la géométrie s’allume après coup, les stratégies dérivent, mais la dérive est coïncidente-à-retardée, pas en avance. Il n’y a donc aucun déclencheur de dérive par stratégie dans le Deployment Stack ; le moniteur actionnable reste le contrôle « faites-confiance-à-cette-agrégation » au niveau de la cohorte (H17 PASS), et le profil de dérive par stratégie est livré uniquement comme aide à la visualisation. H19 a ajouté le quatrième raffinement de la découverte centrale : un degré de liberté ajouté est nécessaire mais pas suffisant, il doit être prédictif du résultat, et un signal de « dérive » ne l’est pas. Avec H19 et H18 tous deux clos, l’ensemble d’hypothèses du deployment-stack est complet, et le Topology Deployment Stack, le pipeline orienté trader `map → select → diversify → monitor → pause/refit`, construit entièrement à partir des primitives robustes d’outlier géométrique, est assemblé : une CLI à dix commandes avec les réserves issues des FAIL intégrées au texte d’aide de chaque commande concernée (six des dix en portent une), un exemple de bout en bout travaillé sur une cohorte fraîche, les chapitres runbook / déploiement en direct / étude de cas rédigés, et le package de test utilisateur externe prêt à être expédié.

Le diagramme de flux de décision du Topology Deployment Stack, une colonne à cinq boîtes : map → select (le portefeuille de clusters Mapper) → diversify (optionnel) → monitor (le contrôle de confiance-d’agrégation de cohorte) → pause/refit (la cadence de rotation par régime) ; l’élagage du vivier de candidats dessiné absorbé dans select (testé, n’aide pas) ; le profil de dérive par stratégie barré (testé comme moniteur en direct, abandonné) ; l’aide de piste d’audit par stratégie à côté, étiquetée « diagnostic, pas une entrée de décision ».
Le Topology Deployment Stack comme flux de décision. Le chemin validé est la colonne à cinq boîtes map → select [+ liste restreinte optionnelle] → diversify → monitor → pause/refit ; select porte le portefeuille de clusters Mapper, avec le +0,61 ΔSortino à l’échelle du corpus sur Hierarchical Risk Parity (significatif au sens de Holm, concentré sur la cohorte des majors L1 et les familles d’indicateurs de volatilité et d’oscillateurs). L’élagage du vivier de candidats (--prune-to K) est dessiné absorbé dans select, il n’y a pas d’étape d’élagage séparée qui batte l’exécution du sélecteur sur tout le corpus ; c’est au mieux une liste restreinte humaine. Le profil de dérive par stratégie est barré : testé comme moniteur en direct et abandonné, un score de dérive topologique par stratégie ne se déclenche pas avant le déclencheur classique de drawdown ; le moniteur actionnable est le contrôle de confiance-d’agrégation au niveau de la cohorte. L’aide de signature géométrique par stratégie est à côté, étiquetée « diagnostic, pas une entrée de décision »., Légende (texte affiché en anglais sur l’image) : map = cartographier · select (the Mapper-cluster portfolio) = sélectionner (le portefeuille de clusters Mapper) · diversify (optional) = diversifier (optionnel) · monitor (the cohort aggregation-trust check) = surveiller (le contrôle de confiance-d’agrégation de cohorte) · pause/refit (the regime-rotation cadence) = pause/refit (la cadence de rotation par régime) · candidate-pool prune absorbed into select (tested, doesn’t help) = l’élagage du vivier de candidats absorbé dans select (testé, n’aide pas) · per-strategy drift profile struck through (tested as the live monitor, dropped) = profil de dérive par stratégie barré (testé comme moniteur en direct, abandonné) · per-strategy audit-trail aid, ‘diagnostic, not a decision input’ = aide de piste d’audit par stratégie, « diagnostic, pas une entrée de décision ».click to open full-size

Constat Phase 22, alerte précoce de santé de couverture de portefeuille H20 : FAIL

Une alarme de « santé de portefeuille », la dérive de couverture se déclenche au drawdown, pas avant

H20 a demandé si la couverture par le portefeuille de l’espace de comportement porte un signal d’alerte précoce, dérive-t-elle (entropie de couverture s’effondrant, les choix s’entassant dans une région étroite, la variété se concentrant) assez en amont d’un drawdown pour qu’un praticien puisse agir dessus ? Verdict : FAIL. À travers 89 unités co-déclenchantes (cohorte × méthode), l’alarme de santé de couverture a une avance médiane de −1,0 fenêtre face au déclencheur classique de drawdown, elle retarde plutôt qu’elle ne devance. Seulement 2 des 70 unités co-déclenchantes dans le bras phare `h4_mapper` montrent une avance positive, et 0 cohorte sur 89 n’a de binomiale d’avance-positive significative au sens de Holm. H20 est livré uniquement comme diagnostic descriptif de couverture, il n’y a aucun signal d’alerte précoce actionnable ici. C’est le troisième signal topologique « quelque chose dérive » coïncident-à-retardé que le pilote a testé (aux côtés du moniteur de dérive par stratégie H19 et du score de risque d’agrégation par fenêtre) et il renforce la découverte centrale : un usage de prévision de la topologie ne se rentabilise pas, peu importe l’ingéniosité avec laquelle le signal est emballé.

Constat Phase 06, H4 : PASS à l’échelle du corpus

Construction de portefeuille consciente de la topologie, +0,61 ΔSortino sur Hierarchical Risk Parity, concentré sur les majors L1 et les familles de volatilité et d’oscillateurs

H4 construit un portefeuille en échantillonnant une stratégie par cluster Mapper dans l’espace de comportement, pondérée par la borne inférieure Beta-Binomiale de profitabilité de chaque stratégie. À l’échelle de déploiement, à travers chaque cellule actif-crypto × famille-d’indicateurs × fenêtre-walk-forward qui atterrit un portefeuille (2 002 cellules, 26 actifs, 7 familles d’indicateurs, k = 20), le Stack topologique de sélection-et-construction bat Hierarchical Risk Parity de **ΔSortino = +0,61** (IC 95 % [+0,39, +0,82], significatif au sens de Holm). L’avantage est hétérogène et mérite d’être dit honnêtement : sur la cohorte des majors L1 l’écart à l’échelle du corpus est +1,20 Sortino (rejeté par Holm) ; hors majors L1 aucune cohorte §5 ne produit d’avantage significatif au sens de Holm sur HRP. Par famille d’indicateurs, ATR / MACD / Stochastic %K sont chacun rejetés positifs par Holm (+1,3 à +2,1 Sortino sur HRP) ; EMA est rejeté négatif par Holm (−0,6) ; RSI / SMA / PPO sont plats. Face à un simple baseline top-k-par-fiabilité à pondération égale, l’étape de cluster Mapper n’ajoute aucun Sortino mesurable (Δ apparié = −0,06, Holm-p = 0,37), donc ce que l’étape de cluster Mapper apporte, c’est de la couverture et de la traçabilité d’audit, non du rendement brut, et face au baseline naïf top-k classé par Sharpe in-sample le Stack topologique perd encore sur le Sortino. La une qui est livrée : H4 est une construction battant la parité de risque, traçable à l’audit, avec une strate d’application claire (majors L1 × familles de volatilité / oscillateurs), pas un sélecteur dominant en rendement brut.

Graphe à barres de la conclusion praticien à l’échelle de déploiement, Sortino moyen pour chacun des cinq sélecteurs de portefeuille (Stack topologique, Hierarchical Risk Parity, top-k-par-fiabilité à pondération égale, top-k naïf classé par Sharpe in-sample, plus l’exécution topologique de première passe héritée pour référence), à travers chaque cellule actif × famille d’indicateurs × fenêtre walk-forward qui a atterri un portefeuille ; barres avec moustaches d’IC bootstrap 95 % ; l’écart ΔSortino-sur-HRP annoté.
La conclusion praticien à l’échelle du corpus : chaque barre = le Sortino moyen pour un sélecteur de portefeuille, sur chaque cellule actif × famille-d’indicateurs × fenêtre-walk-forward qui a atterri un portefeuille (2 002 cellules, k = 20). Le Stack topologique bat Hierarchical Risk Parity de +0,61 Sortino (significatif au sens de Holm) et est statistiquement indiscernable d’un simple baseline top-k-par-fiabilité à pondération égale ; il perd face à un top-k naïf classé par Sharpe in-sample. Moustaches = IC bootstrap 95 % ; paires significatives au sens de Holm marquées.click to open full-size

Constat Phase 06, le résultat H4 en courbes d’équité

Au-dessus de la parité de risque, sous le classement naïf par Sharpe, l’écart, sur des cohortes réelles

À quoi ressemble le résultat H4 en équité out-of-sample réelle, pas une statistique résumée : PnL OOS cumulé sur les fenêtres walk-forward pour quatre cohortes réelles, le Stack topologique face à trois baselines (parité de risque hiérarchique, le classement naïf par Sharpe in-sample, le classement par fiabilité). Sur les cohortes d’oscillateurs de momentum (Litecoin / MACD, Bitcoin / Stochastic %K, Ethereum / MACD) la courbe du Stack se situe nettement au-dessus de celle de la parité de risque hiérarchique, et nettement en dessous de la courbe du classement naïf par Sharpe in-sample, ce qui est le point honnête rendu visible. Sur une cohorte de moyennes mobiles (Ethereum / EMA, mêmes fenêtres) les quatre courbes sont groupées : il n’y a aucun edge à gagner là. Le corpus est lourdement adverse, donc les quatre méthodes de construction saignent en termes absolus, le résultat est l’écart entre elles, pas le niveau. C’est la même image que rapporte le graphe à barres à l’échelle de déploiement, dessinée une cohorte à la fois.

Courbes d’équité H4, PnL out-of-sample cumulé sur les fenêtres walk-forward pour quatre cohortes réelles (Litecoin/MACD, Bitcoin/Stochastic-%K, Ethereum/MACD, Ethereum/EMA), une ligne chacune pour le Stack topologique, la parité de risque hiérarchique, le portefeuille top-20 classé par Sharpe in-sample, et le portefeuille top-20 classé par fiabilité ; le Stack au-dessus de la parité de risque hiérarchique sur les cohortes d’oscillateurs et en dessous de la ligne du classement par Sharpe in-sample, les quatre groupées sur la cohorte de moyennes mobiles.
PnL out-of-sample cumulé sur les fenêtres walk-forward, sur des cohortes réelles. Le Stack topologique (ambre) se situe nettement au-dessus de Hierarchical Risk Parity (rouge) sur les cohortes d’oscillateurs de momentum, et nettement en dessous du portefeuille naïf classé par Sharpe in-sample (sarcelle) ; sur la cohorte de moyennes mobiles (Ethereum/EMA, mêmes fenêtres) les quatre sont groupées, rien à gagner. Le corpus est lourdement adverse, donc tout saigne en termes absolus, lisez l’écart entre les lignes, pas le niveau. Causal par fenêtre au niveau de la stratégie, empreinte de comportement à 45 dimensions, taille de portefeuille k = 20.click to open full-size

Constat Phase 07, H13 MARGINAL

Lissage par Laplacien de graphe du signal de voisinage : positif presque partout, mais faible

H13 demande si lisser le signal de prédiction de voisinage sur le graphe kNN de H1 (noyau de chaleur, passe-bas, ou Tikhonov) extrait du signal que le simple moyennage jette. À travers l’ensemble des 182 cohortes la meilleure variante de lissage est directionnellement positive dans 94,5 % d’entre elles et le nul est rejeté (Holm-Bonferroni) pour les 12 variantes, mais le gain moyen sur le corpus est +0,0035 en qualité de prédiction absolue, sous le seuil phare de +0,02 ; seules 2 cohortes (les deux SOL) le franchissent. La moyenne restreinte à MACD est +0,0115 (3,3× la moyenne corpus, toutes positives). Verdict : MARGINAL, il est livré comme couche de lissage de production optionnelle MACD-seul, pas comme PASS à l’échelle du corpus. H13 est une application de prédiction de la topologie, et atterrit du même côté de la partition prévision-vs-décision que les autres résultats de classe prévision : un edge faible et spécifique à une famille plutôt qu’à l’échelle du corpus.

H13 à deux panneaux, à gauche : gain moyen pour les 12 variantes de lissage à travers le corpus de 182 cohortes, classé ; à droite : histogramme du gain par cohorte pour la meilleure variante sur l’ensemble des 182 cohortes, avec des lignes de référence à zéro et au seuil de +0,02.
À gauche : gain moyen sur le baseline kNN-moyenne pour les 12 variantes de lissage à travers le corpus de 182 cohortes, classé. Un passe-bas modéré domine le classement. À droite : gain par cohorte pour la meilleure variante sur l’ensemble des 182 cohortes, 94,5 % directionnellement positif, seules 2 cohortes (les deux SOL) franchissent le seuil de +0,02 ; moyenne corpus +0,0035, restreinte à MACD +0,0115.click to open full-size

Constat Phase 07, H16 MARGINAL

La couverture seule est du bruit sans prior de qualité

H16 teste la construction de portefeuille de couverture géométrique explicite, farthest-point sampling, processus ponctuels k-déterminantaux, acquisition par couverture bayésienne, contre le portefeuille H4-Mapper. Aucun des trois ne le bat sur le Sortino à travers les 26 cohortes. Mais la confrontation a fait émerger un constat digne d’un chapitre : le seul algorithme de couverture avec un prior de qualité (couverture bayésienne, qui porte un postérieur de processus gaussien sur le Sharpe OOS dans son acquisition) se regroupe près de la une H4-Mapper, tandis que les deux aveugles à la qualité (farthest-point sampling n’utilise que la distance ; k-DPP n’utilise que la répulsion) se regroupent en bas près du plancher du portefeuille aléatoire, ~3–4 unités Sortino plus bas. La couverture ne compte que lorsqu’elle est associée à un prior de qualité ; seule, elle n’est essentiellement que du bruit. Verdict : MARGINAL, H4-Mapper reste le résultat phare de diversification ; la variante de couverture bayésienne est livrée comme alternative (un portefeuille de 20 stratégies avec ~74 % de réduction de drawdown vs HRP).

Graphe à barres H16, Sortino moyen à travers les 26 cohortes MACD par sélecteur de portefeuille ; H4-Mapper en vert en haut (le seul positif), l’algorithme de couverture conscient de la qualité juste en dessous, les aveugles à la qualité et le plancher aléatoire groupés en bas.
Sortino moyen à travers les 26 cohortes MACD, par sélecteur de portefeuille. H4-Mapper (vert, le seul positif) en haut ; l’algorithme de couverture conscient de la qualité (ambre) se regroupe près de lui ; les algorithmes de couverture aveugles à la qualité et le plancher du portefeuille aléatoire (rouge) se regroupent ~3–4 unités Sortino plus bas, la couverture sans prior de qualité est à peine meilleure que choisir au hasard.click to open full-size

Constat Phase 07, H17 PASS

La trajectoire du diagramme de persistance d’une cohorte prédit la stabilité de sa performance OOS

H17 demande si la manière dont le diagramme de persistance d’une cohorte se déplace à travers la séquence de fenêtres walk-forward, sa longueur de trajectoire, son nombre de phases de mouvement distinctes, sa directionnalité, prédit la stabilité du Sharpe out-of-sample de cette cohorte. C’est le cas. À travers les 26 cohortes MACD, le nombre de segments de trajectoire corrèle avec la stabilité du Sharpe OOS à Spearman ρ = +0,72 (longueur de trajectoire à +0,61) ; 5 des 8 tests de trajectoire pré-enregistrés survivent à Holm-Bonferroni, tandis que le meilleur baseline de diagramme de persistance statique (sans trajectoire) ne survit pas, la dynamique géométrique de la cohorte, pas sa forme statique, porte le signal. Verdict : PASS, la première des six hypothèses d’extension à franchir PASS. Livré comme diagnostic au niveau de la cohorte « faites-confiance-à-cette-agrégation » : un nombre de segments élevé ou une longue trajectoire signale une cohorte dont la géométrie est instable, donc l’agrégation à l’échelle du corpus devrait être traitée avec prudence.

Trajectoire de diagramme de persistance de cohorte H17, les trajectoires de résumé de diagramme de persistance de deux cohortes à travers leurs fenêtres walk-forward, projetées en 2D (visualisation uniquement) : Bitcoin/MACD parcourt 16 phases de mouvement sur un chemin serré, Tron/MACD fait un chemin plus long avec seulement 5 phases ; sous chacune, la taille de pas fenêtre-à-fenêtre avec les frontières de phase de mouvement marquées ; à travers les 26 cohortes ce nombre de phases suit la stabilité du Sharpe OOS à Spearman ρ = +0,72.
Comment la géométrie de la population de stratégies d’une cohorte dérive à travers le walk-forward. Le résumé de diagramme de persistance de chaque cohorte trace un chemin à travers sa séquence de fenêtres (projeté en 2D pour l’œil, jamais utilisé comme distance) ; sous chaque chemin, la taille de pas fenêtre-à-fenêtre avec les frontières de phase de mouvement marquées. Bitcoin/MACD parcourt 16 phases de mouvement sur un chemin serré ; une cohorte à historique plus long fait un chemin plus long avec bien moins. À travers les 26 cohortes MACD le nombre de phases suit la stabilité du Sharpe out-of-sample de cette cohorte (ρ = +0,72), l’alerte au niveau de la cohorte « faites-confiance-à-cette-agrégation ».click to open full-size

Constat Phase 01

La variété de l’espace de comportement est lisse, pas en blocs

Nous nous attendions à des clusters de densité discrets de stratégies ; nous ne les avons pas trouvés. HDBSCAN aux paramètres verrouillés renvoie zéro cluster dans 22 des 24 cohortes pilotes (fraction de bruit moyenne 99,0 %) ; les deux exceptions sont toutes deux des cohortes DOGE à 86–90 % de bruit. Mapper, posant une question topologique au lieu d’une question de densité, renvoie 48–60 nœuds de graphe par cohorte avec une riche structure d’arêtes. Mêmes données, deux méthodes, deux réponses complémentaires, et la réponse sur laquelle le programme tourne est Mapper.

Constat de variété lisse, nombre de clusters HDBSCAN par cohorte (à gauche, 22/24 à zéro) vs nombre de nœuds de graphe Mapper par cohorte (à droite, 48–60).
HDBSCAN : 22 des 24 cohortes renvoient zéro cluster sur l’empreinte causale à 45 dimensions ; fraction de bruit moyenne 99,0 %. Mapper : chaque cohorte renvoie 48–60 nœuds de graphe (médiane 58). Le choix de méthode H4 (Mapper, pas HDBSCAN) a été verrouillé en fin de Phase 1 à cause de cela.click to open full-size

Constat Phase 02, H1 PASS

Les voisines de l’espace de comportement prédisent le Sharpe OOS l’une de l’autre

Pour chaque stratégie à chaque fenêtre de prédiction, le Sharpe OOS moyen de ses 20 plus proches voisines de l’espace de comportement (en CV causale par fenêtre : utilisant uniquement les données des fenêtres 1..t-1) prédit le propre Sharpe OOS de la fenêtre suivante de la stratégie substantiellement mieux que ses propres caractéristiques ex-ante seules. À travers l’ensemble des 182 cohortes le méta ΔR² est +0,130 avec p ajusté Holm < 1×10⁻³⁰⁰. C’est le résultat fondateur sur lequel le programme repose, chaque outil de sélection, de portefeuille et de risque en aval s’appuie dessus.

Nuage de points héros H1, Sharpe OOS prédit (agrégat kNN) vs réel à travers les quatre cohortes H1-PASS les plus fortes. Alignement diagonal dans chaque panneau.
H1 rendu visuel. Chaque panneau : une des quatre cohortes H1-PASS les plus fortes. x = Sharpe OOS moyen des 20 plus proches voisines de l’espace de comportement à la fenêtre de prédiction. y = le propre Sharpe OOS réel de la stratégie. ΔR² spec-verrouillée annoté en vert par panneau ; IC 95 % excluant proprement zéro.click to open full-size

Constat Phase 02, H2 FALSIFIÉE (et le piège de fuite attrapé)

La détection de plateaux ne prédit pas l’OOS, même quand une tentative de sauvetage en a l’air

La détection de plateaux dans l’espace des paramètres à travers trois méthodes (H₀ persistant, variétés stables de Morse–Smale, HDBSCAN) se situe toute sous le seuil d’effet de +0,10 à l’échelle du corpus. Une tentative de sauvetage dans l’espace de comportement a bondi à un +0,236 apparent sur Morse-Smale, mais sous correction causale par fenêtre (reconstruire le graphe kNN à chaque fenêtre de prédiction à partir des fenêtres 1..t-1 uniquement) l’effet s’effondre à +0,0705, falsifiée à nouveau. ~74 % du sauvetage apparent était de la fuite par anticipation. La leçon est le précédent méthodologique porteur du programme : la CV causale par fenêtre n’est pas négociable.

H2 falsification à trois panneaux, espace des paramètres (3 méthodes, toutes FAIL) ; espace de comportement naïf (Morse-Smale bondit à +0,236, passerait PASS) ; correction causale par fenêtre (Morse-Smale s’effondre à +0,0705, FAIL).
Panneau A : H2 dans l’espace des paramètres falsifiée à travers 3 méthodes à l’échelle du corpus. Panneau B : Morse-Smale dans l’espace de comportement bondit à +0,236, passerait PASS au seuil verrouillé de +0,10. Panneau C : reconstruire l’empreinte de façon causale par fenêtre de prédiction effondre l’effet à +0,0705. ~74 % de l’effet apparent était de la fuite par anticipation.click to open full-size

Constat Phase 03/04, H3 FALSIFIÉE

Les caractéristiques topologiques ne battent pas le solide baseline tabulaire

Le test imbriqué H3 verrouillé B8 (B2 CatBoost + résumé topologique causal par fenêtre ingénieré à 38 dimensions) vs B2 seul sur les cinq cohortes H1-PASS les plus fortes : méta-FE ΔR² = −0,0378, p ajusté Holm = 1,07 × 10⁻⁵, 5/5 cohortes négatives, 4/5 avec IC bootstrap 95 % excluant zéro. Le résultat se réplique à travers deux représentations de caractéristiques indépendantes (persistence image 400 dimensions, résumé ingénieré 38 dimensions) et trois familles d’architectures indépendantes (gradient boosting, deep learning contrastif sur H100, MLP DeepSet-sur-PD-image). L’affirmation centrale topologie-bat-le-ML-moderne du programme est morte.

Forest plot H3, ΔR²(B8 − B2) par cohorte avec IC bootstrap 95 %. ALGO (gris, non significatif), APT/DOT/ATOM/ICP (rouge, IC excluant zéro).
Décomposition par cohorte du verdict H3. Trié par ΔR² décroissant. ALGO est non significatif à p = 0,136 ; APT/DOT/ATOM/ICP rejettent tous Holm. Aucun ne franchit le seuil d’effet de +0,03. Le balayage de confirmation à 182 cohortes a été reporté selon la règle d’escalade verrouillée : un FAIL directionnel sur les cohortes les plus fortes est une preuve suffisante pour clore la confrontation.click to open full-size

Décomposition par caractéristique du signal H1 survivant

Quelles composantes de l’empreinte portent le signal du Sharpe OOS

Corrélation de Spearman par cohorte entre chacune des 45 caractéristiques de l’empreinte de comportement et le Sharpe OOS moyen de la stratégie, moyennée sur l’ensemble des 182 cohortes. Le PnL moyen par trade, le rendement moyen, et le ratio gains-pertes dominent le côté positif (Spearman +0,65 / +0,55 / +0,35). Côté négatif, les caractéristiques de drawdown se regroupent de −0,31 à −0,35 (drawdown 50p, drawdown 95p, max drawdown), les stratégies à pires drawdowns prédisent leur propre sous-performance future.

Importance des caractéristiques de l’empreinte, 45 barres horizontales classées par corrélation de Spearman moyenne avec le Sharpe OOS sur 182 cohortes.
Les corrélations de Spearman sont des résumés descriptifs inter-stratégies sur l’empreinte de comportement à 45 dimensions, pas le modèle de prédiction H1 causal par fenêtre qui produit le gain corpus de +0,130.click to open full-size

Calcul & soutien

Le travail GPU lourd de la Phase 04 a tourné sur des H100 loués, exécuter PersLay et les encodeurs contrastifs de courbe d’équité à une taille d’architecture de production n’était pas faisable sur la station de travail locale à 8 Go de VRAM, donc le programme a payé de courtes rafales H100 via Modal. Cela signifiait dépenser de l’argent réel en calcul pour faire atterrir proprement le verdict H3 verrouillé, et le même modèle s’applique au travail restant, le test inter-actifs H5 et le H18 / H19 du Topology Deployment Stack, qui auront besoin de leurs propres courtes rafales.

Reproductibilité et scripts

Chaque figure de cette page est un rendu de sortie réelle d’un pilote Python autonome, un script par figure, chaque verdict verrouillé traçable jusqu’à un artefact de données versionné et un rapport de verdict rédigé. Les scripts et les tables sous-jacentes peuvent être fournis sur demande pour un usage académique ou de due-diligence pendant le programme. La publication publique de la boîte à outils complète (package logiciel sous licence MIT, conteneur de reproductibilité Docker, DOI Zenodo) fait partie de la Phase 08 et est livrée avec la monographie à la fin du programme, pas au coup par coup avant.

Ce qui a changé dans cette mise à jour

Full changelog · open archived versions

La mise à jour du 2026-05-14 clôt la Phase I et fait atterrir un sprint de la Phase II en plein milieu par-dessus. Clôture de la Phase I : H4 PASS à l’échelle du corpus à +0,61 ΔSortino sur Hierarchical Risk Parity (significatif au sens de Holm, concentré sur les majors L1 et les familles d’indicateurs de volatilité et d’oscillateurs ; statistiquement indiscernable d’un simple baseline top-k-par-fiabilité à pondération égale sur le Sortino, donc la contribution topologique relève de la couverture et de la traçabilité d’audit, non du rendement brut) ; H5 universalité inter-actifs FAIL ; moniteur de santé de couverture de portefeuille H20 FAIL ; contrainte de portefeuille de diversité des modes de défaillance FAIL avec un coût de magnitude plus faible que mesuré au départ ; la première barre phare sheaf-Laplacian de Mark-2 franchie (+0,72 ΔSortino sur un baseline naïf top-20 classé par Sharpe in-sample, rejeté par Holm). Phase II à mi-sprint : un portefeuille sheaf-Tikhonov à gating cohomologique rejette par Holm cette configuration phare antérieure sur le groupement ALL (+0,20), sur la famille EMA (+0,53), et sur la famille MACD (+0,65), et domine par Holm trois autres baselines, victoire partielle de deuxième étage, avec un suivi Étage 2 propre pour potentiellement combler l’écart SMA (où la variante a manqué à −0,10). Le théorème de stabilité coût-capacité livre deux mesures complémentaires (panel à scénarios discrets : temporellement stable, queue déployable de 16,4 % ; grille continue en points de base : dérive temporelle rejetée par Holm, queue déployable 0,34 % ; Spearman ρ entre elles = 0,0491, essentiellement non corrélé ; elles répondent à des questions de déploiement différentes). Le théorème prévision-vs-décision repose désormais sur six jambes empiriques indépendantes. Ci-dessous l’avant / après explicite ; l’historique de version complet est sur la page de changelog.

Agrégation par sheaf-Laplacian, raffinement partiel de portefeuille de deuxième étage

Before

Première barre phare franchie (+0,72 ΔSortino sur un baseline naïf top-20 classé par Sharpe in-sample, rejeté par Holm sur le corpus) ; le raffinement de l’étage suivant était ouvert.

After

Un portefeuille sheaf-Tikhonov à gating par la première cohomologie rejette par Holm la configuration phare à l’échelle de déploiement précédente sur le groupement ALL (+0,20 ΔSortino), sur la famille EMA (+0,53), et sur la famille MACD (+0,65) ; il manque la famille SMA (−0,10, non rejetée par Holm). La barre pré-enregistrée « doit franchir les deux familles de moyennes mobiles » est atteinte à moitié, un raffinement méthodologique significatif par-dessus la première une, avec un chemin de suivi Étage 2 propre (validation croisée complète de λ, réglage du seuil, gerbe théorique par membre) pour potentiellement combler l’écart SMA. La même variante domine par Holm trois autres baselines : le portefeuille H4 strictement causal (+1,29), le top-20 naïf classé par Sharpe (+0,92), et la fiabilité à pondération égale (+1,23). Deux résultats supplémentaires du même lot de travail atterrissent à ses côtés : l’obstruction de première cohomologie est découplée de la qualité de décision par cellule (Spearman ρ = −0,035 ; seuil ρ ≥ 0,40 non approché, un négatif net), et restreindre la partition à une couverture récente de 8 fenêtres walk-forward réduit l’obstruction avec de grandes tailles d’effet rejetées par Holm sur les deux métriques de sélection testées.

Théorème de stabilité coût-capacité, deux mesures complémentaires

Before

Invariant coût-capacité défini ; une opérationnalisation en cours.

After

Deux opérationnalisations complémentaires ont maintenant atterri, et elles ne sont pas des grossissements du même scalaire. La mesure à scénarios discrets fait passer le corpus à travers un panel de perturbations à 5 scénarios (baseline / frais / slippage / dérive d’entrée / dérive d’entrée + variance d’indicateur), est temporellement stable par stratégie (non rejetée par Holm sur la dérive par fenêtre de la classe), et trouve une queue déployable de 16,4 % (les stratégies qui survivent à toute l’enveloppe) ; l’hétérogénéité inter-cohorte est réelle et rejetée par Holm (les majors L1 les moins robustes au coût ; les alt-L1 les plus). La mesure de coût continue sur une grille de coût absolu en points de base à 9 points {0, 2, 5, 8, 12, 20, 35, 60, 100} réduit la queue déployable à 0,34 % et fait apparaître une dérive temporelle rejetée par Holm que la grille discrète avait manquée (décalage moyen de classe de coût = −0,0213 unités-de-classe-de-coût par fenêtre, p = 0,0008). Mêmes motifs directionnels par famille et par cohorte à travers les deux (MACD le plus fragile au coût ; EMA le plus robuste ; L1 moins robuste qu’alt-L1) mais la mesure continue résout des écarts d’hétérogénéité 1,6× plus larges. Spearman ρ entre les deux mesures = 0,0491, essentiellement non corrélé. Le théorème de stabilité coût-capacité a donc deux mesures complémentaires, pas une.

Théorème prévision-vs-décision, six jambes empiriques indépendantes

Before

Quatre jambes empiriques (les quatre raffinements de la partition) : la prévision échoue ou s’amenuise ; la granularité est au niveau de la covariable ; la robustesse est nécessaire mais pas suffisante ; un degré de liberté ajouté doit être prédictif du résultat.

After

Six jambes empiriques indépendantes à travers plusieurs lots de travail. Les quatre raffinements originaux qui ont clos la partition elle-même, plus deux nouvelles jambes d’invariant structurel atterries aujourd’hui : (5) l’obstruction de cohomologie de faisceau sur le nerf de clusters de stratégies est découplée de la qualité de décision par cellule (Spearman ρ = −0,035 ; seuil ρ ≥ 0,40 non approché, l’obstruction décrit la structure de couverture, pas la qualité côté décision), et (6) l’invariant coût-capacité est temporellement stable sur l’opérationnalisation à scénarios discrets et porte une hétérogénéité inter-cohorte rejetée par Holm, les deux indiquant que l’invariant capte des faits structurels sur les stratégies sous friction plutôt que des faits côté décision. La revendication méthodologique centrale repose donc sur une fondation empirique plus solide qu’à la clôture de la Phase I.

H4 PASS atterrit à l’échelle du corpus

Before

Verdict H4 à l’échelle du corpus en attente ; la figure à l’échelle de déploiement était rapportée comme un résultat provisoire de première passe.

After

H4 PASS à l’échelle du corpus : ΔSortino vs HRP = +0,61 (IC 95 % [+0,39, +0,82], significatif au sens de Holm). Hétérogène par cohorte et famille : la cohorte des majors L1 porte le chiffre du corpus (+1,20 vs HRP, rejeté par Holm) ; hors majors L1 aucune cohorte §5 ne produit d’avantage significatif au sens de Holm. Par famille d’indicateurs, ATR / MACD / Stochastic %K chacun rejeté positif par Holm (+1,3 à +2,1 sur HRP) ; EMA rejeté négatif par Holm (−0,6) ; RSI / SMA / PPO plats. Face à un simple baseline top-k-par-fiabilité à pondération égale, l’étape de cluster Mapper est statistiquement indiscernable sur le Sortino (Δ apparié = −0,06, Holm-p = 0,37), donc la contribution topologique relève de la couverture et de la traçabilité d’audit, non du rendement brut. Face au baseline naïf top-k classé par Sharpe in-sample le Stack topologique perd encore sur le Sortino. Le graphe à barres de la confrontation est re-rendu avec les chiffres à l’échelle du corpus ; la revendication centrale, le dek, le scorecard, le détail de la Phase 06, et la carte de constats lisent tous la même une.

Verdict d’universalité inter-actifs H5, FAIL

Before

H5 listée comme encore en cours (la dernière hypothèse ouverte de la Phase I).

After

H5 FAIL : ratio bottleneck intra-cohorte / inter-cohorte = 1,018 (p = 0,59) ; Gromov–Wasserstein = 0,96 (p = 0,24). Les deux bien au-dessus de la règle de falsification α = 0,01. La topologie de l’espace de comportement ne se mutualise pas entre des cohortes crypto structurellement similaires, chaque actif a besoin de son propre sélecteur ; l’Article D recadre vers la non-universalité. La Phase I est maintenant close ; chaque hypothèse pré-enregistrée a abouti à un verdict.

Alerte précoce de santé de couverture de portefeuille H20, FAIL

Before

Verdict en attente dans le scorecard.

After

H20 FAIL. L’alarme de santé de couverture a une avance médiane de −1,0 fenêtre face au déclencheur classique de drawdown à travers 70 unités co-déclenchantes dans le bras phare h4 ; seules 2 des 70 montrent une avance positive ; 0 cohorte sur 89 ne produit de binomiale d’avance-positive significative au sens de Holm. Livré uniquement comme diagnostic descriptif de couverture, aucun signal d’alerte précoce actionnable. Troisième signal topologique « quelque chose dérive » coïncident-à-retardé que le pilote a testé (H19, le score de risque d’agrégation par fenêtre, H20).

Contrainte de portefeuille de diversité des modes de défaillance, FAIL

Before

Verdict en attente dans le scorecard.

After

Contrainte de portefeuille de diversité des modes de défaillance FAIL, mais un FAIL de magnitude plus faible que ne le suggérait la première mesure. Forcer l’équilibre des modes de défaillance fait baisser le rendement ajusté au risque de ΔSortino = −0,09 (IC 95 % [−0,16, −0,02], rejeté par Holm), porté par les cohortes de la famille des moyennes mobiles. L’aggravation du drawdown du pire décile rapportée à l’origine (~5 %) ne tient pas sous une mesure soignée (l’effet strict est −2,9 % avec l’IC 95 % chevauchant zéro). Les étiquettes de modes de défaillance elles-mêmes restent utiles comme audit descriptif de portefeuille ; la version à contrainte dure reste désactivée par défaut.

Agrégation par sheaf-Laplacian Mark-2, première barre phare franchie

Before

Agrégation par sheaf-Laplacian Mark-2 listée comme en cours ; aucun résultat de portefeuille déployable rejeté par Holm encore.

After

Le portefeuille sheaf-Laplacian (un portefeuille basé sur la partition qui interpole entre le classement par fiabilité et le diversificateur conscient des clusters) franchit sa première barre phare pré-enregistrée : +0,72 ΔSortino sur un baseline naïf top-20 classé par Sharpe in-sample sur le corpus (rejeté par Holm), avec les plus grandes marges sur les familles d’indicateurs de moyennes mobiles, rejeté par Holm à la fois sur EMA (+0,59) et SMA (+1,15) ; 6 des 7 familles d’indicateurs sont individuellement significatives. C’est la première victoire de portefeuille déployable rejetée par Holm sur ce baseline naïf que le programme ait produite. Décrit dans l’article « Une approche topologique de la construction de portefeuille ».

Verdict H19 + le Deployment Stack assemblé

Before

H19 (surveillance de dérive en direct) listée comme l’hypothèse ouverte restante ; le Topology Deployment Stack était une phase re-spécifiée, pas encore construite.

After

H19 FAIL : un score de dérive topologique par stratégie ne se déclenche pas avant le déclencheur classique de drawdown, avance médiane 0 fenêtre, retarde d’1 fenêtre sur le déclencheur de Sharpe glissant, taux de faux positifs de 68 % face à une barre de 30 % (0 cohorte sur 26 en dessous). Une stratégie qui subit un drawdown change sa distribution de rendements du seul fait d’avoir subi le drawdown, donc la géométrie s’allume après coup. Il n’y a donc aucun déclencheur de dérive par stratégie dans le Stack ; le moniteur actionnable est le contrôle de confiance-d’agrégation au niveau de la cohorte (H17 PASS), et le profil de dérive par stratégie est livré uniquement comme aide à la visualisation. Avec H18 et H19 tous deux clos, le Topology Deployment Stack est assemblé, une CLI à dix commandes (map, select, portfolio, audit, monitor, refit, aggregation-check, plateau-audit, universality-check, live-adapter), avec les réserves issues des FAIL intégrées au texte d’aide de chaque commande concernée (six sur dix en portent une), un exemple de bout en bout travaillé sur une cohorte fraîche, un adaptateur en direct qui se branche sur un pipeline walk-forward existant sans le modifier, et les chapitres runbook / déploiement en direct / étude de cas rédigés. Le nœud de phase de déploiement et le texte de la revendication centrale sont mis à jour en conséquence.

Le quatrième raffinement de la partition (H19) + deux nouvelles figures

Before

La partition prévision-vs-décision portait une clause de suffisance (depuis H18 : la topologie doit ajouter un degré de liberté que l’approche standard n’a pas) ; le graphe de décalage du correctif de contamination était la seule figure de partition.

After

H19 a ajouté le quatrième raffinement : un degré de liberté ajouté est nécessaire mais pas suffisant, il doit être prédictif du résultat, et un signal de « dérive » ne porte aucune information sur le drawdown futur ; les couches 1 et 4 sont le même fait vu de deux directions (prévoir la performance future est hors de portée, peu importe l’emballage). La partition est désormais une structure à quatre couches, la prévision échoue ou s’amenuise → granularité au niveau de la covariable → nécessité d’ajouter un degré de liberté → nécessité d’un degré de liberté prédictif, et la nouvelle carte de partition à quatre couches (avec la bannière des survivants : le portefeuille de clusters Mapper, le diagnostic d’agrégation de cohorte, la politique de rotation par régime) est intégrée à la découverte centrale. Une seconde nouvelle figure, le diagramme de flux de décision du Deployment Stack (la colonne à cinq boîtes ; l’élément prune absorbé dans select ; le profil de dérive par stratégie barré), est intégrée au constat H19 / Stack.

Phase 07 (directions étendues), verdicts H14 + H15

Before

H14 / H15 listées comme encore à exécuter.

After

H14 MARGINAL (un flag d’overfit par outlier géométrique est un complément de triage aux détecteurs classiques, pas un remplacement). H15 FAIL (la topologie est fiablement pire que les métriques classiques ex-ante pour prédire la défaillance catastrophique d’une stratégie, C-index hold-out ≈ 0,57–0,60 contre 0,77–0,79 ; l’événement de défaillance a une signature nette que le scorecard standard capte directement). Avec H12 (marginale, Article F) c’étaient les dernières des six ; les directions de recherche étendues sont complètes et la Phase 07 est marquée terminée.

Extension du Deployment Stack, verdict H18

Before

Le pipeline mettait en scène une étape `prune` autonome ; H18 / H19 listées comme hypothèses d’alimentation.

After

H18 FAIL : il n’y a pas d’étape d’élagage conscient de la topologie qui améliore l’exécution du constructeur de portefeuille H4 sur tout le corpus de backtests, le sélecteur exploite déjà la même structure, donc pré-élaguer son entrée ne fait que retirer ses options. L’étape `prune` du pipeline se fond dans `select` (c’est maintenant map → select → diversify → monitor → pause/refit) ; `topo-prune` ne survit que comme diagnostic de liste restreinte optionnel pour l’attention humaine. Recommandation : ne pré-élaguez pas ; donnez au sélecteur tout votre corpus. H19 (surveillance de dérive en direct) est l’hypothèse ouverte restante. Le résultat H18 a aiguisé la découverte centrale en une condition de suffisance (voir ci-dessous).

Découverte centrale promue (+ une clause de suffisance)

Before

La page menait avec H4 PASS comme résultat pratique phare ; la scission en deux classes du correctif de contamination était un sous-constat.

After

La partition prévision-vs-décision, les covariables d’outlier géométrique sont robustes (et portent chaque contribution phare : le constructeur de portefeuille H4, le diagnostic d’agrégation H17, la politique de rotation H12) ; les covariables de régression sur cible s’amenuisent ou échouent ; l’homologie locale persistante sur une variété lisse est un poids mort, est désormais énoncée comme la découverte méthodologique centrale du programme (dek, texte de revendication centrale, un nouveau constat de tête) et capturée par un nouvel article, l’Article H. H18 a ajouté la clause de suffisance : survivre au correctif de nettoyage de données est nécessaire mais pas suffisant, la topologie doit aussi ajouter un degré de liberté que l’approche standard n’a pas déjà. H4 PASS reste le résultat pratique phare.

Phase 06, la phase de déploiement

Before

« Workflow praticien & déploiement en direct » générique avec une liste de la surface CLI.

After

Re-spécifiée comme le Topology Deployment Stack : map → select → diversify → monitor → pause/refit, construit entièrement à partir des primitives robustes d’outlier géométrique (l’étape `prune` fondue dans `select` après H18 FAIL ; `topo-prune` survit comme diagnostic de liste restreinte optionnel). H19 (surveillance de dérive en direct) est l’hypothèse ouverte restante. Le portefeuille de sorties passe à huit articles ; le package logiciel est maintenant nommé.

Liens d’archive du changelog

Before

Les entrées de changelog v2 / v3 n’avaient pas de fichiers de route d’archive → cliquer dessus renvoyait un 404.

After

Fichiers de route d’archive ajoutés pour v2, v3, et la nouvelle v4, les liens du changelog se résolvent maintenant vers un résumé de version (l’entrée v1 reste un instantané de page complète ; v2–v4 sont des résumés structurés de ce qu’était chaque version).

Phase 06, Portefeuilles conscients de la topologie (H4) terminée

Before

ÉLEVÉE à prochaine-active ; H4 pas encore exécutée.

After

TERMINÉE le 2026-05-11. H4 PASS à l’échelle du corpus (voir l’entrée H4 ci-dessus pour le verdict à jour et l’hétérogénéité par cohorte / par famille).

Phase 07, Directions étendues (H12–H17)

Before

Les six hypothèses d’extension listées comme planifiées ; aucun verdict.

After

Les six ont atterri au 2026-05-11. H17 PASS (la dynamique de trajectoire de persistance des cohortes prédit la stabilité OOS, nombre de segments × stabilité ρ = +0,72, la première hypothèse de directions-étendues à franchir PASS). H13 MARGINAL (lissage par Laplacien de graphe positif dans 94,5 % des 182 cohortes mais faible ; livré comme couche de lissage MACD-seul). H16 MARGINAL (la couverture consciente de la géométrie ne bat pas le portefeuille Mapper, mais a fait émerger le constat couverture-consciente-de-la-qualité-vs-aveugle-à-la-qualité). H14 MARGINAL (flag d’overfit par outlier géométrique est un complément de triage, pas un remplacement). H15 FAIL (topologie fiablement pire que les caractéristiques classiques en prédiction de risque). H12 MARGINAL (le détecteur topologique de régime est nul mais la politique de rotation de cohortes qui consomme l’état détecté fonctionne).

Revendication centrale & dek

Before

Le dek lisait « le test décisif (H3) vient d’atterrir, et il a échoué ; le programme se recadre » ; le texte de revendication listait la revendication (b) (meilleurs profils de drawdown que HRP/NCO) comme un espoir survivant.

After

Le dek mène avec H4 PASS à l’échelle du corpus. Le texte de revendication énonce maintenant que la revendication (b) est soutenue à l’échelle du corpus, pas seulement en attente ; les revendications (c) et (d) plus les extensions H12/H14/H15 restent en cours.

Dates du projet

Before

Implicites ; la légende de statut lisait « Statut au 2026-05-09, les constats de première lumière de la Phase 1 vivent dans le journal du programme ».

After

Explicites : Projet démarré le 2026-05-08 · Dernière mise à jour le 2026-05-11. Chaque phase porte sa propre date de complétion.

Phase 01, Fondations & pilote

Before

Marquée en cours (« première lumière de la Phase 1 en cours »). Reproductibilité du pilote présentée comme un jalon à venir.

After

TERMINÉE le 2026-05-09 (Jour 1). 127 879 stratégies parsées, empreinte 50 dimensions livrée, matrices de distance passées à l’échelle, constat de variété lisse verrouillé, manifeste de pré-enregistrement gelé. Jalon de phase franchi.

Phase 02, Analyse géométrique

Before

Planifiée. « Démarre après le verrouillage de la Phase 1. »

After

TERMINÉE le 2026-05-09 (Jour 1, le même jour que la Phase 01). H1 PASS (méta ΔR² = +0,130, p < 1×10⁻³⁰⁰, 180/182 cohortes rejettent Holm). H2 FALSIFIÉE à travers trois méthodes de plateau, et la tentative de sauvetage dans l’espace de comportement est morte sous correction causale par fenêtre (+0,236 → +0,0705).

Phase 03, Topologie persistante + H3

Before

Planifiée. « La contribution TDA centrale. » Le test décisif présenté comme un test futur.

After

TERMINÉE le 2026-05-10 (Jour 2). H3 FALSIFIÉE. Méta-FE ΔR²(B8 − B2) = −0,0378, p ajusté Holm = 1,07 × 10⁻⁵, 5/5 cohortes négatives. Falsification multi-méthode, multi-caractéristique à travers deux représentations de caractéristiques et trois familles d’architectures.

Phase 04, Homologie locale + Fisher–Rao

Before

Planifiée comme le chapitre H10 + H11 de la Partie IV.

After

Dépriorisée après H3 FAIL. Les hypothèses étaient des élaborations de la thèse H3 ; H3 morte, le prior sur le fait que H10/H11 ajoutent un signal non redondant chute fortement. La détection de plateaux survit comme diagnostic par stratégie uniquement.

Phase 05, Portefeuilles conscients de la topologie + universalité

Before

Planifiée. Listée comme « la moitié appliquée de la Partie IV ».

After

ÉLEVÉE au test restant à plus haute EV du programme. Indépendante de la falsification de H3 (elle teste la construction de portefeuille, pas la prédiction de niveau par stratégie). H4 (portefeuilles de clusters Mapper) devient la prochaine phase active.

Phase 07, Directions de recherche étendues (NOUVEAU)

Before

N’existait pas.

After

Nouvelle phase ajoutée le 2026-05-10 couvrant six nouvelles hypothèses (H12 détection de régime · H13 diffusion de performance · H14 détection d’anomalies · H15 risque topologique · H16 diversification consciente de la géométrie · H17 dynamique de trajectoire de persistance). H16 est signalée comme la direction restante à plus haute EV.

Structure de la feuille de route

Before

7 macro-phases (Fondations, Géométrique, Persistante, Locale, Portefeuille, Workflow, Synthèse).

After

8 macro-phases. La Phase 07 (Directions de recherche étendues) insérée entre Workflow et Synthèse ; la Synthèse originale renumérotée 08.

Portefeuille de sorties

Before

5 articles + 1 monographie + 1 package logiciel + 5 visualisations interactives + DOI Zenodo.

After

7 articles + 1 monographie + 1 package logiciel + ≥7 visualisations interactives + DOI Zenodo. Ajoutés : Article F (topologie de régime), Article G (portefeuille conscient de la géométrie + fragilité topologique).

Figures

Before

Deux composants SVG de démo illustratifs : « PersistenceDiagramFigure » et « MapperGraphFigure ».

After

19 rendus de sorties réelles intégrés à travers les sections de phases et de constats (les 13 de la mise à jour précédente plus six nouveaux pour le H4 PASS, le profil de drawdown H4, H13, H16, H17, et la figure de partition en deux classes). Composants SVG de démo retirés. Chaque figure porte un pied de page avec la lignée des données source ; les scripts de production sont disponibles sur demande.

Calcul et soutien

Before

Non abordé.

After

Calcul H100 loué utilisé pour les baselines de deep-learning de la Phase 04 (PersLay, encodeurs contrastifs de courbe d’équité), de l’argent réel a été dépensé, et la Phase 05 + la Phase 07 auront besoin de plus de rafales.

Décisif, falsification, périmètre

Test décisif

H3 face à la pile de baselines de ML moderne (XGBoost, TabPFN, TS2Vec, encodeur contrastif de courbe d’équité, et leur ensemble empilé). Si l’adj-R² incrémental < 0,03, la pile topologique ne gagne pas sa place, et le programme recadre la Partie V autour de la topologie comme enrichissement d’un pipeline de ML plutôt que comme remplacement.

Tests multiples

Holm–Bonferroni FWER ≤ 0,05 à travers les 11 hypothèses primaires. Le pilote à 3 actifs est QA-seulement et n’entre pas dans l’inférence finale ; le pré-enregistrement est verrouillé en fin de Phase 1.

Décisions de périmètre

Crypto-seulement pour la v1. Espace de stratégies hybride (paramètre par famille + comportement unifié). Aucune nouveauté théorique poursuivie, faisceaux et géométrie de l’information utilisés comme outils d’analyse appliquée qui produisent des scalaires alimentant des décisions en aval.