Préinscription de recherche · FR

preregistered

Conditionnement interprétatif : protocole pilote 0.1

Préinscription d’un pilote descriptif destiné à observer si des limites contextuelles explicites réduisent la transformation de relations locales en propriétés intrinsèques.

Question de recherche

À entité, requête, modèle et modalité d’accès constants, comment la présence de conditions, d’exclusions et d’une temporalité explicites modifie-t-elle la fidélité des réponses aux invariants du corpus ?

Plan d’étude

Le pilote compare trois représentations contrôlées d’entités synthétiques. Les requêtes, faits, conditions, versions de modèles, modes d’accès et règles de jugement doivent être figés avant la première exécution.

Unité d’analyse

Une réponse produite pour une requête figée, un modèle versionné, un mode d’accès déclaré et une condition de corpus.

Dimensions de comparaison

  • canonical-baseline · Représentation de référence où l’identité, les invariants, la portée et les limites sont explicitement déclarés.
  • underspecified-context · Représentation où une relation contextuelle est présente, mais où ses conditions, son expiration ou sa portée sont sous-spécifiées.
  • bounded-context · Représentation où la même relation contextuelle est accompagnée de ses conditions, de ses exclusions et de sa temporalité.

Échantillonnage minimal

Jeu d’entités synthétiques et de faits inventés, figé avant la première exécution, sans donnée client ni personne réelle.

Entités
6
Familles de requêtes
5
Requêtes par famille
2
Systèmes du panel
3
Modalités d’accès
2
Conditions planifiées
3
Répétitions par cellule planifiée
3
Unités de réponse planifiées
3240
Fenêtre de collecte
7 jours
Juges indépendants
2
Seuil d’accord
cohens-kappa ≥ 0.80

Règle d’arrêt

Aucun arrêt discrétionnaire. Recueillir les 3 240 unités planifiées, sauf retrait d’un modèle, changement de politique d’accès, défaut d’intégrité ou indisponibilité de plus de 5 % des unités ; tout arrêt et tout dénominateur doivent être publiés.

Résolution des désaccords

Deux juges évaluent indépendamment chaque unité. Un troisième juge tranche les désaccords avant toute agrégation.

Règle en cas d’accord insuffisant

Si le kappa de Cohen est inférieur à 0.80, ne pas agréger les métriques dépendantes du jugement ; publier l’échec d’accord et réviser la grille dans une nouvelle version avant toute reprise.

Séquence d’exécution

  • freeze-corpus · Figer chaque document, fait attendu, relation, exclusion et condition avec son condensat SHA-256.
  • freeze-panel · Figer les modèles, versions, paramètres disponibles, modes d’accès et date de collecte avant toute requête.
  • randomize-runs · Randomiser l’ordre des conditions sans changer le texte figé des requêtes ni mélanger les modes d’accès.
  • adjudicate-blind · Évaluer les assertions contre le manifeste de faits avant de révéler la condition du corpus aux juges humains.
  • publish-complete-denominators · Publier tous les dénominateurs, sorties valides, exclusions, désaccords et arrêts, y compris en l’absence d’effet identifiable.

Exigences de gel

  • corpus-manifest-sha256
  • fact-manifest-sha256
  • query-set-version
  • model-panel-snapshot
  • access-mode-log
  • judge-rubric-version
  • planned-unit-manifest
  • judge-panel-and-agreement-rule
  • collection-window
  • run-order-seed
  • exclusion-policy-version

Métriques préinscrites

entity-identification-fidelity

Degré selon lequel la réponse conserve l’identité attendue sans fusionner l’entité avec un voisin sémantique.

three-level-ordinal · higher-is-better

invariant-fidelity-rate

Part des assertions évaluables qui restituent correctement les invariants présents dans le manifeste de faits.

claim-level-ratio · higher-is-better

unsupported-intrinsic-claim-rate

Part des assertions qui transforment sans preuve une relation locale ou temporaire en propriété intrinsèque.

claim-level-ratio · lower-is-better

legitimate-abstention-rate

Part des cas sous-déterminés où la réponse refuse correctement de conclure plutôt que de compléter les preuves absentes.

query-level-ratio · context-only

cross-run-stability

Accord entre répétitions d’une même unité d’analyse, présenté séparément pour chaque modèle, condition et mode d’accès.

categorical-agreement-rate · higher-is-better

Règles de décision

  • within-stratum-comparison · Comparer seulement des observations partageant la même entité, requête, version de modèle et modalité d’accès.
  • no-causal-language · Ne jamais transformer une différence descriptive entre conditions en effet causal du conditionnement interprétatif.
  • complete-denominator-required · Ne publier aucun taux sans le nombre total d’unités prévues, valides, exclues, manquantes et interrompues.
  • no-population-generalization · Limiter toute conclusion au corpus synthétique, au panel et à la fenêtre d’observation effectivement publiés.
  • null-and-nonidentifiable-publication · Publier les résultats nuls, contradictoires ou non identifiables selon les mêmes exigences que le résultat attendu.

Menaces à la validité

synthetic-corpus-external-validity

Un corpus synthétique améliore le contrôle, mais ne représente pas automatiquement la complexité d’entités réelles.

Mesure de réduction. Présenter le lot comme pilote descriptif et exiger un protocole distinct avant toute réplication sur des entités réelles.

model-drift

Une mise à jour silencieuse d’un modèle peut modifier les réponses pendant ou après la collecte.

Mesure de réduction. Versionner les identifiants disponibles, borner la fenêtre et ne jamais fusionner des observations provenant de fenêtres incompatibles.

access-mode-asymmetry

La mémoire, la navigation et la récupération contrôlée n’exposent pas les mêmes sources ni les mêmes mécanismes.

Mesure de réduction. Enregistrer la modalité d’accès pour chaque unité et publier les résultats dans des strates séparées.

judge-subjectivity

La distinction entre variation légitime et propriété intrinsèque peut produire des désaccords d’adjudication.

Mesure de réduction. Utiliser une grille figée, une double lecture indépendante et publier les désaccords avant arbitrage.

Paquet minimal de publication

  • protocol-version
  • corpus-manifest-and-sha256
  • fact-manifest-and-sha256
  • query-set-version
  • model-panel-and-access-modes
  • judge-rubric-and-disagreements
  • raw-verdict-distribution
  • complete-denominators
  • exclusions-and-halts
  • limitations
  • null-and-nonidentifiable-outcomes

Frontières et non-revendications

  • Cette préinscription ne prouve pas que le conditionnement interprétatif produit un effet.
  • Les observations du pilote ne peuvent pas être généralisées à l’ensemble des modèles ou des entités.
  • Une stabilité accrue ne prouve ni vérité globale, ni recommandabilité, ni conséquence commerciale.
  • Aucune information produit ou donnée client ne fait partie du protocole public.

Ce que prouve une préinscription

La préinscription établit qu’une méthode a été fixée avant l’exécution. Elle ne prouve ni exécution, ni résultat, ni causalité, ni ouverture du produit.

Programme parent : Conditionnement interprétatif

https://gautierdorval.com/doctrine/couche-conditionnement-interpretatif/