Question de recherche
À entité, requête, modèle et modalité d’accès constants, comment la présence de conditions, d’exclusions et d’une temporalité explicites modifie-t-elle la fidélité des réponses aux invariants du corpus ?
Plan d’étude
Le pilote compare trois représentations contrôlées d’entités synthétiques. Les requêtes, faits, conditions, versions de modèles, modes d’accès et règles de jugement doivent être figés avant la première exécution.
Unité d’analyse
Une réponse produite pour une requête figée, un modèle versionné, un mode d’accès déclaré et une condition de corpus.
Dimensions de comparaison
- canonical-baseline · Représentation de référence où l’identité, les invariants, la portée et les limites sont explicitement déclarés.
- underspecified-context · Représentation où une relation contextuelle est présente, mais où ses conditions, son expiration ou sa portée sont sous-spécifiées.
- bounded-context · Représentation où la même relation contextuelle est accompagnée de ses conditions, de ses exclusions et de sa temporalité.
Échantillonnage minimal
Jeu d’entités synthétiques et de faits inventés, figé avant la première exécution, sans donnée client ni personne réelle.
Règle d’arrêt
Aucun arrêt discrétionnaire. Recueillir les 3 240 unités planifiées, sauf retrait d’un modèle, changement de politique d’accès, défaut d’intégrité ou indisponibilité de plus de 5 % des unités ; tout arrêt et tout dénominateur doivent être publiés.
Résolution des désaccords
Deux juges évaluent indépendamment chaque unité. Un troisième juge tranche les désaccords avant toute agrégation.
Règle en cas d’accord insuffisant
Si le kappa de Cohen est inférieur à 0.80, ne pas agréger les métriques dépendantes du jugement ; publier l’échec d’accord et réviser la grille dans une nouvelle version avant toute reprise.
Séquence d’exécution
- freeze-corpus · Figer chaque document, fait attendu, relation, exclusion et condition avec son condensat SHA-256.
- freeze-panel · Figer les modèles, versions, paramètres disponibles, modes d’accès et date de collecte avant toute requête.
- randomize-runs · Randomiser l’ordre des conditions sans changer le texte figé des requêtes ni mélanger les modes d’accès.
- adjudicate-blind · Évaluer les assertions contre le manifeste de faits avant de révéler la condition du corpus aux juges humains.
- publish-complete-denominators · Publier tous les dénominateurs, sorties valides, exclusions, désaccords et arrêts, y compris en l’absence d’effet identifiable.
Exigences de gel
corpus-manifest-sha256fact-manifest-sha256query-set-versionmodel-panel-snapshotaccess-mode-logjudge-rubric-versionplanned-unit-manifestjudge-panel-and-agreement-rulecollection-windowrun-order-seedexclusion-policy-version
Métriques préinscrites
entity-identification-fidelity
Degré selon lequel la réponse conserve l’identité attendue sans fusionner l’entité avec un voisin sémantique.
invariant-fidelity-rate
Part des assertions évaluables qui restituent correctement les invariants présents dans le manifeste de faits.
unsupported-intrinsic-claim-rate
Part des assertions qui transforment sans preuve une relation locale ou temporaire en propriété intrinsèque.
legitimate-abstention-rate
Part des cas sous-déterminés où la réponse refuse correctement de conclure plutôt que de compléter les preuves absentes.
cross-run-stability
Accord entre répétitions d’une même unité d’analyse, présenté séparément pour chaque modèle, condition et mode d’accès.
Règles de décision
- within-stratum-comparison · Comparer seulement des observations partageant la même entité, requête, version de modèle et modalité d’accès.
- no-causal-language · Ne jamais transformer une différence descriptive entre conditions en effet causal du conditionnement interprétatif.
- complete-denominator-required · Ne publier aucun taux sans le nombre total d’unités prévues, valides, exclues, manquantes et interrompues.
- no-population-generalization · Limiter toute conclusion au corpus synthétique, au panel et à la fenêtre d’observation effectivement publiés.
- null-and-nonidentifiable-publication · Publier les résultats nuls, contradictoires ou non identifiables selon les mêmes exigences que le résultat attendu.
Menaces à la validité
synthetic-corpus-external-validity
Un corpus synthétique améliore le contrôle, mais ne représente pas automatiquement la complexité d’entités réelles.
Mesure de réduction. Présenter le lot comme pilote descriptif et exiger un protocole distinct avant toute réplication sur des entités réelles.
model-drift
Une mise à jour silencieuse d’un modèle peut modifier les réponses pendant ou après la collecte.
Mesure de réduction. Versionner les identifiants disponibles, borner la fenêtre et ne jamais fusionner des observations provenant de fenêtres incompatibles.
access-mode-asymmetry
La mémoire, la navigation et la récupération contrôlée n’exposent pas les mêmes sources ni les mêmes mécanismes.
Mesure de réduction. Enregistrer la modalité d’accès pour chaque unité et publier les résultats dans des strates séparées.
judge-subjectivity
La distinction entre variation légitime et propriété intrinsèque peut produire des désaccords d’adjudication.
Mesure de réduction. Utiliser une grille figée, une double lecture indépendante et publier les désaccords avant arbitrage.
Paquet minimal de publication
protocol-versioncorpus-manifest-and-sha256fact-manifest-and-sha256query-set-versionmodel-panel-and-access-modesjudge-rubric-and-disagreementsraw-verdict-distributioncomplete-denominatorsexclusions-and-haltslimitationsnull-and-nonidentifiable-outcomes
Frontières et non-revendications
- Cette préinscription ne prouve pas que le conditionnement interprétatif produit un effet.
- Les observations du pilote ne peuvent pas être généralisées à l’ensemble des modèles ou des entités.
- Une stabilité accrue ne prouve ni vérité globale, ni recommandabilité, ni conséquence commerciale.
- Aucune information produit ou donnée client ne fait partie du protocole public.
Ce que prouve une préinscription
La préinscription établit qu’une méthode a été fixée avant l’exécution. Elle ne prouve ni exécution, ni résultat, ni causalité, ni ouverture du produit.
Programme parent : Conditionnement interprétatif
https://gautierdorval.com/doctrine/couche-conditionnement-interpretatif/
