Méthode

Ce que le rapport mesure, exactement.

TrustCheckIA produit un faisceau d'indices - et non une preuve - organisé en cinq couches complémentaires. Cette page décrit ce que le rapport affiche réellement, avec les pondérations utilisées dans le code.

Les cinq couches du rapport

1 · Indice d'apport humain (indicateur principal)

Le rapport s'ouvre sur un score 0-100 mesurant l'effort et la contribution propre du rédacteur, indépendamment de l'usage d'IA. Il agrège quatre composants pondérés :

  • Ancrage propre - 35 % : éléments concrets du dossier (chiffres, dates, montants, références) propres au rédacteur, hors données d'identité et hors éléments déjà présents dans les pièces fournies.
  • Traces de reprise - 20 % : révisions Word, ruptures de style détectées par le modèle sémantique, passages à faible signature statistique IA.
  • Prose hors listes à puces - 15 % : part du texte rédigée en prose plutôt qu'en listes à puces, le contenu d'une puce ne valant aucun apport humain.
  • Référents vérifiables - 30 % : référents vérifiables extraits du livrable (mesures relevées, obstacles, corrections datées, identifiants traçables) et absents des pièces fournies.

2 · Signature technique IA (indice secondaire)

Score 0-100 combinant le faisceau statistique et l'analyse sémantique. Il n'apparaît qu'en indicateur secondaire pour ne pas écraser la lecture principale (l'apport humain). Plafonné à 97/100 : TrustCheckIA assume un faisceau d'indices et non une preuve.

3 · Hypothèse de reconstruction du processus de génération

Un modèle expert propose une reconstruction plausible : nombre de prompts probablement utilisés, types de prompts (rôle, ton, plan imposé, injection de sources), traces d'itérations. Cette couche est indicative, orientée débat contradictoire.

4 · Cartographie par paragraphe

Chaque paragraphe reçoit un label humain / mixte / IA. Les paragraphes contenant des marqueurs d'ancrage (dates, montants, références juridiques précises) sont plafonnés à « mixte ». Les paragraphes de moins de 15 mots sont marqués comme non évalués, sans peser sur la moyenne.

5 · Artefacts d'assistant

Détection d'artefacts non ambigus (placeholders `[votre nom]`, préambules « en tant qu'IA », balises `<thinking>`, meta-instructions oubliées). Un artefact fort déclenche un plancher de 70/100 sur la signature IA ; deux artefacts un plancher de 85/100. La liste littérale est restreinte pour éviter les faux positifs sur tournures humaines ordinaires.

Le faisceau statistique - pondérations réelles

Les sept familles ne pèsent pas à égalité. Le pipeline (voir src/lib/analysis/stats.ts) applique les poids suivants avant renormalisation à 100 % :

FamillePoids
Uniformité des phrases (burstiness)

Coefficient de variation de la longueur des phrases. Les rédacteurs humains alternent phrases courtes et longues ; les modèles produisent une longueur plus homogène. Neutralisé (poids 0, redistribué) sur les textes de slides ou dès que la phrase moyenne fait moins de 12 mots, cas où l'indicateur n'est plus discriminant.

50 %
Connecteurs formulaïques

Dictionnaire d'une soixantaine de tournures bilingues (FR ~20 entrées, EN ~37 entrées), pondérées : les signatures LLM caractéristiques (« il convient de noter », « en somme », « in conclusion », « let me break this down ») comptent pour 1.0, les connecteurs ordinaires pour 0.3. Les matches sont dédupliqués par position et normalisés sans accents.

28 %
Prédictibilité lexicale (proxy perplexité)

Combine trois signaux : densité de mots outils du Top-100, proportion d'hapax (mots uniques) et uniformité des débuts de phrases. Substitut à la perplexité utilisée par GLTR / GPTZero.

6 %
Uniformité structurelle des paragraphes

Coefficient de variation de la longueur des paragraphes de prose (≥ 25 mots). Mesuré sur un corpus d'articles professionnels humains, l'indicateur s'est révélé non discriminant : il est affiché à titre informatif et son poids est nul dans le score.

0 % (informatif)
N-grammes répétés

Trigrammes ≥ 3× et bigrammes ≥ 4× rapportés à la longueur du texte, hors n-grammes contenant un nom propre du document ou un terme du contexte de mission. Comme la régularité structurelle, cet indicateur saturait sur des documents humains institutionnels : il est conservé à titre informatif, avec un poids nul dans le score.

0 % (informatif)
Richesse lexicale (TTR)

Type-token ratio sur fenêtres glissantes de 200 mots. Neutralisé sous 400 mots.

5 %
Ponctuation & typographie (tiret cadratin)

Densité pondérée de tirets cadratins et demi-cadratins pour 1 000 mots (poids relevé de 4 % à 12 % le 02/08/2026 : en français, le tiret cadratin n'est pas au clavier, c'est un discriminant réel). Neutralisé sur les textes trop courts, et l'effet du signal sur le score global reste borné.

12 %

Ces poids sont les poids NOMINAUX du code (0,50 · 0,28 · 0,06 · 0 · 0 · 0,05 · 0,12, soit une somme de 1,01) : le score est une moyenne pondérée, donc les poids sont renormalisés sur les seuls indicateurs actifs. Burstiness et connecteurs pèsent ainsi à eux seuls environ 77 % du score statistique. Quand la burstiness est neutralisée (slides, phrases courtes), son poids est redistribué au prorata : les connecteurs montent typiquement à ~55 % et la ponctuation à ~24 %.

Analyse sémantique

Un modèle expert (Claude Haiku en standard, Opus en mode approfondi) évalue quatre dimensions polarisées côté IA : homogénéité stylistique, spécificité des références, engagement / prise de position, ruptures de style trahissant une édition humaine partielle. Chaque dimension reçoit un sous-score commenté, cité avec des extraits littéraux.

Métadonnées & format

Pour les .docx, TrustCheckIA lit le nombre de révisions, l'auteur, les dates de création et de modification. Le champ TotalTime (temps d'édition Word) est neutralisé car peu fiable dans la pratique (documents copiés, rouverts, versions Web). Pour les .pptx, un score métadonnées plafonné à 55/100 est calculé à partir de marqueurs pondérés (temps, révisions, structure, uniformité, notes, images, police), reformulés en observations factuelles réfutables. Le bonus de convergence PPTX ne s'applique que si le texte concorde.

Réconciliation & confiance

Quand la signature IA et l'apport humain pointent tous deux dans la même direction alors qu'ils devraient s'opposer, un encart de réconciliation apparaît dans le rapport et la confiance est ramenée à « modérée ». Le score global est plafonné à 97/100 : nous refusons d'afficher un 100/100 probabiliste.