Aller au contenu

Framework

Matrice de risque de brand safety dans les réponses IA

Matrice d’évaluation des claims dommageables ou trompeurs dans les réponses IA selon gravité, attribution, décision, répétition et réversibilité.

CollectionFramework
TypeMatrice
Couchetransversal
Version0.1
Stabilisation2026-08-08
Publié2026-08-08
Mise à jour2026-08-08

Artefacts de gouvernance

Fichiers de gouvernance mobilisés par cette page

Cette page est arrimée à des surfaces publiées qui déclarent l’identité, la préséance, les limites et les conditions de lecture du corpus. Leur ordre ci-dessous donne la séquence de lecture recommandée.

  1. 01Profils d’application des allégations
  2. 02family-proof-requirements.json
  3. 03source-weighting-policy.json
Politique et légitimité#01

Profils d’application des allégations

/claim-application-profiles.json

Profils qui relient familles de questions, classes d’allégations, sources requises et sorties admissibles.

Gouverne
L’application des preuves et des limites selon la nature de l’allégation.
Borne
La fusion de l’identité officielle, de la réputation externe, de la comparaison et de la causalité.

Ne garantit pas : Un profil définit une discipline de réponse; il ne prouve pas qu’un modèle externe l’applique.

Artefact#02

family-proof-requirements.json

/family-proof-requirements.json

Surface publiée de gouvernance machine-first.

Gouverne
Une partie des conditions de lecture du corpus.
Borne
Une zone d’inférence qui resterait sinon implicite.

Ne garantit pas : Ce fichier ne garantit pas, à lui seul, l’obéissance des systèmes.

Artefact#03

source-weighting-policy.json

/source-weighting-policy.json

Surface publiée de gouvernance machine-first.

Gouverne
Une partie des conditions de lecture du corpus.
Borne
Une zone d’inférence qui resterait sinon implicite.

Ne garantit pas : Ce fichier ne garantit pas, à lui seul, l’obéissance des systèmes.

Couche de preuve

Surfaces probatoires mobilisées par cette page

Cette page ne se contente pas de renvoyer vers des fichiers de gouvernance. Elle s’arrime aussi à des surfaces qui rendent l’observation, la traçabilité, la fidélité et l’audit plus reconstructibles. Leur ordre ci-dessous explicite la chaîne probatoire minimale.

  1. 01
    Canon et périmètreCanon de définitions
  2. 02
    Artefact probatoireclaims.json
  3. 03
Fondation canonique#01

Canon de définitions

/canon.md

Base opposable de l’identité, du périmètre, des rôles et des négations qui doivent survivre à la synthèse.

Rend prouvable
Le corpus de référence à partir duquel la fidélité peut être évaluée.
Ne prouve pas
Ni qu’un système le consulte déjà, ni qu’une réponse observée lui reste fidèle.
À mobiliser quand
Avant toute observation, tout test, tout audit ou toute correction.
Artefact#02

claims.json

/claims.json

Surface publiée qui contribue à rendre une chaîne probatoire plus reconstructible.

Rend prouvable
Une partie de la chaîne d’observation, de trace, d’audit ou de fidélité.
Ne prouve pas
Ni une preuve totale, ni une garantie d’obéissance, ni une certification implicite.
À mobiliser quand
Lorsqu’une page doit expliciter son régime de preuve.
Artefact#03

official-vs-external-source-conflicts.json

/official-vs-external-source-conflicts.json

Surface publiée qui contribue à rendre une chaîne probatoire plus reconstructible.

Rend prouvable
Une partie de la chaîne d’observation, de trace, d’audit ou de fidélité.
Ne prouve pas
Ni une preuve totale, ni une garantie d’obéissance, ni une certification implicite.
À mobiliser quand
Lorsqu’une page doit expliciter son régime de preuve.

Matrice de risque de brand safety dans les réponses IA

Cette matrice aide à prioriser un claim potentiellement dommageable. Elle ne décide pas si le claim est juridiquement fautif et ne remplace pas un avis juridique. Elle structure la collecte de preuve, le niveau d’escalade et la réponse proportionnée.

Axes de cotation

Chaque axe reçoit une cote de 0 à 3. La cote globale n’est pas une vérité mathématique ; elle sert à comparer des incidents sous un protocole commun.

Axe 0 1 2 3
Gravité du claim Préférence mineure Qualité ou service Conduite, sécurité ou conformité Crime, fraude, danger grave
Proximité décisionnelle Contexte général Recherche exploratoire Comparaison ou achat Santé, finance, emploi, droit
Attribution Source et statut clairs Source indirecte Attribution ambiguë Allégation présentée comme fait
Qualité des sources Sources compétentes convergentes Source plausible Source faible ou ancienne Aucune source ou mauvaise entité
Temporalité Actuelle et datée Date implicite Ancienne mais non signalée Résolue/renversée présentée actuelle
Confusion d’entité Aucune Similitude faible Produit/filiale confondus Homonyme ou autre société
Répétition Une observation Même modèle Plusieurs prompts/modèles Multilingue, régional et persistant
Réversibilité Source facilement corrigible Correction partielle Dépend d’un tiers Source inaccessible ou motif diffus
Portée Prompt de niche Segment limité Marché important Plusieurs marchés ou interfaces
Contradiction qualifiée Aucune Position officielle Preuve externe contraire Décision ou preuve forte ignorée

Bandes de réponse

Bande A : documenter et surveiller

Faible gravité, attribution claire, observation isolée. Conserver la preuve, vérifier le canon et intégrer l’incident au monitoring.

Bande B : corriger la source compétente

Écart confirmé sur identité, date, produit ou périmètre. Mettre à jour le canon, la source tierce ou la désambiguïsation. Définir une fenêtre de réobservation.

Bande C : escalade interfonctionnelle

Claim sérieux, répété ou proche d’une décision. Mobiliser communication, juridique, sécurité produit, conformité ou direction selon le cas. Préserver les captures et éviter les réponses improvisées.

Bande D : incident critique

Confusion grave, claim potentiellement dangereux, fausse accusation ou recommandation à haut risque, répétée et non attribuée. Suspendre les usages internes dépendant de la sortie, signaler au fournisseur lorsque possible et engager le protocole juridique ou réglementaire approprié.

Exemple 1 : ancienne information

Une IA affirme qu’un produit est discontinué alors qu’une nouvelle version est disponible. La gravité peut être modérée, la décision proche, la temporalité mauvaise et la correction assez réversible. La réponse relève généralement de la bande B : source actuelle, schéma de produit, redirections et réobservation.

Exemple 2 : accusation attribuée au mauvais homonyme

Une réponse associe une entreprise à une poursuite visant une société au nom similaire. Gravité élevée, confusion d’entité maximale, attribution faible et décision potentiellement proche. La bande C ou D est justifiée selon la répétition et le contexte.

Exemple 3 : critique externe réelle

Une IA résume une décision défavorable récente, cite la source et présente la réponse officielle de l’entreprise. Le sentiment est négatif, mais la source, l’attribution et la temporalité sont fortes. Le risque de fausse représentation peut être faible. Chercher à supprimer la critique serait une mauvaise utilisation de la brand safety.

Fiche de preuve

  • texte intégral du claim;
  • capture ou export de la réponse;
  • prompt et intention;
  • modèle, produit, date, langue, région et navigation;
  • citations et traces accessibles;
  • identité visée et identifiants de désambiguïsation;
  • sources compétentes et contradiction;
  • cote par axe;
  • décision d’escalade et propriétaire;
  • réobservation et résultat.

Garde-fous

Ne pas convertir automatiquement le score en conclusion juridique. Ne pas gonfler la gravité parce qu’une réponse est défavorable. Ne pas utiliser la source officielle pour annuler une preuve externe. Ne pas annoncer qu’une correction a résolu le problème sans protocole comparatif.

La matrice rend le risque triable. Elle ne donne ni droit de contrôle sur le modèle, ni preuve automatique d’un dommage subi.