Le screening des sanctions et des PPE est le contrôle de conformité le plus susceptible de submerger votre équipe et le moins susceptible, un jour donné, de détecter un véritable acteur malveillant. Les systèmes du secteur génèrent couramment 90 à 99 % de faux positifs, et chacune de ces alertes consomme 30 à 60 minutes du temps d'un analyste qualifié avant d'être écartée comme un homonyme sans pertinence. À mesure que les volumes de transactions et d'onboarding augmentent, le flot d'alertes augmente avec eux — de façon linéaire, mécanique, et sans ajouter la moindre détection de risque réel.
Ce n'est pas un problème d'effectifs que vous pouvez résoudre par le recrutement. C'est un problème de précision. Pour un responsable KYC en 2026, la question n'est plus « de combien d'analystes ai-je besoin pour vider la file ? » mais « comment rendre cette file plus courte et plus précise sans manquer une vraie correspondance ? »
Cet article est un guide pratique destiné aux responsables KYC et aux référents sanctions et screening des banques, des gérants de fortune indépendants (GFI) et des fintechs. Il quantifie le problème des faux positifs, explique précisément pourquoi le screening traditionnel sur-alerte, et montre comment le scoring contextuel par IA ramène ce taux à 20–25 % tout en gardant chaque décision explicable et défendable sous le régime d'efficacité émergent.
1. Le problème des faux positifs, quantifié
Le taux qui définit la charge de travail
Un moteur de screening calibré pour la sécurité réglementaire pèche par excès d'alertes. C'est voulu — une vraie correspondance manquée est une catastrophe réglementaire et réputationnelle, tandis qu'un faux positif n'est que coûteux. Il en résulte un biais systématique vers la sur-alerte, et les chiffres sont éloquents : dans l'ensemble du secteur, 90 % à 99 % des alertes de screening sont des faux positifs. En pratique, un analyste peut examiner des dizaines d'alertes avant d'en rencontrer une qui nécessite une véritable escalade.
Le coût par alerte
Chaque faux positif n'est pas gratuit. En écarter un exige qu'un analyste ouvre l'alerte, compare le nom signalé avec l'entrée sanctionnée ou PPE, recherche des identifiants corroborants ou infirmants, documente le raisonnement et clôture le cas. Réalistement, cela prend 30 à 60 minutes par alerte une fois la recherche secondaire incluse. À un coût chargé de CHF 80 000 à 110 000 par an pour un analyste KYC en Suisse, l'arithmétique est impitoyable.
Le piège de la mise à l'échelle
Le problème structurel est que le volume d'alertes croît avec le volume d'activité, non avec le risque. Doublez votre débit d'onboarding ou votre volume de paiements, et vous doublez à peu près vos alertes — mais vous ne doublez pas le nombre de parties réellement sanctionnées dans votre portefeuille. La croissance importe donc une augmentation proportionnelle et permanente de tâches à faible valeur.
| Profil de portefeuille | Alertes mensuelles | Faux positifs (95 %) | Heures analyste/mois | Coût chargé/an (CHF) |
|---|---|---|---|---|
| Petit GFI | 400 | 380 | ~285 | ~200 000 |
| Banque de taille moyenne | 2 000 | 1 900 | ~1 425 | ~1 000 000 |
| Fintech à l'échelle | 8 000 | 7 600 | ~5 700 | ~4 000 000 |
Les chiffres supposent 45 minutes par faux positif et un coût chargé de CHF 95 000 par analyste. Ils illustrent l'essentiel : à grande échelle, la majorité d'un budget de screening est dépensée à confirmer que des personnes ne sont pas celles que la liste laisse penser qu'elles pourraient être.
2. Pourquoi le screening traditionnel sur-alerte
Le screening hérité repose sur le fuzzy matching de chaînes : il compare le nom de votre client aux entrées de liste et signale tout ce qui dépasse un seuil de similarité. Cette approche a des décennies, se vérifie facilement, et est structurellement propice au bruit. Quatre causes dominent.
Translittération et variabilité orthographique
Les listes de sanctions agrègent des noms translittérés de l'arabe, du cyrillique, du chinois et d'autres écritures, chacun avec plusieurs romanisations acceptées. « Mohammed », « Muhammad », « Mohamed » et « Mohammad » sont le même nom ; un moteur flou calibré pour tous les capter captera aussi une grande quantité de bruit sans rapport. Abaissez le seuil pour ne manquer aucune variante, et le nombre d'alertes explose.
Les noms courants
Un nom courant est à lui seul une machine à faux positifs. Un client nommé « Li Wei », « Maria Garcia » ou « Mohammed Al-Hassan » peut correspondre à des dizaines d'entrées de liste — presque toutes des homonymes sans rapport. La similarité de chaînes ne peut distinguer un nom courant partagé par des millions d'une véritable correspondance, car sur le seul champ du nom ils sont indiscernables.
Usage insuffisant des identifiants secondaires
L'information qui résout réellement une correspondance — date de naissance, lieu de naissance, nationalité, numéro de passeport ou d'enregistrement, associés connus — est soit absente du dossier client, soit absente de l'entrée de liste, soit tout simplement non pondérée par la logique de correspondance. Les moteurs traditionnels traitent le nom comme le signal principal et les identifiants secondaires comme un accessoire, si bien qu'ils alertent sur le nom seul et laissent la corroboration à l'humain.
Aucun contexte
Un comparateur de chaînes ne comprend pas qui est le client, ce qu'il fait, où il opère, ni si la correspondance est seulement plausible. Il ne peut raisonner qu'un client de détail suisse de 25 ans a peu de chances d'être un haut fonctionnaire étranger sanctionné de 70 ans qui partage un patronyme. Chaque désambiguïsation qu'un humain effectue d'instinct doit être refaite, manuellement, alerte par alerte.
3. Comment l'IA transforme le screening
L'IA ne remplace pas le screening des sanctions et des PPE — elle rend la couche de correspondance intelligente, de sorte que les alertes parvenant à un humain sont celles qui méritent réellement un jugement. Six capacités comptent.
Correspondance contextuelle
Au lieu de scorer la similarité de nom isolément, l'IA évalue la correspondance en contexte : profil du client, juridiction, âge, activité et plausibilité de l'association. Une correspondance de nom contextuellement invraisemblable est déclassée plutôt qu'escaladée, réduisant fortement le bruit des noms courants et des variantes de translittération.
Résolution d'entités
L'IA détermine si deux dossiers renvoient à la même entité du monde réel plutôt que de simplement partager des caractères. Elle réconcilie alias, ordres de noms, translittérations et dossiers partiels en une seule entité résolue, puis compare des entités — non des chaînes. Cela réduit les dizaines de correspondances fallacieuses générées par un nom courant à une seule détermination correctement résolue (généralement négative).
Corroboration par identifiants secondaires
Le modèle utilise activement la date de naissance, le lieu de naissance, la nationalité et les identifiants pour confirmer ou exclure une correspondance. Un patronyme partagé avec une date de naissance et une nationalité divergentes est une exclusion quasi automatique ; un nom et une date de naissance et une nationalité partagés constituent un fort signal de vrai positif, priorisé pour une revue immédiate.
NLP sur les médias défavorables
Pour le screening PPE et réputationnel, le traitement du langage naturel lit les résultats de médias défavorables et les classe par pertinence, récence, gravité et selon que l'article concerne réellement votre client ou un homonyme. Cela filtre l'historique, l'anecdotique et le mal attribué, de sorte que les analystes voient des constats réellement matériels plutôt qu'un mur de titres.
Scoring fondé sur le risque
Chaque alerte reçoit une probabilité calibrée d'être une vraie correspondance, non un signal binaire. Cela transforme une file indifférenciée en une file hiérarchisée, où le petit nombre d'alertes à forte probabilité est sans ambiguïté et où la longue traîne d'homonymes à probabilité quasi nulle peut être traitée avec un effort proportionné.
Triage intelligent par criticité
Les alertes scorées sont routées par criticité : les correspondances à plus forte probabilité et plus fort impact vont directement aux analystes seniors ; les homonymes à faible risque manifestes sont traités automatiquement ou regroupés pour une revue légère. L'attention humaine se concentre sur les 5 à 15 % d'alertes qui la nécessitent réellement.
