PEP- och sanktionsscreening (v.3)
Version 3 av systemet för PEP- och sanktionsscreening introducerar betydande förbättringar gällande träffsäkerhet och konfigurerbarhet. Denna artikel beskriver hur screeningflödet fungerar, tillgängliga inställningar och vad som har ändrats från tidigare versioner.
Hur screening fungerar
Screeningflödet bearbetar varje entitet genom fem steg:
- Förbearbetning -- Normalisera och rensa entitetsnamn.
- Sökning -- Hitta kandidatmatchningar i databaser för PEP och sanktioner.
- Filtrering -- Ta bort lågkvalitativa matchningar.
- Poängsättning -- Beräkna en slutgiltig matchningspoäng för varje kandidat.
- Användarverifiering -- Presentera resultat för mänsklig granskning.
1.1 Förbearbetning
Före sökningen normaliseras entitetsnamn för att förbättra matchningens konsekvens. Följande transformationer tillämpas:
| Transformation | Exempel på indata | Exempel på utdata |
|---|---|---|
| Accenter tas bort | Rene Descartes | Rene Descartes |
| Bindestreck delas upp i separata termer | Ann-Bertine | Ann Bertine |
| Icke-alfanumeriska tecken tas bort | O'Brien | OBrien |
| Titlar tas bort (personer) | Dr. Jane Smith | Jane Smith |
| Bolagsformer tas bort (företag) | Acme Corp AS | Acme Corp |
1.2 Sökning
Söksteget använder två huvudsakliga matchningsregler för att hitta kandidater:
Matchningsregel per term (75 %-regeln)
Varje term i entitetsnamnet jämförs individuellt mot varje term i kandidatnamnet. En term betraktas som en matchning om den uppnår minst 75 % likhet.
Undantag för korta termer: Termer med 3 eller färre tecken kräver en exakt matchning, eftersom även små skillnader i korta termer är betydande (t.ex. ”Bo” kontra ”Ba”).
Övergripande matchningsregel
Den övergripande matchningen använder delmängdslogik: systemet kontrollerar om termerna i entitetsnamnet utgör en delmängd av kandidatnamnets termer (eller vice versa). Detta innebär:
| Entitetsnamn | Kandidatnamn | Matchning? | Orsak |
|---|---|---|---|
| Anna Johansen | Anna Bertine Johansen | Ja | Entitetstermer är en delmängd av kandidattermer |
| Anna Bertine Johansen | Anna Johansen | Ja | Kandidattermer är en delmängd av entitetstermer |
| Anna Johansen | Bertine Andersen | Nej | Inget delmängdsförhållande |
En övergripande likhetspoäng beräknas därefter baserat på andelen matchade termer och deras individuella likhetspoäng.
1.3 Filtrering
Efter söksteget filtreras kandidater baserat på:
- Likhetspoäng -- Kandidater under det konfigurerade tröskelvärdet tas bort.
- Kvarhållandeperiod för PEP -- PEP-träffar behålls under en konfigurerbar period efter att personen lämnar sin position och filtreras därefter bort.
1.4 Poängsättning
Den slutgiltiga matchningspoängen är ett viktat aritmetiskt medelvärde av flera komponenter:
- Namnlikhet (konfigurerbar vikt)
- Matchning av födelsedatum (konfigurerbar vikt)
- Landsmatchning (konfigurerbar vikt)
- SSN-matchning (konfigurerbar vikt)
Formeln är:
score = (w_name * name_score + w_dob * dob_score + w_country * country_score + w_ssn * ssn_score)
/ (w_name + w_dob + w_country + w_ssn)Vikter är konfigurerbara per team i screeninginställningarna.
SSN-åsidosättning: Om entitetens personnummer (SSN) matchar kandidatens SSN exakt sätts poängen automatiskt till högsta möjliga oavsett andra faktorer.
1.5 Användarverifiering
Efter poängsättningen presenteras resultaten för användaren för verifiering. Varje matchning innehåller en poänguppdelning, de matchade datapunkterna och en länk till källposten.
Inställningar
Följande inställningar styr screeningbeteendet:
Sökinställningar
- Matchningströskel (minsta likhetspoäng)
- Känslighet för matchning per term
- Riktning för delmängdsmatchning
Filtreringsinställningar
- Minsta likhetspoäng för kandidater
- Kvarhållandeperiod för PEP (månader efter avslutad position)
Poängsättningsinställningar
- Vikt för namnlikhet
- Vikt för födelsedatum
- Vikt för land
- Vikt för SSN
Aviseringar
När aviseringar skickas
- En ny PEP- eller sanktionsmatchning hittas som inte fanns i föregående screeningkörning.
- En befintlig matchning har ändrats (t.ex. uppdaterade data från sanktionslistor, ny PEP-roll).
- En tidigare matchad entitet finns inte längre i datakällan (borttagen träff).
När aviseringar INTE skickas
- Matchningen fanns redan i föregående körning och har inte ändrats.
- Matchningspoängen understiger det konfigurerade tröskelvärdet.
- Kvarhållandeperioden för PEP har löpt ut och matchningen har filtrerats bort.
- Entiteten har verifierats manuellt och avfärdats i en tidigare granskning.
Förbättringar i v3
Version 3 introducerar flera förbättringar jämfört med tidigare versioner:
- Borttagna söktak -- Tidigare versioner hade en hård gräns för antalet kandidater som returnerades från söksteget. V3 tar bort detta tak, vilket säkerställer att alla potentiella matchningar utvärderas.
- Ny delmängdslogik -- Matchningsalgoritmen använder nu dubbelriktad delmängdskontroll, så att namn med ytterligare mellannamn eller variationer matchas korrekt i båda riktningarna.
- Matchning per term -- Regeln om 75 % per term ersätter det tidigare tillvägagångssättet med matchning av hela namnet, vilket ger mer finkornig kontroll över vad som utgör en giltig matchning och minskar falska positiva träffar från partiella namnöverlappningar.
Senast uppdaterad