StriseWiki
Data

PEP- och sanktionsscreening (v.3)

Version 3 av systemet för PEP- och sanktionsscreening introducerar betydande förbättringar gällande träffsäkerhet och konfigurerbarhet. Denna artikel beskriver hur screeningflödet fungerar, tillgängliga inställningar och vad som har ändrats från tidigare versioner.

Hur screening fungerar

Screeningflödet bearbetar varje entitet genom fem steg:

  1. Förbearbetning -- Normalisera och rensa entitetsnamn.
  2. Sökning -- Hitta kandidatmatchningar i databaser för PEP och sanktioner.
  3. Filtrering -- Ta bort lågkvalitativa matchningar.
  4. Poängsättning -- Beräkna en slutgiltig matchningspoäng för varje kandidat.
  5. Användarverifiering -- Presentera resultat för mänsklig granskning.

1.1 Förbearbetning

Före sökningen normaliseras entitetsnamn för att förbättra matchningens konsekvens. Följande transformationer tillämpas:

TransformationExempel på indataExempel på utdata
Accenter tas bortRene DescartesRene Descartes
Bindestreck delas upp i separata termerAnn-BertineAnn Bertine
Icke-alfanumeriska tecken tas bortO'BrienOBrien
Titlar tas bort (personer)Dr. Jane SmithJane Smith
Bolagsformer tas bort (företag)Acme Corp ASAcme Corp

Söksteget använder två huvudsakliga matchningsregler för att hitta kandidater:

Matchningsregel per term (75 %-regeln)

Varje term i entitetsnamnet jämförs individuellt mot varje term i kandidatnamnet. En term betraktas som en matchning om den uppnår minst 75 % likhet.

Undantag för korta termer: Termer med 3 eller färre tecken kräver en exakt matchning, eftersom även små skillnader i korta termer är betydande (t.ex. ”Bo” kontra ”Ba”).

Övergripande matchningsregel

Den övergripande matchningen använder delmängdslogik: systemet kontrollerar om termerna i entitetsnamnet utgör en delmängd av kandidatnamnets termer (eller vice versa). Detta innebär:

EntitetsnamnKandidatnamnMatchning?Orsak
Anna JohansenAnna Bertine JohansenJaEntitetstermer är en delmängd av kandidattermer
Anna Bertine JohansenAnna JohansenJaKandidattermer är en delmängd av entitetstermer
Anna JohansenBertine AndersenNejInget delmängdsförhållande

En övergripande likhetspoäng beräknas därefter baserat på andelen matchade termer och deras individuella likhetspoäng.

1.3 Filtrering

Efter söksteget filtreras kandidater baserat på:

  • Likhetspoäng -- Kandidater under det konfigurerade tröskelvärdet tas bort.
  • Kvarhållandeperiod för PEP -- PEP-träffar behålls under en konfigurerbar period efter att personen lämnar sin position och filtreras därefter bort.

1.4 Poängsättning

Den slutgiltiga matchningspoängen är ett viktat aritmetiskt medelvärde av flera komponenter:

  • Namnlikhet (konfigurerbar vikt)
  • Matchning av födelsedatum (konfigurerbar vikt)
  • Landsmatchning (konfigurerbar vikt)
  • SSN-matchning (konfigurerbar vikt)

Formeln är:

score = (w_name * name_score + w_dob * dob_score + w_country * country_score + w_ssn * ssn_score)
        / (w_name + w_dob + w_country + w_ssn)

Vikter är konfigurerbara per team i screeninginställningarna.

SSN-åsidosättning: Om entitetens personnummer (SSN) matchar kandidatens SSN exakt sätts poängen automatiskt till högsta möjliga oavsett andra faktorer.

1.5 Användarverifiering

Efter poängsättningen presenteras resultaten för användaren för verifiering. Varje matchning innehåller en poänguppdelning, de matchade datapunkterna och en länk till källposten.

Inställningar

Följande inställningar styr screeningbeteendet:

Sökinställningar

  • Matchningströskel (minsta likhetspoäng)
  • Känslighet för matchning per term
  • Riktning för delmängdsmatchning

Filtreringsinställningar

  • Minsta likhetspoäng för kandidater
  • Kvarhållandeperiod för PEP (månader efter avslutad position)

Poängsättningsinställningar

  • Vikt för namnlikhet
  • Vikt för födelsedatum
  • Vikt för land
  • Vikt för SSN

Aviseringar

När aviseringar skickas

  • En ny PEP- eller sanktionsmatchning hittas som inte fanns i föregående screeningkörning.
  • En befintlig matchning har ändrats (t.ex. uppdaterade data från sanktionslistor, ny PEP-roll).
  • En tidigare matchad entitet finns inte längre i datakällan (borttagen träff).

När aviseringar INTE skickas

  • Matchningen fanns redan i föregående körning och har inte ändrats.
  • Matchningspoängen understiger det konfigurerade tröskelvärdet.
  • Kvarhållandeperioden för PEP har löpt ut och matchningen har filtrerats bort.
  • Entiteten har verifierats manuellt och avfärdats i en tidigare granskning.

Förbättringar i v3

Version 3 introducerar flera förbättringar jämfört med tidigare versioner:

  • Borttagna söktak -- Tidigare versioner hade en hård gräns för antalet kandidater som returnerades från söksteget. V3 tar bort detta tak, vilket säkerställer att alla potentiella matchningar utvärderas.
  • Ny delmängdslogik -- Matchningsalgoritmen använder nu dubbelriktad delmängdskontroll, så att namn med ytterligare mellannamn eller variationer matchas korrekt i båda riktningarna.
  • Matchning per term -- Regeln om 75 % per term ersätter det tidigare tillvägagångssättet med matchning av hela namnet, vilket ger mer finkornig kontroll över vad som utgör en giltig matchning och minskar falska positiva träffar från partiella namnöverlappningar.

Senast uppdaterad

På den här sidan