Streszczenie
VERA‑2R, ERG22+ i TRAP‑18 nie są trzema wersjami tego samego testu. Powstały dla odmiennych pytań, populacji i środowisk:
- VERA‑2R porządkuje profesjonalną ocenę i zarządzanie ryzykiem przemocowego ekstremizmu u konkretnej osoby;
- ERG22+ jest brytyjskim narzędziem formułowania zaangażowania, intencji i zdolności u sprawców ekstremistycznych w więziennictwie i probacji;
- TRAP‑18 wspiera ocenę dynamicznego zagrożenia ze strony potencjalnego samotnego sprawcy, zwłaszcza w środowisku otwartym;
- MLG‑V2 dotyczy przemocy grupowej i dodaje poziom grupy oraz jej relacji ze społeczeństwem;
- narzędzia takie jak IVP guidance, VAF, RADAR‑iTE, Radar, IR46 czy inne krajowe ramy mają własne cele: od wstępnego rozpoznania podatności po priorytetyzację spraw.
Większość publicznie opisanych narzędzi wykorzystuje ustrukturyzowany profesjonalny osąd — structured professional judgment, SPJ. Lista domen wymusza systematyczne zbieranie informacji, ale ostateczny osąd nie wynika z prostego dodania punktów. Oceniający tworzy sformułowanie mechanizmu, scenariusze, poziom pilności i plan zarządzania.
Najważniejszy wniosek z systematycznego przeglądu opublikowanego w 2025 roku jest ostrożny: istnieją obiecujące wyniki rzetelności i trafności treściowej, lecz nie ma prospektywnego badania dowodzącego trafności predykcyjnej któregokolwiek narzędzia przemocowego ekstremizmu. Przegląd nie znalazł podstaw, aby jedno narzędzie rekomendować ponad wszystkie inne dla konkretnych populacji i kontekstów.1 Nowsze badania VERA‑2R i ERG22+ powiększają wiedzę o zgodności ocen i strukturze, ale nie zmieniają instrumentów w kalkulatory zamachu.
Narzędzia:
- nie diagnozują „terrorystycznej osobowości”;
- nie wyliczają pewnego prawdopodobieństwa;
- nie zastępują informacji źródłowych;
- nie mogą być stosowane przez osobę bez szkolenia i mandatu;
- nie powinny być używane poza populacją i celem bez uzasadnienia;
- nie zwalniają z oceny praw, kultury, zdrowia, wieku i możliwych uprzedzeń;
- wymagają aktualizacji po istotnej zmianie.
Właściwy wybór zaczyna się od pytania: jaka decyzja ma zostać podjęta, wobec kogo, w jakim czasie i jaki wynik jest przedmiotem obawy? Dopiero potem wybiera się instrument, kompetencje, dane i tryb przeglądu.
Po co strukturyzować osąd
Osąd nieustrukturyzowany
Ekspert zapoznaje się ze sprawą i wydaje opinię bez jawnego protokołu. Może dostrzec niuanse, ale łatwo ulega:
- pierwszemu wrażeniu;
- efektowi potwierdzenia;
- nadmiernej wadze dramatycznego faktu;
- stereotypowi;
- różnym definicjom;
- pomijaniu ochrony;
- niepowtarzalności.
Dwie osoby mogą dojść do odmiennych wniosków i nie potrafić wskazać, dlaczego.
Metoda aktuarialna
Z góry określony algorytm łączy zmienne i przypisane im wagi, aby oszacować wynik na podstawie danych z odpowiedniej populacji. Mocą jest powtarzalność. Warunkiem są:
- wystarczająca liczba zdarzeń;
- stabilna definicja wyniku;
- próba rozwojowa i niezależna walidacja;
- podobieństwo ocenianej populacji;
- określony horyzont.
Terroryzm stawia tu wyjątkowe trudności: rzadkie wyniki, heterogeniczne drogi, niejawne dane, zmieniające się ideologie i małe próby. Większość narzędzi ekstremizmu nie jest aktuarialna.
Structured professional judgment
SPJ jest w literaturze wskazywane jako pragmatyczna odpowiedź na ograniczenia czysto aktuarialnej prognozy rzadkiej i heterogenicznej przemocy terrorystycznej.16,17 Łączy:
- określone domeny i definicje;
- systematyczne zbieranie danych;
- ocenę obecności i znaczenia czynników;
- indywidualne sformułowanie;
- scenariusze;
- profesjonalny osąd końcowy;
- plan zarządzania.
Osąd pozostaje, ale ma być przejrzysty i możliwy do audytu.
Struktura nie gwarantuje trafności
Formularz może:
- zawierać nietrafne elementy;
- być użyty poza zakresem;
- mieć niejasne definicje;
- otrzymać słabe dane;
- zostać mechanicznie zsumowany;
- utrwalać uprzedzenia.
„Ustrukturyzowane” nie znaczy automatycznie „zwalidowane”.
Ryzyko, zagrożenie, podatność i potrzeba
Ocena ryzyka
Zwykle dotyczy przyszłego wyniku w określonym czasie, na przykład ponownego przemocowego zaangażowania po zwolnieniu.
Threat assessment
Koncentruje się na aktualnej drodze do zamierzonej przemocy:
- czy pojawia się cel;
- zamiar;
- przygotowanie;
- zdolność;
- pilność.
Jest dynamiczne i zarządcze. TRAP‑18 należy przede wszystkim do tego świata.
Ocena podatności
Dotyczy potrzeby wsparcia albo wpływu rekrutera, niekoniecznie intencji czynu. Wczesne ramy Prevent lub Channel nie powinny być przedstawiane jako odpowiedniki sądowej prognozy przemocy.
Ocena potrzeb
Pyta, co należy zmienić:
- relacje;
- mieszkanie;
- trauma;
- ideologiczne uzasadnienie;
- zdolność regulacji;
- kontakt z grupą.
Potrzeba może być duża przy małym aktualnym zagrożeniu.
Ten sam formularz nie odpowiada na wszystko
Wynik „wymaga intensywnej pomocy” nie oznacza:
- wysokiego prawdopodobieństwa zamachu;
- podstawy zatrzymania;
- niezdolności do zwolnienia;
- diagnozy.
Każdy raport musi nazywać pytanie decyzyjne.
Jak czytać badania walidacyjne
Rzetelność między oceniającymi
Inter-rater reliability odpowiada:
czy dwie osoby, mając te same informacje i reguły, podobnie kodują przypadek?
Wysoka zgodność nie dowodzi, że obie mają rację o przyszłości. Mogą konsekwentnie stosować nietrafny wskaźnik.
Rzetelność tego samego oceniającego
Intra-rater reliability bada stabilność kodowania przez tę samą osobę przy powtórzeniu. Zbyt wysoka stabilność nie jest zaletą, jeśli przypadek realnie się zmienił; badanie musi odróżniać powtarzalność od aktualizacji.
Trafność treściowa
Czy domeny obejmują zjawiska uznawane za istotne? Przykład sprawcy, u którego można odnaleźć większość pozycji, pokazuje dopasowanie treści, ale nie dowodzi, że pozycje odróżniają go od podobnych osób bez przemocy.
Trafność konstruktu
Czy empiryczna struktura danych odpowiada zakładanym domenom? Jeżeli pozycje z domeny „intencja” nie grupują się razem, może to oznaczać:
- złą strukturę;
- współzależność procesów;
- problem próby;
- niewłaściwe użycie sum.
SPJ nie musi zachowywać się jak jednowymiarowy test, więc miary wewnętrznej spójności trzeba interpretować ostrożnie.
Trafność zbieżna
Czy narzędzia mierzące podobny konstrukt dają podobne wyniki? Brak zbieżności może wynikać z tego, że naprawdę mierzą coś innego.
Trafność różnicowa
Czy narzędzie odróżnia:
- sprawców i nie-sprawców;
- przemoc i poglądy;
- grupę i samotnego aktora;
- ideologie;
- poziomy pilności?
Bez odpowiedniej grupy porównawczej łatwo badać tylko zgodność narzędzia z przypadkami, dla których je stworzono.
Trafność retrospektywna
Postdictive validity polega na kodowaniu przypadków, których wynik już jest znany, i sprawdzaniu, czy wskaźniki odróżniają grupy. Oceniający może być nieświadomy wyniku, ale dokumenty powstałe po zdarzeniu są bogatsze niż informacje dostępne wcześniej.
Trafność prospektywna
Najmocniejsze pytanie brzmi:
czy ocena wykonana przed wynikiem trafnie różnicuje późniejsze zdarzenia w realnej praktyce?
Przegląd z 2025 roku nie znalazł takiego dowodu dla żadnego narzędzia przemocowego ekstremizmu.1
Użyteczność kliniczna i zarządcza
Narzędzie może być użyteczne, nawet jeśli nie przewiduje dokładnie:
- porządkuje rozmowę;
- ujawnia brak danych;
- tworzy wspólny język;
- identyfikuje cele interwencji;
- dokumentuje zmianę.
Nie wolno jednak zamieniać użyteczności w twierdzenie o potwierdzonej predykcji.
Porównanie w skrócie
Wcześniejsze porównania praktyczne siedmiu narzędzi również wykazywały różnice celu, odbiorców, konstrukcji i wymagań szkoleniowych, dlatego podobna nazwa domeny nie powinna przesłaniać odmienności instrumentów.15
| Narzędzie | Główne pytanie | Typowy kontekst | Poziom | Rodzaj wyniku |
|---|---|---|---|---|
| VERA‑2R | jakie czynniki wspierają i ograniczają ryzyko przemocowego ekstremizmu | sąd, więzienie, probacja, sprawa indywidualna | osoba w kontekście | profesjonalny osąd i plan |
| ERG22+ | jak sformułować zaangażowanie, intencję i zdolność sprawcy ekstremistycznego | HMPPS, więzienie i probacja | osoba | sformułowanie potrzeb i ryzyka |
| TRAP‑18 | czy samotny aktor wykazuje dystalne cechy i proksymalne warning behaviors | threat assessment w społeczności | osoba–cel | aktywne zarządzanie lub monitorowanie |
| MLG‑V2 | jak jednostka, grupa i otoczenie współtworzą przemoc grupową | gangi, grupy ideologiczne, przemoc zbiorowa | wiele poziomów | scenariusze przemocy grupowej |
| IVP guidance | jakie cechy występują u osób identyfikowanych jako podatne na przemoc ideologiczną | wczesne rozpoznanie | osoba | strukturyzacja podatności |
| VAF/Channel | jakie potrzeby i czynniki powinny kierować dobrowolnym wsparciem | brytyjski Prevent/Channel | osoba | decyzja i plan wsparcia |
| RADAR‑iTE i podobne | jak priorytetyzować lub klasyfikować określoną populację krajową | policja lub bezpieczeństwo | zależnie od wersji | poziom lub kategoria sprawy |
Tabela pokazuje funkcję, nie rekomendację. Nazwa „risk tool” nie czyni wyników wymiennymi.
VERA‑2R
Geneza i cel
Violent Extremism Risk Assessment powstało jako próba przeniesienia zasad SPJ do przemocy politycznej i ideologicznej. Wersja 2 Revised rozwija protokół w kierunku:
- oceny indywidualnej;
- sformułowania ryzyka;
- zarządzania;
- uwzględnienia czynników ochronnych;
- powtarzanej oceny.
Oficjalny opis wyraźnie zaznacza, że VERA‑2R nie generuje liczbowego prawdopodobieństwa przyszłego działania.2
Populacja
Narzędzie przeznaczono dla osób podejrzanych, oskarżonych, skazanych albo objętych oceną z powodu przemocowego ekstremizmu. Nie jest:
- screeningiem całej populacji;
- testem uczniów;
- kwestionariuszem internetowym;
- skalą poglądów;
- samodzielną diagnozą kliniczną.
Warunki użytkowania wymagają profesjonalnego mandatu, wiedzy i dostatecznej obiektywnej informacji.3
Domeny
34 wskaźniki ryzyka i ochrony są grupowane w pięciu domenach:
- przekonania, postawy i ideologia;
- kontekst społeczny i intencja;
- historia, działanie i zdolność;
- zaangażowanie i motywacja;
- czynniki ochronne i ograniczające ryzyko.
Narzędzie zawiera także 11 wskaźników dodatkowych dotyczących między innymi historii osobistej, przestępczości i zdrowia, które nabierają znaczenia w połączeniu z domenami specyficznymi dla ekstremizmu.2
Czego nie oznacza domena ideologii
Nie ocenia się, czy pogląd jest popularny albo religijnie ortodoksyjny. Istotne są:
- usprawiedliwienie przemocy;
- wróg i jego odczłowieczenie;
- krzywda;
- związek przekonania z osobistą intencją.
Wysoka pobożność bez przemocy nie powinna podnosić oceny.
Ochrona
Osobna domena jest istotną zaletą. Ochrona nie jest prostym minusem odejmowanym od ryzyka. Ocenia się jej:
- realność;
- stabilność;
- dostępność;
- odporność na kryzys;
- związek ze scenariuszem.
Praca chroni tylko przez funkcję, którą rzeczywiście pełni.
Informacje
Dobra ocena może korzystać z:
- akt;
- wywiadu;
- danych penitencjarnych;
- informacji probacji;
- źródeł dodatkowych;
- konsultacji.
Brak danych powinien pozostać brakiem, nie automatycznym „niskim” wynikiem.
Kwalifikacje
Oficjalne zasady wymagają ukończenia certyfikowanego szkolenia. Użytkownik ma:
- doświadczenie zawodowe;
- mandat organizacji;
- rozumienie SPJ;
- zdolność wyjaśnienia ograniczeń;
- dostęp do odpowiednich danych.3
Certyfikat nie zastępuje bieżącej praktyki. Badanie użytkowników ze Szwecji, Belgii i Niderlandów pokazało, że część wyszkolonych specjalistów rzadko stosowała narzędzie, a superwizja, interwizja, szkolenia odświeżające i przepływ informacji były nierówne.4
Rzetelność
Badanie dwóch oceniających kodujących 30 niderlandzkich spraw z akt wykazało na ogół wysoką stabilność i zgodność, ale warunki były kontrolowane, a drugi oceniający znał źródła użyte przez pierwszego.5 Autorzy sami wskazali potrzebę sprawdzenia zgodności w zwykłej praktyce z wywiadami i różnymi profesjonalistami.
Australijskie badanie 50 spraw, kodowanych przez dwóch przeszkolonych autorów, wykazało dobrą zgodność między oceniającymi, ale niską trafność predykcyjną w przyjętej analizie.6 To dobre przypomnienie: rzetelność i trafność są osobnymi własnościami.
Ograniczenia
- dużo zależy od jakości akt;
- część domen może się nakładać;
- kontekst kulturowy wpływa na interpretację;
- brak danych może być nierówny między sprawami;
- narzędzie wymaga czasu;
- różne organizacje używają raportu do różnych decyzji;
- transfer wyniku między sądem, więzieniem i probacją może zniekształcać sens.
Najlepsze zastosowanie
VERA‑2R jest najbardziej przekonujące jako:
- mapa indywidualnych czynników;
- wspólny język;
- struktura sformułowania;
- podstawa planu;
- rama aktualizacji.
Najmniej przekonujące jest przedstawianie jego końcowej kategorii jako empirycznie skalibrowanego procentu.
ERG22+
Geneza
Extremism Risk Guidelines 22+ zostało opracowane w brytyjskim systemie więziennym na podstawie pracy ze skazanymi za ekstremizm, następnie używane w więziennictwie i probacji Anglii i Walii od 2011 roku.7 Jest elementem szerszego systemu oceny i interwencji, nie produktem do swobodnego użycia poza nim.
Cel: formulation
ERG22+ służy sformułowaniu:
- dlaczego osoba zaangażowała się;
- co podtrzymuje intencję;
- jaką ma zdolność;
- jakie potrzeby trzeba adresować;
- co może zmienić ryzyko.
Nie jest prostym testem recydywy.
Trzy domeny
22 czynniki są organizowane wokół:
- Engagement — procesów i potrzeb wiążących z grupą, sprawą lub ideologią;
- Intent — gotowości, nastawienia i dążenia do szkodliwego działania;
- Capability — zdolności umożliwiających realizację.
W praktyce uwzględnia się też czynniki ochronne i inne szczególne elementy przypadku; znak „+” przypomina o możliwości istotnych czynników poza podstawową listą.
Populacja i kontekst
Typowym przedmiotem jest:
- sprawca terrorystyczny;
- sprawca przestępstwa powiązanego z ekstremizmem;
- więzień budzący uzasadnione obawy;
- osoba przechodząca do probacji.
Przeniesienie ERG22+ do powszechnego screeningu młodzieży lub społeczności byłoby zmianą celu, której nie uzasadnia sama popularność narzędzia.
Powiązanie z interwencją
Domeny mogą kierować:
- Healthy Identity Intervention;
- Desistance and Disengagement Programme;
- planem więziennym;
- warunkami zwolnienia;
- wsparciem probacyjnym.
Ta funkcja jest mocna, jeżeli sformułowanie wskazuje mechanizm. Słaba, jeśli rezultat ogranicza się do etykiety.
Rzetelność badawcza i terenowa
Badanie z 2019 roku rozdzieliło:
- warunki badawcze z doświadczonymi oceniającymi;
- warunki terenowe z praktykami po szkoleniu.
W przeglądzie systematycznym średnia ważona kappa ekspertów kodujących 50 spraw wyniosła 0,93. U 33 praktyków oceniających dwa przypadki współczynniki terenowe wyniosły około 0,47 i 0,59; doświadczeni użytkownicy radzili sobie lepiej w jednym przypadku.1,8 Narzędzie może zatem wyglądać znacznie rzetelniej w rękach twórców i ekspertów niż w rutynie.
Struktura psychometryczna
Analiza danych ERG22+ wykazała przyzwoitą spójność całego zestawu, lecz niektóre podskale miały bardzo niską spójność, a analiza wymiarów nie potwierdziła jednoznacznie zakładanej struktury Engagement–Intent–Capability.1,9
Nie musi to unieważniać SPJ. Oznacza jednak, że:
- nie należy traktować domen jak jednorodnych testów;
- sumy mogą być mylące;
- ważniejsze jest sformułowanie niż ranking liczbowy.
Mocne strony
- bliski związek z praktyką penitencjarną;
- wspólny język więzienia i probacji;
- bezpośrednie połączenie z potrzebami;
- oficjalne badania na aktach;
- możliwość aktualizacji.
Ograniczenia
- rozwój w specyficznym brytyjskim systemie;
- przewaga spraw inspirowanych islamizmem w części badań;
- ograniczony publiczny dostęp do pełnych definicji;
- zmienna zgodność terenowa;
- ryzyko użycia domen jako punktów;
- brak prospektywnej trafności predykcyjnej.
ERG22+ a VERA‑2R
Oba narzędzia dotyczą przemocowego ekstremizmu i SPJ, ale nie są wymienne:
- VERA‑2R ma jawnie wydzieloną domenę ochrony i szerszą międzynarodową implementację;
- ERG22+ jest silnie osadzone w HMPPS i sformułowaniu penitencjarnym;
- mają różne definicje, szkolenia i format wyniku.
Nie wolno wybrać kilku pozycji z jednego i kilku z drugiego, zachowując nazwę któregokolwiek.
TRAP‑18
Cel
Terrorist Radicalization Assessment Protocol‑18 jest protokołem SPJ dla zagrożenia ze strony samotnego aktora. Wspiera:
- priorytetyzację spraw;
- rozpoznanie zmian;
- aktywne zarządzanie;
- monitorowanie.
Nie jest testem penitencjarnym ani ogólnym miernikiem deradykalizacji.
Dwa poziomy
TRAP‑18 obejmuje:
- osiem proksymalnych warning behaviors — zmian bliższych w czasie i bardziej dynamicznych;
- dziesięć dystalnych characteristics — cech i warunków dalszych od możliwego czynu.
Pełne definicje wymagają podręcznika i szkolenia. Publiczne omówienie nie powinno zamieniać ich w instrukcję omijania rozpoznania.
Logika
Same cechy dystalne sugerują potrzebę monitorowania i gromadzenia danych. Pojawienie się proksymalnego wzorca może wymagać aktywnego zarządzania. Nie istnieje empiryczny cut-off liczby pozycji, po którego przekroczeniu osoba „zostaje terrorystą”. Autorzy podkreślają, że TRAP‑18 nie jest testem psychologicznym ani instrumentem aktuarialnym.10
Populacja
Najlepiej odpowiada:
- osobie działającej bez formalnego kierownictwa grupy;
- przypadkowi w środowisku otwartym;
- ocenie targeted violence;
- krótszemu horyzontowi dynamicznemu.
Samotny sprawca może mieć relacje internetowe, inspiratorów i kontakty; „samotny” nie znaczy społecznie odłączony.
Informacje
Ocena może wykorzystywać:
- wywiad;
- informacje od bliskich;
- akta;
- dane policyjne;
- komunikację publiczną;
- oś zachowania.
Badanie wykazało, że w publicznych danych o 77 sprawach wiele pozycji było niekodowalnych; dla około połowy pozycji brak występował częściej niż rozstrzygnięcie, a średnio nie można było zakodować połowy protokołu.1 Open source nie zastępuje pełnej oceny.
Rzetelność i treść
TRAP‑18 ma największą liczbę publikacji spośród narzędzi ujętych w przeglądzie z 2025 roku, ale wiele to:
- studia pojedynczych przypadków;
- retrospektywne kodowanie;
- dane publiczne;
- małe próby.
Badania potwierdzają, że wiele domen można odnaleźć w historiach sprawców oraz że dystalne charakterystyki często poprzedzały proksymalne zachowania.1,11 To wsparcie modelu treści i sekwencji, nie dowód prospektywnej prognozy.
Retrospektywne różnicowanie
Metaanaliza czterech badań retrospektywnych dała dużą zbiorczą korelację z przemocą, ale wyniki były bardzo heterogeniczne, próby małe, a outcome znany historycznie. Przegląd uznał rezultat za obiecujący i wstępny, nie za prawdziwą trafność predykcyjną.1
Ochrona
TRAP‑18 nie ma osobnej pełnej domeny czynników ochronnych takiej jak VERA‑2R. Brak części wskaźników może obniżać niepokój, lecz dobra praktyka threat management i tak musi jawnie opisać:
- hamulce;
- relacje;
- alternatywy;
- utratę dostępu;
- gotowość do pomocy.
Ograniczenia
- wąski cel samotnego aktora;
- ryzyko retrospekcji;
- brak wartości progowej;
- niepełne dane open source;
- pozycje dystalne bywają nieswoiste;
- kultura i jurysdykcja wpływają na widoczność;
- brak prospektywnego testu.
TRAP‑18 a „Ocena zagrożenia ze strony samotnego sprawcy”
Następny artykuł omawia ocenę samotnego sprawcy szerzej: relację osoba–cel, komunikację, grievance, oś czasu i zarządzanie. Tutaj najważniejsza jest granica: TRAP‑18 nie zastępuje całego procesu threat assessment.
MLG‑V2
Inne pytanie
Multi-Level Guidelines Version 2 dotyczy ryzyka przemocy grupowej. Nie jest wyłącznie „dłuższym VERA”.
Cztery poziomy
16 czynników jest organizowanych wokół:
- jednostki;
- jednostki w grupie;
- grupy;
- grupy w społeczeństwie.
To ważne, gdy przemoc zależy od:
- norm;
- przywództwa;
- rywalizacji;
- pozycji;
- konfliktu międzygrupowego;
- sposobności zbiorowej.
Oficjalne brytyjskie omówienia narzędzi potwierdzają cztery domeny i zastosowanie SPJ do przemocy grupowej.12
Populacje
MLG‑V2 może wspierać analizę:
- gangów;
- grup przestępczych;
- ekstremistycznych organizacji;
- sekt;
- przemocy zbiorowej.
Nie każda grupa polityczna jest grupą przemocy.
Relacja z VERA
Badania niewielkiej liczby przypadków wskazały, że wiele pozycji VERA pokrywa się z indywidualnymi częściami MLG‑V2, ale VERA słabiej reprezentuje domenę samej grupy i jej relacji ze społeczeństwem.1,13
Brak pełnej zbieżności nie musi oznaczać, że jedno narzędzie jest błędne. Mierzą różne poziomy.
Ograniczenia
- bardzo mała baza walidacyjna;
- ogólna przemoc grupowa nie jest identyczna z terroryzmem;
- potrzeba danych o grupie, nie tylko o jednostce;
- wynik może stać się niesprawiedliwą odpowiedzialnością zbiorową, jeśli relacje nie są analizowane indywidualnie.
IVP guidance
Cel
Identifying Vulnerable People guidance zostało stworzone jako rama wczesnego rozpoznania osób podatnych na przemoc ideologiczną. W przeglądzie empirycznym narzędzie miało 16 pozycji i próbę obejmującą różne typy spraw.1
Wczesne rozpoznanie a prognoza
IVP nie powinno być interpretowane jak sądowy test przyszłego ataku. Słowo „vulnerable” dotyczy:
- wpływu;
- podatności;
- potrzeb;
- procesu.
Dowody
Jedno badanie wykazało średnią zgodność między oceniającymi na poziomie około 0,80 w kodowanej części próby, ale spójność wewnętrzna całego zestawu wyniosła około 0,64 i mocno różniła się między grupami. Dla niektórych typów przemocy była szczególnie niska.1
Ograniczenia
- heterogeniczne populacje;
- niejednorodny konstrukt;
- ryzyko pomieszania poglądu i przemocy;
- brak prospektywnej predykcji.
VAF i Channel
Vulnerability Assessment Framework
Brytyjski Channel korzystał z ram czynników powiązanych z:
- engagement;
- intent;
- capability.
Podobieństwo do ERG22+ nie czyni VAF jego równoważnym zastosowaniem. Channel ma charakter prewencyjny i wsparciowy, a ERG22+ powstało w systemie sprawców.
Decyzja o wsparciu
Rama powinna pomagać odpowiedzieć:
- czy istnieje podatność na wejście w przemoc;
- jakie wsparcie jest właściwe;
- czy skierowanie do Channel jest zasadne;
- kiedy sprawę zamknąć.
Nie powinna służyć do:
- karania poglądu;
- diagnozy;
- automatycznego uzasadniania nadzoru;
- kopiowania kategorii do innych instytucji bez celu.
Krytyka
Wczesne systemy są szczególnie podatne na:
- profilowanie;
- słabe zgłoszenia;
- różne progi szkół i ochrony zdrowia;
- nierówności etniczne i religijne;
- trwałość danych mimo braku sprawy.
Ich jakość zależy bardziej od triage, szkolenia i możliwości odrzucenia zgłoszenia niż od samej listy.
RADAR‑iTE, Radar, IR46 i inne ramy
RADAR‑iTE
Niemiecki RADAR‑iTE został opracowany do oceny ostrego ryzyka osób powiązanych z islamistycznym terroryzmem i priorytetyzacji policyjnej. Taki instrument:
- działa w określonej jurysdykcji;
- wykorzystuje określone dane;
- ma węższą populację;
- nie powinien być przenoszony na wszystkie ideologie bez walidacji.
Radar
Nazwa może odnosić się do innych ram oceny. Instytucja musi podać:
- pełną wersję;
- autorów;
- datę;
- podręcznik;
- cel;
- populację.
Samo „użyto Radar” jest nieweryfikowalne.
IR46
Islamic Radicalisation‑46 jest checklistą opartą na wielu wskaźnikach możliwej radykalizacji islamistycznej. Liczba pozycji może sugerować precyzję, ale:
- więcej nie znaczy trafniej;
- ideologiczna swoistość ogranicza transfer;
- szerokie wskaźniki generują fałszywe alarmy;
- suma nie jest dowodem zamiaru.
RAN Returnee 45 i podobne
Ramy dla powracających zagranicznych bojowników mają wspierać:
- zebranie informacji;
- ocenę potrzeb;
- bezpieczeństwo;
- dzieci i rodzinę;
- reintegrację.
Nie można z nich tworzyć jednego wyniku dla wszystkich członków rodziny.
Der Screener — Islamismus
W przeglądzie z 2025 roku był wyjątkiem jako narzędzie aktuarialne wśród protokołów SPJ. Badanie było ograniczone do małej liczby spraw i określonego środowiska językowego; jego algorytmiczna natura nie usuwa problemu transferu.1
Narzędzia niepubliczne
Brak pełnego podręcznika może wynikać z bezpieczeństwa i licencji, ale utrudnia:
- niezależną walidację;
- kontrolę sądową;
- porównanie;
- wykrywanie uprzedzeń;
- zrozumienie wyniku przez osobę.
Tajemnica operacyjna nie powinna być mylona z potwierdzeniem naukowym.
Narzędzia ogólnej przemocy
HCR‑20 i podobne
Ocena ekstremizmu nie usuwa ryzyka:
- przemocy ogólnej;
- domowej;
- psychotycznej;
- impulsywnej;
- kryminalnej.
Narzędzie ogólnej przemocy może być potrzebne równolegle, jeśli odpowiada na odrębne pytanie.
Nie sumować wyników
VERA‑2R i HCR‑20 nie tworzą przez dodanie „podwójnie dokładnej” liczby. Raport powinien rozdzielić:
- scenariusz ekstremistyczny;
- scenariusz ogólnej przemocy;
- wspólne czynniki;
- różne czynniki;
- plan dla każdego.
Kliniczne narzędzia
Skale depresji, psychozy, traumy czy osobowości:
- opisują objaw lub konstrukt;
- nie mierzą terroryzmu;
- nie mogą zastąpić analizy ideologii, sieci i zachowania.
Diagnoza psychiatryczna nie jest pozycją końcową „wysokiego ekstremizmu”.
Dlaczego narzędzi nie wolno mieszać
Różne definicje
To samo słowo może oznaczać różne rzeczy. „Zaangażowanie” w ERG22+ nie jest automatycznie tą samą zmienną co „commitment” VERA‑2R.
Różne mianowniki
Narzędzie rozwinięte na:
- skazanych;
- podejrzanych;
- samotnych sprawcach;
- osobach skierowanych do wsparcia
dziedziczy cechy tej populacji.
Różne horyzonty
TRAP‑18 interesuje dynamika zbliżająca do targeted violence. ERG22+ może wspierać dłuższy plan więzienny. Jeden „poziom” nie odpowiada temu samemu okresowi.
Różne wyniki
- akt przemocy;
- ponowne przestępstwo;
- afiliacja;
- podatność;
- potrzeba interwencji
nie są wymienne.
Eklektyczny formularz traci walidację
Instytucja wybiera „najlepsze pozycje” z kilku narzędzi. Powstaje nowe narzędzie, dla którego:
- nie ma podręcznika;
- nie ma rzetelności;
- nie ma walidacji;
- nie ma zasad interpretacji.
Można korzystać z kilku pełnych ocen dla różnych pytań, ale trzeba je raportować osobno.
Jak wybrać narzędzie
Europejskie zalecenia praktyczne odróżniają screening od pełnej oceny i każą zaczynać od celu, kwalifikacji oceniającego oraz miejsca osoby w procesie.18
Krok 1: decyzja
Czy chodzi o:
- zwolnienie;
- warunki probacji;
- plan interwencji;
- pilność zagrożenia;
- wsparcie w społeczności;
- priorytetyzację policyjną;
- ocenę grupy?
Krok 2: wynik
Co ma się wydarzyć:
- atak;
- ponowne zaangażowanie;
- przemoc dowolna;
- naruszenie;
- wejście do sieci?
Krok 3: populacja
- dorosły czy dziecko;
- skazany czy nieskazany;
- samotny aktor czy członek grupy;
- więzienie czy społeczność;
- jaka ideologia;
- jaki kraj.
Krok 4: horyzont
- godziny;
- tygodnie;
- okres zwolnienia;
- kilka lat.
Krok 5: dane
Czy dostępne są:
- akta;
- wywiad;
- osoby trzecie;
- informacja niejawna;
- chronologia;
- dane o wyniku?
Krok 6: kompetencje
- certyfikacja;
- doświadczenie;
- superwizja;
- wiedza kulturowa;
- znajomość prawa;
- zdolność pisania opinii.
Krok 7: dowody
Instytucja powinna sprawdzić:
- wersję narzędzia;
- badania tej populacji;
- niezależność autorów;
- rzetelność terenową;
- trafność;
- ograniczenia;
- konflikty interesów.
Krok 8: proporcjonalność
Im bardziej dolegliwa decyzja, tym:
- mocniejsze dane;
- większa kontrola;
- lepsza możliwość odwołania;
- wyższy standard uzasadnienia.
Minimalne kwalifikacje użytkownika
Szkolenie narzędziowe
Obejmuje:
- definicje;
- kodowanie;
- przypadki;
- brak danych;
- sformułowanie;
- raport;
- zarządzanie;
- ograniczenia.
Wiedza dziedzinowa
Potrzebna jest znajomość:
- terroryzmu;
- procesów radykalizacji;
- różnych ideologii;
- więziennictwa lub threat assessment;
- praw człowieka;
- błędów poznawczych.
Wiedza o populacji
Praca z:
- dzieckiem;
- osobą z psychozą;
- powracającym bojownikiem;
- kobietą zmuszoną przez partnera;
- liderem grupy
wymaga różnych kompetencji dodatkowych.
Superwizja i kalibracja
Organizacja powinna zapewnić:
- wspólne kodowanie;
- omówienie rozbieżności;
- okresowe sprawdzanie zgodności;
- szkolenie odświeżające;
- audyt raportów;
- aktualizację po zmianie wersji.
Jednorazowy certyfikat nie utrzymuje jakości przez lata bez praktyki.
Jakość danych
Triangulacja
Łączy:
- samoopis;
- zachowanie;
- akta;
- informacje niezależne;
- chronologię.
Nie oznacza automatycznego uznania instytucji za bardziej wiarygodną niż osoba. Każde źródło ma błędy.
Dane open source
Są selektywne:
- media opisują niezwykłe fakty;
- powtarzają błędy;
- znają wynik;
- pomijają ochronę;
- nie mają wywiadu.
Dobre do badań wstępnych, słabsze jako jedyna podstawa decyzji.
Brak danych
Powinien być kodowany jako:
- brak;
- nieustalone;
- sprzeczne,
zgodnie z podręcznikiem. Brak nie jest ochroną ani ryzykiem.
Informacja niejawna
Może zwiększać wiedzę, ale:
- osoba nie może jej skorygować;
- oceniający może nie znać źródła;
- sąd ma ograniczoną kontrolę;
- partnerzy nie mogą zobaczyć uzasadnienia.
Raport powinien oddzielać fakty możliwe do ujawnienia od wniosków opartych na materiale chronionym.
Aktualność
Ocena sprzed dwóch lat nie opisuje:
- nowych relacji;
- zmiany zamiaru;
- leczenia;
- konfliktu;
- utraty dostępu;
- przygotowania.
Każdy raport ma datę ważności zależną od kontekstu, nie magiczny okres.
Od pozycji do sformułowania
Lista faktów
Nie wystarcza:
obecne: 17 czynników.
Mechanizm
Lepsze sformułowanie:
po utracie statusu osoba odzyskuje znaczenie w małej sieci, która przedstawia przemoc jako obowiązek; nowa rola i dostęp zwiększają zdolność, natomiast relacja rodzinna i moralny zakaz wobec cywilów pozostają hamulcami.
Scenariusz
Raport opisuje:
- jaki wynik;
- wobec kogo;
- w jakich warunkach;
- przez jaki mechanizm;
- z jaką pilnością.
Zarządzanie
Każdy czynnik powinien prowadzić do pytania:
- można go zmienić;
- ograniczyć;
- monitorować;
- zrekompensować;
- czy jest historyczny?
Ochrona
Nie jest dekoracyjnym akapitem. Plan określa:
- jak ją utrzymać;
- co może ją osłabić;
- jak rozpoznać utratę;
- czym ją zastąpić.
Raport końcowy
Pytanie zleceniodawcy
Musi być konkretne i mieścić się w mandacie.
Źródła
- daty;
- dostęp;
- ograniczenia;
- informacje niepotwierdzone;
- odmowa wywiadu.
Metoda
- pełna nazwa;
- wersja;
- cel;
- kwalifikacje;
- data oceny.
Sformułowanie
- mechanizm;
- scenariusze;
- zmienność;
- ochrona.
Osąd
Nie sama etykieta „niski/średni/wysoki”, lecz:
- czego dotyczy;
- w jakim czasie;
- przy jakich warunkach;
- z jaką pewnością.
Plan
- działania;
- odpowiedzialni;
- termin;
- próg eskalacji;
- próg obniżenia;
- ponowna ocena.
Ograniczenia
Raport powinien powiedzieć wprost:
- czego narzędzie nie przewiduje;
- jak wpływa brak danych;
- czy populacja różni się od walidacyjnej;
- jakie są alternatywne wyjaśnienia.
Powtarzana ocena
Kiedy
- przed zwolnieniem;
- po zwolnieniu;
- po transferze;
- po nowej informacji;
- po istotnej interwencji;
- po kryzysie;
- przed zmianą decyzji.
Nie przepisywać
Aktualizacja wskazuje:
- co zmieniono;
- dlaczego;
- co pozostało;
- które źródło jest nowe;
- jak zmienił się scenariusz.
Historia nie znika
Czynnik historyczny pozostaje faktem, ale jego znaczenie może się zmienić. Dawna zdolność bez obecnego dostępu nie jest tym samym co zdolność operacyjna dziś.
Wynik może wzrosnąć i spaść
SPJ nie jest wyrokiem osobowości. Jeżeli raport nigdy nie pozwala obniżyć oceny, narzędzie działa jako sankcja.
Kultura, religia i ideologia
Błąd tłumaczenia
Termin religijny może zostać:
- wyrwany z kontekstu;
- błędnie przełożony;
- utożsamiony z przemocą;
- oceniony asymetrycznie.
Potrzebna jest kompetencja, ale ekspert kulturowy nie rozstrzyga zamiaru sam.
Legalny radykalizm
Odrzucenie polityki państwa, rewolucyjny pogląd, separatyzm albo religijny konserwatyzm mogą być legalne. Pozycja musi dotyczyć przemocy lub mechanizmu, nie konformizmu.
Adaptacja
Przetłumaczenie podręcznika nie jest pełną walidacją kulturową. Potrzebne są:
- znaczenie pozycji;
- rzetelność;
- trafność;
- różne grupy;
- analiza błędu.
Różne ideologie
Narzędzie rozwinięte głównie na dżihadyzmie może zawierać ogólne mechanizmy, ale musi być sprawdzone dla:
- skrajnej prawicy;
- skrajnej lewicy;
- przemocy jednej sprawy;
- motywów mieszanych.
Nie wystarczy zamienić nazwę wroga.
Płeć, wiek i przymus
Kobiety
Mała reprezentacja kobiet w badaniach ogranicza pewność. Te same zachowania mogą mieć inne znaczenie przy:
- przymusie partnera;
- opiece nad dziećmi;
- wykorzystaniu;
- roli logistycznej;
- autonomicznej intencji.
Dzieci
Przegląd z 2025 roku wskazał, że ujęte badania dotyczyły dorosłych; nie było próby dzieci i nastolatków.1 Narzędzia dorosłych nie powinny być automatycznie używane do:
- decyzji szkolnych;
- odpowiedzialności dziecka;
- rozwojowej interpretacji;
- rodzinnego screeningu.
Osoby przymuszone
Obecność w grupie może wynikać z:
- porwania;
- groźby;
- zależności;
- dziecięcego wieku;
- małżeństwa;
- braku drogi wyjścia.
Ocena musi oddzielić rolę, intencję, odpowiedzialność i potrzebę ochrony.
Etyka i prawo
Skutek decyzji
Narzędzie może wpływać na:
- wolność;
- długość kontroli;
- kontakt z dziećmi;
- mieszkanie;
- reputację;
- deportację;
- dostęp do programu.
Im większy skutek, tym mocniejsza kontrola metodologiczna.
Prawo do informacji
W możliwym prawnie zakresie osoba powinna wiedzieć:
- jaki jest cel;
- jakie dane użyto;
- jak skorygować błąd;
- co oznacza wynik;
- kiedy nastąpi przegląd.
Nie dyscyplinować poglądu
Narzędzie nie może być karą za:
- religię;
- krytykę;
- odmowę zgody z prowadzącym;
- legalną aktywność.
Konflikt ról
Terapeuta, który jednocześnie leczy i przygotowuje raport dla sądu, powinien jawnie określić:
- poufność;
- odbiorcę;
- granice;
- konsekwencje.
Kontrola
Potrzebne są:
- drugi oceniający w trudnych sprawach;
- superwizja;
- audyt;
- skarga;
- korekta;
- retencja danych;
- rejestr decyzji.
Najnowszy stan dowodów
Przegląd z 2016 roku
Scarcella i współautorzy stwierdzili, że jakość raportowania i psychometria nie pozwalały rekomendować jednego narzędzia ponad inne.14
Przegląd Campbell z 2025 roku
Objął 20 badań sześciu narzędzi:
- TRAP‑18;
- ERG22+;
- MLG‑V2;
- IVP guidance;
- VERA;
- Der Screener — Islamismus.
Łącznie badania dotyczyły 1106 uczestników, przeważnie dorosłych mężczyzn. Średnia próba była niewielka; wiele badań korzystało z danych publicznych, a żadne nie było prospektywne.1
Co było obiecujące
- dobra zgodność w części warunków badawczych;
- obecność istotnych domen w sprawach;
- pewne różnicowanie retrospektywne TRAP‑18;
- rozwój badań ERG22+ i VERA‑2R;
- wartość w identyfikacji celów zarządzania.
Co pozostaje słabe
- rzetelność terenowa może być niższa;
- podskale nie zawsze są spójne;
- struktury empiryczne nie zawsze odpowiadają teoriom;
- mało grup porównawczych;
- dominacja danych retrospektywnych;
- brak prawdziwej predykcji prospektywnej;
- mało kobiet i brak dzieci;
- brak niezależnej replikacji w wielu kontekstach.
Nowsze publikacje
Przegląd miał formalną datę graniczną wyszukiwania 31 grudnia 2021 roku, a późniejsze prace omówił pomocniczo. Od tego czasu pojawiły się między innymi badania:
- VERA‑2R na sprawach niderlandzkich;
- VERA‑2R w próbie australijskiej;
- większej próby ERG22+;
- TRAP‑18 w nowych populacjach.
Autorzy przeglądu uznali, że prace te nie zmieniają głównego wniosku o braku prospektywnej trafności.1
Hipotetyczne wybory
Przypadek A: zwolnienie skazanego
Pytanie:
jakie scenariusze ponownego przemocowego zaangażowania są istotne po zwolnieniu i jak nimi zarządzać?
Możliwy wybór:
- VERA‑2R w systemie mającym wyszkolonych użytkowników;
- ERG22+ w HMPPS;
- dodatkowe narzędzie ogólnej przemocy, jeśli uzasadnione.
Nie:
- samo TRAP‑18 jako pełna ocena wszystkich potrzeb;
- szkolny VAF;
- suma kilku skal.
Przypadek B: osoba w społeczności ujawnia zamiar samotnego ataku
Pytanie:
czy obserwowane zachowania wskazują dynamiczną drogę do targeted violence i jaka jest pilność?
Możliwy wybór:
- profesjonalny proces threat assessment;
- TRAP‑18 jako jedna struktura;
- aktualizacja ciągła.
Nie:
- długoterminowa kategoria ERG22+ bez kontekstu;
- oczekiwanie na pełną diagnozę.
Przypadek C: przemoc zależna od organizacji
Pytanie:
jak przywództwo, normy grupy, rola osoby i konflikt społeczny współtworzą scenariusz?
Możliwy wybór:
- MLG‑V2;
- uzupełniająca indywidualna ocena.
Nie:
- przypisanie każdemu członkowi wyniku lidera.
Przypadek D: uczeń wypowiada kontrowersyjny pogląd
Najpierw:
- kontekst;
- konkretne zachowanie;
- potrzeba;
- bezpieczeństwo.
Nie ma podstaw do pełnej VERA‑2R wyłącznie przez opinię. Szkoła korzysta z procedury ochrony i pomocy; narzędzia dorosłych sprawców nie są screeningiem.
Audyt organizacji
Przed wdrożeniem
- Jaki problem ma rozwiązać narzędzie?
- Czy problem występuje wystarczająco często?
- Czy populacja odpowiada badaniom?
- Kto ma uprawnienia?
- Jakie są koszty?
- Czy istnieje polska wersja i adaptacja?
- Jak będzie oceniana jakość?
Wdrożenie
- pełne szkolenie;
- podręcznik;
- format raportu;
- superwizja;
- drugi oceniający;
- zasady danych;
- przepływ informacji;
- harmonogram powtórzeń.
Monitorowanie
- zgodność między oceniającymi;
- brakujące dane;
- rozbieżności;
- czas;
- decyzje;
- skutki uboczne;
- różnice między grupami;
- liczba obniżonych ocen.
Ewaluacja
Należy odróżnić:
- czy użytkownicy wypełniają formularz;
- czy robią to podobnie;
- czy raport zmienia zarządzanie;
- czy decyzje są proporcjonalne;
- czy wynik odpowiada późniejszym zdarzeniom.
Warunek wycofania
Organizacja powinna ustalić, kiedy:
- zawiesi użycie;
- zmieni szkolenie;
- zaktualizuje wersję;
- ograniczy populację;
- wycofa narzędzie.
Bez tego instrument może trwać wyłącznie siłą instytucjonalnego przyzwyczajenia.
Minimalna karta porównawcza
Dla każdego narzędzia należy wypełnić:
| Pole | Pytanie |
|---|---|
| Nazwa i wersja | Czy wiadomo dokładnie, czego użyto? |
| Autor i właściciel | Kto odpowiada za podręcznik i szkolenie? |
| Cel | Ryzyko, threat, podatność czy potrzeba? |
| Wynik | Jakie zdarzenie i horyzont? |
| Populacja | Kto był podstawą rozwoju i badań? |
| Kontekst | Sąd, więzienie, probacja, społeczność? |
| Metoda | SPJ, aktuarialna, checklista? |
| Dane | Jakie źródła są wymagane? |
| Użytkownik | Jakie szkolenie i mandat? |
| Rzetelność | Badawcza czy terenowa? |
| Trafność | Treść, konstrukt, retrospekcja czy prospekcja? |
| Ochrona | Czy i jak jest ujmowana? |
| Aktualizacja | Kiedy ocenia się ponownie? |
| Prawa | Jak działa korekta, kontrola i odwołanie? |
Najczęstsze błędy
„Wynik 17 na 22”
Jeżeli narzędzie SPJ nie ma empirycznie wyprowadzonej sumy i progu, liczba tworzy fałszywą precyzję.
„Certyfikowany test”
Certyfikowane szkolenie nie jest certyfikatem bezbłędnej predykcji.
„Dwa narzędzia potwierdziły”
Mogą używać tych samych faktów i podobnych domen. To nie są niezależne dowody.
„Brak danych = brak ryzyka”
Nieznane nie znaczy nieobecne.
„Brak współpracy = ekstremizm”
Odmowa może wynikać z prawa, lęku, języka, nieufności lub strategii. Jest faktem o dostępności danych, nie automatycznym czynnikiem.
„Wysoki wynik = zatrzymanie”
Decyzja prawna wymaga własnej podstawy. Raport oceny nie tworzy kompetencji.
„Niski wynik = gwarancja”
Żadne narzędzie nie daje zera.
„Stara ocena nadal obowiązuje”
Raport ma kontekst i datę. Zmiana przypadku wymaga aktualizacji.
„Jedno narzędzie dla wszystkich”
Oszczędność wdrożeniowa nie uzasadnia błędnego celu.
Wnioski
VERA‑2R, ERG22+, TRAP‑18 i MLG‑V2 organizują różne pytania:
- VERA‑2R — indywidualne ryzyko i zarządzanie przemocowym ekstremizmem;
- ERG22+ — sformułowanie sprawcy w brytyjskim więziennictwie i probacji;
- TRAP‑18 — dynamiczne zagrożenie samotnego aktora;
- MLG‑V2 — wielopoziomowa przemoc grupowa.
IVP, VAF i inne ramy wczesnej podatności nie są równoważne sądowej ocenie recydywy. Krajowe narzędzia policyjne nie powinny być przenoszone między populacjami bez badań.
Najważniejsze zasady:
- najpierw pytanie i decyzja, potem narzędzie;
- SPJ nie jest sumą punktów;
- rzetelność nie jest trafnością;
- retrospekcja nie jest prognozą;
- brak danych nie jest wynikiem niskim;
- ocena musi zawierać ochronę;
- użytkownik potrzebuje szkolenia, mandatu i superwizji;
- raport musi wskazywać scenariusz i ograniczenia;
- ocena wymaga aktualizacji;
- narzędzi nie miesza się w domowy test;
- prawa i możliwość korekty są częścią jakości;
- żaden instrument nie przewiduje pewnego zamachu.
Stan dowodów pozwala powiedzieć, że narzędzia mogą poprawiać strukturę informacji i planowanie. Nie pozwala powiedzieć, że jedno z nich trafnie wylicza prawdopodobieństwo terroryzmu u jednostki. Wybór powinien być skromny metodologicznie i precyzyjny funkcjonalnie.
Najbardziej użyteczne pytanie brzmi:
czy to narzędzie, w tej wersji, użyte przez tę osobę, na tych danych i w tej populacji rzeczywiście odpowiada na decyzję, którą mamy podjąć — oraz czy raport pokazuje mechanizm, ochronę, niepewność i sposób aktualizacji?
Jeżeli któregokolwiek elementu brakuje, nazwa instrumentu nie naprawia oceny.