Case Study
Moderacja komentarzy z analizą AI — wtyczka WordPress
Wtyczka WordPress, która analizuje każdy nowy komentarz pod kątem mowy nienawiści i treści obraźliwych, zanim trafi on na stronę.
Cel projektu
Klient prowadzi serwis z dużą liczbą komentarzy publikowanych codziennie — artykuły, produkty, dyskusje pod wpisami. Do tej pory każdy komentarz trafiał na stronę natychmiast po dodaniu, bez żadnej weryfikacji.
Problem: pojedyncze, ale regularnie pojawiające się komentarze zawierające mowę nienawiści, wulgaryzmy lub treści obraźliwe wobec innych osób publikowały się od razu, zanim ktokolwiek zdążył zareagować — a ręczne przeglądanie setek komentarzy dziennie było nierealne.
Jak działa analiza AI
Każdy nowy komentarz trafia najpierw do „poczekalni” — nie jest od razu widoczny na stronie. W tym czasie AI analizuje jego treść pod kątem kilku kategorii: mowy nienawiści, wulgaryzmów i przekleństw, treści obraźliwych wobec konkretnych osób oraz spamu.
Wynik analizy trafia bezpośrednio do panelu WordPressa jako gotowa, czytelna ocena przy każdym komentarzu — administrator widzi dokładnie, co dokładnie wzbudziło wątpliwości, a nie tylko samą flagę „podejrzany”.
Tryb automatyczny i ręczna weryfikacja
Wtyczka daje wybór sposobu działania. W trybie automatycznym AI samodzielnie publikuje czyste komentarze i odrzuca te, które łamią zasady — bez udziału człowieka.
W trybie ręcznej weryfikacji (wybranym przez klienta) każdy wynik analizy trafia do administratora, który podejmuje ostateczną decyzję — komentarz nie zostanie opublikowany, dopóki człowiek go nie zatwierdzi. To rozwiązanie dało klientowi kontrolę nad tym, co pojawia się na stronie, bez konieczności ręcznego czytania każdego zgłoszenia od podstaw.
Panel moderacji w akcji
Też zmagasz się z niebezpiecznymi komentarzami?