Przejdź do treści
METODOLOGIA

Jak analizujemy przekaz

Wersja 1.0 ·
Diagnoza dotyczy konkretnego komunikatu, nie osoby. Poniżej: skąd biorą się wpisy, jak powstaje wynik i jak liczymy dane Kliniki.

W skrócie

  1. 1Selekcja

    Strażnik czyta nowe wpisy i wybiera te z tezą do sprawdzenia.

  2. 2Konsylium

    Kilka modeli różnych firm osobno ocenia ten sam wpis.

  3. 3Dowody

    Twierdzenia trafiają do wyszukiwarki; ocena faktu wymaga źródła.

  4. 4Publikacja

    Diagnoza ukazuje się automatycznie. Człowiek może ją tylko wycofać.

Selekcja wpisów

Czytamy wpisy z obserwowanych kont X polityków i partii z ostatnich 3 dni. Strażnik daje każdemu wstępny wynik — to nie jest siła spinu.

pomijanydo decyzjikolejka automatyczna
04075100

To próba wybranych wypowiedzi, nie cała debata. Więcej diagnoz jednej strony nie znaczy, że ta strona częściej stosuje spin. Brak diagnozy nie oznacza „bez spinu”.

Zakres analizy

Badamy

  • tekst wpisu
  • zdjęcia i grafiki: opis i tekst na obrazie
  • tytuły i opisy podlinkowanych stron

Nie badamy we wpisach

  • filmów dołączonych do wpisu
  • tego, czego model nie odczytał — opisujemy to w ograniczeniach diagnozy

Wywiady mają osobny proces: transkrypcja i osobne oceny gościa oraz prowadzącego.

Werdykty i siła spinu

  • Spin

    Wyraźne techniki perswazji lub manipulacyjne przedstawienie treści.

  • Częściowy spin

    Takie elementy są, ale nie określają całego komunikatu.

  • Bez spinu

    Brak istotnego spinu w badanym materiale. To nie certyfikat prawdy.

  • Nie da się ocenić

    Dane nie pozwalają rozstrzygnąć oceny.

55/100

Siła spinu to nasilenie rozpoznanych zabiegów — nie procent fałszu ani winy. Wynik to mediana ocen modeli; dla „bez spinu” najwyżej 20.

Werdykt to środkowa ocena Konsylium; przy remisie wybieramy łagodniejszą. Głosy „nie da się ocenić” nie wchodzą do mediany. Nie dopisujemy fikcyjnych głosów tam, gdzie oceniał jeden model.

Zgodność modeli

2/3ten sam werdykt

Tyle modeli dało werdykt równy wynikowi diagnozy. „Nie da się ocenić” liczy się do mianownika, brak odpowiedzi — nie. Obok pokazujemy rozrzut ocen siły.

Modele mogą popełnić ten sam błąd, więc zgoda nie jest dowodem. Docelowo: co najmniej 4 odpowiedzi z 3 firm i model polski; przy limitach usług — 3 odpowiedzi z opisem braków. Aktualny skład

Statusy twierdzeń

  • Potwierdzoneźródła wspierają twierdzenie
  • Sprzeczne ze źródłamiźródła przeczą twierdzeniu
  • Wprowadzające w błądistotne pominięcie, zniekształcenie lub nieuprawniony wniosek
  • Niezweryfikowanebrak źródła albo nie da się tego sprawdzić

Status faktu wymaga źródła z wyszukiwania — bez niego twierdzenie zostaje niezweryfikowane. Podobne twierdzenia łączymy przed liczeniem. W zestawieniach grupa „opinie” obejmuje dziś także fakty, których nie udało się sprawdzić.

Rodziny technik

21 kategorii w trzech rodzinach oraz „Inne”. Technika trafia do diagnozy tylko z cytatem z materiału i gdy wskaże ją co najmniej 2 członków Konsylium (przy 1–2 rozstrzygniętych głosach wystarczy jedno wskazanie). Najwyżej 6 technik na diagnozę.

Dane i wnioskowanie10

  • Liczba bez punktu odniesienia
  • Wybiórcze dane
  • Pominięcie kontekstu
  • Przeinaczenie faktów
  • Teza bez dowodu
  • Fałszywa przyczynowość
  • Nadmierne uogólnienie
  • Fałszywa analogia i skojarzenie
  • Fałszywa alternatywa
  • Odwołanie do autorytetu

Emocje i przedstawienie6

  • Apel do emocji
  • Straszenie
  • Przesada
  • Etykietowanie
  • My kontra oni
  • Sugestia i niedopowiedzenie

Spór i odpowiedzialność5

  • Atak na osobę
  • Przypisywanie intencji
  • Zniekształcenie cudzego stanowiska
  • Zmiana tematu
  • Przypisywanie sobie zasług

Zgodność z SemEval 2023

SemEval 2023 Task 3 to międzynarodowe zadanie badawcze, którego podzadanie 3 dotyczy rozpoznawania 23 technik perswazji w 6 grupach, także w tekstach po polsku. Poniższe przypisanie jest nasze i orientacyjne. Kategorie dotyczące rzetelności danych, faktów i wnioskowania wykraczają poza ten katalog perswazji językowej. Przypisanie nie oznacza walidacji skuteczności naszego systemu w SemEval.

Nasza kategoriaOdpowiednik SemEval
StraszenieAppeal to Fear/Prejudice
Przypisywanie sobie zasługbrak odpowiednika
Przypisywanie intencjiCasting Doubt
Atak na osobęQuestioning the Reputation
Fałszywa alternatywaFalse Dilemma/No Choice
Słomiany człowiekStrawman
Fałszywa analogia i skojarzenieGuilt by Association
Przeinaczenie faktówbrak odpowiednika
Sugestia i niedopowiedzenieCasting Doubt
Fałszywa przyczynowośćCausal Oversimplification
Liczba bez punktu odniesieniabrak odpowiednika
Wybiórcze danebrak odpowiednika
Pominięcie kontekstubrak odpowiednika
Nadmierne uogólnieniebrak odpowiednika
EtykietowanieName Calling/Labeling
My kontra oniFlag Waving
Zmiana tematuRed Herring; Whataboutism
Odwołanie do autorytetuAppeal to Authority
Teza bez dowodubrak odpowiednika
PrzesadaExaggeration/Minimisation
Apel do emocjiLoaded Language; Appeal to Values
Innebrak odpowiednika
Słowa nacechowane (osobny moduł)Loaded Language

Techniki SemEval, których nie rozpoznajemy osobno:

  • Appeal to Hypocrisy
  • Appeal to Popularity
  • Consequential Oversimplification
  • Slogans
  • Conversation Killer
  • Appeal to Time
  • Obfuscation/Vagueness/Confusion
  • Repetition

Słowa nacechowane

  • strach i zagrożenie
  • gniew i oburzenie
  • pogarda i wyśmiewanie
  • duma i wspólnota
  • współczucie i krzywda

Najpierw bierzemy wskazania modeli (słowo musi być we wpisie), a gdy ich brak — polski słownik. Liczymy różne słowa i zwroty, nie wszystkie wystąpienia. Samo nacechowane słowo nie przesądza o spinie.

Jak liczymy dane

Wykresy obejmują opublikowane, nieukryte diagnozy. Porównania dotyczą 30 dni według daty diagnozy.

MiaraPodstawa
Werdykty i siłaliczba diagnoz w grupie i okresie; średnia arytmetyczna wyników diagnoz
Techniki i rodzinyliczba diagnoz z daną kategorią (raz na diagnozę), nie suma technik
Twierdzeniaodrębne twierdzenia po scaleniu powtórzeń; niezweryfikowane osobno
Słowa nacechowaneśrednia liczba różnych słów lub zwrotów na diagnozę
Jednomyślnośćdiagnozy z co najmniej 2 odpowiedziami, w których wszystkie głosy są zgodne
Polubieniatylko wpisy z dostępną liczbą; brak danych to nie zero

Poniżej 10 obserwacji oznaczamy małą próbę. To sygnał ostrożności, nie test statystyczny.

Ograniczenia

  • AI może pomylić cytat, kontekst, ironię, ocenę faktu albo kategorię techniki.
  • Modele różnych firm mogą mieć wspólne dane treningowe i uprzedzenia.
  • Wyszukiwanie nie obejmuje całej wiedzy; źródła bywają nieaktualne.
  • Limity usług zmieniają skład Konsylium i zakres badań.
  • Wnioski dotyczą tej próby komunikatów — nie oceniamy prawdomówności osób.

Błędy i wycofanie

Widzisz błąd? Wyślij link do diagnozy, opis i źródła na kontakt@spin.clinic. Tą samą drogą autor wypowiedzi może przesłać odpowiedź.

Operator może wycofać całą diagnozę – zapisujemy datę i powód. Treści, werdyktu ani siły nie poprawia się ręcznie. Każde wycofanie, ukrycie prawne i odpowiedź autora znajdziesz w publicznym rejestrze korekt i odpowiedzi. Karta Konsylium