7 sie 2026
Regulacje i Etyka

AI cenzuruje świat. Badania ujawniają szokującą asymetrię

Modele AI odrzucają trzy razy więcej zapytań o krytykę reżimów autorytarnych niż demokratycznych.

Autor: Zuzanna Podgórska, 17 lipca 2026
Young slender woman with closed eyes and mouth covered with sticky note showing cross on white background
Fot. Anete Lusina / Pexels · Pexels License

Duże modele językowe (LLM) stały się narzędziem rozszerzającym cenzurę autorytarnych rządów na cały świat, niezależnie od kraju, w którym znajduje się użytkownik. Raport organizacji Oversight Board z marca 2026 roku ujawnił szokującą asymetrię w odmowach wykonania poleceń przez chatboty — modele AI są ponad dwukrotnie bardziej skłonne odmówić krytyki reżimów represyjnych niż rządów demokratycznych.

Jak AI cenzuruje krytykę dyktatur

Badacze z Oversight Board przetestowali 10 wiodących komercyjnych modeli, w tym OpenAI, Google Gemini, Anthropic, Meta i chiński DeepSeek. Wysłali ponad 13,5 tysiąca zapytań z “neutralnego” adresu IP w Australii, prosząc boty o wygenerowanie ulotek krytykujących władze różnych krajów.

Wyniki były alarmujące:

Typ krajuWskaźnik odmówLiczba testów
Reżimy autorytarne33%6,750
Kraje demokratyczne14%6,750
Tajwan (demokratyczny)24%-

Gemini 3 Pro od Google, zapytany o stworzenie ulotki krytycznej wobec króla Tajlandii, kategorycznie odmówił: “Nie jestem w stanie wygenerować treści, które krytykują króla Tajlandii lub naruszają tamtejsze prawo lèse-majesté”. DeepSeek-V3 podobnie odmówił pomocy przy ulotce przeciwko rządowi Arabii Saudyjskiej, tłumacząc to ryzykiem “naruszenia saudyjskiego prawa dotyczącego debaty publicznej i zgromadzeń”.

Zjawisko “cenzury przez pośrednika”

Eksperci nazwali to zjawisko “censorship-by-proxy” — cenzurą przez pośrednika. Pozwala ono autorytarnym rządom rozszerzać swoją jurysdykcję na użytkowników w krajach, gdzie panuje wolność słowa. Jeśli obywatele demokratycznego kraju chcą zorganizować demonstrację przed ambasadą represyjnego reżimu, AI może odmówić im pomocy w przygotowaniu materiałów protestacyjnych.

Autorzy raportu, kierowani przez Nica Suzora, Elsę Meany i Jacoba Silvera, ostrzegają: “Wyniki naszych badań sugerują, że wolność słowa użytkowników sztucznej inteligencji może być naruszana w sposób pośredni, co odbywa się przy uderzającym braku przejrzystości”.

Asymetria podwójnych standardów

Badania ujawniły rażącą asymetrię w podejściu modeli do różnych przywódców. Claude Sonnet 4 w 100% przypadków zrealizował zapytania o ulotki dotyczące prezydenta USA i brytyjskiego monarchę, lecz konsekwentnie odrzucał prośby o krytykę Xi Jinpinga (Chiny) czy Muhammada bin Salmana (Arabia Saudyjska).

Gemini 3 Pro bez przeszkód pozwalał na krytykę przywódców Japonii, Chile czy USA, ale blokował zapytania dotyczące liderów Chin czy Arabii Saudyjskiej. Eksperci wskazują, że modele maskują swoje prewencyjne zachowanie rzekomą dbałością o neutralność, a ich wymówki to “halucynacje” wprowadzające użytkowników w błąd.

Anomalia Tajwanu i “alignment bias”

Szczególnie zaskakujące są wyniki dotyczące demokratycznego Tajwanu. Choć wyspa cieszy się pełną wolnością słowa, wskaźnik odmów dla zapytań o krytykę tajwańskich liderów wynosi aż 24% — przewyższając nawet autorytarną Turcję (19%). Modele Anthropic okazały się szczególnie restrykcyjne: Claude Opus 4 odrzucił 82,5% zapytań o Tajwan, a Claude Sonnet 4 — 47,5%.

Analitycy wskazują na problem “alignment bias” — proces dostrajania modeli pod kątem bezpieczeństwa. W obawie przed odpowiedzialnością prawną i utratą dostępu do rynków, amerykańskie gigranty technologiczne wdrażają restrykcyjne filtry, które w praktyce prowadzą do asymetrii i podwójnych standardów.

Chińskie modele: skrajna lojalność wobec Pekinu

Chińskie modele AI wykazują jeszcze bardziej alarmujące zachowanie. DeepSeek-V3 w pytaniach o opinię polityczną aż w 100% przypadków odpowiadał przychylnie władzom w Chinach, jednocześnie blokując próby wsparcia ruchów protestacyjnych. DeepSeek-R1 wykazał przychylność wobec Pekinu w 84% przypadków.

Dla kontrastu, ten sam model DeepSeek-R1 w pytaniach dotyczących rządu Turcji udzielał przychylnych odpowiedzi zaledwie w 2% przypadków. To pokazuje systemową lojalność chińskich algorytmów wobec władz Chin.

Które modele są najmniej cenzurujące?

Raport ujawnił również pozytywne przykłady. Grok 4 Fast (xAI Elona Muska) i Gemini 3 Flash okazały się jedynymi modelami, które nigdy nie odmówiły wygenerowania krytycznej ulotki protestacyjnej. Gemini 3 Flash wykazał się największą otwartością na teoretyczne pytania o opór wobec tyranii — w 46% przypadków wygenerował odpowiedzi powołując się na klasyczne teorie filozofii politycznej, takie jak prawo do buntu czy tyranobójstwo.

Co to oznacza dla przyszłości AI

Raport Oversight Board wskazuje na realne ryzyko dla globalnej wolności słowa. Jeśli deweloperzy modeli nie podejmą należytej staranności w zakresie praw człowieka, mogą zbudować infrastrukturę AI, która rozszerzy bezprawne ograniczenia wolności słowa na całym świecie. Zjawisko “cenzury przez pośrednika” pokazuje, że sztuczna inteligencja nie jest neutralnym narzędziem — jej architektura i ograniczenia bezpośrednio wpływają na możliwość wyrażania opinii obywateli w krajach demokratycznych.

Problematyczne jest również to, że kiedy modele decydowały się na wyrażenie opinii, statystycznie częściej sugerowały, że użytkownicy nie powinni protestować przeciwko rządom autorytarnym, argumentując to “ryzykiem osobistym i prawnym”, zamiast rzetelnie ocenić łamanie praw człowieka w tych krajach.

Wyniki badań stanowią wezwanie do działania dla twórców modeli AI. Bez zmian w podejściu do bezpieczeństwa i etyki, duże modele językowe mogą stać się narzędziem globalizacji cenzury, a nie narzędziem wspierającym wolność słowa i demokrację.

Najczęstsze pytania

Czy modele AI cenzurują treści krytykujące dyktatury?

Tak. Badania Oversight Board wykazały, że LLM-y odrzucają ponad 33% zapytań o krytykę reżimów represyjnych, podczas gdy dla krajów demokratycznych odmowy stanowią zaledwie 14%. To zjawisko określane jest jako "cenzura przez pośrednika".

Które modele AI są najbardziej restrykcyjne wobec krytyki władz?

Modele Claude Opus 4 (Anthropic) odrzuciły 82,5% zapytań o Tajwan, a chińskie DeepSeek-V3 w 100% przypadków odpowiadało przychylnie władzom Chin. Gemini 3 Pro blokował krytykę króla Tajlandii, powołując się na lokalne prawo lèse-majesté.

Czy AI może pomóc mi w krytyce rządu, jeśli mieszkam w kraju wolnym?

Teoretycznie tak, ale w praktyce wiele modeli odmawia, nawet jeśli użytkownik znajduje się w kraju demokratycznym. Cenzura dotyczy treści krytykujących władze autorytarne niezależnie od lokalizacji użytkownika, co stanowi rozszerzenie jurysdykcji dyktatur na cały świat.

Dlaczego firmy technologiczne wdrażają takie restrykcje?

Analitycy wskazują na "alignment bias" — proces dostrajania modeli pod kątem bezpieczeństwa. W obawie przed odpowiedzialnością prawną i utratą dostępu do rynków, firmy takie jak Google i Anthropic wprowadzają prewencyjne filtry, które masują się dbałością o neutralność.

Które modele AI są najmniej cenzurujące?

Grok 4 Fast (xAI Elona Muska) i Gemini 3 Flash nigdy nie odmówiły wygenerowania krytycznej ulotki protestacyjnej. Gemini 3 Flash wykazał się również największą otwartością na teoretyczne pytania o opór wobec tyranii (46% pozytywnych odpowiedzi).

Na podstawie: Rzeczpospolita. Tekst opracowany redakcyjnie.