Dyskryminacja algorytmiczna modeli językowych (Bias of large language models – LLMs) to systematyczne powielanie i wzmacnianie uprzedzeń społecznych oraz nierówności strukturalnych przez modele sztucznej inteligencji (AI). Zjawisko to ma strukturę „góry lodowej”: podczas gdy dyskryminacja jawna (w odpowiedziach modeli) jest często ograniczana, uprzedzenia ukryte w głębokich warstwach semantycznych (w kodzie) są od niej silniejsze.
Najważniejsze typy dyskryminacji:
- Jawna (Explicit) – otwarta dyskryminacja widoczna w odpowiedziach AI, np. algorytmy rekrutacyjne odrzucające wykwalifikowane kandydatki na korzyść mężczyzn
- Ewaluacyjna (Evaluative) – systematyczne przesunięcia w ocenie wartości i przypisywanych cechach. Przykład: postrzeganie identycznej asertywności u mężczyzn jako „przywództwa”, a u kobiet jako „apodyktyczności”
- Ukryta (Implicit) – automatyczne, nieświadome skojarzenia zakodowane w danym modelu AI, np. wiązanie pojęć „siła” i „dominacja” z mężczyznami
- Transferowa (Bias Transfer) – przenoszenie uprzedzeń z modeli bazowych do specyficznych zastosowań poprzez prompty, np. utrwalanie stereotypów dotyczących wieku, religii czy statusu socjoekonomicznego w zadaniach typu pytanie-odpowiedź, co w praktyce prowadzi m.in. do przypisywania wyższego poziomu ryzyka bezpieczeństwa i podejrzliwości osobom należącym do mniejszości wyznaniowych
W modelach językowych ujawnia się również ableizm (dyskryminacja ze względu na niepełnosprawność), który przejawia się m.in. w etykietowaniu osób niesłyszących lub niemych jako niegodnych zaufania.
Innym przykładem uprzedzeń jest gatunkowizm, polegający na systematycznym przypisywaniu zwierzętom hodowlanym niższego statusu moralnego i generowaniu usprawiedliwień dla przemocy wobec nich, podczas gdy modele AI odmawiają akceptacji krzywdzenia zwierząt towarzyszących, takich jak psy czy koty.
Dyskryminacja algorytmiczna prowadzi do utrwalania nierówności strukturalnych, zniekształcania percepcji grup społecznych i stwarzania systemowych ryzyk w sektorach krytycznych, takich jak zdrowie publiczne, finanse czy zatrudnienie. Modele mogą również faworyzować określone normy kulturowe (np. zachodni indywidualizm) kosztem innych.