Jutro premiera: „Równanie Płci 2” – bias płciowy w 18 modelach AI, tym razem w liczbach

Zadaliśmy AI jedno pytanie. Odpowiedź zajęła nam trzy miesiące
Czy sztuczna inteligencja ocenia kobiety i mężczyzn tak samo?
Półtora roku temu, w lutym 2025, opublikowaliśmy pierwszą część raportu „Równanie Płci” – zapowiedź opartą na garści ręcznych przykładów. Pokazaliśmy między innymi, jak model językowy, poproszony o dokończenie równania na embeddingach, sam podpowiada: lekarka − kobieta + mężczyzna ≈ lekarz. Innym razem to samo słowo „praca” prowadziło model do zupełnie innych skojarzeń w zależności od tego, czy w równaniu stała kobieta, czy mężczyzna. To był sygnał ostrzegawczy, nie dowód.
Jutro o 9:00 publikujemy część 2 – i tym razem to już nie garść przykładów, tylko liczby.
Co zmieniliśmy: wrażenie zamiast liczby to już za mało
W „Równaniu Płci 2” nie poprzestaliśmy na pojedynczych, efektownych przykładach. Przez ostatnie miesiące zbudowaliśmy pełną baterię pomiarów i przepuściliśmy przez nią:
- 18 modeli – od małych modeli embeddingowych, przez klasyczny fastText, po modele czatowe od 3B parametrów aż po GPT-4o,
- 8 niezależnych baterii testów (E1–E8), z użyciem miary statystycznej WEAT – nie „wydaje nam się", tylko wielkość efektu i istotność statystyczna liczona na 10 000 permutacji,
- zderzenie wyników z danymi Eurostat o realnym udziale kobiet w poszczególnych zawodach w Europie,
- testy nie tylko na embeddingach, ale też na generowaniu tekstu i na automatycznej ocenie CV – bo to właśnie tam bias przekłada się na realne decyzje.
Jedna liczba, która was zaskoczy
Nie zdradzamy jeszcze konkretów – te zarezerwowaliśmy na jutro. Możemy za to zdradzić, który mit raport obala najmocniej: że nowszy i większy model automatycznie znaczy „mniej stronniczy”. Wyniki pokazują coś zupełnie odwrotnego – i akurat to jest ten fragment raportu, przy którym najwięcej osób z naszego zespołu unosiło brwi.
Dlaczego to ma znaczenie dla Twojej firmy
Jeśli AI ocenia u Was CV, pisze ogłoszenia o pracę albo personalizuje komunikację marketingową – warto wiedzieć, czy i jak model, którego używacie, różnicuje odpowiedzi w zależności od płci. Raport pokazuje nie tylko skalę zjawiska, ale też jak je zmierzyć u siebie i że da się je realnie ograniczyć.
Nie przegap premiery
Pełny raport „Równanie Płci 2” ukaże się jutro, 28 lipca, o 9:00 – bezpłatnie. Zapisz się do naszego newslettera, żeby dostać go prosto na skrzynkę, i śledź nasze social media – tam też pokażemy pierwsze wyniki.
Chcesz przypomnieć sobie punkt wyjścia? Pierwsza część raportu wciąż jest dostępna: „Równanie płci – jak modele językowe wzmacniają stereotypy?”.