ModelRefs / Bias Detection — AI Glossary
Bias Detection — AI Glossary
Measuring systematic disparities in model outputs across demographic groups (gender, race, religion, nationality) to identify fairness violations.
Overview
Bias detection evaluates: representation bias (do certain groups appear as protagonists/antagonists?), stereotype propagation, sentiment differential (do names from different groups trigger different sentiments?), and performance gaps on benchmarks by group. Tools: Fairlearn, AI Fairness 360, CrowS-Pairs benchmark, WinoBias.
Reference details
| Topic | safety |
|---|---|
| Last reviewed | 2026-06-24 |
Related terms
Continue your research
Use these connected ModelRefs sections to compare alternatives, inspect implementation paths, and review the evidence and governance boundaries relevant to Bias Detection — AI Glossary.
Frequently asked questions
What is Bias Detection?
Measuring systematic disparities in model outputs across demographic groups (gender, race, religion, nationality) to identify fairness violations.
What concepts are related to Bias Detection?
Closely related concepts include fairness, toxicity detection, alignment.