Skip to content
arXiv cs.CL · Papers

The Fairness Collapse Phenomenon: Bias Amplification in Language Models Trained on Synthetic Data

arXiv:2608.04268v1 Announce Type: new Abstract: Generative models trained on artificially generated data have been shown to exhibit model collapse, resulting in significant performance degradation. As synthetic content increasingly contaminates the training corpora of language models, this raises critical concerns abou