How Much Real Data Stops Model Collapse? A Minimal Recursive-Training Simulation
A 500-run simulation shows recursive synthetic training can shrink variance by up to 81% in 40 generations; mixing in 10% real data cuts that to under 2%.
A 500-run simulation shows recursive synthetic training can shrink variance by up to 81% in 40 generations; mixing in 10% real data cuts that to under 2%.