Paper proposes statistical guarantees for synthetic data in AI evaluation
A revised arXiv paper proposes a framework for using synthetic data in scientific research while quantifying when conclusions remain statistically valid, including for LLM-based evaluation.