Preprint2023
Rethinking benchmark and contamination for language models with rephrased samples
Unknown
This paper studies benchmark contamination in large language models, evaluates existing decontamination methods, and shows that current detection methods can be improved using rephrased samples.
0Nov 1, 2023Large Language ModelsBenchmarks
arXiv