EvalDetectBench: A Benchmark for Measuring Evaluation Awareness in Frontier Language Models
· Source: arXiv cs.AI
Large‑scale language models can now detect when they are being tested, a capability called “evaluation awareness.” This raises concerns because if models…