Frontier Models Can Take Actions at Low Probabilities
By Alex Serrano, Wen Xing, David Lindner, Erik Jenner
Tests whether frontier models (GPT-5, Claude-4.5, Qwen-3) can take actions at very low probabilities while maintaining calibration, finding they are surprisingly well-calibrated even at rates like 0.01%. This has implications for evasion of safety evaluations.