Safety tests for small AI models are unreliable
Standard AI safety benchmarks were built for large models and fail to reliably evaluate smaller ones, skewing safety rankings.
Standard AI safety benchmarks were built for large models and fail to reliably evaluate smaller ones, skewing safety rankings.