AI researcher Herbie Bradley says leading closed labs use strict internal evals to avoid public benchmark overfitting
The debate centers on labs optimizing models to score high on leaderboards.
Combined views
115.2K
3 posts, first seen 58d ago
636 likes101 comments146 saves
AI researcher Herbie Bradley says leading closed labs use strict internal evals to avoid public benchmark overfitting
The debate centers on labs optimizing models to score high on leaderboards.