Show HN: AA-Briefcase: a frontier knowledge work evaluation
artificialanalysis.ai
2 threads
the example submissions are really good comparisons, comparing Fable 5's submission to Opus 4 is fairly stark
GLM hanging with the frontier big dogs