Running 4.03k The Ultra-Scale Playbook π 4.03k The ultimate guide to training LLM on large GPU Clusters
Running Agents 44 Open LMM Reasoning Leaderboard π₯ 44 A Leaderboard that demonstrates LMM reasoning capabilities
Running Agents 436 Reward Bench Leaderboard π 436 Explore and compare model scores on RewardBench benchmarks
Running on CPU Upgrade 14.1k Open LLM Leaderboard π 14.1k Track, rank and evaluate open LLMs and chatbots
Running Agents Featured 136 Open VLM Video Leaderboard π 136 VLMEvalKit Eval Results in video understanding benchmark
Running on CPU Upgrade Agents 1.03k Open VLM Leaderboard π 1.03k VLMEvalKit Evaluation Results Collection