rankings Running on CPU Upgrade 7.67k MTEB Leaderboard 📊 7.67k Embedding Leaderboard Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots Running Agents 436 Reward Bench Leaderboard 📐 436 Explore and compare model scores on RewardBench benchmarks
Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots
Running Agents 436 Reward Bench Leaderboard 📐 436 Explore and compare model scores on RewardBench benchmarks
datasets argilla/distilabel-intel-orca-dpo-pairs Viewer • Updated Aug 7, 2025 • 12.9k • 19.4k • 182 m-a-p/Code-Feedback Viewer • Updated Feb 26, 2024 • 66.4k • 4.61k • 240 argilla/ultrafeedback-binarized-preferences-cleaned Viewer • Updated Dec 11, 2023 • 60.9k • 23.5k • 165 kyujinpy/orca_math_dpo Viewer • Updated Apr 12, 2024 • 15.3k • 58 • 20
argilla/ultrafeedback-binarized-preferences-cleaned Viewer • Updated Dec 11, 2023 • 60.9k • 23.5k • 165
rankings Running on CPU Upgrade 7.67k MTEB Leaderboard 📊 7.67k Embedding Leaderboard Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots Running Agents 436 Reward Bench Leaderboard 📐 436 Explore and compare model scores on RewardBench benchmarks
Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots
Running Agents 436 Reward Bench Leaderboard 📐 436 Explore and compare model scores on RewardBench benchmarks
datasets argilla/distilabel-intel-orca-dpo-pairs Viewer • Updated Aug 7, 2025 • 12.9k • 19.4k • 182 m-a-p/Code-Feedback Viewer • Updated Feb 26, 2024 • 66.4k • 4.61k • 240 argilla/ultrafeedback-binarized-preferences-cleaned Viewer • Updated Dec 11, 2023 • 60.9k • 23.5k • 165 kyujinpy/orca_math_dpo Viewer • Updated Apr 12, 2024 • 15.3k • 58 • 20
argilla/ultrafeedback-binarized-preferences-cleaned Viewer • Updated Dec 11, 2023 • 60.9k • 23.5k • 165