rankings Running on CPU Upgrade 7.58k MTEB Leaderboard 📊 7.58k Embedding Leaderboard Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots Running Agents 432 Reward Bench Leaderboard 📐 432 Explore and compare model scores on RewardBench benchmarks
Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots
Running Agents 432 Reward Bench Leaderboard 📐 432 Explore and compare model scores on RewardBench benchmarks
datasets argilla/distilabel-intel-orca-dpo-pairs Viewer • Updated Aug 7, 2025 • 12.9k • 9.57k • 182 m-a-p/Code-Feedback Viewer • Updated Feb 26, 2024 • 66.4k • 3.12k • 240 argilla/ultrafeedback-binarized-preferences-cleaned Viewer • Updated Dec 11, 2023 • 60.9k • 12.7k • 163 kyujinpy/orca_math_dpo Viewer • Updated Apr 12, 2024 • 15.3k • 114 • 20
argilla/ultrafeedback-binarized-preferences-cleaned Viewer • Updated Dec 11, 2023 • 60.9k • 12.7k • 163
rankings Running on CPU Upgrade 7.58k MTEB Leaderboard 📊 7.58k Embedding Leaderboard Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots Running Agents 432 Reward Bench Leaderboard 📐 432 Explore and compare model scores on RewardBench benchmarks
Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots
Running Agents 432 Reward Bench Leaderboard 📐 432 Explore and compare model scores on RewardBench benchmarks
datasets argilla/distilabel-intel-orca-dpo-pairs Viewer • Updated Aug 7, 2025 • 12.9k • 9.57k • 182 m-a-p/Code-Feedback Viewer • Updated Feb 26, 2024 • 66.4k • 3.12k • 240 argilla/ultrafeedback-binarized-preferences-cleaned Viewer • Updated Dec 11, 2023 • 60.9k • 12.7k • 163 kyujinpy/orca_math_dpo Viewer • Updated Apr 12, 2024 • 15.3k • 114 • 20
argilla/ultrafeedback-binarized-preferences-cleaned Viewer • Updated Dec 11, 2023 • 60.9k • 12.7k • 163