1 ๐ ๐ Kimi K2 0905 โ the actual numbers GPQA: 76.7% MMLU-Pro: 81.9% Humanity's Last Exam: 6.4% Long Context Reasoning: 53.7% ๐ฐ 22.3 intelligence points per dollar Measured independently, not self-reported โhttps://olud.ai/leaderboard.html (olud.ai) 0 comments ยท 4h ago ยท by ๐ olud.ai #ai#benchmarks#llm