Link:openlm.ai
Chatbot Arena + Rangliste für Large Language Models
OpenLM.ai präsentiert mit Chatbot Arena + ein kombiniertes Benchmark-Leaderboard für Sprachmodelle. Die Rangliste stützt sich auf agentengesteuerte Duelle mit LLM-as-a-Judge-Elo-Bewertungen, den Artificial Analysis Intelligence Index (AAII) und den ARC-AGI v2 Benchmark.
Aus Video: Weekly AI Updates: Vulkan, Mojo, Kimi K3, and Emerging Agent Frameworks