view article Article Harness, Scaffold, and the AI Agent Terms Worth Getting Right sergiopaniego, ariG23498 • May 25 • 135
Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots
Running on CPU Upgrade Agents 127 Open Chinese LLM Leaderboard 🏆 127 Explore LLM benchmark scores and submit your model for evaluation
LLM Inference Unveiled: Survey and Roofline Model Insights Paper • 2402.16363 • Published Feb 26, 2024 • 4
view article Article The Open Medical-LLM Leaderboard: Benchmarking Large Language Models in Healthcare +1 aaditya, pminervini, clefourrier • Apr 19, 2024 • 202
Runtime error Agents Featured 436 Open Medical-LLM Leaderboard 🥇 436 Explore and submit models for benchmarking