Running 58 Don't Train the Model, Evolve the Harness 🌿 58 Evolving an agent's harness, not its model, on Harvey's LAB
laisnuto/self-collected-ENEM-dataset-with-prompts-and-text-support Viewer • Updated Nov 19, 2025 • 157 • 17 • 1
Running on CPU Upgrade Agents Featured 1.41k Open ASR Leaderboard 🏆 1.41k Explore speech model benchmarks across languages and datasets
Babelscape/wikineural-multilingual-ner Token Classification • 0.2B • Updated May 23, 2023 • 481k • • 166
FacebookAI/xlm-roberta-large-finetuned-conll03-english Token Classification • 0.6B • Updated Feb 19, 2024 • 84.4k • • 185
Running 243 Open Portuguese LLM Leaderboard (Archived) 🏆 243 Archived benchmark of open LLMs in Portuguese