📁 导航集 👤 明峻问道 📅 2025-03-19 CMMLU 1. 概述CMMLU(Chinese Multilingual Language Understanding Evaluation)是一项专为中文语言模型设计的综合性评估标准,旨在深入评估模型在中文化的语境中的表现。它紧密贴合国内外多领域的实际应用,全面考察语言模型在知识掌握、逻辑推理以及对特定情境... 主题分类 #AI模型评测
📁 导航集 👤 明峻问道 📅 2025-03-19 Open LLM Leaderboard Hugging Face 推出了一个名为 Open LLM Leaderboard 的开放式平台,这是一个致力于大型语言模型(LLM)和数据集的社区。该排行榜利用 Eleuther AI 语言模型评估框架,为用户提供了一个透明和标准化的方式来衡量不同模型的性能。背景与必要性随着开源社区发布越来越多的... 主题分类 #AI模型评测