MMLU

MMLU

大模型/AI能力
MMLU提供覆盖57个学科的多任务语言理解基准测试,用于评估和对比大模型在广泛知识领域的综合表现,是衡量模型泛化能力的重要参考标准。
关注度趋势
暂无趋势数据

产品简介

MMLU提供覆盖57个学科的多任务语言理解基准测试,用于评估和对比大模型在广泛知识领域的综合表现,是衡量模型泛化能力的重要参考标准。

用户评价

还没有评价
这款产品刚收录,成为第一个评价的人
写第一条评价