登录 注册 退出
博客 AI资讯+
热门搜索: 2024 坍塌之后

标签:AI模型评测

共 8 篇文章
C-Eva AI

C-Eva

C-Eval 是面向中文基础模型的综合性评测基准,覆盖多领域知识与能力评估。...

普思AI资讯 3星期前 5 阅读
SuperCLUE AI

SuperCLUE

SuperCLUE 是中文通用大模型综合性测评基准,全面评估大模型在多任务场景下的性能表现。...

普思AI资讯 3星期前 8 阅读
OpenCompass AI

OpenCompass

OpenCompass 是上海人工智能实验室推出的开源大模型评测体系,支持多维度、标准化模型评估。...

普思AI资讯 3星期前 8 阅读
CMMLU AI

CMMLU

CMMLU 是面向中文大模型的综合性评估基准,涵盖多领域知识与能力评测。...

普思AI资讯 3星期前 6 阅读
MMBench AI

MMBench

MMBench 是面向多模态大模型的综合性评测体系,涵盖视觉、语言与跨模态理解能力。...

普思AI资讯 3星期前 9 阅读
HELM AI

HELM

斯坦福大学推出的开源大模型评测体系,聚焦多维度、可复现的AI模型评估。...

普思AI资讯 3星期前 7 阅读
LMArena AI

LMArena

LMArena 是一个专注于AI模型多维度评测的公开平台,支持用户对比测试主流大模型性能。...

普思AI资讯 3星期前 8 阅读