Lumaktaw sa pangunahing nilalaman
AI Cluster
.world
AI tools
AI apps
Araw-araw na balita sa AI
Mga bagong proyektong AI
Mga kagamitan sa pag-aaral
Tungkol sa amin
Advertising
Pumili ng wika
English
简体中文
繁體中文
العربية
Русский
Español
Français
Português
Deutsch
Türkçe
Nederlands
Українська
Tiếng Việt
Bahasa Indonesia
日本語
Italiano
한국어
ไทย
Polski
Română
Ελληνικά
Čeština
Suomi
हिन्दी
Български
دری
Dansk
עברית
Bahasa Melayu
فارسی
Slovenčina
Svenska
Hrvatski
Filipino
Magyar
Norsk bokmål
Slovenščina
Català
Nynorsk
தமிழ்
Afrikaans
Baguhin ang wika
Magsuggest ng tool
Home
AI benchmarks
TUKLASIN ANG KOLEKSYON
AI benchmarks
.
15 tools · 1 grupo
Maghanap ng AI tools
/
Hanapin
Sa site na ito
Bing
百度
Google
Perplexity
Pindutin ang / para maghanap
AI模型评测
Compact view
AI模型评测
15
MagicArena
字节推出的视觉生成模型对战平台
MMLU
大规模多任务语言理解基准
Open LLM Leaderboard
Hugging Face推出的开源大模型排行榜单
C-Eval
一个全面的中文基础模型评估套件
FlagEval
智源研究院推出的FlagEval(天秤)大模型评测平台
SuperCLUE
中文通用大模型综合性测评基准
AGI-Eval
AI大模型评测社区
OpenCompass
上海人工智能实验室推出的大模型开放评测体系
CMMLU
一个综合性的大模型中文评估基准
MMBench
全方位的多模态大模型能力评测体系
HELM
斯坦福大学推出的大模型评测体系
LMArena
AI模型评估平台
LLMEval3
由复旦大学NLP实验室推出的大模型评测基准
H2O EvalGPT
H2O.ai推出的基于Elo评级方法的大模型评估系统
PubMedQA
生物医学研究问答数据集和模型得分排行榜
Patuloy na tuklasin ang kayang gawin ng AI
Mag-browse sa lahat ng tools