Gå till huvudinnehållet
AI Cluster
.world
AI-verktyg
AI-appar
Dagliga AI-nyheter
Nya AI-projekt
Lärresurser
Om oss
Annonsera
Välj språk
English
简体中文
繁體中文
العربية
Русский
Español
Français
Português
Deutsch
Türkçe
Nederlands
Українська
Tiếng Việt
Bahasa Indonesia
日本語
Italiano
한국어
ไทย
Polski
Română
Ελληνικά
Čeština
Suomi
हिन्दी
Български
دری
Dansk
עברית
Bahasa Melayu
فارسی
Slovenčina
Svenska
Hrvatski
Filipino
Magyar
Norsk bokmål
Slovenščina
Català
Nynorsk
தமிழ்
Afrikaans
Byt språk
Föreslå ett verktyg
Start
AI-benchmarks
UTFORSKA SAMLINGEN
AI-benchmarks
.
15 verktyg · 1 grupper
Sök AI-verktyg
/
Sök
Denna webbplats
Bing
百度
Google
Perplexity
Tryck / för att söka
AI模型评测
Kompakt vy
AI模型评测
15
MagicArena
字节推出的视觉生成模型对战平台
MMLU
大规模多任务语言理解基准
Open LLM Leaderboard
Hugging Face推出的开源大模型排行榜单
C-Eval
一个全面的中文基础模型评估套件
FlagEval
智源研究院推出的FlagEval(天秤)大模型评测平台
SuperCLUE
中文通用大模型综合性测评基准
AGI-Eval
AI大模型评测社区
OpenCompass
上海人工智能实验室推出的大模型开放评测体系
CMMLU
一个综合性的大模型中文评估基准
MMBench
全方位的多模态大模型能力评测体系
HELM
斯坦福大学推出的大模型评测体系
LMArena
AI模型评估平台
LLMEval3
由复旦大学NLP实验室推出的大模型评测基准
H2O EvalGPT
H2O.ai推出的基于Elo评级方法的大模型评估系统
PubMedQA
生物医学研究问答数据集和模型得分排行榜
Fortsätt utforska vad AI kan göra
Bläddra bland alla verktyg