Aller au contenu principal
AI Cluster
.world
Outils IA
Applications IA
Actualités IA du jour
Nouveaux projets IA
Ressources d'apprentissage
À propos
Publicité
Choisir une langue
English
简体中文
繁體中文
العربية
Русский
Español
Français
Português
Deutsch
Türkçe
Nederlands
Українська
Tiếng Việt
Bahasa Indonesia
日本語
Italiano
한국어
ไทย
Polski
Română
Ελληνικά
Čeština
Suomi
हिन्दी
Български
دری
Dansk
עברית
Bahasa Melayu
فارسی
Slovenčina
Svenska
Hrvatski
Filipino
Magyar
Norsk bokmål
Slovenščina
Català
Nynorsk
தமிழ்
Afrikaans
Changer de langue
Proposer un outil
Accueil
Benchmarks IA
EXPLORER LA COLLECTION
Benchmarks IA
.
15 outils · 1 groupes
Rechercher des outils IA
/
Rechercher
Ce site
Bing
百度
Google
Perplexity
Appuyez sur / pour rechercher
AI模型评测
Vue compacte
AI模型评测
15
MagicArena
字节推出的视觉生成模型对战平台
MMLU
大规模多任务语言理解基准
Open LLM Leaderboard
Hugging Face推出的开源大模型排行榜单
C-Eval
一个全面的中文基础模型评估套件
FlagEval
智源研究院推出的FlagEval(天秤)大模型评测平台
SuperCLUE
中文通用大模型综合性测评基准
AGI-Eval
AI大模型评测社区
OpenCompass
上海人工智能实验室推出的大模型开放评测体系
CMMLU
一个综合性的大模型中文评估基准
MMBench
全方位的多模态大模型能力评测体系
HELM
斯坦福大学推出的大模型评测体系
LMArena
AI模型评估平台
LLMEval3
由复旦大学NLP实验室推出的大模型评测基准
H2O EvalGPT
H2O.ai推出的基于Elo评级方法的大模型评估系统
PubMedQA
生物医学研究问答数据集和模型得分排行榜
Continuez à explorer ce que l'IA peut faire
Parcourir tous les outils