跳至主要內容
AI Cluster
.world
AI工具集
AI應用集
每日AI資訊
最新AI專案
AI教學資源
關於我們
廣告合作
選擇語言
English
简体中文
繁體中文
العربية
Русский
Español
Français
Português
Deutsch
Türkçe
Nederlands
Українська
Tiếng Việt
Bahasa Indonesia
日本語
Italiano
한국어
ไทย
Polski
Română
Ελληνικά
Čeština
Suomi
हिन्दी
Български
دری
Dansk
עברית
Bahasa Melayu
فارسی
Slovenčina
Svenska
Hrvatski
Filipino
Magyar
Norsk bokmål
Slovenščina
Català
Nynorsk
தமிழ்
Afrikaans
切換語言
收錄工具
首頁
AI模型評測
瀏覽完整目錄
AI模型評測
.
共 15 個工具 · 1 個分組
搜尋 AI 工具
/
搜尋
站內
Bing
百度
Google
Perplexity
按 / 快速搜尋
AI模型評測
精簡檢視
AI模型評測
15
MagicArena
位元組推出的視覺生成模型對戰平台
MMLU
大規模多工語言理解基準
Open LLM Leaderboard
Hugging Face推出的開源大模型排行榜單
C-Eval
一個全面的中文基礎模型評估套件
FlagEval
智源研究院推出的FlagEval(天秤)大模型評測平台
SuperCLUE
中文通用大模型綜合性測評基準
AGI-Eval
AI大模型評測社群
OpenCompass
上海人工智慧實驗室推出的大模型開放評測體系
CMMLU
一個綜合性的大模型中文評估基準
MMBench
全方位的多模態大模型能力評測體系
HELM
斯坦福大學推出的大模型評測體系
LMArena
AI模型評估平台
LLMEval3
由復旦大學NLP實驗室推出的大模型評測基準
H2O EvalGPT
H2O.ai推出的基於Elo評級方法的大模型評估系統
PubMedQA
生物醫學研究問答資料集和模型得分排行榜
繼續探索 AI 的更多可能
瀏覽全部工具