深度网址导航

帅气的我简直无法用语言描述!
OpenCompass司南

OpenCompass司南

OpenCompass司南提供大语言模型和多模态模型的评测榜单,涵盖多能力维度评分。
580
Open LLM Leaderboard

Open LLM Leaderboard

Open LLM Leaderboard 是一个交互式排行榜,用于筛选和比较开源语言模型在多项测试中的表现。
510
MMBench

MMBench

MMBench是一个多模态大语言模型评测基准平台,提供模型性能评估与排行榜服务。
480
LMArena

LMArena

LMArena是一个供用户聊天、比较和投票评选最佳AI模型的平台,通过真实世界评估构建公共排行榜。
460
HELM

HELM

HELM是斯坦福大学推出的语言模型透明性基准,提供多指标标准化评估。
390
H2O Eval Studio

H2O Eval Studio

H2O Eval Studio 是一个模块化工作室,用于评估检索增强生成和大型语言模型应用的性能、可靠性和安全性。
460
FlagEval

FlagEval

FlagEval 是一个用于评估人工智能模型性能的在线平台。
430
AGI-Eval

AGI-Eval

AGI-Eval是一个用于评估人工智能模型的网站平台。
430
Hyper3D Rodin

Hyper3D Rodin

Hyper3D Rodin 是一款AI 3D模型生成器,可将文本或图像快速转换为高质量3D资产。
710
Spline

Spline

Spline 提供 AI 驱动的 3D 模型生成,支持文本或图像输入,并可直接在编辑器中打开。
510
Meshy

Meshy

Meshy 是一款 AI 3D 模型生成器,可将文本或图像快速转换为可用于游戏和 3D 打印的模型。
1310
LumaAI

LumaAI

Luma AI是面向视频生成和图像创作的创意AI平台,提供模型与智能体以支持端到端工作流。
560