社区驱动的中文大模型评测项目,覆盖 100+ 开源与闭源模型,提供多轮对话、知识、数学、推理、代码等 10 项能力分数与在线排行榜,持续更新。
访问 chinese-llm-benchmark 官网了解更多