LOT-Bench

AI开发 大模型评测

工具介绍

开源的长文本理解评测基准,提供 2000+ 超长文档任务与自动化指标,持续更新国内外大模型排行榜。

评测榜单开源长文本benchmarkGitHub

官方入口

访问 LOT-Bench 官网了解更多

前往官网 →
最后更新:2026-07-29