← 工具雷达
devtool

AI/ML benchmark for local LLM inference and XGBoost training on GPU/CPU

这是一个非常基础且未完善的基准测试脚本集合,缺乏文档和独特价值,不适合严肃的性能评估。

3.3综合
实用性4
上手速度3
完成度4
不可替代3
生命力2

5 维独立打分,综合分为加权平均。分数只对同一套标准内部可比。

适合谁

需要一个快速、非正式的个人项目来粗略测试GPU/CPU性能的开发者。

不适合谁

任何需要可靠、可重复、有详细文档的基准测试结果的团队或个人。

项目自述

github.com

替代品

MLPerfOpen LLM Leaderboard (for LLM evaluation)custom scripts with better documentation and methodology
访问官网1 · 评测时 Stars评测于 2026-05-16

同类工具