← 工具雷达
app

Agent-skills-eval – Test whether Agent Skills improve outputs

实验性工具,缺乏实际应用场景

3.1综合
实用性2
上手速度4
完成度5
不可替代3
生命力2

5 维独立打分,综合分为加权平均。分数只对同一套标准内部可比。

适合谁

AI代理研究者做实验

不适合谁

需要生产级解决方案的团队

项目自述

github.com

替代品

LangSmithAutoGPT
访问官网2 · 评测时 Stars评测于 2026-05-07

同类工具