waza
创建技能评测套件并比较不同模型的执行效果
- Stars
- 1,088
- Forks
- 65
- 更新时间
- 更新于 2026年7月14日
创建技能评测套件并比较不同模型的执行效果
Waza 是用于 Agent Skills 的 Go 命令行工具,可初始化评测、运行基准并比较不同模型或执行器的结果。它还能检查技能前置元数据、Token 预算、评测文件和 agentskills.io 规范符合度,并把结果接入 CI;适合需要持续衡量技能质量和回归变化的作者与团队。
资源类型
使用场景
运行平台
运行方式
为 Agent Skills 运行可重复的发现与使用评测
用 eBPF 追踪 AI Agent 的进程、文件、网络和模型调用。
核心能力
GitHub 公开事实最近同步于 2026年7月14日。
用一条命令汇总并筛选 Databricks 作业日志
从终端诊断受企业认证门禁保护的线上 Web 应用