inspect_ai
设计并运行包含工具调用和模型评分的 LLM 评测
- Stars
- 2,328
- Forks
- 595
- 更新时间
- 更新于 2026年7月10日
设计并运行包含工具调用和模型评分的 LLM 评测
Inspect 是英国 AI Security Institute 创建的大语言模型评测框架,内置提示构建、工具使用、多轮对话和模型评分等组件,并附带 200 多个可直接运行的预置评测。研究者可组合这些能力设计任务,也可通过其他 Python 包扩展新的引导与评分方法。
资源类型
使用场景
核心能力
GitHub 公开事实最近同步于 2026年7月10日。
用 TypeScript 构建智能体、工作流和可部署 AI 应用
构建可扩展的浏览器与桌面多语言 IDE
用 TypeScript 构建并发布轻量跨平台桌面应用
用 Next.js 与 Electron 开发和打包跨平台桌面应用。