
立即试用
GPT-4o什么是 Agent-Eval?
Agent-Eval 是一个面向 LLM 智能体的统计回归测试工具。它通过统计方法检测智能体在迭代过程中的行为漂移,帮助开发者验证智能体输出是否偏离预期。该工具专注于回归测试,能够持续监控智能体性能,确保其稳定性和可靠性。Agent-Eval 提供免费的开源方案,适合需要严格验证智能体行为的开发团队。
4.5
评分
免费增值
定价模式
2+
平台
6.3k
收藏
优点
- 专注统计严谨性,测试结果可靠
- 有助于维护智能体的稳定性
- 开源免费,易于使用
缺点
- 仅覆盖回归测试,不包含全面评估
- 解读结果可能需要统计知识
多维度评分
4.4/ 5.0
⚡
功能完整性
4.9
🚀
性能速度
4.1
✨
易用性
4.9
💰
性价比
4.3
🎧
客户支持
4.0
🔒
隐私安全
4.1
核心能力
调试工具
代码审查
API接口
IDE插件
同类工具对比
| 功能 | Agent-Eval | Krate | QuantaMind | Token Relay |
|---|---|---|---|---|
| 评分 | 4.5 | 4.5 | 4.1 | 4.3 |
| 定价模式 | 免费增值 | 免费增值 | 免费增值 | 免费增值 |
| 起价 | Free / Paid | Free / Paid | Free / Paid | Free / Paid |
| API | ✓ | — | — | — |
| 免费版 | — | — | — | — |
| 移动端 | — | — | — | — |
支持平台
网页版 ↗
Windows 暂不支持
Mac 暂不支持
iPhone/iPad 暂不支持
安卓 暂不支持
华为 暂不支持
Linux 暂不支持
支持语言
English