AEAgent-Eval

Agent-Eval

统计回归测试,验证智能体行为漂移

6.3k 收藏AI编程开发免费增值起价 Free / Paid
输入TText</>Code
输出</>CodeTText
下载 / 访问
网页版 ↗
Windows 暂不支持
Mac 暂不支持
iPhone/iPad 暂不支持
安卓 暂不支持
华为 暂不支持
Linux 暂不支持
Agent-Eval screenshot

立即试用

GPT-4o
完整Playground →

什么是 Agent-Eval?

Agent-Eval 是一个面向 LLM 智能体的统计回归测试工具。它通过统计方法检测智能体在迭代过程中的行为漂移,帮助开发者验证智能体输出是否偏离预期。该工具专注于回归测试,能够持续监控智能体性能,确保其稳定性和可靠性。Agent-Eval 提供免费的开源方案,适合需要严格验证智能体行为的开发团队。

4.5
评分
免费增值
定价模式
2+
平台
6.3k
收藏

优点

  • 专注统计严谨性,测试结果可靠
  • 有助于维护智能体的稳定性
  • 开源免费,易于使用

缺点

  • 仅覆盖回归测试,不包含全面评估
  • 解读结果可能需要统计知识

多维度评分

4.4/ 5.0
功能完整性
4.9
🚀
性能速度
4.1
易用性
4.9
💰
性价比
4.3
🎧
客户支持
4.0
🔒
隐私安全
4.1

核心能力

调试工具
代码审查
API接口
IDE插件

同类工具对比

功能Agent-EvalKrateQuantaMindToken Relay
评分4.54.54.14.3
定价模式免费增值免费增值免费增值免费增值
起价Free / PaidFree / PaidFree / PaidFree / Paid
API
免费版
移动端
查看完整对比 →
支持平台
网页版 ↗
Windows 暂不支持
Mac 暂不支持
iPhone/iPad 暂不支持
安卓 暂不支持
华为 暂不支持
Linux 暂不支持
支持语言
English