Skip to content

standard

Agent Evaluation Metric

A decomposable, turn-level scheme for measuring AI agent quality, defined by AWS, in which a composite score is built from named sub-metrics such as truthfulness and completeness computed on each turn.

Known aliases

  • AEM

Relationships

No evidence-backed relationships are recorded.

Current clusters