Mosaic AI Agent Evaluation
ProductEvaluation system using human feedback, built-in metrics and LLM judges to measure generative-AI and agent quality.
- Jun 28, 2023
- —
- —
- —
- —
- 2
Releases
Mar 12, 2025Agent Evaluation gains customizable metrics and open tracingFeature update
Databricks enhanced agent evaluation with customizable LLM judges, human review workflows and OpenTelemetry-based MLflow tracing.
Jun 28, 2023Mosaic AI Agent Evaluation introducedProduct launch
Databricks introduced automated and human evaluation tooling for assessing generative-AI quality on enterprise data.

