Agentic AI Evaluation
Agentic AI Scenario Quality Assurance & Evaluation (Agent Error Analysis Project)
Designed and validated agentic AI evaluation scenarios by reviewing task specifications, execution traces, evaluator logic, and scoring rubrics to improve benchmark reliability for autonomous AI systems.