Evaluation harness for Amazon Bedrock: run a fixed case suite across models and prompts, and compare scores, cost and latency between runs.

amazon-bedrock aws eval-harness genai llm-evaluation llmops
1 Open Issue Need Help Last updated: Aug 16, 2026

Open Issues Need Help

View All on GitHub

Evaluation harness for Amazon Bedrock: run a fixed case suite across models and prompts, and compare scores, cost and latency between runs.

Python
#amazon-bedrock#aws#eval-harness#genai#llm-evaluation#llmops