Production LLM evaluation: golden datasets, model-as-judge scoring, CI/CD regression gates
Python 7 KB Created Apr 22, 2026
Stars 0 Forks 0 Watchers 0 Open issues 0 Open PRs 0
Issues & PRs over time
Time to close issues
Time to merge PRs
Contribution distribution
Work mix
Code churn
Star history
Commit punch card
Languages
Release cadence