gnaulak-redhat/lm-evaluation-harness
A framework for few-shot evaluation of language models.
A framework for few-shot evaluation of language models.
Open Data Hub operator to manage ODH component integrations
Out-Of-Tree Llama Stack Eval Provider for Red Teaming LLM Systems with Garak
Evalhub mock-provider sample
TrustyAI's Kubernetes operator
Community-contributed evaluation framework adapters for eval-hub