Skip to main content

EvalRunner

The runner orchestrates completions and scoring across all configured models and metrics.

EvalRunner(config=None)

.add_provider(provider_name, model, *, label=None, api_key=None, base_url=None)

Add a model to evaluate. Returns self for chaining.

.add_provider_instance(label, provider)

Add a pre-configured Provider instance.

.add_metric(metric)

Add a scoring metric. Returns self for chaining.

.run(dataset, show_progress=True)

Run the eval. Returns an EvalResults object.

RunConfig