Skip to content
Judgment Labs
Esc
↑↓navigate↵open⌘Jpreview
On this page

ScoringResult

The combined result of running scorers against a single example.

Returned by Evaluation.run(). Inspect scorers_data for per-scorer values, errors, and metadata.

results = evaluation.run(
    examples=examples,
    scorers=["faithfulness", "answer_relevancy"],
    eval_run_name="nightly",
)
for result in results:
    for scorer in result.scorers_data:
        print(f"{scorer.name}: {scorer.value}")

Attributes

PropType
scorers_data?List[ScorerData]

Per-scorer results (see ScorerData).

TypeList[ScorerData]
data_object?Union[TraceSpan, Example]

The Example or TraceSpan that was scored.

TypeUnion[TraceSpan, Example]
name?Optional[str]

The evaluation run name.

TypeOptional[str]
DefaultNone
trace_id?Optional[str]

Associated trace ID, if applicable.

TypeOptional[str]
DefaultNone
run_duration?Optional[float]

How long the evaluation took (seconds).

TypeOptional[float]
DefaultNone
evaluation_cost?Optional[float]

Total cost in USD.

TypeOptional[float]
DefaultNone

to_dict()

def to_dict() -> APIScoringResult:

Returns

APIScoringResult

Was this page helpful?