@arizeai/phoenix-evals
Version:
A library for running evaluations for AI use cases
38 lines • 1.88 kB
JavaScript
import { CORRECTNESS_CLASSIFICATION_EVALUATOR_CONFIG } from "../__generated__/default_templates/index.js";
import { createClassificationEvaluator } from "./createClassificationEvaluator.js";
/**
* Creates a correctness evaluator function.
*
* This function returns an evaluator that determines whether a given output
* is factually accurate, complete, logically consistent, and uses precise terminology.
*
* @param args - The arguments for creating the correctness evaluator.
* @param args.model - The model to use for classification.
* @param args.choices - The possible classification choices (defaults to CORRECTNESS_CHOICES).
* @param args.promptTemplate - The prompt template to use (defaults to CORRECTNESS_TEMPLATE).
* @param args.telemetry - The telemetry to use for the evaluator.
*
* @returns An evaluator function that takes a {@link CorrectnessEvaluationRecord} and returns a classification result
* indicating whether the output is correct or incorrect.
*
* @example
* ```ts
* const evaluator = createCorrectnessEvaluator({ model: openai("gpt-4o-mini") });
* const result = await evaluator.evaluate({
* input: "What is the capital of France?",
* output: "Paris is the capital of France.",
* });
* console.log(result.label); // "correct" or "incorrect"
* ```
*/
export function createCorrectnessEvaluator(args) {
const { choices = CORRECTNESS_CLASSIFICATION_EVALUATOR_CONFIG.choices, promptTemplate = CORRECTNESS_CLASSIFICATION_EVALUATOR_CONFIG.template, optimizationDirection = CORRECTNESS_CLASSIFICATION_EVALUATOR_CONFIG.optimizationDirection, name = CORRECTNESS_CLASSIFICATION_EVALUATOR_CONFIG.name, ...rest } = args;
return createClassificationEvaluator({
...rest,
promptTemplate,
choices,
optimizationDirection,
name,
});
}
//# sourceMappingURL=createCorrectnessEvaluator.js.map