import { AccuracyEval } from "@agentium/eval";
import { Agent, openai } from "@agentium/core";
const agent = new Agent({ name: "qa-bot", model: openai(process.env.OPENAI_MODEL ?? "gpt-6.1-sol") });
const evaluator = new AccuracyEval({
name: "qa-accuracy",
agent,
judge: openai(process.env.OPENAI_FAST_MODEL ?? "gpt-6-luna"),
cases: [
{ name: "capital", input: "What is the capital of France?", expected: "Paris" },
{ name: "math", input: "What is 2+2?", expected: "4" },
],
threshold: 0.8,
});
try {
const result = await evaluator.run();
console.log(`${result.passed}/${result.total} passed`);
if (result.failed > 0) process.exitCode = 1;
} finally {
await agent.close();
}