ai-ctrf
Version:
Generate AI summaries of test results using a wide range of AI models like OpenAI, Anthropic, Gemini, Mistral, Grok, DeepSeek, Azure, Perplexity, OpenRouter, and custom OpenAI-compatible APIs
93 lines (92 loc) • 5.43 kB
JavaScript
;
var __awaiter = (this && this.__awaiter) || function (thisArg, _arguments, P, generator) {
function adopt(value) { return value instanceof P ? value : new P(function (resolve) { resolve(value); }); }
return new (P || (P = Promise))(function (resolve, reject) {
function fulfilled(value) { try { step(generator.next(value)); } catch (e) { reject(e); } }
function rejected(value) { try { step(generator["throw"](value)); } catch (e) { reject(e); } }
function step(result) { result.done ? resolve(result.value) : adopt(result.value).then(fulfilled, rejected); }
step((generator = generator.apply(thisArg, _arguments || [])).next());
});
};
var __importDefault = (this && this.__importDefault) || function (mod) {
return (mod && mod.__esModule) ? mod : { "default": mod };
};
Object.defineProperty(exports, "__esModule", { value: true });
exports.openAI = openAI;
exports.openAIFailedTestSummary = openAIFailedTestSummary;
const openai_1 = __importDefault(require("openai"));
const common_1 = require("../common");
const consolidated_summary_1 = require("../consolidated-summary");
const constants_1 = require("../constants");
function openAI(systemPrompt, prompt, args) {
return __awaiter(this, void 0, void 0, function* () {
var _a, _b, _c, _d;
const client = new openai_1.default({
apiKey: process.env.OPENAI_API_KEY,
});
try {
const response = yield client.chat.completions.create(Object.assign(Object.assign({ model: (_a = args.model) !== null && _a !== void 0 ? _a : 'gpt-4o', messages: [
{ role: 'system', content: systemPrompt },
{ role: 'user', content: (0, common_1.stripAnsi)(prompt) },
], max_tokens: (_b = args.maxTokens) !== null && _b !== void 0 ? _b : null, frequency_penalty: args.frequencyPenalty, presence_penalty: args.presencePenalty }, (args.temperature !== undefined
? { temperature: args.temperature }
: {})), (args.topP !== undefined ? { top_p: args.topP } : {})));
return (_d = (_c = response.choices[0].message) === null || _c === void 0 ? void 0 : _c.content) !== null && _d !== void 0 ? _d : null;
}
catch (error) {
console.error(`Error invoking OpenAI`, error);
return null;
}
});
}
function openAIFailedTestSummary(report_1, args_1, file_1) {
return __awaiter(this, arguments, void 0, function* (report, args, file, log = false) {
var _a;
const failedTests = report.results.tests.filter((test) => test.status === 'failed');
failedTests.forEach((test) => {
if (test.extra != null) {
delete test.extra;
}
});
let logged = false;
let messageCount = 0;
for (const test of failedTests) {
if (args.maxMessages != null && messageCount >= args.maxMessages) {
break;
}
// const prompt = generateFailedTestPrompt(test, report);
let prompt = `Report:\n${JSON.stringify(test, null, 2)}.\n\nTool:${report.results.tool.name}.\n\n Please provide a human-readable failure summary that explains why you think the test might have failed and ways to fix`;
if (args.additionalPromptContext != null &&
args.additionalPromptContext !== '') {
prompt += `\n\nAdditional Context:\n${args.additionalPromptContext}`;
}
let systemPrompt = (_a = args.systemPrompt) !== null && _a !== void 0 ? _a : constants_1.FAILED_TEST_SUMMARY_SYSTEM_PROMPT_CURRENT;
if (args.additionalSystemPromptContext != null &&
args.additionalSystemPromptContext !== '') {
systemPrompt += `\n\n${args.additionalSystemPromptContext}`;
}
const response = yield openAI(systemPrompt, prompt, args);
if (response != null) {
test.ai = response;
messageCount++;
if (args.log === true && !logged) {
console.log(`\n─────────────────────────────────────────────────────────────────────────────────────────────────────────────`);
console.log(`✨ AI Test Reporter Summary`);
console.log(`─────────────────────────────────────────────────────────────────────────────────────────────────────────────\n`);
logged = true;
}
if (args.log === true) {
console.log(`❌ Failed Test: ${test.name}\n`);
console.log(`${response}\n`);
}
}
}
if (args.consolidate === true) {
yield (0, consolidated_summary_1.generateConsolidatedSummary)(report, 'openai', args);
}
if (file !== undefined) {
(0, common_1.saveUpdatedReport)(file, report);
}
return report;
});
}