ai-ctrf
Version:
Generate AI summaries of test results using a wide range of AI models like OpenAI, Anthropic, Gemini, Mistral, Grok, DeepSeek, Azure, Perplexity, and OpenRouter
87 lines (86 loc) • 4.53 kB
JavaScript
;
var __awaiter = (this && this.__awaiter) || function (thisArg, _arguments, P, generator) {
function adopt(value) { return value instanceof P ? value : new P(function (resolve) { resolve(value); }); }
return new (P || (P = Promise))(function (resolve, reject) {
function fulfilled(value) { try { step(generator.next(value)); } catch (e) { reject(e); } }
function rejected(value) { try { step(generator["throw"](value)); } catch (e) { reject(e); } }
function step(result) { result.done ? resolve(result.value) : adopt(result.value).then(fulfilled, rejected); }
step((generator = generator.apply(thisArg, _arguments || [])).next());
});
};
Object.defineProperty(exports, "__esModule", { value: true });
exports.claudeAI = claudeAI;
exports.claudeFailedTestSummary = claudeFailedTestSummary;
const common_1 = require("../common");
const sdk_1 = require("@anthropic-ai/sdk");
const consolidated_summary_1 = require("../consolidated-summary");
const constants_1 = require("../constants");
function claudeAI(systemPrompt, prompt, args) {
return __awaiter(this, void 0, void 0, function* () {
const client = new sdk_1.Anthropic({
apiKey: process.env['ANTHROPIC_API_KEY'],
});
try {
const response = yield client.messages.create({
system: systemPrompt,
messages: [
{ role: 'user', content: (0, common_1.stripAnsi)(prompt) },
],
max_tokens: args.maxTokens || 300,
model: args.model || "claude-3-5-sonnet-20240620",
temperature: args.temperature || 1
});
const aiResponseArray = response.content;
const aiResponse = aiResponseArray
.filter(block => block.type === 'text')
.map(block => block.text)
.join(' ');
return aiResponse || null;
}
catch (error) {
console.error(`Error invoking Claude AI`, error);
return null;
}
});
}
function claudeFailedTestSummary(report_1, args_1, file_1) {
return __awaiter(this, arguments, void 0, function* (report, args, file, log = false) {
const failedTests = report.results.tests.filter(test => test.status === 'failed');
failedTests.forEach(test => {
if (test.extra) {
delete test.extra;
}
});
let logged = false;
let messageCount = 0;
for (const test of failedTests) {
if (args.maxMessages && messageCount >= args.maxMessages) {
break;
}
const prompt = `Report:\n${JSON.stringify(test, null, 2)}.\n\nTool:${report.results.tool.name}.\n\n Please provide a human-readable failure summary that explains why you think the test might have failed and ways to fix`;
const systemPrompt = args.systemPrompt || constants_1.FAILED_TEST_SUMMARY_SYSTEM_PROMPT_CURRENT;
const response = yield claudeAI(systemPrompt, prompt, args);
if (response) {
test.ai = response;
messageCount++;
if (args.log && !logged) {
console.log(`\n─────────────────────────────────────────────────────────────────────────────────────────────────────────────`);
console.log(`✨ AI Test Reporter Summary`);
console.log(`─────────────────────────────────────────────────────────────────────────────────────────────────────────────\n`);
logged = true;
}
if (args.log) {
console.log(`❌ Failed Test: ${test.name}\n`);
console.log(`${response}\n`);
}
}
}
if (args.consolidate) {
yield (0, consolidated_summary_1.generateConsolidatedSummary)(report, "claude", args);
}
if (file) {
(0, common_1.saveUpdatedReport)(file, report);
}
return report;
});
}