ai-ctrf
Version:
Generate AI summaries of test results using a wide range of AI models like OpenAI, Anthropic, Gemini, Mistral, Grok, DeepSeek, Azure, Perplexity, OpenRouter, and custom OpenAI-compatible APIs
95 lines (94 loc) • 5.19 kB
JavaScript
;
var __awaiter = (this && this.__awaiter) || function (thisArg, _arguments, P, generator) {
function adopt(value) { return value instanceof P ? value : new P(function (resolve) { resolve(value); }); }
return new (P || (P = Promise))(function (resolve, reject) {
function fulfilled(value) { try { step(generator.next(value)); } catch (e) { reject(e); } }
function rejected(value) { try { step(generator["throw"](value)); } catch (e) { reject(e); } }
function step(result) { result.done ? resolve(result.value) : adopt(result.value).then(fulfilled, rejected); }
step((generator = generator.apply(thisArg, _arguments || [])).next());
});
};
Object.defineProperty(exports, "__esModule", { value: true });
exports.claudeAI = claudeAI;
exports.claudeFailedTestSummary = claudeFailedTestSummary;
const common_1 = require("../common");
const sdk_1 = require("@anthropic-ai/sdk");
const consolidated_summary_1 = require("../consolidated-summary");
const constants_1 = require("../constants");
function claudeAI(systemPrompt, prompt, args) {
return __awaiter(this, void 0, void 0, function* () {
var _a, _b, _c;
const client = new sdk_1.Anthropic({
apiKey: process.env.ANTHROPIC_API_KEY,
});
try {
const response = yield client.messages.create({
system: systemPrompt,
messages: [{ role: 'user', content: (0, common_1.stripAnsi)(prompt) }],
max_tokens: (_a = args.maxTokens) !== null && _a !== void 0 ? _a : 300,
model: (_b = args.model) !== null && _b !== void 0 ? _b : 'claude-3-5-sonnet-20240620',
temperature: (_c = args.temperature) !== null && _c !== void 0 ? _c : 1,
});
const aiResponseArray = response.content;
const aiResponse = aiResponseArray
.filter((block) => block.type === 'text')
.map((block) => block.text)
.join(' ');
return aiResponse !== '' ? aiResponse : null;
}
catch (error) {
console.error(`Error invoking Claude AI`, error);
return null;
}
});
}
function claudeFailedTestSummary(report_1, args_1, file_1) {
return __awaiter(this, arguments, void 0, function* (report, args, file, log = false) {
var _a;
const failedTests = report.results.tests.filter((test) => test.status === 'failed');
failedTests.forEach((test) => {
if (test.extra != null) {
delete test.extra;
}
});
let logged = false;
let messageCount = 0;
for (const test of failedTests) {
if (args.maxMessages != null && messageCount >= args.maxMessages) {
break;
}
let prompt = `Report:\n${JSON.stringify(test, null, 2)}.\n\nTool:${report.results.tool.name}.\n\n Please provide a human-readable failure summary that explains why you think the test might have failed and ways to fix`;
if (args.additionalPromptContext != null &&
args.additionalPromptContext !== '') {
prompt += `\n\nAdditional Context:\n${args.additionalPromptContext}`;
}
let systemPrompt = (_a = args.systemPrompt) !== null && _a !== void 0 ? _a : constants_1.FAILED_TEST_SUMMARY_SYSTEM_PROMPT_CURRENT;
if (args.additionalSystemPromptContext != null &&
args.additionalSystemPromptContext !== '') {
systemPrompt += `\n\n${args.additionalSystemPromptContext}`;
}
const response = yield claudeAI(systemPrompt, prompt, args);
if (response != null) {
test.ai = response;
messageCount++;
if (args.log === true && !logged) {
console.log(`\n─────────────────────────────────────────────────────────────────────────────────────────────────────────────`);
console.log(`✨ AI Test Reporter Summary`);
console.log(`─────────────────────────────────────────────────────────────────────────────────────────────────────────────\n`);
logged = true;
}
if (args.log === true) {
console.log(`❌ Failed Test: ${test.name}\n`);
console.log(`${response}\n`);
}
}
}
if (args.consolidate === true) {
yield (0, consolidated_summary_1.generateConsolidatedSummary)(report, 'claude', args);
}
if (file !== undefined) {
(0, common_1.saveUpdatedReport)(file, report);
}
return report;
});
}