UNPKG

gpt-tokenizer

Version:

A pure JavaScript implementation of a BPE tokenizer (Encoder/Decoder) for GPT-2 / GPT-3 / GPT-4 and other OpenAI models

41 lines (39 loc) 1.45 kB
/* eslint-disable import/extensions */ import bpeRanks from '../bpeRanks/o200k_base.js' import { GptEncoding } from '../GptEncoding.js' export * from '../constants.js' export * from '../specialTokens.js' // prettier-ignore const api = GptEncoding.getEncodingApiForModel('gpt-4.1', () => bpeRanks, {name:"gpt-4.1-2025-04-14",slug:"gpt-4.1-2025-04-14",performance:4,latency:3,modalities:{input:["text","image"],output:["text"]},context_window:1047576,max_output_tokens:32768,knowledge_cutoff:new Date(1717200000000),supported_features:["streaming","structured_outputs","predicted_outputs","distillation","function_calling","file_search","file_uploads","image_input","web_search","fine_tuning","prompt_caching"],supported_endpoints:["chat_completions","responses","assistants","batch","fine_tuning"],reasoning_tokens:false,price_data:{main:{input:10,output:30},batch:{input:5,output:15}}}) const { decode, decodeAsyncGenerator, decodeGenerator, encode, encodeGenerator, isWithinTokenLimit, countTokens, encodeChat, encodeChatGenerator, vocabularySize, setMergeCacheSize, clearMergeCache, estimateCost, } = api export { clearMergeCache, countTokens, decode, decodeAsyncGenerator, decodeGenerator, encode, encodeChat, encodeChatGenerator, encodeGenerator, estimateCost, isWithinTokenLimit, setMergeCacheSize, vocabularySize, } // eslint-disable-next-line import/no-default-export export default api