nlp-tokenizer
Version:
14 lines (13 loc) • 331 B
TypeScript
declare class WordPieceTokenizer {
version: string;
vocab: {
[index: string]: number;
};
unk_token: string;
max_len: number;
constructor(vocab: {
[index: string]: number;
}, unk_token: string, max_len?: number);
tokenize(text: string): string[];
}
export default WordPieceTokenizer;