cudf.core.tokenize_vocabulary.TokenizeVocabulary.tokenize# TokenizeVocabulary.tokenize( text: Series, delimiter: str = '', default_id: int = -1, ) → Series[source]# Parameters: textcudf string seriesThe strings to be tokenized. delimiterstrDelimiter to identify tokens. Default is whitespace. default_idintValue to use for tokens not found in the vocabulary. Default is -1. Returns: Tokenized strings