--- audiocraft/modules/conditioners.py.orig 2024-01-01 00:00:00.000000000 +0000 +++ audiocraft/modules/conditioners.py 2024-01-01 00:00:00.000000000 +0000 @@ -18,7 +18,6 @@ import einops from num2words import num2words -import spacy from transformers import RobertaTokenizer, T5EncoderModel, T5Tokenizer # type: ignore import torch from torch import nn @@ -194,17 +193,11 @@ """ PUNCTUATION = "?:!.,;" - def __init__(self, n_bins: int, pad_idx: int = 0, language: str = "en_core_web_sm", - lemma: bool = True, stopwords: bool = True) -> None: - self.n_bins = n_bins - self.pad_idx = pad_idx - self.lemma = lemma - self.stopwords = stopwords - try: - self.nlp = spacy.load(language) - except IOError: - spacy.cli.download(language) # type: ignore - self.nlp = spacy.load(language) + def __init__(self, *args, **kwargs) -> None: + raise NotImplementedError( + "WhiteSpaceTokenizer requires spaCy which is not available " + "on this Python version. Use the 'noop' tokenizer instead." + ) @tp.no_type_check def __call__(self, texts: tp.List[tp.Optional[str]],