#initialize tokenizer model vectorizer_model = CountVectorizer(stop_words="english") #initialize ctfidf model to weight terms ctfidf_model = ClassTfidfTransformer() #add tokenizer and ctfidf to pipeline topic_model.update_topics(data['all_text'].tolist(), vectorizer_model=vectorizer_model, ctfidf_model=ctfidf_model)