review = df['review_cleaned'].iloc[0] token_ids = tokenizer.encode( review, max_length = 512, padding = 'max_length', truncation = True, return_tensors = 'pt') print(token_ids)