tokenizer = get_chat_template( tokenizer, mapping={"role": "from", "content": "value", "user": "human", "assistant": "gpt"}, chat_template="chatml",)def apply_template(examples): messages = examples["conversations"] text = [tokenizer.apply_chat_template(message, tokenize=False, add_generation_prompt=False) for message in messages] return {"text": text}dataset = load_dataset("mlabonne/FineTome-100k", split="train")dataset = dataset.map(apply_template, batched=True)