import re from youtube_transcript_api import YouTubeTranscriptApi youtube_url = "video link here" # extract video ID with regex video_id_regex = r'(?:v=|/)([0-9A-Za-z_-]{11}).*' match = re.search(video_id_regex, youtube_url) if match: return match.group(1) else: return None # extract transcript text_list = [transcript[i]['text'] for i in range(len(transcript))] transcript_text = 'n'.join(text_list)