batch_size = 32 max_seqlen = 100 model = torch.compile(model) benchmark( lambda: generate_sequence( model, max_seqlen=max_seqlen, batch_size=batch_size, use_cache=True, use_static_cache=True ) )