# Simulate MoE (Mixture of Experts) scenario num_experts = 4 tokens_per_expert = [128, 96, 112, 144] # Variable tokens per expert expert_dim = 512 # Create contiguous tensor for all tokens total_tokens = sum(tokens_per_expert) alignment = deep_gemm.get_m_alignment_for_contiguous_layout() # 128 # Align each expert's token count aligned_tokens = [((t + alignment - 1) // alignment) * alignment for t in tokens_per_expert] total_aligned = sum(aligned_tokens) print(f"Original tokens: {tokens_per_expert}") print(f"Aligned tokens: {aligned_tokens}") print(f"Total aligned: {total_aligned}")