Speed Always Wins: A Survey on Efficient Architectures for Large Language Models
moe mamba linear-models state-space-model mixture-of-experts efficient-architectures linear-attention sparse-attention linear-rnn diffusion-llm
-
Updated
Nov 11, 2025