MiniMax’s sparse attention architecture for its M3 model delivers massive speed improvements for processing large documents and code repositories.