Skip to content

Add MiniMax M3 MI355X optimization blog - #313

Open
tanpinsiang wants to merge 1 commit into
vllm-project:mainfrom
tanpinsiang:blog/minimax-m3-mi355x
Open

Add MiniMax M3 MI355X optimization blog#313
tanpinsiang wants to merge 1 commit into
vllm-project:mainfrom
tanpinsiang:blog/minimax-m3-mi355x

Conversation

@tanpinsiang

Copy link
Copy Markdown
Contributor

Summary

Adds a follow-up blog post on optimizing MiniMax M3 serving with vLLM on AMD Instinct MI355X.
the post follows the bottleneck as it moves, from rank-local GEMM shapes and repeated MoE work to sparse-attention data movement, collective dispatch, P/D topology, and AgentX KV-cache capacity.

Co-authored-by: vllmellm <vllm.ellm@embeddedllm.com>
Co-authored-by: Hongxia Yang <hongxia.yang@amd.com>
Co-authored-by: Jun Kang Chow <junkangchow@gmail.com>
Signed-off-by: Tan Pin Siang <tanpinsiang@gmail.com>
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant