
MXFP8 (microscaling FP8) quantized variant of MiniMax-M3. Natively multimodal MoE model (~428B total, ~23B active) with a 1M-token context.
✓ Active✓ Public access⚖ Open weightsLLMMultimodalReasoning modelTool-using model
Context window
1M
tokens
Parameters
428B (23B active)
parameters
Access:APIDownloadHostedDeployment:☁ Cloud💻 Local
Overview
Classification
LLMMultimodalReasoning modelTool-using model
Access & deployment
APIDownloadHosted
CloudLocal
Weights: Open weights
Key parameters
📏 Context: 1M
🧩 Parameters: 428B (23B active)
✓ Tools
📥 Input: text, image, video
Technical specification
Context window
1M
tokens
Parameters
428B (23B active)
parameters
License
MiniMax Community License
Hardware requirements
The MXFP8 (microscaling FP8) variant reduces the memory footprint versus the BF16 original. Recommended inference frameworks: SGLang, vLLM, Transformers.
Features:✓ Tool use
Modalities
⬇ Input
textimagevideo
⬆ Output
text
Capabilities and applications
Native model capabilities
Long context
Processing very long inputs (tens to hundreds of thousands of tokens) while maintaining coherence.
Category: language
Coding
Generating, completing, explaining and debugging code across multiple programming languages.
Category: coding
Reasoning
The model's ability to perform multi-step logical inference, solve complex problems and decompose tasks into steps.
Category: reasoning
Interleaved Multimodal Input
Category: reasoning
Function Calling
Category: planning
Pricing
Technical architecture
Core Architecture
Model Form