
A Ferramenta AI Que Mais Me Surpreendeu Essa Semana
O MiniMax M3 surpreendeu pela combinação de tamanho, contexto e abertura: é um modelo nativo multimodal com 1 milhão de tokens de contexto, arquitetura mix
O que é
A Ferramenta AI Que Mais Me Surpreendeu Essa Semana
O MiniMax M3 surpreendeu pela combinação de tamanho, contexto e abertura: é um modelo nativo multimodal com 1 milhão de tokens de contexto, arquitetura mixture-of-experts (MoE) com cerca de 428 bilhões de parâmetros totais e ~23 bilhões ativados por inferência — ou seja, capacidade de modelo gigante com custo de execução de um modelo bem menor.
O diferencial técnico é a MiniMax Sparse Attention (MSA), um operador de atenção esparsa feito para contextos de um milhão de tokens. Comparado à GQA tradicional, a MSA reduz drasticamente o custo de compute e memória da atenção mantendo a qualidade — é o que torna o contexto de 1M viável na prática.
É multimodal de verdade (texto, imagem e vídeo treinados juntos desde o primeiro passo, não colados depois) e pode ser usado de duas formas: pelo produto pronto (MiniMax Agent / API) ou rodando localmente, já que os pesos estão abertos no Hugging Face sob a licença minimax-community. Confira os termos da licença antes de uso comercial.
Como funciona
Principais recursos
Contexto de 1M tokens
Janela de um milhão de tokens — processa bases de código, documentos longos e vídeos inteiros em uma única passada.
MoE eficiente
~428B de parâmetros totais, mas só ~23B ativados por inferência — capacidade de modelo grande com custo de execução menor.
Nativamente multimodal
Texto, imagem e vídeo em treino de modalidade mista desde o primeiro passo, para fusão semântica mais profunda.
MiniMax Sparse Attention
A MSA reduz compute e memória da atenção em contextos de 1M vs. GQA, preservando qualidade.
Três modos de raciocínio
Pelo parâmetro thinking: enabled (sempre raciocina), adaptive (decide sozinho) ou disabled (latência mínima, throughput máximo).
Pesos abertos no HF
Disponível no Hugging Face sob licença minimax-community. Rode local com vLLM, SGLang ou Transformers — ou use a API/Agent.
Comece agora
Explore o repositório, contribua ou integre na sua operação.
Vá além do tutorial
Quer dominar isso na prática?
Aprofunde com acompanhamento direto na mentoria ou siga o passo a passo completo, do zero ao avançado, no curso online.