MiniMax M3.1 Flash Preview chega ao Token Plan sem preço nem benchmark

Interface do MiniMax Code mostrando o seletor M3.1-Flash-Preview com dropdown de esforço low, medium, high, xhigh e max

Resposta curta: a MiniMax colocou mais um modelo em produção, mas desta vez veio quase sem números. O M3.1-Flash-Preview entrou no ar em 27 de setembro de 2026 dentro do MiniMax Code e do Token Plan, sem tabela de benchmark, sem preço por token publicado, sem card oficial e sem pesos abertos. Para um modelo com a palavra Flash no nome, a falta de velocidade divulgada é o detalhe mais estranho do lançamento.

O ponto mais importante do anúncio não é o modelo em si, é o formato da entrega. A MiniMax está trocando a ordem que costuma seguir, que é abrir doc, abrir benchmark e abrir preço antes do lançamento. Aqui veio primeiro o produto fechado e a documentação veio depois, com buracos. Isso muda como avaliamos o modelo e muda como qualquer equipe deveria decidir testar ou ignorar.

M3.1-Flash-Preview em um minuto

  • Lançamento: 27 de setembro de 2026, dentro do MiniMax Code e do Token Plan.
  • Identificador oficial: MiniMax-M3.1-Flash-Preview.
  • Contexto: 1.000.000 de tokens, mesmo teto do MiniMax-M3.
  • Modalidades: texto, imagem e vídeo de entrada, saída em texto.
  • Thinking: sempre ligado, com escada de esforço low, medium, high, xhigh e max, padrão max.
  • Acesso: Token Plan e MiniMax Code, sem pay-as-you-go por enquanto.
  • Preço por token: não publicado.
  • Velocidade: não publicada.
  • Benchmark: nenhum publicado pela MiniMax nem por terceiros.
  • Open weights: não.

Nota editorial: nenhum número de benchmark ou de velocidade do M3.1-Flash-Preview aparece abaixo. Tudo que circula na web com resultados para este modelo hoje vem de agregadores que repetem o nome do modelo sem fonte primária. Onde um dado não foi publicado pela própria MiniMax, o post marca como não publicado em vez de inventar.

Mockup da interface do MiniMax Code mostrando o seletor de modelo M3.1-Flash-Preview e o dropdown de esforço com low, medium, high, xhigh e max
Material oficial distribuído pela MiniMax junto ao anúncio. Mostra o seletor de modelo e o controle de esforço que aparecem dentro do MiniMax Code. Fonte: MiniMax.

O que a MiniMax lançou, afinal?

O M3.1-Flash-Preview é a primeira coisa que a MiniMax entrega com a marca M3.1. A leitura direta é que ele se posiciona entre o MiniMax-M2.7-highspeed e o MiniMax-M3: mais leve que o M3, pensado para tarefas de desenvolvimento do dia a dia, de correção rápida a feature completa. É o típico modelo que você chama cem vezes por hora sem pensar, em vez de guardar para um caso raro e pesado.

Outra diferença importante aparece no controle de raciocínio. No MiniMax-M3 dá para desligar o thinking ou deixá-lo adaptativo. No M3.1-Flash-Preview isso não existe mais. Mandar thinking: {"type": "disabled"} ou reasoning_effort: "none" devolve HTTP 400 com a mensagem de que o modelo exige thinking adaptativo. A única alavanca de velocidade que sobra é a escada de esforço. Para uma edição de uma linha, low resolve. Para um refactor de repositório inteiro, xhigh ou max. O resto é a mesma arquitetura servindo duas trocas diferentes entre custo e qualidade.

O detalhe que pega desavisado é o default. Se você não passar reasoning_effort, o modelo assume max. Isso aparece tanto na API quanto na interface do MiniMax Code. Resultado: na primeira hora muita gente vai reclamar de latência no modelo com Flash no nome, sem perceber que está rodando no topo da escada. Para tarefas curtas, ajuste o esforço antes de pedir a primeira resposta.

O lançamento veio acompanhado de uma campanha de pontos em dobro dentro do MiniMax Code entre 28 de setembro e 7 de outubro, válida para novos e antigos usuários, e de um reset de cota do Token Plan para todo mundo. Os pontos podem ser gastos em modelos de texto, multimodal e em geração de vídeo com H3 e H3 Max. É o tipo de empurrão que a MiniMax costuma usar para puxar tráfego logo depois de subir um modelo novo.

Banner promocional do MiniMax Code anunciando créditos em dobro entre 28 de setembro e 7 de outubro de 2026
Banner oficial da campanha de créditos em dobro que acompanha o lançamento. Fonte: MiniMax.

O que a MiniMax não está dizendo

Quase tudo que costuma acompanhar um lançamento. Não tem preço por token, não tem tokens por segundo, não tem pontuação em nenhum teste público, não tem contagem de parâmetros, não tem model card. A MiniMax divulga velocidade dos outros modelos da mesma família na própria documentação, então o silêncio aqui parece escolha, não acidente.

O nome é a promessa, e a promessa está sem prova. Chamar um modelo de Flash cria uma expectativa de latência que a MiniMax não mediu em público. Como o modelo só pode ser acessado pelo MiniMax Code, nenhum rastreador independente consegue medir nada. É a primeira vez que a empresa solta um modelo que ninguém de fora consegue nem testar direito.

Vale separar o que é omissão do que é confusão do ecossistema. Quatro dias antes do lançamento, apareceu em um repositório de parceiro uma transcrição descrevendo um MiniMax M3.1 com sparse attention, quantização Q8KV4, experts roteados em NVFP4 e cabeça de decodificação especulativa DSpark. Dessas cinco afirmações, só a escada de esforço foi confirmada pela documentação oficial da MiniMax. As outras quatro continuam sem confirmação. Quem reproduzir “atenção esparsa” e “NVFP4” como se fosse especificação está repetindo a transcrição de um terceiro, que é exatamente o que o lançamento não confirmou.

M3.1-Flash-Preview contra MiniMax-M3

A comparação mais útil hoje não é contra concorrente, é entre o que a MiniMax publicou desta vez e o que publicou no MiniMax-M3 em junho de 2026. O M3 chegou com nota de arquitetura, tabela de benchmark e rate card no dia um. O M3.1-Flash-Preview chegou com uma post no X e uma entrada na documentação interna.

Campo M3.1-Flash-Preview MiniMax-M3
Lançamento 27 de setembro de 2026 1 de junho de 2026
Contexto 1.000.000 tokens 1.000.000 tokens
Entrada texto, imagem, vídeo texto, imagem, vídeo
Thinking sempre ligado, escada de esforço ligado, adaptativo ou desligado
Velocidade não publicada cerca de 100+ tps de saída
Preço por 1M tokens não publicado US$ 0,30 entrada / US$ 1,20 saída (promocional)
Open weights não sim, Hugging Face
Benchmark oficial nenhum publicado SWE-Bench Pro 59,0%, Terminal-Bench 2.1 66,0%, MCP Atlas 74,2%, BrowseComp 83,5%, OSWorld-Verified 70,06%
Acesso Token Plan e MiniMax Code API, MiniMax Code e hosts terceiros

Os números do MiniMax-M3 acima são do release da própria MiniMax em junho. Nenhum desses números é do M3.1-Flash-Preview. Quem está publicando SWE-Bench com etiqueta M3.1 está reaproveitando resultado do M3, e o M3 tem pesos abertos que você pode baixar para confirmar, enquanto o M3.1 não.

Onde conseguir usar

O caminho hoje é por dentro do MiniMax Code. Abra o produto, escolha M3.1-Flash-Preview no seletor de modelo, escolha um nível na escada de esforço antes de mandar a primeira mensagem, e faça check-in diário até 7 de outubro para coletar os pontos em dobro. Quem já tem assinatura do Token Plan não precisa de chave nova nem de contrato novo. Quem não tem, precisa fechar o plano antes, porque o M3.1-Flash-Preview não está no pay-as-you-go.

A API ainda não é rota confiável. O identificador M3.1-Flash-Preview que aparece no seletor do Code é a etiqueta da interface, não um ID de requisição confirmado pela MiniMax. Quem tentar usar o ID como modelo em uma chamada genérica vai descobrir rápido que a documentação não lista rota pública com preço, e sem preço não dá para orçamento. Para colocar o modelo em pipeline que precisa cobrar por token, espere uma rota publicada.

Como decidir testar ou esperar

Três sinais vão transformar isso de curiosidade em decisão:

  • Rate card oficial. Enquanto não tiver preço por token, não dá para comparar com o M3 em custo por tarefa.
  • Pontuações independentes. Hoje o modelo nem aparece em índices como Artificial Analysis. Sem nota de terceiros, qualquer elogio de velocidade ou qualidade é adjetivo do fabricante.
  • Pesos abertos. A MiniMax abriu o M3 em junho. Se abrir o M3.1, a reprodutibilidade some como objeção.

Resumo honesto para quem lê no dia do lançamento: o modelo está no ar, é gratuito na margem para quem já paga o Token Plan, e está completamente sem preço e sem medida nos próprios termos. Teste dentro do MiniMax Code em tarefas reais, mantenha o que depende de produção no M3 com rate card e track record, e fique de olho nos dois sinais acima. Quando chegarem, vira decisão. Antes disso, é preview curioso com Flash no nome.

Fontes consultadas

Gostaria de receber mais novidades?

Nossas publicações serão sempre voltadas ao mundo do marketing digital, design e criação de sites. Você não será importunado com assuntos que não são do seu interesse!

Compartilhe com seus familiáres e amigos!

Baita Site

Desenvolvemos soluções completas em Marketing Digital para o seu o seu negócio.

Contate-nos, solicite um orçamento, teremos o maior prazer em lhe ajudar!

baitasite@baitasite.com.br
+55 (47) 3360-7843
CNPJ 22.130.607/0001-29

Porque nos escolher?

É algo muito simples! Temos anos e uma vasta experiência com internet, nosso preço é justo e nosso trabalho profissional.

São anos de estudo e dedicação para adquirir o conhecimento necessário para executar projetos com qualidade e eficiência

Onde Estamos

Estamos localizados em um aconchegante home office em Itapema, litoral de Santa Catarina. Você está longe? Não tem problema!

Somos feras em atendimento e suporte a distância, por WhatsApp e pela internet!

Copyright 2020 - Baita Site - Criação de Sites em Itapema. Site feito com amor por nós mesmos!