MiniMax AI vale a pena? M3, H3 e preços (agosto de 2026)

MiniMax AI vale a pena? Veja como M3, H3, Code e Hub funcionam, quanto custam e quando ChatGPT, Claude ou Runway são escolhas melhores para sua equipe.

Thursday, September 3, 2026Omid Saffari
MiniMax AI vale a pena? M3, H3 e preços (agosto de 2026)

O MiniMax AI vale a pena se concentrar M3 para programação, H3 para vídeo, Speech 2.8, Music 3.0 e APIs de baixo custo em um só fornecedor for mais importante do que ter um aplicativo de chat refinado. Os planos começam em $20 por mês, o H3 custa $0.08 por segundo em 768P e, para equipes dos EUA, a principal ressalva é que os pesos abertos do H3 exigem autorização específica, embora a API hospedada esteja disponível globalmente.

O que é o MiniMax AI, na prática

A MiniMax é uma empresa de modelos de IA com vários produtos que compartilham modelos e cobrança, mas não funcionam como um único assistente integrado. O M3 é seu modelo de linguagem e programação com contexto longo. O MiniMax Code é a interface de agentes para programação e tarefas gerais. O Hub é uma tela criativa para desktop que coordena agentes de texto, imagem, vídeo e áudio. O H3 é o novo modelo de vídeo. Speech 2.8, Music 3.0, image-01 e as APIs da Open Platform completam a linha de mídia. Essa variedade é justamente o atrativo, mas também explica por que o primeiro contato pode confundir: página inicial, Code, Hub, Audio, Hailuo, Token Plan e console de API são portas diferentes para a mesma empresa. Portanto, faz mais sentido avaliar a MiniMax como um ecossistema do que como um substituto isolado do ChatGPT.

Página inicial da MiniMax com os produtos M3, H3, Code, Hub, voz e música
MiniMax AI

MiniMax AI vale a pena? Comparativo rápido

A MiniMax entrega mais variedade por dólar, enquanto ChatGPT, Claude e Runway resolvem com mais clareza problemas de compra específicos. Os preços abaixo foram conferidos nas páginas oficiais dos fornecedores em 6 de agosto de 2026.

OpçãoMelhor paraPlano pago inicialEvite se
MiniMaxQuem desenvolve soluções combinando M3, H3, Speech 2.8 e Music 3.0Plus por $20/mês ou $200/anoVocê quer um único assistente geral refinado ou direitos simples para hospedar o H3 por conta própria nos EUA
ChatGPTUm espaço de trabalho geral baseado em GPT-5.6 Sol, arquivos, busca, voz e projetosGo por $8/mês; Plus por $20/mêsSua prioridade é vídeo com pesos abertos ou controle de custos de mídia via API
ClaudeProgramação e trabalho intelectual de alto impacto com Sonnet 5 ou Opus 5Pro por $17/mês no plano anual; $20 no mensalVocê precisa de geração nativa de vídeo e de uma única plataforma multimídia
RunwayUm fluxo criativo centrado em vídeo, com Gen-4.5 e outros modelos de geraçãoStandard por $12/mês no plano anual; $15 no mensalVocê precisa de código com contexto longo ou tarefas gerais com agentes

A prioridade do trabalho é o que define a escolha. A MiniMax faz sentido quando um fluxo técnico usa pelo menos dois de seus pontos fortes, como M3 com H3 ou H3 com Speech 2.8. Se uma única tarefa domina o processo, escolha a solução especialista. Pagar pela amplitude da MiniMax para usar apenas o chat acrescenta complexidade sem trazer retorno.

Para quem a MiniMax serve — e quem deve procurar outra opção

A MiniMax atende bem quem desenvolve produtos técnicos e profissionais de criação capazes de transformar preços unitários baixos em fluxos repetíveis. Já para quem julga uma ferramenta principalmente pela fluidez de um único aplicativo de consumo, ela dificilmente será a melhor escolha inicial.

Escolha a MiniMax para modelos e mídia em grande volume

Quem desenvolve um produto técnico sozinho pode usar o M3 pelo MiniMax Code ou por um cliente de programação já adotado e, depois, chamar as APIs de H3, voz, música e imagem na mesma plataforma. Essa combinação ganha valor quando o produto precisa de narração para a central de ajuda, vídeos curtos, variações de imagem e um agente que mantenha todo o pipeline. A vantagem vem de trabalhar com menos fornecedores e pagar tarifas baixas por uso, não de uma interface milagrosa.

Um fundador com capital captado ou o CTO de uma empresa de médio porte deve considerar a MiniMax quando contexto extenso de repositório e controle de custos são igualmente importantes. O contexto hospedado do M3 chega a 1M tokens, o Token Plan funciona com várias ferramentas de programação e o plano de pagamento por uso começa em $0.30 por milhão de tokens de entrada abaixo de 512K de contexto. O teste ideal é uma rotina cara e repetível, com critérios claros de aceitação, e não a troca do modelo de toda a empresa.

Para profissionais de criação, a MiniMax merece entrar na lista quando vídeo com áudio nativo é essencial. O H3 gera clipes de 4 a 15 segundos com áudio estéreo e aceita texto, imagens, vídeo e áudio como referências. O Hub organiza esses recursos em uma tela de trabalho. Esse é um motivo bem mais específico para escolher a MiniMax do que um chat genérico.

Escolha o ChatGPT para ter um único espaço de trabalho geral

O ChatGPT é a escolha inicial mais segura para um profissional sem perfil técnico que quer arquivos, busca, voz, projetos, tarefas agendadas e um assistente versátil em um ambiente conhecido. Nos planos individuais atuais, o Go começa em $8 por mês, enquanto o Plus custa os mesmos $20 mensais do MiniMax Plus. A MiniMax cobre mais modalidades de modelo, mas exige que o comprador entenda qual interface e qual saldo pagam por cada tarefa.

Escolha o Claude quando a qualidade das decisões de código pesar mais que o preço por unidade

O Claude merece prioridade para um desenvolvedor sênior cujo custo é determinado mais pelo tempo de revisão e por alterações malsucedidas do que pelos tokens. O Claude Pro custa $20 no pagamento mês a mês, ou o equivalente a $17 mensais quando os $200 do plano anual são pagos de uma vez. O MiniMax M3 merece um teste controlado para tarefas de contexto longo e grande volume, mas benchmarks conduzidos pelo próprio fornecedor não substituem uma comparação de patches aceitos, novas tentativas, erros de ferramenta e minutos de revisão no mesmo repositório.

Escolha o Runway quando a entrega final acontece em um editor de vídeo

O Runway é a opção mais clara quando uma equipe criativa busca um produto centrado em vídeo, escolha de modelos, economia compartilhada de produção e um fluxo consolidado de créditos. O Standard custa $15 por mês ou $12 mensais no plano anual e inclui 625 créditos por mês — o equivalente, segundo o Runway, a 52 segundos de Gen-4.5. O MiniMax H3 pode sair mais barato por segundo gerado, mas o custo bruto de geração não compra um processo maduro de revisão e edição. Se vídeo for a única questão de compra, o comparativo de geradores de vídeo com IA oferece um panorama melhor.

Os quatro recursos da MiniMax que realmente importam

A MiniMax merece consideração por quatro fluxos concretos: trabalho com agentes e contexto longo, vídeo orientado por referências, produção criativa coordenada e geração de voz de baixo custo.

1. MiniMax M3 e Code barateiam tarefas de agentes com contexto longo

O MiniMax M3 é um modelo de programação e agentes com janela de contexto hospedada de até 1M tokens e mínimo garantido de 512K. Segundo a MiniMax, ele recebe entradas multimodais nativas e foi criado para decompor tarefas, chamar ferramentas e executar trabalhos prolongados. Na prática, isso é útil quando a mesma sessão precisa carregar um repositório grande, o histórico de issues, capturas de tela e saídas de ferramentas.

Página do modelo MiniMax M3 destacando programação, agentes, multimodalidade e contexto de um milhão de tokens
MiniMax M3

As evidências de maior destaque na página ainda vêm do próprio fornecedor. A MiniMax afirma que o M3 reproduziu um artigo acadêmico ao longo de quase 12 horas, gerando 18 commits e 23 figuras experimentais. Também relata uma execução de otimização CUDA de aproximadamente 24 horas, com 147 envios e 1,959 chamadas de ferramentas. Os exemplos deixam claro qual é a carga de trabalho pretendida, mas não provam que o M3 superará Claude ou ChatGPT no seu código.

O MiniMax Code é a interface pronta para usar esse modelo. Ele acrescenta memória persistente, skills reutilizáveis, Agent Teams e acesso pelo desktop ou pela web. Um Token Plan permite executar o Code diretamente ou fornece uma chave sk-cp separada para ferramentas de programação compatíveis com OpenAI que estejam na lista, como Cursor, Codex CLI, Cline, Claude Code ou OpenCode.

Interface web do MiniMax Code com M3, Agent Teams, memória e skills
MiniMax Code

Este fluxo torna a relação entre custo e resultado mensurável:

  1. Escolha uma tarefa de repositório

    Use uma issue bem delimitada, com testes existentes, uma falha conhecida e alguém responsável por aceitar ou rejeitar o resultado. Uma migração do repositório inteiro é ampla demais para a primeira comparação.

  2. Mantenha a configuração constante

    Conecte o M3 ao mesmo cliente de programação usado pelo modelo atual. Preserve permissões de ferramentas, comandos de teste, timeouts e critérios de aceitação, para que a comparação meça o modelo, não uma interface nova.

  3. Calcule o preço da solicitação completa

    Uma solicitação com 200,000 tokens de entrada sem cache e 20,000 tokens de saída custa $0.084 nas tarifas padrão do M3 abaixo de 512K: $0.06 pela entrada e $0.024 pela saída. Uma solicitação com entrada de 700,000 tokens e saída de 30,000 custa $0.492 na tarifa mais alta para contexto longo.

  4. Conte os resultados aceitos

    Registre o gasto com o modelo, o tempo decorrido, novas tentativas, chamadas de ferramenta malsucedidas, arquivos alterados e minutos de revisão. Divida o custo total pelo número de tarefas aceitas. Uma saída barata que exige conserto não representa trabalho barato.

Ponto de equilíbrio entre pagamento por uso do MiniMax M3 e o Plus em 239 solicitações grandes por mês
Com a carga informada, o Plus supera o pagamento por uso perto de 239 solicitações mensais.

2. MiniMax H3 reúne referências, vídeo e áudio estéreo nativo

O MiniMax H3 é o principal motivo para olhar além do mercado de chat e programação. Ele aceita um briefing multimodal e gera vídeos de 4 a 15 segundos a 24 FPS, com áudio estéreo de 32 kHz. O modo de referência permite até 9 imagens, 3 vídeos, 3 clipes de áudio e 12 arquivos no total — o suficiente para definir pessoa ou objeto, linguagem visual, referência de movimento e referência de voz em um único trabalho.

Página oficial do MiniMax H3 mostrando geração de vídeo multimodal com áudio nativo
MiniMax H3

É possível estruturar uma cena de lançamento de produto sem apostar que um único prompt de texto dará conta de todo o briefing:

  1. Envie as fotos do produto como imagens de referência e um vídeo curto como referência de movimento.
  2. Acrescente a narração ou a identidade da voz como referência de áudio. O áudio não pode ser a única entrada de referência.
  3. Defina uma duração de 4 a 15 segundos e uma proporção compatível. A geração de texto para vídeo exige uma proporção explícita; a de imagem para vídeo acompanha a imagem de entrada.
  4. Gere em 768P na etapa de seleção e passe a cena aprovada para 2K.

A cobrança é direta. Uma saída de 10 segundos em 768P custa $0.80. A mesma duração em 2K custa $1.30, e uma saída de 15 segundos em 2K custa $1.95. Uma geração de 10 segundos em 2K que também use um vídeo de referência de 10 segundos custa $2.60, pois a MiniMax cobra tanto a duração da saída quanto a do vídeo de referência a $0.13 por segundo. Referências de áudio são gratuitas, as primeiras 5 imagens de referência são gratuitas e cada imagem seguinte custa $0.04.

O ComfyUI lançou templates nativos do H3 para texto para vídeo, imagem para vídeo e referência para vídeo já na estreia. Com isso, os checkpoints Base em 768P podem ser usados em um fluxo baseado em nós, mas o sistema hospedado completo não passa a funcionar localmente. Essa diferença será a principal limitação analisada mais adiante.

3. MiniMax Hub coordena um briefing criativo em diferentes mídias

O MiniMax Hub é a tentativa de reunir os diferentes modelos da empresa em uma única tela de produção. O fluxo público começa com um briefing, divide o trabalho em roteiro, storyboard, imagem, vídeo, música, locução e edição e pode acionar, em paralelo, agentes de texto, imagem, vídeo e áudio.

Tela do MiniMax Hub coordenando agentes de roteiro, storyboard, imagem, vídeo, música e voz
MiniMax Hub

O fluxo mais realista é uma campanha pequena, não uma obra-prima criada de uma só vez. Entregue ao Hub um briefing de produto, o público-alvo, as alegações aprovadas, os materiais de referência e a lista de entregas. O agente de texto pode preparar roteiro e legendas; o de imagem, definir opções visuais; o de vídeo, montar sequências curtas; e o de áudio, produzir locução ou música. Revise cada etapa antes que o próximo modelo gaste mais créditos. Depois, exporte os materiais selecionados para a ferramenta profissional que fará a finalização.

Essa revisão final é indispensável. A orquestração de agentes reduz a troca entre ferramentas, mas não elimina direção de arte, liberação de direitos, conferência de marca nem decisões de edição. O Hub entrega mais valor quando transforma uma receita recorrente de campanha em uma skill reutilizável. Ele convence menos quando a equipe já opera um fluxo maduro centrado em um editor e só precisa de um modelo de geração.

4. MiniMax Speech 2.8 deixa o custo de narração previsível

O MiniMax Speech 2.8 aceita tags nativas de som e, segundo a página atual de lançamento, clona uma voz a partir de uma amostra de 10 segundos. A API síncrona recebe até 10,000 caracteres por solicitação; a rota assíncrona, até 1M caracteres. Há suporte a MP3, PCM, FLAC e WAV, sendo que WAV só funciona sem streaming.

Página do MiniMax Speech 2.8 com tags de som, clonagem de voz e exemplos em vários idiomas
MiniMax Speech 2.8

Para uma narração de treinamento com 50,000 caracteres, o speech-2.8-turbo custa $3, e o speech-2.8-hd, $5. Uma clonagem rápida de voz acrescenta $1.50 no primeiro uso, enquanto uma voz criada com Voice Design custa $3. O processo é simples: obtenha uma amostra de voz com a devida autorização, gere um trecho curto para aprovação, fixe pronúncia e ritmo, envie o roteiro completo pelo endpoint assíncrono e salve o resultado antes que o link temporário de entrega expire.

Os preços de música e imagem também facilitam o cálculo de pequenos lotes complementares. Vinte músicas do Music-3.0 custam $3 a $0.15 cada, e 100 imagens do image-01 custam $0.35 a $0.0035 por unidade. Explorar alternativas fica barato com esses valores. Seleção, direitos, consistência e finalização continuam sendo as partes caras do resultado.

Preços do MiniMax AI: todos os planos atuais

O preço do MiniMax AI é baixo na camada de modelos e complexo na camada da conta. O sistema público reúne Token Plans, créditos pré-pagos separados, saldo de API com pagamento por uso, Audio Subscriptions e Video Packages antigos. Todas as tarifas abaixo foram verificadas no resumo de preços da MiniMax e nas páginas vinculadas em 6 de agosto de 2026.

Página de preços do MiniMax Token Plan com Plus, Max, Ultra, créditos e limites dos planos
Preços do MiniMax Token Plan

Assinaturas do Token Plan

PlanoMensalAnualO que muda a decisão
Plus$20$200, ou o equivalente a $16.67/mêsCerca de 1.7B tokens M3/mês, 3 a 4 agentes, sem geração de vídeo incluída
Max$50$500, ou o equivalente a $41.67/mêsCerca de 5.1B tokens M3/mês, 4 a 5 agentes, 3 clipes de vídeo/dia
Ultra$120$1,200, ou o equivalente a $100/mêsCerca de 12.5B tokens M3/mês, 6 a 7 agentes, 5 clipes de vídeo/dia
TeamNão divulgado publicamenteNão divulgado publicamenteCompra por usuário para equipes de 5 ou mais pessoas; fale com a MiniMax

Os pacotes de créditos pré-pagos do Token Plan são Starter, por $5 e 5,000 créditos; Growth, por $25 e 25,000; e High Volume, por $100 e 100,000. Os créditos comprados são válidos por um ano. Eles não são o mesmo saldo usado pela API padrão com pagamento por uso.

As regras de cota merecem tanta atenção quanto as estimativas bilionárias de tokens. O uso incluído é controlado por janelas móveis de 5 horas e semanais, a cota não consumida não passa para o ciclo de cobrança seguinte e a capacidade pode ser reduzida nos horários de pico. Para produção, a recomendação explícita da MiniMax é pagar pelo uso.

API M3 com pagamento por uso

No pagamento por uso, a MiniMax separa os serviços Standard e Priority e aumenta os preços quando a entrada ultrapassa 512K tokens.

Preços da MiniMax por uso para M3, H3, voz, música, imagem e ferramentas
Preços da API MiniMax

Na prioridade Standard e com entrada de no máximo 512K, o M3 custa $0.30 por milhão de tokens de entrada, $1.20 por milhão de tokens de saída e $0.06 por milhão de leituras do cache de prompts. Acima de 512K, as tarifas sobem para $0.60 na entrada, $2.40 na saída e $0.12 nas leituras de cache.

A tarifa Priority equivale a 1.5 vezes a Standard. Com 512K ou menos, os preços por milhão são $0.45 na entrada, $1.80 na saída e $0.09 nas leituras de cache. Acima de 512K, passam a $0.90, $3.60 e $0.18, respectivamente.

O M2.7 permanece em $0.30 por milhão de tokens de entrada, $1.20 de saída, $0.06 de leitura de cache e $0.375 de gravação de cache. O M2.7-highspeed dobra entrada e saída para $0.60 e $2.40, mantendo as mesmas tarifas de cache.

Tarifas da API do H3 e de mídia

O MiniMax H3 custa $0.08 por segundo de saída em 768P e $0.13 por segundo em 2K. Regenerar um resultado existente em 768P para 2K custa $0.05 por segundo de saída, com nova cobrança dos materiais de entrada originais. As primeiras 5 imagens de referência são gratuitas; as seguintes custam $0.04 cada durante a geração e $0.025 na regeneração. O áudio de referência é gratuito. O vídeo de referência é cobrado por segundo, conforme a tarifa da resolução de saída escolhida.

O speech-2.8-turbo custa $60 por milhão de caracteres, e o speech-2.8-hd, $100. A clonagem rápida custa $1.50 por voz, e o Voice Design, $3 por voz. O Music-3.0 sai por $0.15 para até 5 minutos e oferece um modelo gratuito com 3 RPM. Gerar ou editar letras custa $0.01 por música. O Image-01 custa $0.0035 por imagem, o API-vlm custa $0.01 por solicitação e a busca web no servidor custa $0.01 por solicitação.

Todos os planos de Audio Subscription

A MiniMax vende cinco assinaturas fixas de voz, além de uma modalidade personalizada:

  • Starter: $5 por mês, $13.50 por 3 meses ou $48 por ano; 100,000 pontos de áudio/mês, 10 RPM e 10 espaços para vozes.
  • Standard: $30 por mês, $81 por 3 meses ou $288 por ano; 300,000 pontos, 50 RPM e 100 espaços para vozes.
  • Pro: $99 por mês, $267 por 3 meses ou $950 por ano; 1.1M pontos, 200 RPM e 250 espaços para vozes.
  • Scale: $249 por mês, $672 por 3 meses ou $2,390 por ano; 3.3M pontos, 500 RPM e 500 espaços para vozes.
  • Business: $999 por mês, $2,697 por 3 meses ou $9,590 por ano; 20M pontos, 800 RPM e 800 espaços para vozes.
  • Custom: capacidade negociada, RPM/TPM ilimitados, atualizações prioritárias e garantias de serviço negociadas.

A página de assinaturas trabalha com pontos e não promete uma conversão universal para caracteres. Compare a carga de trabalho pretendida no console de cobrança antes de interpretar o total de pontos como uma quantidade fixa de minutos de narração.

Todos os planos antigos de Video Package

Os Video Packages de um mês da MiniMax são Standard, por $1,000, com 3,760 pontos de vídeo e 20 RPM; Pro, por $2,500, com 9,920 pontos e 30 RPM; Scale, por $4,500, com 18,900 pontos e 40 RPM; e Business, por $6,000, com 26,780 pontos e 50 RPM. O plano Custom oferece pontos negociados e RPM/TPM ilimitados.

Esses pacotes funcionam com a série Hailuo e ainda não oferecem suporte ao H3. A quantidade não utilizada é zerada quando o pacote expira. Quem chegou atraído pelo H3 não deve presumir que um grande pacote Hailuo dará desconto no uso do H3.

Limitações que podem mudar a decisão

A MiniMax tem quatro limitações importantes o bastante para definir quem deve comprá-la e como implantá-la.

Os pesos abertos do H3 são parciais e têm restrições territoriais

O MiniMax H3 oferece pesos abertos apenas na camada Base. Os checkpoints liberados geram em 768P. O H3-Context-IR, que a MiniMax considera decisivo para a qualidade final, continua hospedado. O H3-Regenerate-2K também não é aberto, e a versão inicial não inclui a implementação de atenção esparsa do modelo. Nos comandos oficiais para SGLang, a própria MiniMax especifica 4 GPUs para cada checkpoint de tarefa.

A licença impõe uma restrição ainda maior ao público do site, voltado prioritariamente aos EUA. A licença padrão H3 Community License classifica Estados Unidos, União Europeia, Reino Unido e Coreia do Sul como territórios excluídos. Organizações nessas regiões podem solicitar autorização formal, e a API hospedada continua disponível globalmente. Produtos comerciais que geram mais de $20M em receita anual também precisam de autorização prévia por escrito.

Portanto, “disponível para download” não significa “pronto para produção nos EUA”. Use a API hospedada durante a avaliação e obtenha a autorização correta antes de criar um produto local baseado nesses pesos. O guia mais amplo sobre modelos de pesos abertos explica por que arquivos, licença, hardware e um caminho reproduzível de serving são quatro requisitos distintos.

Arquitetura do MiniMax H3 com Context IR hospedado, Base local em 768P, regeneração em 2K hospedada, quatro GPUs e controle de licença
O H3 Base disponível para download é apenas a parte intermediária do fluxo completo em 2K.

O Token Plan não é um SLA de produção

Segundo a MiniMax, o Token Plan foi criado para uso individual e interativo por desenvolvedores, e o pagamento por uso é a opção recomendada para produção. Limites móveis de 5 horas e semanais, cotas não acumuláveis e restrição dinâmica em horários de pico são aceitáveis para um agente pessoal de programação. Para um serviço voltado a clientes, porém, não equivalem a um compromisso de capacidade.

Use o Token Plan para conhecer o modelo e apoiar tarefas interativas. Em produção, migre a rotina para pagamento por uso, com timeouts, novas tentativas, observabilidade e limites de gasto explícitos.

A cobrança é fragmentada entre os produtos

As tarifas baixas da MiniMax ficam distribuídas em vários controles de saldo. Cota do Token Plan, créditos do Token Plan, saldo de pagamento por uso, pontos de áudio e pontos de vídeo não formam um fundo intercambiável. Os Video Packages não incluem H3. O preço por usuário do Team não é público. Por isso, não dá para uma pessoa responsável pelas finanças estimar o total mensal olhando apenas para os cartões Plus, Max e Ultra.

Monte a previsão por carga de trabalho: entrada e saída do M3, duração da saída e da referência do H3, caracteres de voz, músicas, quantidade de imagens e eventuais assinaturas especializadas. Em seguida, atribua cada linha ao saldo correspondente. É um processo trabalhoso, mas evita que uma tarifa de destaque muito baixa esconda créditos parados ou uma segunda cobrança.

As evidências de desempenho mais fortes vêm do próprio fornecedor

A MiniMax divulga exemplos ambiciosos de tarefas prolongadas e benchmarks do M3. Eles ajudam a escolher um teste, não a dispensá-lo. A página atual do M3 também fala em “pesos abertos”, enquanto a seção de acesso informa que a abertura completa do código ocorrerá em breve. Antes de planejar uma infraestrutura privada para o M3, confirme novamente quais são os arquivos, a licença, o framework de serving e a data de lançamento.

A análise do Kling AI adota o mesmo critério para vídeo: o modelo conquista espaço por cenas aprovadas e fluxos controláveis, não pela melhor demonstração de lançamento. A MiniMax merece o mesmo rigor.

O ponto forte
O que faz bem
10 points

  • M3, H3, voz, música, imagem e interfaces de agentes no mesmo fornecedor
  • Tarifas baixas da API do M3 e preço transparente do H3 por segundo
  • Entradas de referência do H3 combinam imagens, vídeo e áudio com saída estéreo nativa
  • MiniMax Code funciona diretamente ou por vários clientes de programação consolidados
  • Os preços publicados têm detalhes suficientes para calcular o custo de cada carga de trabalho
  • A versão local do H3 não inclui Context-IR, regeneração em 2K nem atenção esparsa
  • Os direitos padrão sobre os pesos abertos do H3 excluem EUA, UE, Reino Unido e Coreia do Sul sem autorização
  • As cotas do Token Plan podem ser reduzidas e não se destinam à produção
  • Saldos e pacotes separados dificultam a previsão do custo total
  • O preço público do Team não é divulgado, e os pacotes antigos de vídeo não incluem H3

MiniMax AI vale a pena? Veredito

A MiniMax oferece um ótimo custo-benefício para compradores técnicos com uma carga multimodal específica, mas não é a assinatura de IA ideal para todo mundo.

Escolha a MiniMax quando pelo menos duas destas condições forem verdadeiras:

  • O M3 executa uma tarefa recorrente de repositório ou de agente com custo baixo o bastante e ainda atende aos critérios de aceitação.
  • O vídeo orientado por referências e o áudio nativo do H3 eliminam uma etapa separada de geração.
  • O volume das APIs de voz, música ou imagem torna relevantes as tarifas unitárias mínimas da plataforma.
  • Sua equipe consegue administrar diferentes interfaces, saldos e regras de implantação.

Evite a MiniMax quando o único requisito for um assistente refinado, quando o tempo dos revisores tornar a qualidade das decisões do modelo mais importante do que o preço por token ou quando uma equipe de vídeo precisar de um sistema de produção centrado em um editor. ChatGPT, Claude e Runway vencem nesses três cenários, respectivamente.

A regra de custo é objetiva. Comece a testar o M3 pagando pelo uso. No exemplo de entrada de 200K e saída de 20K, o Plus fica mais barato perto de 239 solicitações mensais, antes da economia de cache. Mantenha o tráfego voltado a clientes no pagamento por uso, pois a própria MiniMax não apresenta o Token Plan como capacidade de produção. Comece o H3 em 768P, pague por 2K somente depois que uma cena for aprovada na revisão e inclua a duração do vídeo de referência no cálculo.

A regra de implantação é igualmente clara. Organizações dos EUA, UE, Reino Unido ou Coreia do Sul devem usar a API do H3 ou obter autorização formal para os pesos abertos antes da implantação local. Não compre hardware apenas por ter lido a palavra “aberto”.

Perguntas frequentes sobre o MiniMax AI

Quanto custa o MiniMax AI?

Os Token Plans da MiniMax custam $20/mês no Plus, $50 no Max e $120 no Ultra, com preços anuais de $200, $500 e $1,200. No M3, o pagamento por uso começa em $0.30 por milhão de tokens de entrada e $1.20 por milhão de tokens de saída abaixo de 512K de contexto; no H3, começa em $0.08 por segundo de saída em 768P.

O MiniMax AI é melhor que o ChatGPT?

A MiniMax é melhor para compradores técnicos que combinam M3 de baixo custo, vídeo H3, voz, música e APIs. O ChatGPT leva vantagem quando o objetivo é ter um único espaço de trabalho geral e refinado para arquivos, busca, voz, projetos e tarefas intelectuais do dia a dia.

É seguro usar o MiniMax AI?

O MiniMax H3 aplica moderação automatizada aos textos, às imagens e aos vídeos enviados, mas o cartão do modelo informa que ainda podem ocorrer falsos positivos e falsos negativos. Não inclua material sensível na avaliação até que os termos relevantes de privacidade, segurança e contrato atendam às suas exigências, e controle as permissões fora do modelo.

O MiniMax vale a pena?

A MiniMax vale a pena quando uma rotina mensurada com M3, H3, voz ou diferentes mídias ultrapassa o limite de custo e continua atendendo aos critérios de aceitação. Não vale a pena adicionar várias interfaces da MiniMax para usar chat ocasionalmente, se uma assinatura mais simples já resolve a tarefa.

É possível executar o MiniMax H3 localmente?

Os checkpoints H3 Base em 768P podem rodar localmente, e o ComfyUI oferece fluxos nativos. O exemplo oficial da MiniMax para SGLang usa 4 GPUs, enquanto as etapas de Context-IR, essencial para a qualidade, e de regeneração em 2K continuam hospedadas. A licença padrão de pesos abertos também exclui EUA, UE, Reino Unido e Coreia do Sul, a menos que haja autorização formal.

Quer saber quais modelos atuais combinam com cada tipo de trabalho? Receba gratuitamente o mapa de ferramentas de IA para donos de empresas.

Última atualização

3 de set. de 2026

CategoriaAI

Prefira este site no Google

Adicionar omidsaffari.com como fonte preferida na Busca do Google

Marque omidsaffari.com como fonte preferida e o Google destaca o site para você em Top Stories, AI Overviews e AI Mode.

Newsletter

Uma carta, todo domingo. Sistemas que funcionam, não hot takes.

Build logs, sistemas em produção e notas de campo de um portfólio de ventures de IA.

Semanal. Sem spam. Cancele quando quiser.