Gemini 3.5 Pro foi adiado: sem data de lançamento e sem motivo para esperar

Gemini 3.5 Pro perdeu a janela de junho e segue sem nova data. Entenda o atraso, compare custos e veja quais modelos usar no seu projeto enquanto isso.

Thursday, September 3, 2026Omid Saffari
Gemini 3.5 Pro foi adiado: sem data de lançamento e sem motivo para esperar

Gemini 3.5 Pro ainda não tem uma data pública de lançamento. O Google disse que o modelo chegaria em junho; em 16 de julho, a Reuters informou que ele estava meses atrasado porque seu desempenho em programação ficou aquém do esperado. Ainda não é hora de basear nele um produto, uma migração ou uma decisão de compra.

Gemini 3.5 Pro tem data de lançamento? Ainda não

Gemini 3.5 Pro segue em testes, e o Google não substituiu a janela perdida de junho por uma nova data pública. O catálogo de modelos atualizado da empresa traz Gemini 3.5 Flash e Gemini 3.1 Pro Preview, enquanto sua página de preços não inclui o 3.5 Pro nem informa ID de modelo da API, preço, condições da camada gratuita, limite de contexto ou tabela de benchmarks.

Isso torna inúteis para fins de planejamento os rumores de lançamento em 17 de julho. Uma data só ganha credibilidade quando o Google publica o modelo, a forma de acesso e as condições comerciais — não quando uma fonte anônima ou uma página de contagem regressiva simplesmente a repete.

Página oficial do anúncio do Gemini 3.5 pelo Google
Gemini 3.5

O histórico confirmado é curto:

DataO que aconteceuO que isso significa
19 de maio de 2026O Google apresentou o Gemini 3.5, lançou o 3.5 Flash e disse que o 3.5 Pro chegaria “no mês seguinte”A janela pública era junho de 2026
Junho de 2026A janela anunciada terminou sem um modelo 3.5 Pro disponível ao públicoO cronograma atrasou
Fim de junho de 2026Segundo relatos, o Google atualizou os dados de treinamento do Gemini para melhorar a programação, mas os resultados ficaram aquém do esperadoO problema relatado era a qualidade do modelo, não o empacotamento
16 de julho de 2026A Reuters informou que o 3.5 Pro estava meses atrasadoUma data próxima deixou de ser uma suposição segura
17 de julho de 2026O catálogo público e a página de preços do Google ainda não incluem o 3.5 ProNão há nada concreto para comprar, integrar ou avaliar em benchmarks

A declaração do Google é cuidadosa. Um porta-voz disse que a empresa está testando o 3.5 Pro, um modelo Flash atualizado e outros modelos com parceiros. Isso confirma que o desenvolvimento está em andamento, mas não confirma semana de lançamento, conjunto de recursos ou preço.

Linha do tempo entre o anúncio de maio, a janela perdida de junho e a notícia do atraso em julho
A janela oficial de junho passou; nenhuma nova data foi divulgada.

Por que o desempenho em programação pode atrasar um modelo topo de linha

A programação pode atrasar um modelo topo de linha porque o trabalho difícil já não é gerar uma função bem escrita. O desafio é manter a correção enquanto um agente lê um repositório, escolhe ferramentas, edita vários arquivos, executa testes, percebe uma falha e se recupera sem piorar a base de código.

Isso é programação agêntica: trabalho contínuo de software, distribuído por muitas etapas, ferramentas e decisões. Um modelo pode impressionar em uma demonstração de prompt único e ainda falhar quando a vigésima ação depende de as dezenove anteriores estarem corretas. Um plano ruim ou uma dependência inventada basta para apagar todo o ganho de velocidade obtido antes.

Dentro do próprio portfólio do Google, o patamar já é desconfortavelmente alto para um novo modelo Pro. A empresa apresenta o Gemini 3.5 Flash disponível hoje como seu modelo mais forte para agentes e programação e publica estes resultados:

BenchmarkO que ele avaliaGemini 3.5 Flash
Terminal-Bench 2.1Execução de trabalho prático em um terminal76.2%
GDPval-AATarefas especializadas com utilidade econômica1656 Elo
MCP AtlasFluxos de várias etapas com ferramentas conectadas83.6%
CharXiv ReasoningCompreensão de material visual e técnico complexo84.2%

O Google também afirma que o 3.5 Flash gera tokens de saída quatro vezes mais rápido que outros modelos de fronteira. São resultados publicados pelo próprio fornecedor, não provas independentes, mas eles expõem o desafio interno do produto: um modelo topo de linha chamado Pro não pode apenas ser maior. Ele precisa superar o modelo rápido no trabalho caro que os compradores reservam para um modelo topo de linha, sem perder a confiabilidade durante execuções longas de agentes.

A Reuters, citando a Bloomberg, informou que o Google atualizou os dados de treinamento no fim de junho para melhorar a programação e que os resultados ficaram abaixo do esperado. Isso não comprova uma reconstrução completa, uma nova arquitetura nem qualquer tamanho especulado para a janela de contexto. Comprova apenas que, segundo a reportagem, o nível de qualidade esperado não foi alcançado no cronograma planejado.

Para um CTO de empresa de médio porte, essa diferença importa mais que o atraso em si. Um modelo atrasado é inconveniente. Um modelo que muda de comportamento durante uma longa tarefa de programação pode gerar trabalho de revisão, risco de segurança e esforço de rollback que custam muito mais que a própria conta da API.

O que usar agora

Use o Gemini 3.5 Flash para entregas, programação e ciclos repetidos de agentes. Escolha o Gemini 3.1 Pro Preview quando um raciocínio mais profundo compensar a latência e a conta de tokens mais altas. Esperar pelo 3.5 Pro não deve ser a opção padrão, porque as duas alternativas disponíveis já têm formas públicas de acesso e custos mensuráveis.

O portfólio mais amplo do Gemini 3 muda depressa, mas a escolha hoje é simples:

DecisãoGemini 3.5 FlashGemini 3.1 Pro PreviewGemini 3.5 Pro
Situação públicaDisponibilidade geralPreviewNão aparece publicamente
Melhor uso hojeProgramação, agentes, alto volume e baixa latênciaRaciocínio difícil e resolução de problemas complexosAinda não há uso que possa ser planejado
ID de modelo da APIgemini-3.5-flashgemini-3.1-pro-previewNão publicado
Preço padrão de entrada$1.50 por 1 milhão de tokens$2.00 até 200,000 tokens, inclusive; $4.00 acima dissoNão publicado
Preço padrão de saída$9.00 por 1 milhão de tokens$12.00 até 200,000 tokens, inclusive; $18.00 acima dissoNão publicado
Camada gratuita da APISimNãoNão publicado
Principal ressalvaRapidez não significa infalibilidadeStatus de Preview e custo mais altoSem data, condições ou evidências

A diferença de preço fica visível em uma carga de trabalho comum de agente calculada pelas tarifas atuais da API do Google. Um milhão de tokens de entrada mais 200,000 tokens de saída custam $3.30 no 3.5 Flash nas tarifas Standard. A mesma carga agregada custa $4.40 no 3.1 Pro Preview quando cada prompt permanece em 200,000 tokens ou menos. Nesse exemplo, o Flash é 25% mais barato antes mesmo de considerar sua vantagem de latência.

O conjunto de ferramentas já disponível do Google dá conta de trabalhos substanciais em segundo plano. Os Gemini Managed Agents executam tarefas de várias etapas em ambientes remotos, portanto uma equipe não precisa suspender um piloto de agentes enquanto espera por um futuro modelo topo de linha.

Mapa de decisão que direciona velocidade e trabalho de agentes ao Gemini 3.5 Flash e raciocínio profundo ao Gemini 3.1 Pro
Coloque em produção o modelo adequado ao trabalho; mantenha o 3.5 Pro fora do fluxo até o lançamento.
  1. Estabeleça uma linha de base com o 3.5 Flash

    Meça a taxa de sucesso das tarefas, o tempo de revisão, a latência e o custo no modelo com disponibilidade geral. Um anúncio de lançamento não substitui seus próprios critérios de aceitação.

  2. Crie um único caminho de escalonamento para Pro

    Envie ao 3.1 Pro Preview somente as falhas causadas por profundidade insuficiente de raciocínio. Mantenha o restante no Flash para que a comparação revele se o gasto adicional realmente melhora o resultado.

  3. Mantenha o ID do modelo configurável

    Armazene o nome do modelo na configuração em vez de fixá-lo no código de toda a aplicação. Assim, uma futura avaliação do 3.5 Pro vira um teste controlado, não uma reescrita.

  4. Retome a decisão depois do lançamento

    Compare o 3.5 Pro com o mesmo conjunto de tarefas somente depois que o Google publicar acesso, preços, limites e benchmarks. Adote o modelo pelo ganho medido, não pelo rótulo Pro.

Os cinco critérios antes de adotar o Gemini 3.5 Pro

Vale a pena avaliar o Gemini 3.5 Pro quando cinco fatos públicos existirem ao mesmo tempo. Um post de lançamento, sozinho, não basta.

  1. Um ID oficial de modelo da API. Isso comprova que desenvolvedores podem chamar o modelo real por uma interface documentada, e não por um Preview privado para parceiros ou um wrapper de terceiros.
  2. Uma tabela completa de preços. Valores de entrada, saída, cache, lote, grounding e prompts longos determinam se uma vitória em benchmark sobrevive às finanças da produção.
  3. Limites operacionais publicados. Tamanho do contexto, limites de saída, tipos de entrada aceitos, regiões, cotas e condições de tratamento de dados definem se o modelo cabe no sistema ao redor dele.
  4. Benchmarks comparáveis. A pergunta útil não é se o 3.5 Pro tem uma boa pontuação, mas se supera o 3.5 Flash e o 3.1 Pro exatamente na classe de falha que custa tempo à equipe.
  5. Um rótulo de disponibilidade estável. Preview é adequado para experimentos com alternativas de segurança. A disponibilidade geral é uma base mais sólida para uma dependência voltada ao cliente.

Esses critérios evitam dois erros caros. O primeiro é paralisar um trabalho útil à espera de uma capacidade futura cuja viabilidade econômica permanece desconhecida. O segundo é migrar no dia do lançamento e só então descobrir que o novo modelo topo de linha é mais lento, mais caro ou apenas um pouco melhor na sua carga de trabalho.

Quem deve esperar e quem deve agir agora

A maioria das equipes deve agir agora, mas com uma arquitetura independente de modelo.

PerfilMelhor decisão agoraMotivo
Fundador com aporte lançando um produto baseado em agentesUsar o 3.5 Flash como base, com uma camada de modelo configurávelO tempo até o mercado importa, e o modelo com disponibilidade geral já é voltado a tarefas agênticas
CTO de empresa de médio porte padronizando a IA internaTestar o Flash para volume e o 3.1 Pro Preview para exceções difíceisIsso cria uma política real de roteamento e uma referência de custos antes da chegada do 3.5 Pro
Executivo sênior automatizando pesquisa ou relatóriosUsar o modelo disponível que passe em um teste de aceitação revisado por humanosUm atraso no cronograma não deve bloquear um fluxo de trabalho reversível
Desenvolvedor técnico independenteCriar o protótipo na camada gratuita do 3.5 Flash e depois calcular o caminho pagoA evidência útil mais barata é melhor que esperar por um preço desconhecido
Equipe com uma tarefa que nenhum modelo atual executa de forma confiávelEsperar, mas suspender apenas esse experimentoAinda não há evidências de que o 3.5 Pro resolverá essa falha específica

Quem compra modelos para programação também deve comparar opções fora da família Gemini. O ranking atual de modelos de IA para programação é uma referência melhor quando trabalhar em repositórios importa mais que permanecer no ecossistema do Google.

Há apenas um motivo defensável para esperar: o projeto tem um requisito documentado que o Flash e o 3.1 Pro não atendem, e adiar custa menos que escolher outro fornecedor. Mesmo nesse caso, trate o 3.5 Pro como um possível candidato futuro, não como a resposta presumida.

O Gemini 3.5 Pro foi adiado?

Sim. Em 19 de maio, o Google disse que pretendia lançar o 3.5 Pro no mês seguinte. Em 16 de julho, a Reuters informou que o modelo estava meses atrasado e que seu desempenho em programação havia ficado abaixo das expectativas internas.

O Gemini 3.5 já foi lançado?

O Gemini 3.5 Flash está disponível de forma geral pela Gemini API e pelos produtos do Google. O Gemini 3.5 Pro não aparece publicamente no catálogo de modelos nem na página de preços do Google.

O Gemini 3.5 Flash é melhor que o 3.1 Pro?

O Flash é a melhor opção padrão para velocidade, custo, programação e ciclos repetidos de agentes. O Google publica um resultado de 76.2% no Terminal-Bench 2.1 para o 3.5 Flash, enquanto sua tabela de benchmarks do 3.1 Pro informa 68.5% no Terminal-Bench 2.0; portanto, não é uma comparação direta da mesma versão do benchmark. Use o 3.1 Pro Preview quando o raciocínio mais profundo melhorar sua tarefa real, não porque Pro parece mais forte.

O Gemini 3.5 Pro é gratuito?

Não há preço público nem condições de camada gratuita para o 3.5 Pro. Alegações de acesso gratuito não são preços do Google. O Gemini 3.5 Flash oferece atualmente uma camada gratuita da API; o Gemini 3.1 Pro Preview, não.

Receba o próximo briefing de decisão sobre modelos quando os fatos mudarem.

Última atualização

3 de set. de 2026

CategoriaAI

Prefira este site no Google

Adicionar omidsaffari.com como fonte preferida na Busca do Google

Marque omidsaffari.com como fonte preferida e o Google destaca o site para você em Top Stories, AI Overviews e AI Mode.

Newsletter

Uma carta, todo domingo. Sistemas que funcionam, não hot takes.

Build logs, sistemas em produção e notas de campo de um portfólio de ventures de IA.

Semanal. Sem spam. Cancele quando quiser.