Gemini 3.5 Pro foi adiado: sem data de lançamento e sem motivo para esperar
Gemini 3.5 Pro perdeu a janela de junho e segue sem nova data. Entenda o atraso, compare custos e veja quais modelos usar no seu projeto enquanto isso.

Gemini 3.5 Pro ainda não tem uma data pública de lançamento. O Google disse que o modelo chegaria em junho; em 16 de julho, a Reuters informou que ele estava meses atrasado porque seu desempenho em programação ficou aquém do esperado. Ainda não é hora de basear nele um produto, uma migração ou uma decisão de compra.
Gemini 3.5 Pro tem data de lançamento? Ainda não
Gemini 3.5 Pro segue em testes, e o Google não substituiu a janela perdida de junho por uma nova data pública. O catálogo de modelos atualizado da empresa traz Gemini 3.5 Flash e Gemini 3.1 Pro Preview, enquanto sua página de preços não inclui o 3.5 Pro nem informa ID de modelo da API, preço, condições da camada gratuita, limite de contexto ou tabela de benchmarks.
Isso torna inúteis para fins de planejamento os rumores de lançamento em 17 de julho. Uma data só ganha credibilidade quando o Google publica o modelo, a forma de acesso e as condições comerciais — não quando uma fonte anônima ou uma página de contagem regressiva simplesmente a repete.

O histórico confirmado é curto:
A declaração do Google é cuidadosa. Um porta-voz disse que a empresa está testando o 3.5 Pro, um modelo Flash atualizado e outros modelos com parceiros. Isso confirma que o desenvolvimento está em andamento, mas não confirma semana de lançamento, conjunto de recursos ou preço.

Por que o desempenho em programação pode atrasar um modelo topo de linha
A programação pode atrasar um modelo topo de linha porque o trabalho difícil já não é gerar uma função bem escrita. O desafio é manter a correção enquanto um agente lê um repositório, escolhe ferramentas, edita vários arquivos, executa testes, percebe uma falha e se recupera sem piorar a base de código.
Isso é programação agêntica: trabalho contínuo de software, distribuído por muitas etapas, ferramentas e decisões. Um modelo pode impressionar em uma demonstração de prompt único e ainda falhar quando a vigésima ação depende de as dezenove anteriores estarem corretas. Um plano ruim ou uma dependência inventada basta para apagar todo o ganho de velocidade obtido antes.
Dentro do próprio portfólio do Google, o patamar já é desconfortavelmente alto para um novo modelo Pro. A empresa apresenta o Gemini 3.5 Flash disponível hoje como seu modelo mais forte para agentes e programação e publica estes resultados:
O Google também afirma que o 3.5 Flash gera tokens de saída quatro vezes mais rápido que outros modelos de fronteira. São resultados publicados pelo próprio fornecedor, não provas independentes, mas eles expõem o desafio interno do produto: um modelo topo de linha chamado Pro não pode apenas ser maior. Ele precisa superar o modelo rápido no trabalho caro que os compradores reservam para um modelo topo de linha, sem perder a confiabilidade durante execuções longas de agentes.
A Reuters, citando a Bloomberg, informou que o Google atualizou os dados de treinamento no fim de junho para melhorar a programação e que os resultados ficaram abaixo do esperado. Isso não comprova uma reconstrução completa, uma nova arquitetura nem qualquer tamanho especulado para a janela de contexto. Comprova apenas que, segundo a reportagem, o nível de qualidade esperado não foi alcançado no cronograma planejado.
Para um CTO de empresa de médio porte, essa diferença importa mais que o atraso em si. Um modelo atrasado é inconveniente. Um modelo que muda de comportamento durante uma longa tarefa de programação pode gerar trabalho de revisão, risco de segurança e esforço de rollback que custam muito mais que a própria conta da API.
O que usar agora
Use o Gemini 3.5 Flash para entregas, programação e ciclos repetidos de agentes. Escolha o Gemini 3.1 Pro Preview quando um raciocínio mais profundo compensar a latência e a conta de tokens mais altas. Esperar pelo 3.5 Pro não deve ser a opção padrão, porque as duas alternativas disponíveis já têm formas públicas de acesso e custos mensuráveis.
O portfólio mais amplo do Gemini 3 muda depressa, mas a escolha hoje é simples:
A diferença de preço fica visível em uma carga de trabalho comum de agente calculada pelas tarifas atuais da API do Google. Um milhão de tokens de entrada mais 200,000 tokens de saída custam $3.30 no 3.5 Flash nas tarifas Standard. A mesma carga agregada custa $4.40 no 3.1 Pro Preview quando cada prompt permanece em 200,000 tokens ou menos. Nesse exemplo, o Flash é 25% mais barato antes mesmo de considerar sua vantagem de latência.
O conjunto de ferramentas já disponível do Google dá conta de trabalhos substanciais em segundo plano. Os Gemini Managed Agents executam tarefas de várias etapas em ambientes remotos, portanto uma equipe não precisa suspender um piloto de agentes enquanto espera por um futuro modelo topo de linha.

Estabeleça uma linha de base com o 3.5 Flash
Meça a taxa de sucesso das tarefas, o tempo de revisão, a latência e o custo no modelo com disponibilidade geral. Um anúncio de lançamento não substitui seus próprios critérios de aceitação.
Crie um único caminho de escalonamento para Pro
Envie ao 3.1 Pro Preview somente as falhas causadas por profundidade insuficiente de raciocínio. Mantenha o restante no Flash para que a comparação revele se o gasto adicional realmente melhora o resultado.
Mantenha o ID do modelo configurável
Armazene o nome do modelo na configuração em vez de fixá-lo no código de toda a aplicação. Assim, uma futura avaliação do 3.5 Pro vira um teste controlado, não uma reescrita.
Retome a decisão depois do lançamento
Compare o 3.5 Pro com o mesmo conjunto de tarefas somente depois que o Google publicar acesso, preços, limites e benchmarks. Adote o modelo pelo ganho medido, não pelo rótulo Pro.
Os cinco critérios antes de adotar o Gemini 3.5 Pro
Vale a pena avaliar o Gemini 3.5 Pro quando cinco fatos públicos existirem ao mesmo tempo. Um post de lançamento, sozinho, não basta.
- Um ID oficial de modelo da API. Isso comprova que desenvolvedores podem chamar o modelo real por uma interface documentada, e não por um Preview privado para parceiros ou um wrapper de terceiros.
- Uma tabela completa de preços. Valores de entrada, saída, cache, lote, grounding e prompts longos determinam se uma vitória em benchmark sobrevive às finanças da produção.
- Limites operacionais publicados. Tamanho do contexto, limites de saída, tipos de entrada aceitos, regiões, cotas e condições de tratamento de dados definem se o modelo cabe no sistema ao redor dele.
- Benchmarks comparáveis. A pergunta útil não é se o 3.5 Pro tem uma boa pontuação, mas se supera o 3.5 Flash e o 3.1 Pro exatamente na classe de falha que custa tempo à equipe.
- Um rótulo de disponibilidade estável. Preview é adequado para experimentos com alternativas de segurança. A disponibilidade geral é uma base mais sólida para uma dependência voltada ao cliente.
Esses critérios evitam dois erros caros. O primeiro é paralisar um trabalho útil à espera de uma capacidade futura cuja viabilidade econômica permanece desconhecida. O segundo é migrar no dia do lançamento e só então descobrir que o novo modelo topo de linha é mais lento, mais caro ou apenas um pouco melhor na sua carga de trabalho.
Quem deve esperar e quem deve agir agora
A maioria das equipes deve agir agora, mas com uma arquitetura independente de modelo.
Quem compra modelos para programação também deve comparar opções fora da família Gemini. O ranking atual de modelos de IA para programação é uma referência melhor quando trabalhar em repositórios importa mais que permanecer no ecossistema do Google.
Há apenas um motivo defensável para esperar: o projeto tem um requisito documentado que o Flash e o 3.1 Pro não atendem, e adiar custa menos que escolher outro fornecedor. Mesmo nesse caso, trate o 3.5 Pro como um possível candidato futuro, não como a resposta presumida.
O Gemini 3.5 Pro foi adiado?
Sim. Em 19 de maio, o Google disse que pretendia lançar o 3.5 Pro no mês seguinte. Em 16 de julho, a Reuters informou que o modelo estava meses atrasado e que seu desempenho em programação havia ficado abaixo das expectativas internas.
O Gemini 3.5 já foi lançado?
O Gemini 3.5 Flash está disponível de forma geral pela Gemini API e pelos produtos do Google. O Gemini 3.5 Pro não aparece publicamente no catálogo de modelos nem na página de preços do Google.
O Gemini 3.5 Flash é melhor que o 3.1 Pro?
O Flash é a melhor opção padrão para velocidade, custo, programação e ciclos repetidos de agentes. O Google publica um resultado de 76.2% no Terminal-Bench 2.1 para o 3.5 Flash, enquanto sua tabela de benchmarks do 3.1 Pro informa 68.5% no Terminal-Bench 2.0; portanto, não é uma comparação direta da mesma versão do benchmark. Use o 3.1 Pro Preview quando o raciocínio mais profundo melhorar sua tarefa real, não porque Pro parece mais forte.
O Gemini 3.5 Pro é gratuito?
Não há preço público nem condições de camada gratuita para o 3.5 Pro. Alegações de acesso gratuito não são preços do Google. O Gemini 3.5 Flash oferece atualmente uma camada gratuita da API; o Gemini 3.1 Pro Preview, não.
Receba o próximo briefing de decisão sobre modelos quando os fatos mudarem.
3 de set. de 2026







