O Google anunciou o Gemini 4 Argon, seu novo modelo de ponta. A empresa diz que ele entrega desempenho de fronteira em engenharia de software, trabalho corporativo (como direito e finanças) e defesa cibernética. O detalhe: por enquanto, quase ninguém de fora pode testar.

Quem tem acesso hoje

O Argon está sendo liberado apenas para um grupo de defensores cibernéticos de confiança, por meio do Fairwind Program. O Google afirma que um modelo desse nível pede lançamento em fases e que participa do processo voluntário do governo dos EUA para acesso pré-lançamento a modelos.

A empresa quer levar o Argon a desenvolvedores, empresas e consumidores o mais rápido possível, mas não dá data. Depois dos testes de segurança cibernética, a disponibilidade geral começa pelos usuários pagos da API e pelos assinantes do Google AI Ultra. Não há informação sobre disponibilidade no Brasil.

Preço da API

Mesmo sem acesso aberto, o Google já definiu o preço de lançamento: US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. Os tokens de entrada em cache têm 95% de desconto sobre o preço da entrada. O valor é introdutório e válido por tempo limitado. Não há preço para o Brasil.

O que o Google diz que ele faz

O limite de saída sobe para 1 milhão de tokens, contra 64 mil nos modelos anteriores. A ideia é deixar o modelo raciocinar e gerar centenas de milhares de tokens numa única sequência, resolvendo tarefas difíceis de uma vez.

Os números de desempenho abaixo são os divulgados pelo Google:

  • DeepSWE v1.1, de engenharia de software: 77,9%, acima do GPT-6 Astra, do Fable 5.1 e do Opus 5.5.
  • AutomationBench, da Zapier: 51,3%, primeiro lugar.
  • LVBench, de compreensão de vídeos longos: 91,7%.
  • Vals Index, que mede impacto econômico em finanças, programação, direito e impostos: o Argon aparece na liderança.

Dentro do Google, agentes do Argon analisaram dados de telemetria da frota e liberaram mais de 300 TiB de memória nos data centers, com economia total estimada entre 500 TiB e 1 PiB. Outros agentes trabalham na migração de código C/C++ para Rust. Em bibliotecas centrais, como re2 e libgav1, são dezenas de milhares de linhas; no kernel Zircon, do Fuchsia, passa de 800 mil. Essas reescritas passam por auditoria automatizada e manual antes de ir para produção.

No libgav1, decodificador de vídeo de código aberto, o resultado descrito é uma versão em Rust 2,7 vezes mais rápida que o port anterior, com a mesma saída de vídeo.

Foco em segurança

O Argon foi treinado para encontrar, validar e corrigir vulnerabilidades de forma autônoma. Para defensores confiáveis e equipes internas, o Google diz que lançará o modelo sem as travas de segurança cibernética. A Wiz já o usa na iniciativa Scan for Good.

A Wiz usou o Argon para achar uma falha crítica que poderia expor dados pessoais em um sistema usado em hospitais ao redor do mundo. O Google diz que outros modelos de ponta não detectaram o problema, mas não deu detalhes.

O Google também afirma que desenhou o Argon com sistemas que monitoram a cadeia de raciocínio do modelo e podem interrompê-lo se ele sair dos limites.

O anúncio vem depois de o Google ter prometido o Gemini 3.5 Pro para junho e passado o verão lançando modelos Flash menores.