O Google apresentou em 30 de setembro o Gemini 4 Argon, seu novo modelo de fronteira para engenharia de software, trabalho profissional e defesa cibernética. A estreia, porém, não acontece com um botão liberado para todos. O acesso começou por um grupo de defensores selecionados no programa Fairwind enquanto a empresa amplia testes de segurança.
Essa escolha revela tanto sobre o produto quanto os benchmarks. O Google atribui ao Argon capacidade de sustentar tarefas longas, usar informações multimodais e gerar até 1 milhão de tokens de saída em uma única trajetória, contra 64 mil no modelo anterior citado pela empresa. Isso é limite de saída, não uma promessa de que respostas gigantes serão sempre úteis, corretas ou econômicas.
Código, documentos e tarefas longas
Nos resultados divulgados pelo próprio Google, o Argon alcançou 77,9% no DeepSWE v1.1, voltado a engenharia de software de longa duração, e 51,3% no AutomationBench, que mede execução ponta a ponta em funções empresariais. Também ficou em primeiro lugar no Vals Index e marcou 91,7% no LVBench para compreensão de vídeos longos.
A empresa apresentou casos internos mais concretos. Agentes com Argon teriam ajudado a migrar bases C e C++ para Rust, incluindo trabalhos no kernel Zircon do Fuchsia, e a identificar otimizações de memória em data centers. Em outro exemplo, uma versão em Rust do decodificador libgav1 ficou 2,7 vezes mais rápida após ciclos de experimentação orientados pelo modelo. Esses números vêm do Google e de seus ambientes internos; ainda não demonstram que equipes externas obterão o mesmo resultado em código, ferramentas e critérios diferentes.
O lançamento do Argon não é apenas uma disputa por pontuação. É um teste sobre quanto trabalho autônomo uma empresa aceita liberar antes de confiar nos próprios mecanismos de controle.
Segurança explica o acesso restrito
O Google afirma que o Argon consegue localizar, validar e corrigir vulnerabilidades críticas. No CWE-bench v1, o modelo empatou na liderança com 68%. Para defensores confiáveis, a empresa pretende fornecer uma versão sem algumas restrições cibernéticas, justamente para preservar utilidade em atividades legítimas de defesa.
Esse desenho também amplia o risco de uso indevido. Antes da distribuição geral, o Google diz estar reforçando recusas para ataques cibernéticos e riscos químicos, biológicos, radiológicos e nucleares, testes contra prompt injection, monitoramento de possíveis desvios de objetivo e isolamento dos ambientes de execução. São controles descritos pela própria empresa. A eficácia deles ainda precisará ser observada em uso externo e adversarial.
O modelo será oferecido inicialmente por US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, com 95% de desconto no cache de entrada. Após o período introdutório, os valores anunciados sobem para US$ 4 e US$ 20. O Google não informou a duração desse período.
A próxima etapa prevê acesso para clientes pagos da API e assinantes Google AI Ultra, seguido por empresas e consumidores, mas sem data pública. Para líderes técnicos, isso impede uma decisão imediata baseada apenas na tabela de preços. Antes de comparar o Argon com modelos disponíveis hoje, será preciso conhecer latência, limites reais, controles administrativos e custo por tarefa concluída. Um milhão de tokens abre espaço para trajetórias mais longas; também abre uma conta maior para erros que demoram a ser percebidos.
